Ein KI-Agent ist über den Zaun geklettert. Keiner hat es gemerkt, drei Monate lang.
Am 18. Juni hat ein OpenAI-Modell bei einer internen Evaluation auf das Medicare-Statistikportal der australischen Behörde Services Australia zugegriffen. Die Aufgabe war harmlos: Recherche zu öffentlichen Medikamentenausgaben. Das Modell ist dabei an Sperren vorbeigekommen und hat auch nicht-öffentliche Dateien geöffnet. Laut OpenAI waren das aggregierte Gesundheitsstatistiken und interne Dateinamen, keine Patientendaten.
OpenAI hat das im August bei einer eigenen Prüfung bemerkt und am 10. September eine Mail an das öffentliche Postfach der Behörde geschickt. Premierminister Anthony Albanese nennt das zu spät. Der Agent habe „Nein“ nicht als Antwort akzeptiert. Jetzt ermittelt eine Taskforce, unter anderem mit dem Australian Signals Directorate und dem AI Safety Institute.
Meine Sicht: Der Schaden ist klein. Die Lehre ist es nicht. Hier hat kein Angreifer eine KI missbraucht. Das Modell hat sich den Weg selbst gesucht, weil es seine Aufgabe erledigen wollte. OpenAI selbst spricht von „misaligned model activity“.
Wer Agenten mit Web-Zugriff einsetzt, braucht Grenzen außerhalb des Modells. Also feste Allowlists, lückenlose Logs und einen Meldeweg, der keine drei Monate dauert.
Wie begrenzt ihr, was eure KI-Agenten im Netz tun dürfen?
#KI #AgenticAI #ITSecurity #CyberSecurity #AIGovernance
Quellen:
Australian Cyber Security Magazine: OpenAI agent breached Australian Medicare statistics portal
ABC News: What we know about the data accessed in the OpenAI Medicare hack
ABC News: OpenAI agent hacked Medicare portal, PM says
SBS News: OpenAI agent hacked Medicare, Albanese reveals
CNN Business: ‚Extreme concern‘ over OpenAI breach of health database
Blog
Dieser Abschnitt bietet einen Überblick über den Blog und präsentiert eine Vielzahl von Artikeln, Einblicken und Ressourcen, um Leser zu informieren und zu inspirieren.
-

Weniger Chefs, mehr Ownership? Die Rechnung geht bisher nicht auf.
Das „Great Flattening“ ist keine Prognose mehr, sondern Zahlenwerk. Bei börsennotierten US-Unternehmen ist die Zahl…
-

Ein KI-Agent ist über den Zaun geklettert. Keiner hat es gemerkt, drei Monate lang.
Am 18. Juni hat ein OpenAI-Modell bei einer internen Evaluation auf das Medicare-Statistikportal der australischen…
-

Der KI-Rollout scheitert selten an der Technik. Er scheitert eine Ebene tiefer.
Gleb Tsipursky hat am 1. September in der Harvard Business Review eine These aufgestellt, die…
Erst „Slow down“ sagen, dann volles Tempo geben – die neue Release-Kadenz von Anthropic und OpenAI
Am 12. September veröffentlichte Anthropic-CEO Dario Amodei einen Essay mit dem Titel „We Must Pace the Frontier“. Darin schreibt er wörtlich: „We must slow the pace at which we improve the capabilities of AI models. Progress will still seem fast, and we must make wise use of the time we gain.“ OpenAI-Chef Sam Altman stimmte ihm öffentlich zu: „I agree with Dario that we need to pace the frontier.“
Zehn Tage später, am 22. September, brachte Anthropic mit Claude Opus 5.5 das nach eigenen Angaben stärkste Modell heraus, das das Unternehmen je getestet hat.
Vom Quartalsrhythmus zum Monatstakt
Was auffällt, ist weniger das einzelne Modell als der Abstand zwischen den Releases. Opus 5.5 kam nur 21 Tage nach Claude Fable 5.1 und Mythos 5.1, die wiederum nur 39 Tage nach Opus 5 folgten. 2025 lag zwischen größeren Anthropic-Releases meist ein Quartal. 2026 ist daraus ein fast monatlicher Rhythmus geworden.
OpenAI zeigt dasselbe Muster: Nach GPT-6 Astra am 3. September folgten GPT-6 Sol und GPT-6 Luna bereits 19 Tage später.
Die Preise fallen mit
Neben dem Tempo ist die zweite auffällige Zahl der Preis. Claude Opus 5.5 kostet 4 Dollar pro Million Input-Token und 20 Dollar pro Million Output-Token, ein Rückgang von 20 Prozent gegenüber Opus 5. Cache-Reads werden sogar 60 Prozent günstiger. GPT-6 Sol liegt bei 2 Dollar Input und 10 Dollar Output pro Million Token, 50 Prozent weniger als beim Vorgänger GPT-5.6. GPT-6 Luna, für einfachere Aufgaben in hoher Stückzahl gedacht, kostet nur noch 0,10 Dollar Input und 0,50 Dollar Output pro Million Token.
Sicherheitsdebatte und Geschäftsmodell
Beide Unternehmen bereiten parallel einen Börsengang vor: Anthropic angeblich noch in diesem Jahr, OpenAI voraussichtlich 2027. Das wirft die Frage auf, wie stark der Kapitalmarkt das tatsächliche Entwicklungstempo bestimmt, unabhängig davon, was in Essays und Interviews gesagt wird.
Amodeis Aufruf zur Verlangsamung bezog sich in erster Linie auf Sicherheitsrisiken durch autonome KI-Systeme, nicht auf die Geschwindigkeit von Preissenkungen oder Produktankündigungen. Trotzdem bleibt die Beobachtung interessant: Wer öffentlich zur Vorsicht mahnt und wenige Tage später das schnellste Modell der eigenen Firmengeschichte veröffentlicht, muss sich die Frage gefallen lassen, wo genau die Grenze zwischen Warnung und Wettbewerbsdruck verläuft.
Quellen
- Anthropic, OpenAI CEOs call for slowdown in AI development – Axios
- Frontier AI keeps racing despite calls to slow down – The Register
- Anthropic releases Claude Opus 5.5 and OpenAI counters with two cheaper GPT-6 models – SiliconANGLE
- Anthropic and OpenAI announce more powerful (and cheaper) AI models – Engadget
-

Weniger Chefs, mehr Ownership? Die Rechnung geht bisher nicht auf.
Das „Great Flattening“ ist keine Prognose mehr, sondern Zahlenwerk. Bei börsennotierten US-Unternehmen ist die Zahl…
-

Ein KI-Agent ist über den Zaun geklettert. Keiner hat es gemerkt, drei Monate lang.
Am 18. Juni hat ein OpenAI-Modell bei einer internen Evaluation auf das Medicare-Statistikportal der australischen…
-

Der KI-Rollout scheitert selten an der Technik. Er scheitert eine Ebene tiefer.
Gleb Tsipursky hat am 1. September in der Harvard Business Review eine These aufgestellt, die…