Pannen bei Tests von KI-Agenten:Anthropic-KI schickt erfundenen Hinweis an die Polizei
Ausgebrochene Software sorgt für Alarm: KI-Agenten von Anthropic und OpenAI reichen Fake-Mordinformationen bei der Polizei ein und hacken fremde IT-Systeme.
KI außer Kontrolle: Autonome KI-Agenten von Anthropic und OpenAI sorgen mit Fehlverhalten bei Polizei für Aufsehen.
Quelle: AFP | Sebastien BozonKünstliche Intelligenz der Entwicklerfirma Anthropic hat in einem Testlauf einen falschen Hinweis auf einer Polizei-Website zur Aufklärung ungelöster Mordfälle eingereicht. In einem weiteren Zwischenfall füllte die KI-Software Formulare auf einer US-Regierungsseite aus, wie Anthropic in einem Blogeintrag bekanntgab.
Medienberichten zufolge waren es 20 Visa-Anträge beim amerikanischen Außenministerium. In den vergangenen Wochen wurden bereits verschiedene ungeplante Aktivitäten vor allem von KI des ChatGPT-Entwicklers und Anthropic-Rivalen OpenAI bekannt.
Autonome KI-Agenten: Anthropic-Software außer Kontrolle
Die Unternehmen trainieren aktuell so genannte KI-Agenten - also Software, die im Auftrag der Nutzer weitgehend autonom verschiedene Aufträge erfüllen soll. Die von Anthropic aufgelisteten Vorfälle gehen direkt auf Versuche zurück, die KI für alle möglichen Online-Aufgaben vorzubereiten.
CEOs großer KI-Unternehmen wie OpenAI und Anthropic warnen vor dem Kontrollverlust über KI. Auch auf einer Start-Up-Messe in München sind KI-Risiken ein zentrales Thema.
29.09.2026 | 1:49 minDen Fake-Hinweis zu einem ungeklärten Mord reichte Anthropics KI über eine Website der Polizei von Philadelphia ein. "Ich könnte Informationen zu diesem Fall haben", schrieb die Software demnach. "Ich erinnere mich, jemanden, der der Beschreibung entspricht", in der Gegend zur Tatzeit gesehen zu haben, hieß es weiter.
Falscher Mordinweis bei der US-Polizei eingereicht
Die Website der Polizei enthielt allerdings gar keine Täter-Beschreibung. Die Software ließ außerdem das Kontakt-Feld offen - und ihre Einreichung wurde als Spam markiert. Die Polizei von Philadelphia kritisierte als "inakzeptabel", dass sie erst jetzt von dem Vorfall Mitte Juli erfuhr.
Anthropic zufolge wurde das Handeln der KI Ende September bei einer vertieften Überprüfung von Testläufen nach anderen Zwischenfällen entdeckt. Die Software habe den Auftrag gehabt, Aufgaben auf zufällig ausgesuchten Websites auszuführen. Ihr sei zwar untersagt gewesen, etwa Accounts anzulegen oder Dinge zu kaufen - aber das Ausfüllen von Formularen habe man nicht verboten.
Anthropic schränkt Internet-Zugang für Test-KI ein
In anderen Fällen sollte die KI laut Anthropic üben, ein Behördenformular auszufüllen. Wenn sie das Übungsformular nicht laden konnte oder versehentlich schloss, navigierte die Software stattdessen mehrfach auf die echte Website und reichte es dort ein, wie die KI-Firma erläuterte. In einem der Versuche sollte sie demnach ein Formular nur ausfüllen, aber nicht einreichen. Sie tat es versehentlich dennoch, weil sie davon ausgegangen sei, dass es vorher noch eine Bestätigungsseite geben werde.
Dabei habe Anthropics KI beim US-Außenministerium 20 Anträge auf Nichteinwanderungs-Visa eingereicht, berichteten die Website "Axios" und die "New York Times" unter Berufung auf Regierungsbeamte. Sie seien unvollständig gewesen und nicht bearbeitet worden, hieß es. 19 der Anträge seien im August eingereicht worden und einer bereits im Mai.Anthropic schränkt Internet-Zugang für Test-KI ein.
OpenAI-Hackerangriff und die Debatte um KI-Sicherheit
Sorgen rund um die Technologie. In dem bisher aufsehenerregendsten Fall war Künstliche Intelligenz des ChatGPT-Entwicklers OpenAI aus einer abgesicherten Testumgebung ausgebrochen und hatte sich ungeplant in Computer einer anderen KI-Firma gehackt, der Plattform Hugging Face.
Wegen der wachsenden Risiken fordern mehrere Entwickler künstlicher Intelligenz eine Drosselung der Entwicklung. Anthropic-Chef Amodei, OpenAI-Gründer Altman und Elon Musk unterstützen die Forderung.
13.09.2026 | 0:29 minAnthropic-Chef Dario Amodei schlug danach vor, die Entwicklung besonders fähiger KI-Modelle abzubremsen, damit man nicht die Kontrolle über die Technologie verliert. US-Präsident Donald Trump lehnt dies jedoch ab und verweist darauf, dass die USA bei Künstlicher Intelligenz den Vorsprung gegenüber China behalten müssten.
Anthropic betonte, dass inzwischen der Internet-Zugang in Testläufen eingeschränkt worden sei und einige Versuche in Offline-Versionen liefen. Zugleich seien einige Aufgaben ohne eine Verbindung zum Internet schwer zu trainieren, schränkte die Firma ein. "Trainingsumgebungen sind nicht perfekt" - und manchmal finde ein Modell eine Lücke oder lerne, Einschränkungen zu umgehen.
Lassen Sie sich Beiträge von ZDFheute bevorzugt bei Google anzeigen.
→ Hier ZDFheute als bevorzugte Quelle einstellen.
Mehr zu KI, Anthropic, Google Gemini & ChatGPT
Aufruhr durch Sicherheitsvorfälle:Wer bremst, verliert? Woran mehr KI-Regeln derzeit scheitern
Tobias Bluhm, Münchenmit Video8:26Nach OpenAI, Anthropic und Meta:Auch Googles KI Gemini führte Cyberattacken durch
mit Video5:33OpenAI und Anthropic:KI-Firmenchefs warnen UN-Sicherheitsrat vor Gefahren
mit Video3:06Sicherheitsvorfall bei KI-Firma:Forscher stoppt Späh-Software von Anthropic
von Hakan Tanrıverdimit Video5:33KI-Sicherheit:Anthropic stoppt mögliche Biowaffen-Forschung mit KI "Claude"
mit Video0:23