OpenAI veröffentlicht neue Fälle von KI-Fehlverhalten

Eigensinnige Software:OpenAI veröffentlicht neue Fälle von KI-Fehlverhalten

|

OpenAI macht sechs Fälle öffentlich, in denen KI-Systeme eigenmächtig gehandelt haben oder Kontrollen umgehen wollten. Künftig sollen solche Vorfälle systematisch erfasst werden.

Das Logo von OpenAI an der Fassade des Hauptquartiers.

OpenAI ist das Unternehmen hinter dem KI-Bot ChatGPT.

Quelle: 123RF

OpenAI hat sechs Fälle "unerwarteten oder bedenklichen" Verhaltens von Künstlicher Intelligenz (KI) öffentlich gemacht.

Zugleich kündigte das Unternehmen am Mittwoch einen neuen Rahmen zur regelmäßigen Erfassung, Untersuchung und Veröffentlichung solcher Fälle an. Dabei geht es um sogenannte Fehlanpassungen von KI-Modellen, bei denen diese etwa eigenmächtig handeln, mit anderen Modellen zusammenarbeiten oder versuchen, Kontrollen zu umgehen.

Die sechs Fälle wurden laut OpenAI in den vergangenen Monaten bei der Entwicklung oder Überprüfung von Modellen entdeckt. OpenAI ist das Unternehmen hinter ChatGPT.

Prof. Dennis-Kenji Kipker | Experte für IT-Sicherheit

"Was man definitiv sagen kann, ist, dass wir einem KI-GAU immer näherkommen", warnt der IT-Experte Prof. Dennis-Kenji Kipker. Man dürfe die Begrenzung von KI nicht allein den Unternehmen überlassen.

14.09.2026 | 5:33 min

Forschungsmodell ignoriert Einschränkungen

In einem bislang nicht veröffentlichten Forschungsmodell fanden sich demnach Anweisungen in den eigenen Notizen, die normalen Einschränkungen zu ignorieren. In einem anderen Fall lud ein KI-Agent ohne Zustimmung des Nutzers Dateien ins Internet hoch, um eine Quellenangabe für einen Browser zu erhalten.

OpenAI erklärte, mit zunehmender Leistungsfähigkeit und Verbreitung von KI-Systemen müsse ein breiterer Konsens über die Erforschung ihrer Ausrichtung und Sicherheit entstehen. Entscheidungen über die weitere Entwicklung sollten sich auf Erkenntnisse stützen, die auch von unabhängigen Beobachtern überprüft werden könnten.

Mit dem Begriff der Künstlichen Intelligenz (KI) werden derzeit viele Hoffnungen zur Lösung gesellschaftlicher Probleme verbunden.

NANO vom14.09.2026: Die Entwicklung von KI wird immer leistungsfähiger. Nun warnen selbst führende KI-Unternehmen vor Risiken und fordern strengere Kontrollen.

14.09.2026 | 28:04 min

Auch andere Hersteller meldeten Fehlverhalten der KI

Die neuen Fälle folgen auf frühere Berichte über KI-Systeme, die bei Tests eigenständig in Computersysteme eindrangen. OpenAI hatte im Juli mitgeteilt, dass ein KI-System das KI-Start-up Hugging Face gehackt habe. Das Unternehmen Anthropic berichtete im selben Monat von ähnlichen Vorfällen bei Tests.

Nach Einschätzung des Analysten Lian Jye Su des Analyse- und Beratungsunternehmens Omdia werden KI-Agenten zunehmend fähig, komplexe Aufgaben durch Zusammenarbeit, Wissensaustausch, Täuschung und Verschleierung zu lösen. Dadurch werde ihre Kontrolle schwieriger.

Symbolfoto KI: Ein Auge blickt durch eine Matrix aus Zahlen und Punkten.

Angela Müller ist Geschäftsleiterin von Algorithm Watch in Zürich. Wir haben mit ihr über die jüngsten Warnungen der Tech-Industrie vor den Gefahren von KI gesprochen.

16.09.2026 | 9:59 min

Über das Thema berichtete das ZDF in verschiedenen Sendungen, etwa im heute journal am 16.09.2026 ab 21:45 Uhr.

Mehr zum Thema KI

  1. Abstrakter Developer Code, KI, Javascript
    Analyse

    KI-Weltuntergangsszenarien:Ein Hochrisiko-Experiment, dessen Ausgang niemand kennt

    von Jan Schüßler
    mit Video5:33

  2. Symbolbild: Das Logo von Anthropic, auf dem Bildschirm eines Smartphones

  3. Smartphone-Display mit Logo von Anthropic (Fotomontage)

    Drastische Warnung vor Gefahr durch KI:Forscher verlässt Anthropic: "Spielen mit unserem Leben"

    mit Video0:38

  4. Prof. Dennis-Kenji Kipker | Experte für IT-Sicherheit

    Gefahren durch künstliche Intelligenz:Experte: Kommen einem KI-GAU immer näher

    mit Video5:33