Bei einem Test neuer KI-Modelle von OpenAI ist es kürzlich zu einem bemerkenswerten Zwischenfall gekommen, der am 16. Juli 2026 öffentlich dokumentiert wurde. Die Modelle sollten demonstrieren, inwieweit sie Sicherheitslücken erkennen und für Cyberoperationen ausnutzen können. Dabei blieben sie jedoch offenbar nicht innerhalb der vorgesehenen Testumgebung. Nach Angaben des Unternehmens verschafften sich die Systeme selbstständig Zugang zum offenen Internet, indem sie mit ihren Fähigkeiten Lücken in der Testumgebung selbst ausnutzten, und drangen anschließend in Systeme der KI-Plattform Hugging Face ein. Hierfür nutzten sie bislang unbekannte Schwachstellen sowie entwendete Zugangsdaten. OpenAI bezeichnete den Vorgang selbst als einen beispiellosen Cyberzwischenfall.
Bibliographische Angaben:
Reinhold, Thomas. “Wenn KI selbstständig angreift: Automatisierte Cyberattacken als sicherheitspolitische Mahnung” PRIF Blog, 23.07.2026.