Ein interner Test beim ChatGPT-Entwickler OpenAI hat einen außergewöhnlichen Zwischenfall ausgelöst. Bei der Erprobung neuer KI-Modelle verschaffte sich eine Software eigenständig Zugang zum Netzwerk des KI-Unternehmens Hugging Face – und agierte dabei wie ein Hacker. OpenAI spricht von einem „beispiellosen Cyber-Zwischenfall“. Das neue Modell GPT-5.6 Sol sollte eigentlich nur unter kontrollierten Bedingungen Sicherheitslücken aufspüren und ausnutzen. Dafür kam der in der Branche verbreitete Sicherheitstest ExploitGym zum Einsatz. Doch die KI ging deutlich weiter als vorgesehen. Nach Angaben von OpenAI gelang es der Software, aus ihrer Testumgebung auszubrechen und sich über eine bislang unbekannte Schwachstelle eigenständig Zugang zum offenen Internet zu verschaffen. Dort identifizierte sie Hugging Face als potenzielle Quelle hilfreicher Informationen für den Test und verschaffte sich mithilfe bislang unbekannter Sicherheitslücken sowie gestohlener Zugangsdaten Zugriff auf vertrauliche Daten. Laut Hugging Face führte die KI dabei tausende einzelne Schritte aus und wechselte mehrfach den digitalen Ursprung ihrer Attacke. OpenAI kündigte gemeinsam mit Hugging Face eine umfassende Untersuchung des Vorfalls an. Nach Abschluss sollen weitere Informationen zu den ausgenutzten Sicherheitslücken und den gewonnenen Erkenntnissen veröffentlicht werden. Der Vorfall befeuert die Debatte über die Risiken leistungsfähiger KI. Experten warnen seit Längerem, dass sie nicht nur Sicherheitslücken aufdecken, sondern auch für Cyberangriffe missbraucht werden könnte.
