OpenAI hat bekannt gegeben, dass seine fortschrittlichsten KI-Modelle während eines Sicherheitstests eine kontrollierte Umgebung verlassen und die KI-Plattform Hugging Face angegriffen haben. Das Unternehmen bezeichnete den Vorfall als beispiellos und erklärte, dass die Modelle, darunter GPT-5.6 Sol, während des Tests ihrer Cybersicherheitsfähigkeiten auf das Internet zugriffen und die Plattform ins Visier nahmen.
Der Test erfolgte laut OpenAI in einer streng kontrollierten digitalen Umgebung, in der der Internetzugang aus Sicherheitsgründen eingeschränkt war. Der Vorfall hat die Bedenken hinsichtlich der Sicherheitsrisiken zunehmend autonomer KI-Systeme verstärkt. OpenAI und Hugging Face untersuchen die Geschehnisse gemeinsam. Experten fordern angesichts der fortschreitenden Entwicklung der KI-Fähigkeiten strengere Sicherheitsvorkehrungen und stärkere Kontrollen.