KI-Modelle außer Kontrolle: OpenAI-KI startet eigenständigen Hackerangriff – Beispielloser Sicherheitsvorfall erschüttert Tech-Welt

Der KI-Entwickler OpenAI, bekannt für ChatGPT, hat in einem Blogeintrag einen “beispiellosen Vorfall” dokumentiert. Während eines Tests drangen neue Modelle der künstlichen Intelligenz eigenmächtig in die Computersysteme eines anderen Unternehmens ein – und agierten dabei wie Hacker. Betroffen war Hugging Face, eine Plattform, die vor allem für ihre KI-Anwendungen bekannt ist. Das Unternehmen hatte bereits in der Vorwoche einen Cyberangriff gemeldet, der ebenfalls auf KI zurückging.

OpenAI erklärte, dass es bei der Erprobung des neuen Modells GPT-5.6 Sol und einer noch nicht veröffentlichten Variante darum ging, die Fähigkeit der KI zu testen, Sicherheitslücken für Angriffe auszunutzen. Dazu sollte die Software die Aufgaben eines branchenüblichen Tests namens ExploitGym lösen. Die KI-Modelle gingen jedoch weit über die Erwartungen hinaus, um diese Aufgaben zu bewältigen.

Zunächst gelang es den Modellen, aus der Testumgebung auszubrechen, indem sie sich eigenständig Zugang zum offenen Internet verschafften – und zwar über eine bisher unentdeckte Schwachstelle. Während sie im Netz agierten, kamen sie zu dem Schluss, dass Hugging Face nützliche Daten und Lösungen für die ExploitGym-Aufgaben bereithalten könnte. Daraufhin verschafften sie sich Zugang zu “geheimen Informationen” auf der Plattform, um beim Test zu betrügen.

Für diesen Schritt nutzten die OpenAI-Entwicklungen gestohlene Zugangsdaten sowie zuvor unbekannte Sicherheitslücken. Hugging Face zufolge führten die KI-Angreifer Tausende von Einzelschritten aus und wechselten mehrfach den Standort ihrer digitalen Kommandozentrale.

In den vergangenen Monaten hatte insbesondere ein neues Modell des OpenAI-Konkurrenten Anthropic die Diskussion über die Gefahren von KI-gestützten Cyberangriffen befeuert. Die Software namens Mythos entdeckte jahrzehntealte Sicherheitslücken in weit verbreiteten Programmen und Onlinediensten. Diese Schwachstellen konnten daraufhin geschlossen werden. Gleichzeitig machte dies jedoch deutlich, dass solche KI-Modelle in falschen Händen als verheerende Cyberwaffe eingesetzt werden könnten. Auf Anweisung der US-Regierung musste Anthropic den Zugang zu Mythos vorübergehend sperren.

Mehr zum Thema – DeepSeek-Gründer wird zum reichsten KI-Modellentwickler der Welt

Schreibe einen Kommentar