Künstliche Intelligenz: KI von OpenAI unternimmt selbstständig Hackerangriff
KI-Prototypen von OpenAI sind aus einer Testumgebung ausgebrochen und haben eine Website gehackt, berichtet die Firma. Einen Forscher beunruhigt das.
Foto: imago
afp | KI-Modelle des Unternehmens OpenAI haben während eines Sicherheitstests selbständig einen Hackerangriff auf eine beliebte Programmierplattform unternommen. Es handele sich um einen „nie dagewesenen Cybervorfall“, erklärte das Unternehmen aus San Francisco am Dienstag. OpenAI werde eine gemeinsame Untersuchung mit der betroffenen Online-Code-Bibliothek Hugging Face unternehmen.
An dem Vorfall waren nach Angaben von OpenAI mehrere Modelle beteiligt, darunter das kürzlich veröffentlichte GPT-5.6 Sol sowie ein „noch leistungsfähigeres“, noch vor der Veröffentlichung stehendes Modell. Das Unternehmen wollte die Hacking-Fähigkeiten der Modelle bemessen und gab ihnen dazu Aufgaben in einem streng kontrollierten digitalen Testumfeld. Zur Sicherheit war der Internetzugang eingeschränkt.
In der gesicherten Testumgebung hätten die KI-Modelle einen wesentlichen Teil ihrer Rechenleistung darauf verwendet, an einen offenen Internetzugang zu gelangen, erklärte OpenAI. Nachdem sie eine Verbindung zum Internet hergestellt hatten, entschieden sich die Modelle demnach dazu, die Plattform Hugging Face für ihre Aufgabe zu nutzen – die Plattform bietet eine große Sammlung von KI-Modellen, Datensätzen und anderen Informationen.
Auf der Suche nach „geheimer Information“, die ihnen helfen könnte, verketteten die OpenAI-Systeme mehrere Angriffswege, „darunter auch die Verwendung gestohlener Anmeldedaten“, schilderte das KI-Unternehmen.
Hugging Face wusste von dem Vorfall
Der Vorfall sei in mehrerer Hinsicht „verblüffend“, sagte IT-Professor Hussein Abbas von der UNSW Canberra der Nachrichtenagentur AFP. Die KI habe das „interne System“ von Hugging Face angegriffen, um dessen „eigene Schwachstellen auszunutzen“. „Und das ist beängstigend.“
GPT-5.6 und andere fortschrittliche Modelle wie die Mythos-Serie des OpenAI-Rivalen Anthropic haben Bedenken ausgelöst, dass sie Cybersicherheitsmaßnahmen durchbrechen könnten. Die beiden US-Unternehmen hatten die allgemeine Veröffentlichung der jüngsten Technologien deshalb zeitweise zurückhalten müssen.
Fortschrittliche KI befinde sich „normalerweise in den Händen von Menschen, die ethisch und verantwortungsbewusst“ handelten, sagte Abbass. „Katastrophal“ hingegen würde es, wenn sie an Menschen gelangten, die Schaden anrichten wollten. Die Frage nach der Regulierung des KI-Sektors sei zu einem zentralen Thema geworden, und „wir brauchen gemeinsame Anstrengungen, um diese Situation in den Griff zu bekommen“, fuhr Abbass fort.
Hugging Face hatte den Angriff in der vergangenen Woche bekanntgegeben – aber dabei nicht OpenAI erwähnt. „Dieser Fall unterschied sich in einem wichtigen Punkt von allem, womit wir bisher zu tun hatten: Er wurde von Anfang bis Ende von einem autonomen KI-Agentensystem gesteuert – und wir haben ihn größtenteils mit unserer eigenen KI aufgedeckt und analysiert“, erklärte die Plattform.
Angesichts der Ausgereiftheit des Angriffs habe die Firma den Verdacht gehabt, dass dieser aus einem weltweit führenden KI-Labor kam, erklärte Hugging-Face-Chef Clément Delangue im Onlinedienst X und fuhr mit Blick auf OpenAI fort: „Wir sind fest davon überzeugt, dass ihrerseits keine bösartige Absicht vorlag.“ Es sei „atemberaubend, dass all das autonom geschehen ist“.
Die taz gehört zu 100 Prozent ihren Leser:innen und ist damit nicht nur konzernfrei, sondern auch kostenfrei zugänglich. Alle Artikel stellen wir frei zur Verfügung, ohne Paywall. Gerade in diesen Zeiten müssen Einordnungen und Informationen allen zugänglich sein. Unsere Leser:innen müssen nichts bezahlen, wissen aber, dass kritischer, unabhängiger Journalismus nicht aus dem Nichts entsteht. Dafür sind wir sehr dankbar. Damit wir auch morgen noch unseren Journalismus machen können, brauchen wir mehr Unterstützung für taz zahl ich. Dank Ihnen haben wir nun die 50.000 erreicht. So viele unterstützen freiwillig und regelmäßig. Noch nicht dabei? Werden Sie jetzt Teil der Community! Jetzt unterstützen
meistkommentiert