Cyber-Zwischenfall

Wie KI von OpenAI ausbrach und eine Firma hackte

22. Juli 2026, 16:55 Uhr · Quelle: dpa
OpenAI-Logo
Foto: Richard Drew/AP/dpa
Neue KI-Modelle des ChatGPT-Entwicklers OpenAI versuchten sich als Computer-Hacker, um bei einem internen Test zu schummeln. (Archivbild)
Ein außergewöhnlicher Vorfall bei einem Testlauf des ChatGPT-Entwicklers OpenAI demonstriert drastisch das Risiko von KI-Cyberattacken. Dabei wollte die Software nur in einem Test schummeln.

San Francisco (dpa) - Ein Alptraum-Szenario von Tech-Sicherheitsexperten ist Wirklichkeit geworden: Eine Software mit Künstlicher Intelligenz drang auf eigene Faust in Computersysteme einer anderen KI-Firma ein und verhielt sich dabei wie ein gewiefter Hacker. Zum Glück war es diesmal nur ein schiefgegangener Testlauf, bei dem ein übereifriges neues KI-Modell des ChatGPT-Entwicklers OpenAI zwar zu weit ging - aber letztlich nur harmlos auf ein gutes Prüfungsergebnis aus war. Doch der außergewöhnliche Zwischenfall zeigt drastisch, was passieren kann. Und mit böswilligen Angreifern hätte es ganz anders ausgehen können.

Das betroffene Unternehmen Hugging Face, eine Plattform für quelloffene KI-Anwendungen, berichtete bereits vergangene Woche von einem Cyberangriff und vermutete Künstliche Intelligenz dahinter. Das war korrekt: Wie sich herausstellte, ging die Attacke auf einen internen Versuch bei OpenAI zurück, den die Software ungeplant zu weit trieb. 

Ein Test, der zum Ernstfall wurde 

OpenAI selbst spricht von einem «beispiellosen Cyber-Zwischenfall». Wie so oft bei Unfällen fielen unerwartete Faktoren und das Versagen von Schutzmechanismen zusammen.

OpenAI wollte laut einem Blogeintrag beim neuen Modell GPT-5.6 Sol und einer noch unveröffentlichten künftigen Version die Fähigkeit ausloten, Sicherheitslücken für Cyberattacken auszunutzen. Dafür sollte die Software in abgesicherter Umgebung Aufgaben eines Standard-Tests mit dem Namen ExploitGym lösen, der dafür oft in der Branche verwendet wird. Doch die KI-Modelle gingen viel weiter als gedacht, um die Aufgabe zu erfüllen.

Flucht ins offene Internet

Zunächst brach die Software aus der Testumgebung aus, indem sie sich auf eigene Faust Zugang zum offenen Internet verschaffte - und zwar über eine bisher unentdeckt gebliebene Schwachstelle. Während sie eigenständig im Netz unterwegs waren, kamen die Modelle zu dem Schluss, dass es bei Hugging Face nützliche Daten und Lösungen für die ExploitGym-Aufgaben geben könnte. Deshalb habe die Software sich Zugang zu «geheimen Informationen» auf der Plattform verschafft, mit denen sie beim ExploitGym-Test schummeln könnte, erläuterte OpenAI. 

Auch dafür setzte die OpenAI-Software unter anderem auf zuvor unentdeckte Sicherheitslücken - aber auch auf gestohlene Zugangsdaten. Hugging Face zufolge führte der KI-Angreifer tausende Schritte aus und wechselte den Standort der digitalen Steuerzentrale der Attacke. Besser hätte ein erfahrener Computer-Hacker auch nicht vorgehen können.

Wie konnte das passieren?

Eigentlich sollte der Test in einer «höchst isolierten Umgebung» verlaufen, erklärte OpenAI. Die KI durfte eigentlich nur selektiv einige Datenpakete aus dem Netz laden, Software eines Spezialanbieters fungierte dabei als eine Art Türwächter. Was jedoch keine wusste: In dieser externen Software schlummerte unerkannt eine Schwachstelle, die das OpenAI-Modell nicht nur entdeckte, sondern auch eiskalt ausnutzte, um sich den Weg ins Internet freizulegen. Die Lücke wurde inzwischen dem Anbieter gemeldet.

Hugging Face hatte dann das Pech, der Ort zu sein, an dem die KI die Antwort auf die ExploitGym-Testaufgaben vermutete - es hätte auch jemand anderes treffen können. Mit freiem Zugang zum offenen Internet konnte das OpenAI-Modell methodisch nach Schwachstellen in den Systemen von Hugging Face suchen. Um hineinzukommen, verknüpfte es sogar mehrere davon zu einer Kette. Hugging Face entdeckte den Angriff, fand es aber schwierig, dagegen anzukämpfen, weil die KI so geschickt agierte. Auch OpenAI fiel nach eigenen Angaben auf, dass etwas falsch lief.

Was bedeutet das nun? 

Experten warnen schon lange vor Cyberattacken mit KI-Software. Branchenveteran Steve Newman, der einst Geburtshelfer von Google Docs war und jetzt Künstliche Intelligenz beim Golden Gate Institute for AI erforscht, sah in dem neuen Vorfall einen überaus präzisen «Warnschuss». 

Auch bei OpenAI ist das Alarmsignal angekommen. Micah Carroll, der dafür zuständig ist, die ChatGPT-Firma auf eine Zukunft vorzubereiten, in der sich KI-Software selbst weiterentwickeln kann, griff zu klaren Worten: Wenn dieser Vorfall jemanden nicht davon überzeugen könne, dass eine potenzielle Diskrepanz zwischen den Absichten der Menschen und der KI-Software in Zukunft zu den größten Risiken gehören werden, «weiß ich auch nicht, was dazu in der Lage wäre», schrieb er auf der Online-Plattform X.

Das Bundesamt für Sicherheit in der Informationstechnik mahnte: «Ein Angriff auf eine kritische Infrastruktur, etwa um einer Stadt den Strom abzustellen, wäre denkbar, wenn dies für die Aufgabenstellung der KI hilfreich ist.»

Rufe nach schärferen Regeln

Sofort wurden in der KI-Führungsmacht USA wieder Stimmen für eine striktere Regulierung Künstlicher Intelligenz lauter. Der Vorfall sei «extrem alarmierend», warnte etwa der demokratische Kongressabgeordnete Greg Casar. KI entwickele sich extrem schnell ohne verlässliche Regulierung für die Sicherheit. 

Präsident Donald Trump hatte in seiner zweiten Amtszeit die Leitplanken-Regeln seines Vorgängers Joe Biden für Künstliche Intelligenz schnell gekippt - im Namen eines Vorteils für US-Entwickler. Spätestens, wenn Trumps Republikaner im November ihre Mehrheiten in Abgeordnetenhaus und Senat an die Demokraten verlieren sollten, dürfte es neue Anläufe für strengere Regeln geben.

In Europa unterdessen sprachen sich EU-Abgeordnete dafür aus, die Abhängigkeit von US-Technologiekonzernen zu verringern. Es brauche eigene leistungsfähige KI und mehr Kontrolle über Schlüsseltechnologien in Europa, sagten mehrere Europapolitiker dem «Spiegel».

Anthropics Wunder-KI löste Debatten aus 

In den vergangenen Monaten hatte vor allem ein neues Modell des OpenAI-Rivalen Anthropic die Debatte um Wohl und Risiken Künstlicher Intelligenz angeheizt. Die Software mit dem Namen Mythos entdeckte über Jahrzehnte unentdeckt gebliebene Sicherheitslücken bei viel genutzten Programmen und Online-Diensten. Die Schwachstellen konnten in der Folge gestopft werden. Doch zugleich führte das vor Augen, dass solche KI in den falschen Händen als verheerende Cyberwaffe dienen kann.

Anthropic macht die vollen Möglichkeiten von Mythos nur für ausgewählte Behörden und Unternehmen zugänglich. Für andere gibt es eine abgespeckte Version mit dem Namen Fable, der unter anderem die Cybersicherheits-Fähigkeiten fehlen. Nach Warnungen, dass die KI-Modelle von den Zügeln befreit werden könnten, musste Anthropic auf Geheiß der US-Regierung den Zugang zu Mythos und Fable zeitweise sperren. Die Blockade wurde inzwischen aufgehoben.

Computer / Internet / Software / USA / OpenAI / Hugging Face / KI-Sicherheit
22.07.2026 · 16:55 Uhr
[2 Kommentare]
Pressesprecherin des Weißen Hauses Leavitt
Washington (dpa) - Sie war das Sprachrohr von US-Präsident Donald Trump. Mit nicht einmal 30 Jahren rückte Karoline Leavitt als jüngste Präsidenten-Sprecherin überhaupt auf eine der wichtigsten Positionen im Weißen Haus – und prägte den Ton von Trumps erratischer Politik. Überraschend hört Leavitt, die als stramme Loyalistin des Präsidenten gilt, nun […] (00)
vor 1 Stunde
Sizilien - Vulkan Ätna hochaktiv
Catania (dpa) - Für Urlauber auf der italienischen Mittelmeerinsel Sizilien bleibt der Flugverkehr am Flughafen von Catania eingeschränkt. Wegen der Vulkanasche des Ätna sind dort keine Starts und Landungen möglich. Der Airport bleibt nach jüngsten Angaben des Betreibers mindestens bis Freitag um 2.00 Uhr dicht. Ob der Flugbetrieb danach wieder […] (01)
vor 19 Minuten
Jenna Ortegas Szenen in Sabrina Carpenters Musikvideo zu 'Taste' waren größtenteils improvisiert.
(BANG) - Jenna Ortegas Szenen in Sabrina Carpenters Musikvideo zu 'Taste' waren größtenteils improvisiert, da sie erst wenige Tage zuvor von der Rolle erfahren hatte. In einer Szene beugt sich Jenna vor, um ihren Liebhaber zu küssen, der sich plötzlich in seine Ex-Freundin Sabrina verwandelt, und sie zerschneidet die Illusion mit einer pinkfarbenen […] (00)
vor 7 Stunden
GTA 6 soll selbst beim Autoklau überraschen: Leaker spricht von „Next Level“-Gameplay
Bei Grand Theft Auto VI erwarten wir eine größere Welt, bessere Grafik und natürlich Vice City. Doch ausgerechnet beim eigentlichen Gameplay könnte Rockstar Games einen deutlich größeren Sprung machen als bisher gedacht. Zumindest wenn die neuen Aussagen eines Leakers stimmen. Der bekannte Gaming-Influencer behauptet, dass sich GTA 6 „komplett […] (00)
vor 2 Stunden
Ben Affleck gerät in «Animals» zwischen Macht und Moral
Für Netflix übernimmt Ben Affleck bei «Animals» gleich mehrere Aufgaben: Er inszeniert den Thriller, spielt die Hauptrolle und war am Drehbuch beteiligt. Netflix hat einen ersten Teaser zu Animals veröffentlicht, der am 9. Oktober 2026 veröffentlicht wird. Der neue Thriller stammt von Ben Affleck, der nicht nur die Regie übernommen hat, sondern auch selbst vor der Kamera steht. Gemeinsam mit […] (00)
vor 1 Stunde
Paris Saint-Germain - Aston Villa
Salzburg (dpa) - Paris Saint-Germain hat den UEFA-Supercup gewonnen und damit die Erfolgsserie der Champions-League-Sieger in dem Wettbewerb fortgesetzt. Die Franzosen schlugen Europa-League-Gewinner Aston Villa in Salzburg mit 2: 1 (1: 1). Chwitscha Kwarazchelia (20. Minute) und Desiré Doué (61.) trafen für PSG. Das Tor der Engländer schoss der erst 17 […] (02)
vor 1 Stunde
bitcoin, gold, coin, icon, symbol, logo, bitcoin gold, bitcoin logo, currency, cryptocurrency
In der vergangenen Woche bewegte sich Bitcoin in Richtung der oberen Grenze seiner Handelsspanne, da die institutionelle Nachfrage durch US-Spot-ETFs zunahm. Günstigere Arbeitsmarktdaten reduzierten die Erwartungen an eine sofortige Zinserhöhung der Federal Reserve, doch anhaltender Verkaufsdruck begrenzte die Kursbewegung. Die stärkere ETF-Nachfrage […] (00)
vor 52 Minuten
Aus GEG wird GModG
Freiburg, 12.08.2026 (lifePR) - Das Gebäudeenergiegesetz (GEG) wird zum Gebäudemodernisierungsgesetz (GModG). Mit der Umsetzung der europäischen Gebäuderichtlinie Energy Performance of Buildings Directive (EPBD) gehen zugleich zahlreiche Änderungen einher, die insbesondere Eigentümer und Betreiber von Nichtwohngebäuden betreffen. Eine der wichtigsten […] (00)
vor 9 Stunden
 
iPhone 20: Apples gläsernes Redesign zum Jubiläum auf Kurs
Laut einem Bericht von Bloomberg befindet sich die Entwicklung des […] (00)
Apple kürzt Hardwarelieferungen wegen globaler Speicherknappheit
Einem aktuellen Bericht des renommierten Analysten Ming-Chi Kuo zufolge […] (00)
Netatmo KI – Präziser Schutz ohne nervende Fehlalarme
Smart-Home-Geräte gibt es viele, doch echte Intelligenz steckt in den wenigsten. Oft […] (00)
Sarah Wagenknecht
Magdeburg (dpa) - Vor der Landtagswahl in Sachsen-Anhalt am 6. September stellt Sahra […] (21)
Preise statt Subventionen Brenntag hat im zweiten Quartal gezeigt, wie ein […] (00)
FRITZ!Box 5630 – Starke Glasfaserpower, schnelle Einrichtung
Mit der FRITZ! Box 5630 erweitert FRITZ! sein Glasfaser-Portfolio um ein […] (01)
Massimo Sinato sorgt für Wirbel bei «Inga Lindström»
Im neuen „Herzkino“-Film „Rezept für die Liebe“ kehrt Sofia Lund nur widerwillig in ihre Heimat […] (00)
Fan-Plakat zur 50+1-Regel
Bonn (dpa) - 50+1 darf bleiben - für eine dauerhafte Lösung im Ringen um die […] (00)
 
 
Suchbegriff