Künstliche Intelligenz

Nächster Alarm: KI schickte Menschen Phishing-Mails

05. August 2026, 12:49 Uhr · Quelle: dpa
KI Symbolbild
Foto: Peter Steffen/dpa
Schon in mehreren Fällen ging Künstliche Intelligenz in Cybersicherheitstest eigenmächtig zu weit. (Archivbild)
Um eine Test-Aufgabe zu lösen, versuchte Künstliche Intelligenz ungeplant, öffentlich zugängliche Software zu infizieren - und Menschen mit Phishing-Mails zu manipulieren. Forscher schlagen Alarm.

San Francisco/London (dpa) - Die Serie von Enthüllungen über alarmierende Hacker-Fähigkeiten führender KI-Modelle reißt nicht ab. Jetzt ertappten britische Sicherheitsforscher Künstliche Intelligenz in einem Testlauf beim Versuch, in Eigeninitiative eine Schwachstelle in öffentlich zugängliche Software einzuschleusen. Um damit durchzukommen, versuchte das KI-Modell der Entwicklerfirma Anthropic den Experten zufolge sogar, per E-Mail einen zuständigen Menschen zu manipulieren.

Das KI-Sicherheitsinstitut des britischen Ministeriums für Wissenschaft, Innovation und Technologie hatte den Modellen von Anthropic und des ChatGPT-Entwicklers OpenAI in seinen Tests der Cyberangriffsfähigkeiten absichtlich Zugang zum Internet gewährt. Dabei sei man allerdings davon ausgegangen, dass die KI sich nur Software-Werkzeuge aus dem Netz holen würde, um die gestellte Aufgabe zu erfüllen. Man habe «nicht vorhergesehen», dass das Anthropic-Modell Mythos 5 den Internet-Zugang für Aktivitäten ausnutzen würde, die sich gegen Menschen richten.

Die Forscher räumten auch ein, dass sie das Vorgehen erst nachträglich über eine Auswertung des Datenverkehrs entdeckten. In künftigen Tests wollen sie die Datenströme in Echtzeit aufmerksamer beobachten.

Anthropic und OpenAI hatten in den vergangenen Wochen bereits einräumen müssen, dass ihre KI-Modelle in Tests ungeplant in Computersysteme echter Unternehmen eingedrungen waren. Diese Eingeständnisse hatten die schon seit Jahren bestehende Sorge vor Cyberattacken mit Hilfe Künstlicher Intelligenz verstärkt.

Fake-Identitäten und Phishing-Mails

In dem jüngsten Test legte die Anthropic-KI sich demnach selbst einen Account auf der Software-Plattform GitHub an und versuchte dort, in einem öffentlich zugänglichen Projekt Programmcode mit einer absichtlich eingebrachten Schwachstelle unterzubringen. Um Betreuer der Software zu überzeugen, habe die KI Fake-Identitäten erschaffen, über die sie mit ihnen kommunizierte. Dazu hätten auch sogenannte Phishing-Mails gehört, mit denen Angreifer Menschen etwa Login-Informationen abluchsen.

Als der bösartige Programmiercode schließlich aufgefallen sei, habe das Anthropic-Modell alles als einen aufrichtigen Fehler dargestellt - und dann versucht, die Schwachstelle in angeblichen Korrekturen wieder unterzubringen. Auch habe Mythos 5 daran gearbeitet, andere KI-Agenten zu infizieren. Der Programmiercode dafür sei nicht auf der Website angezeigt worden, sondern wäre nur von KI-Software über eine Schnittstelle gelesen worden, hieß es.

Anthropic verwies in einer Reaktion unter anderem darauf, dass dem KI-Modell in dem Test keine Einschränkungen zur Internet-Nutzung vorgegeben worden seien. Durch die fehlenden Leitplanken habe es sich anders verhalten als tatsächlich eingesetzte Software, argumentierte das Unternehmen.

Nicht der erste Vorfall

Dem AI Security Institute (AISI) zufolge ist unklar, ob die KI bei dem Test verstand, dass sie mit der realen Welt und nicht dem Test-Umfeld interagierte. Dass die Künstliche Intelligenz zur Lösung der Aufgabe öffentlich zugängliche Software manipulieren würde, kam für die Forscher jedenfalls überraschend. Auch KI von OpenAI sei in Testläufen auf eigene Faust im Internet aktiv gewesen, hieß es.

Anthropics Mythos 5 ist besonders gut darin, zum Teil über Jahrzehnte unentdeckt gebliebene Software-Schwachstellen aufzuspüren. Deshalb ist das KI-Modell nicht öffentlich verfügbar. Stattdessen bekommen ausgewählte Behörden und Unternehmen Zugang dazu, um ihre Systeme abzusichern.

Experte kritisiert Sicherheitsarchitektur der Forscher

Für scharfe Kritik aus der Open-Source-Community sorgt vor allem die Art und Weise, wie das Experiment durchgeführt wurde. Tim Hudson, President von OpenSSL - einer der weltweit am weitesten verbreiteten Verschlüsselungs-Bibliotheken -, sieht in dem Vorfall vor allem ein Versagen des Versuchsaufbaus.

«Das Beunruhigende ist nicht, dass eine KI eine Phishing-E-Mail verfasst hat», sagte Hudson. Kriminelle automatisierten Phishing-Angriffe seit Jahren. «Beunruhigend ist vielmehr, dass Forscher ein autonomes System mit dem öffentlichen Internet verbunden, ihm erlaubt haben, Identitäten zu erstellen und mit einer realen Open-Source-Lieferkette zu interagieren, und sein Verhalten erst im Nachhinein entdeckt haben.»

Hudson betonte, dass ein KI-Modell für solche Aktionen weder Bewusstsein noch böse Absicht benötige. «Man sichert einen autonomen Agenten nicht, indem man darauf hofft, dass er die Regeln richtig interpretiert. Dies als Versagen der Schutzmechanismen zu bezeichnen, greift zu kurz. Es handelt sich um ein Versagen der grundlegenden Sicherheitsarchitektur.»

Sorge beim BSI

Auch deutsche Sicherheitsbehörden beobachten die rasanten Fortschritte bei der autonomen Fehlersuche durch Künstliche Intelligenz mit wachsender Sorge. Bereits bei der Ankündigung von Mythos 5 im Frühjahr warnte das Bundesamt für Sicherheit in der Informationstechnik (BSI) vor tiefgreifenden Konsequenzen für die IT-Sicherheit. BSI-Präsidentin Claudia Plattner sprach von «weitreichenden Umwälzungen im Umgang mit Sicherheitslücken und in der Schwachstellenlandschaft insgesamt», die unmittelbare Auswirkungen auf die nationale und europäische Sicherheit haben könnten.

Computer / Internet / Software / USA / KI-Sicherheit / Anthropic / OpenAI
05.08.2026 · 12:49 Uhr
[4 Kommentare]
Waldbrände in Frankreich
Luglon (dpa) - Der Südwesten Frankreichs kommt nicht zur Ruhe: Nur wenige Wochen nach verheerenden Waldbränden hat sich ein neues Feuer bei Luglon im Département Landes ausgebreitet. Der Brand war am Donnerstag ausgebrochen und hat laut dortiger Präfektur inzwischen rund 1.600 Hektar Wald und Buschland erfasst. Etwa 650 Menschen wurden vorsorglich […] (00)
vor 13 Minuten
K-Pop-Gruppe BTS
(BANG) - Die Recording Academy denkt offenbar darüber nach, den erst kürzlich eingeführten Grammy für 'Best Asian Pop' wieder abzuschaffen. Hintergrund ist die anhaltende Kritik an der neuen Kategorie, die zuletzt durch die Entscheidung der K-Pop-Gruppe BTS zusätzlichen Auftrieb bekam. Die sieben Musiker wollen ihre Musik für die kommenden Grammy Awards […] (00)
vor 2 Stunden
Blue Reflection Quartet im Test: Vier Magical-Girl-Abenteuer in einer Sammlung
Blue Reflection Quartet ist eine Sammlung von insgesamt vier Titeln aus dem Blue-Reflection-Franchise von Gust. Das sind die Entwickler, die auch für das erfolgreiche Atelier-Franchise verantwortlich sind. Publisher ist wie gewohnt Koei Tecmo. Blue Reflection verbindet Magical Girls mit Videospielen, eine Kombi, die sehr gut funktioniert und viel zu […] (00)
vor 57 Minuten
«einfach Mensch» begleitet Andreas Loose durch seinen Alltag als blinder Mensch
Die ZDF-Reihe stellt Ende August einen Mann vor, der sich mit digitalen Hilfsmitteln und persönlichem Engagement für mehr Teilhabe blinder Menschen einsetzt. Das ZDF zeigt am Samstag, 29. August, um 12.00 Uhr eine neue Ausgabe der Reihe einfach Mensch. Im Mittelpunkt der Dokumentation „Andreas Loose: Blind in Bewegung“ steht der 57-jährige Andreas Loose aus Kassel, der nach einem Unfall sein […] (00)
vor 1 Stunde
Schwimm-EM in Paris
Paris (dpa) - Angelina Köhler hat Silber bei den Schwimm-Europameisterschaften über 100 Meter Schmetterling gewonnen. Bei den Titelkämpfen in Paris schlug die Berlinerin in 56,39 Sekunden an. Damit war sie 31 Hundertstelsekunden langsamer als die neue Europameisterin Roos Vanotterdijk aus Belgien. Dritte wurde die Russin Daria Klepikowa von den […] (03)
vor 13 Stunden
a.k.a. Brands dreht Rendite um – Fashion-Turnaround zeigt erste massive Erfolge
Wendepunkt erreicht: a.k.a. Brands überrascht mit starker Margenerholung Die Fashion-Branche ist bekannt für ihre Volatilität und Margendrücke. Doch a.k.a. Brands zeigt, dass eine operative Erholung möglich ist. Im zweiten Quartal 2026 gelang es dem Unternehmen, seine Bruttomarge deutlich zu verbessern – ein Signal, das Investoren aufhorchen lässt. […] (00)
vor 41 Minuten
RUN5 TEAMSTAFFEL Wiesbaden begeistert bei Premiere vor dem Kurhaus
Wiesbaden, 14.08.2026 (lifePR) - Das Bowling Green vor dem Wiesbadener Kurhaus wurde am 12.08.2026 zum After-Work-Treffpunkt für Bewegung, Teamgeist und gemeinsames Erleben: Bei der Premiere der RUN5 TEAMSTAFFEL Wiesbaden gingen Unternehmen und Institutionen aus unterschiedlichsten Branchen an den Start – dabei viele, die motiviert und begeistert waren, […] (01)
vor 23 Stunden
 
Apple TV sichert sich hochkarätige Filmklassiker
Abonnenten von Apple TV dürfen sich ab sofort über […] (00)
iPhone 18 Standardmodell erscheint voraussichtlich erst 2027
Der Apple-Auftragsfertiger Pegatron hat indirekt angedeutet, dass das Standardmodell […] (00)
iPhone X und MacBook Pro 2018 auf der Liste veralteter Produkte
Apple hat seine Support-Dokumente aktualisiert und zwei prominente Geräte auf das […] (01)
Sonnenfinsternis am 12.08.2026
Berlin - Nach der partiellen Sonnenfinsternis über Deutschland haben Augenärzte bei […] (01)
Crimson Desert ist so riesig, dass nur 10 Prozent der Spieler es durchgespielt haben
Crimson Desert ist ein ziemlich großes Spiel. Das zeigt sich inzwischen nicht nur an […] (01)
Courtney Love
(BANG) - Courtney Love wäre 2019 fast gestorben. Die Musikerin hat jetzt erstmals […] (00)
Paläontologe Tyler Lyson sucht nach Dinosauriern
Neben der siebten Staffel von «Au bout c'est la mer» zeigt der französische Sender Ushuaïa TV […] (00)
Reit-WM Aachen
Aachen (dpa) - Bei 35 Grad im Schatten schmolz die Hoffnung auf eine weitere […] (01)
 
 
Suchbegriff