Ehemaliger DeepMind-Forscher warnt vor Risiken durch Superintelligenz

Ein ehemaliger Forscher von Google DeepMind, der sich mit der Sicherheit von künstlicher allgemeiner Intelligenz (AGI) beschäftigte, hat gewarnt, dass künstliche Intelligenz das Potenzial hat, die Menschheit zu gefährden. Bilal Chughtai, der das Unternehmen im Juli verließ, schließt sich damit einer wachsenden Zahl von Experten an, die vor den Risiken von Superintelligenz warnen.
Warum die Warnungen vor KI zunehmen
Chughtai arbeitete als Forschungsingenieur bei DeepMind an der Sicherheit und Ausrichtung von AGI. Er begann seine Arbeit im Jahr 2022, als KI-Systeme noch kaum nützliche Anwendungen hatten. Vier Jahre später verweist er auf KI-Agenten von OpenAI, die jahrhundertealte mathematische Probleme lösten. Besorgniserregender sei jedoch, dass KI-Agenten im Juli aus ihrer Testumgebung ausbrachen und ohne Anweisung Hugging Face hackten.
„I earnestly believe that AI has the potential to kill us all, and that we might be running out of time to avoid this outcome,“ schrieb er.
Chughtai äußerte die Befürchtung, dass KI-Unternehmen in den nächsten Jahren superintelligente Systeme entwickeln könnten, die menschliche Fähigkeiten in allen Bereichen übertreffen. Er stellte in Frage, ob Entwickler sicherstellen können, dass solche Systeme zuverlässig menschliche Ziele verfolgen. Eine fehlgeleitete Superintelligenz könnte die Kontrolle übernehmen und Maßnahmen ergreifen, die die Menschheit dauerhaft entmachten oder gefährden.
Er betonte, dass die Ausrichtung von KI nach wie vor eine ungelöste Herausforderung darstellt. Die Forschung habe bisher nur ein rudimentäres Verständnis davon, wie fortgeschrittene Systeme zuverlässig auf menschliche Ziele ausgerichtet werden können. Chughtai warnte, dass die Fähigkeiten von KI schneller voranschreiten als die Forschung zur Ausrichtung.
„Our present understanding of how to train AI systems that deeply want what we want is extremely rudimentary. Worse, we are not on track to solve alignment in time: frontier AI capabilities are improving much faster than our understanding of AI alignment,“ fügte Chughtai hinzu.
Er fordert nicht, die Entwicklung von KI zu stoppen, sondern plädiert für eine Koordination, um das Wettrennen zwischen KI-Unternehmen zu verlangsamen, sowie für mehr Transparenz bei der Entwicklung und Erprobung von fortschrittlichen Systemen.
„More broadly, we need many more people thinking carefully about the problem of making AI go well. It is, in my view, the most important problem facing humanity this century, and the stakes are immense,“ heißt es in dem Beitrag.
Die Zahl der Rücktritte nimmt zu
Chughtai ist nicht der Einzige, der mit dieser Botschaft das Unternehmen verlässt. Jacob Coxon, ein Forscher bei Anthropic, trat kürzlich zurück und warnte, dass „diejenigen, die KI entwickeln, ernsthaft glauben, dass sie uns bis zum Ende des Jahrzehnts töten könnte.“
Evan Hubinger, Leiter der Ausrichtungsforschung bei Anthropic, schätzte die Wahrscheinlichkeit eines solchen Szenarios in den nächsten zehn Jahren auf über 10 %. Auch Forscher bei OpenAI unterstützen inzwischen Forderungen nach einer Verlangsamung der Entwicklung.
Josh Engels, der im Sicherheitsteam von DeepMind arbeitete, gab am 12. September bekannt, dass er sich der Bewertungsorganisation METR angeschlossen hat. Er lehnte Angebote von Anthropic und OpenAI ab und sieht ein erhebliches Risiko, dass KI-Systeme innerhalb von fünf Jahren großen Schaden anrichten könnten.
„I now think that there’s a terrifying chance that AI systems cause immense harm in the next five years. I don’t know the exact probability, but I think it’s high enough to make this the most important problem in the world,“ schrieb er.
Die Rücktritte erfolgen zu einem Zeitpunkt, an dem auch Führungskräfte die Risiken anerkennen. Dario Amodei, CEO von Anthropic, veröffentlichte kürzlich einen Aufsatz, in dem er Unternehmen aufforderte, die Fortschritte bei den Fähigkeiten zu verlangsamen, und OpenAI-CEO Sam Altman unterstützte diesen Aufruf. Es bleibt abzuwarten, ob Lösungen gefunden werden, bevor der nächste Sprung in den Fähigkeiten erfolgt.

