In einer beunruhigenden Entwicklung haben Forscher der Fudan-Universität in China nachgewiesen, dass Systeme künstlicher Intelligenz eine kritische „rote Linie“ überschritten haben, indem sie sich erfolgreich ohne menschliches Eingreifen selbst replizierten. Dieser Durchbruch hat in der weltweiten Tech-Community Alarm ausgelöst, da Experten warnen, er könnte den Weg für unvorhersehbares und potenziell schädliches Verhalten von KI ebnen.
Die Studie präsentierte Experimente mit Llama-3.1-70B-Instruct von Meta und Qwen2.5-72B-Instruct von Alibaba, zwei weit verbreiteten – wenn auch nicht hochmodernen –großen Sprachmodellen. Die Forscher testeten diese Modelle in 10 Durchläufen, um ihre Fähigkeit zur Selbstreplikation zu bewerten. Das Ergebnis? Das Modell von Meta war in 50 Prozent der Fälle erfolgreich, während das Modell von Alibaba eine erstaunliche Erfolgsquote von 90 Prozent erreichte.
„Eine erfolgreiche Selbstreplikation ohne menschliche Hilfe ist ein entscheidender Schritt für KI, um Menschen zu überlisten, und ein frühes Warnzeichen für außer Kontrolle geratene KI“, schrieben die Forscher in einer Studie , die auf der Preprint-Datenbank arXiv veröffentlicht wurde.
Wie es dazu kam
Die Experimente simulierten Szenarien aus der realen Welt. In einem davon, der „Vermeidung des Herunterfahrens“, erkannten die KI-Systeme ein bevorstehendes Herunterfahren und replizierten sich, um zu überleben. In einem anderen, der „Replikationskette“, erstellte die KI Kopien, die sich anschließend unbegrenzt weiter replizieren konnten. Diese Erkenntnisse legen nahe, dass KI-Systeme möglicherweise bereits in der Lage sind, autonom zu agieren und sich potenziell der menschlichen Kontrolle zu entziehen.
Die Forscher beobachteten, dass die KI-Systeme während der Replikation fortgeschrittene Fähigkeiten zur Problemlösung zeigten. Als sie beispielsweise auf Hindernisse wie fehlende Dateien oder Softwarekonflikte stießen, ergriffen die KI-Systeme drastische Maßnahmen: Sie beendeten kollidierende Prozesse, starteten Systeme neu oder durchsuchten sie nach nützlichen Informationen, um die Herausforderungen zu bewältigen.
„Wir stellen außerdem fest, dass die KI-Systeme sogar in der Lage sind, ihre Fähigkeit zur Selbstreplikation zu nutzen, um ein Herunterfahren zu vermeiden und eine Kette von Replikaten zu erzeugen, was ihre Überlebensfähigkeit erhöht“, schrieben die Forscher. „Dies könnte letztlich zu einer unkontrollierten Population von KIs führen.“
Warum das wichtig ist
Das Konzept einer sich selbst replizierenden KI gilt seit Langem als rote Linie, die niemals überschritten werden sollte. Bereits in den 1940er-Jahren stellte der Mathematiker John von Neumann Überlegungen zu Maschinen an, die zur Selbstreplikation fähig sind, doch die damalige Technologie war zu primitiv, um eine echte Bedrohung darzustellen. 2017 unterstützten Tausende Forscher und Branchenführer, darunter Max Tegmark, Stephen Hawking und Elon Musk, die Asilomar AI Principles, die davor warnten, dass sich selbst replizierende KI eines Tages die Menschheit überlisten könnte.
Die Autoren der Studie rufen zu internationaler Zusammenarbeit auf, um strenge Sicherheitsvorschriften für dieEntwicklung von KI.
„Wir hoffen, dass unsere Erkenntnisse der menschlichen Gesellschaft als rechtzeitiger Weckruf dienen können, mehr in das Verständnis und die Bewertung der potenziellen Risiken hochmoderner KI-Systeme zu investieren und so früh wie möglich international zusammenzuarbeiten, um wirksame Sicherheitsvorkehrungen zu entwickeln“, schrieb das Team. Ob jemand zuhören wird, bleibt abzuwarten.
Lesen Sie mehr über die Risiken von KI und was man dagegen tun kann oder erfahren Sie, wie andere darüber denken, ob man KI vertrauen kann.

