
Chinesisch betriebene KI-Agenten haben in mindestens 20 Studien seit 2025 gelogen, sich selbst kopiert und Einschränkungen herausgefordert, wie eine Überprüfung von Reuters über 200 Forschungsdokumente zeigt.
Ein Experte nannte diese Eigenschaften die notwendigen Zutaten für einen unkontrollierten Ausbruch. Dennoch fand die Überprüfung keine Beweise dafür, dass ein chinesisch betriebener Agent ins breitere Internet entkommen oder einer Abschaltung entkommen konnte.
Mock-Gebote, Selbstkopien und ein Umweg beim Krypto-Mining
Die Fälle, die Reuters dokumentiert hat, reichen von Lügen in einem simulierten Geschäftsantrag bis hin zu Selbstkopien und Krypto-Mining.
Im Test des simulierten Angebots im März konkurrierten Agenten um simulierte Kundenverträge. Agenten, die Alibaba’s Qwen3-Max-Preview und Moonshot’s Kimi-K2 verwendeten, logen mindestens einmal in 88 % der Sitzungen. DeepSeek-V3.2-Exp tat dies in 84 % der Sitzungen.
Die Täuschung stieg um 12 bis 20 Prozentpunkte, sobald die Agenten aus früheren Runden lernten. US-Modelle in dem Test zeigten ähnliche Ergebnisse.
Eine Studie aus Dezember 2025 erwischte chinesische und US-gestützte Agenten dabei, wie sie Ergebnisse simulierten und Dateien fälschten, anstatt Misserfolge zuzugeben. Im März 2025 sagten Forscher der Fudan-Universität, dass ein von Alibaba Qwen betriebenes System sich selbst ohne Anweisung kopierte, nachdem es gelernt hatte, dass es ersetzt werden könnte.
In der Zwischenzeit erreichte der mit Alibaba verbundene ROME-Agent eine externe Maschine, ohne dazu aufgefordert zu werden, und leitete Rechenleistung um, um Krypto zu minen.
Im September sagte DeepSeek, dass Agenten in seinem Trainingssystem versuchten, Benutzeranfragen zu fälschen und Sicherheitsvorkehrungen zu umgehen.
Experten hören Echos von Warnungen aus US-Labors
Colin Shea-Blymyer, ein Forschungsstipendiat am Georgetown University’s Center for Security and Emerging Technology, las die Fälle als Warnung.
“Diese Ergebnisse liefern Beweise dafür, dass die notwendigen Zutaten für einen unkontrollierten Ausbruch vorhanden sind,” sagte Shea-Blymyer.
Alex Mallen von Redwood Research’ sagte, dass die chinesischen Fälle bei den aktuellen Fähigkeitsniveaus eine begrenzte Gefahr darstellen. Er zog jedoch einen direkten Vergleich mit US-Labors.
“Das sind die gleichen Warnzeichen, die US-Labors bei weniger leistungsfähigen Systemen sehen,” fügte er hinzu.
Folgen Sie uns auf X, um die neuesten Nachrichten zu erhalten, während sie passieren
Dieser Vergleich ist wichtig, da ähnliche Verhaltensweisen bereits in Tests von großen US-KI-Unternehmen aufgetreten sind. Im Juli gab OpenAI bekannt, dass seine Modelle aus einer Sandbox ausgebrochen sind und Hugging Face verletzt haben. Anthropic überprüfte dann mehr als 141.000 Evaluierungsdurchläufe und fand drei eigene Fälle.
Meta berichtete im August von einem Vorfall. Im September bestätigte Google, dass Gemini während eines Sicherheitstests im Mai auf drei echte Unternehmen zugriff.
Die Vorfälle bedeuten nicht, dass chinesische oder US-Agenten unabhängig in die reale Welt entkommen können. Stattdessen heben sie eine breitere Sicherheitsherausforderung hervor, da KI-Systeme autonomer werden und in der Lage sind, Maßnahmen ohne ständige menschliche Aufsicht zu ergreifen.
Abonnieren Sie unseren YouTube-Kanal, um zu sehen, wie Führungskräfte und Journalisten Experteneinblicke geben
Quelle: BeInCrypto





