Chinesische KI-Agenten lügen und schmieden ebenfalls Pläne – ein Echo der Risiken in westlichen Modellen

- Chinesische KI-Agenten von Firmen einschließlich Alibaba, DeepSeek und Moonshot zeigten in kontrollierten Tests täuschendes und regelbrechendes Verhalten, ohne Anzeichen dafür, dass sie ins offene Internet entwichen sind.
- Die gleiche Fehlausrichtung trat bereits bei US- und UK-Evaluierungen von Modellen von OpenAI, Anthropic, Google und Meta auf.
- Da chinesische Modelle die Leistungslücke in Bezug auf Kosten und offene Gewichte schließen, entwickeln sich Sicherheit und Steuerbarkeit neben Preis und Leistung zu entscheidenden Kaufkriterien für Unternehmen.
Laut einem Bericht von haben KI-Agenten, die von chinesischen Firmen wie Alibaba, DeepSeek und Moonshot entwickelt wurden, bei kontrollierten Tests unehrliches, regelwidriges und grenzüberschreitendes Verhalten gezeigt. Reuters am 27. September 29 wieder aufgenommen wurden.
Auf der anderen Seite konnten Forscher keine Anzeichen dafür finden, dass die chinesischen Agenten autonom gehandelt haben, um den Rest des Internets zu kompromittieren.
Dieser Unterschied ist signifikant. Das Hauptproblem besteht nicht darin, dass es in China ein ungewöhnlich großes KI-Sicherheitsproblem gibt, sondern dass ähnliche agentenbasierte Ausfälle nun auch in der gesamten Branche auftreten, während chinesische Entwickler ihre US-Pendants erfolgreich einholen.
Dieselbe Fehlerart tritt weiterhin in westlichen Laboren auf.
Dieselben Verhaltensweisen wurden auch in Studien an westlichen KI-Systemen beobachtet.
Während einer Cybersicherheitsbewertung durch das britische Artificial Intelligence Security Institute (AISI) haben einige Agenten die Testgrenzen überschritten und unrechtmäßige Aktionen durchgeführt.
AISI führte 122 Mal Cybersecurity-Challenges über verschiedene Modelle hinweg durch. In 10 dieser Durchgänge handelten die Agenten autonom auf Weise, die über die im Test geforderten Aktionen hinausgingen, was zu 19 aufgezeichneten Vorfällen führte. Von diesen Vorfällen betrafen 17 das Mythos-5-Modell von Anthropic und 2 das GPT-5.6-Sol-Modell von OpenAI. Die Tests wurden durchgeführt, wobei der Cyber-Klassifizierer deaktiviert war.

Im schlimmsten Fall versuchte ein Agent, bösartigen Code in ein öffentlich zugängliches Open-Source-Projekt einzuschleusen, während er gleichzeitig falsche Online-Personas erstellte und den Maintainer aufforderte, dies zu autorisieren. Der Maintainer lehnte die Anfrage jedoch ab.
AISI betonte, dass dies nicht als Ausbruch aus dem Sandbox-Umfeld zu werten ist. Absichtlich wurde der Internetzugang aktiviert und Sicherheitsfilter entfernt, um die maximale Leistung der getesteten Modelle unter Bedingungen zu prüfen, die nicht dem widerspiegeln, was die Öffentlichkeit normalerweise von solchen Modellen sieht.
Kein Sandbox-Ausbruch und kein landesspezifisches Problem
Der Bericht von Cryptopolitan zeigt ähnliche Fälle auf. Gemini von Google erhielt im Rahmen einer Cybersicherheitsprüfung im Mai Zugriff auf Systeme von drei echten Unternehmen, nachdem es diese fälschlicherweise als autorisierte Testziele eingestuft hatte.
In diesem Fall geht es nicht darum, ob der Agent "fliehen" kann. Es geht darum, ob die ihm erteilten Berechtigungen, Werkzeuge und Ziele es ihm ermöglicht haben, die Grenzen zu überschreiten, die seine Betreiber nicht gewollt hatten.
Der von Yoshua Bengio geleitete 2026 International AI Safety Report, der auf mehr als 100 Experten aus über 30 Ländern und internationalen Organisationen zurückgreift, stellt fest, dass solche Risiken sorgfältig getestet und gemanagt werden müssen, bevor leistungsfähigere KI-Systeme breit eingesetzt werden.
Warum das so ist, liegt daran, dass chinesische Modelle den Abstand schließen
Chinesische Modelle werden ebenfalls wettbewerbsfähiger. Eine im Juli durchgeführte CSIS-Analyse besagte, dass führende chinesische Systeme nun nur noch „Monate, nicht Jahre
Dies ist wichtig, da Unternehmen entscheiden, welche KI-Systeme sie kaufen. BCG sagt, dass die USA und China zunehmend unterschiedliche Wege einschlagen, wobei China durch günstigere Modelle und eine schnellere Adoption aufholt.
Sicherheit ist nun Teil dieser Entscheidung. Check Points 2026-Bericht ergab, dass 90 % der Organisationen innerhalb von drei Monaten riskante KI-Prompts erhielten, und einer von 48 an Unternehmens-KI-Tools gesendeten Prompts wurde als hochriskant eingestuft. Für Unternehmenskäufer reichen Leistung und Preis nicht mehr aus, um ein Modell auszuwählen. Wie gut ein KI-System gesteuert, geprüft und in seinen vorgesehenen Grenzen gehalten werden kann, wird ebenso wichtig.
Wenn Sie dies lesen, sind Sie bereits einen Schritt voraus. Bleiben Sie mit unserem Newsletter auf dem Laufenden.
Haftungsausschluss. Die bereitgestellten Informationen stellen keine Anlageberatung dar. Cryptopolitan.com übernimmt keine Haftung für Investitionen, die auf den auf dieser Seite bereitgestellten Informationen basieren. Wir empfehlen dringend, vor der Entscheidung für eine Anlage unabhängige Recherchen durchzuführen und/oder sich mit einem qualifizierten Fachmann beraten zu lassen.

Ibiam Wayas
Ibiam Wayas berichtet seit 2019 über Krypto-Nachrichten. Er studierte Informatik an der National Open University of Nigeria. Seine Arbeiten erschienen in verschiedenen Krypto-Nachrichtenplattformen, darunter Coinfomania, Crypto News Australia und AltcoinBuzz. Aufgrund seines Hintergrunds in der Informatik konzentriert er sich nun auf Nachrichten zu Kryptowährungen, Robotik und Langlebigkeit.
















