US-Modelle überholen chinesisches KI-Modell Kimi K3 in Cybersicherheits-Tests
Eine gemeinsame Studie des britischen Instituts UK AISI und des US-Zentrums CAISI zeigt, dass das chinesische KI-Modell Kimi K3 in Cybersicherheits-Tests mit einer Erfolgsquote von 32,2 Prozent deutlich hinter führenden US-Modellen mit 76,2 Prozent zurückbleibt. Obwohl Kimi K3 autonome Angriffe auf schwach verteidigte Systeme durchführen kann, scheitert es bei komplexen Aufgaben und der vollständigen Codeausführung, während US-Modelle ihre Führungsrolle in diesem Bereich bewahrt haben.

Kurzfassung
Warum das wichtig ist
- Eine gemeinsame Studie des britischen Instituts UK AISI und des US-Zentrums CAISI zeigt, dass das chinesische KI-Modell Kimi K3 in Cybersicherheits-Tests mit einer Erfolgsquote von 32,2 Prozent deutlich hinter führenden US-Modellen mit 76,2 Prozent zurückbleibt.
- Obwohl Kimi K3 autonome Angriffe auf schwach verteidigte Systeme durchführen kann, scheitert es bei komplexen Aufgaben und der vollständigen Codeausführung, während US-Modelle ihre Führungsrolle in diesem Bereich bewahrt haben.
- Sicherheitsprüfungen im Bereich der Cybersicherheit: USA und China stehen sich gegenüber Eine gemeinsame Cybersicherheitsbewertung, die vom britischen Institut für Künstliche-Intelligenz-Sicherheit (UK AISI) und dem US-Zentrum für KI-Standards und Innovation (CAISI) durchgeführt wurde, zeigt, dass das AI entwickelte Modell Kimi K3 bei der Fähigkeit, Cyberangriffe durchzuführen, hinter amerikanischen Modellen zurückbleibt.
SvyTech-Check
Redaktionelle Einordnung
Kernpunkt
Obwohl Kimi K3 autonome Angriffe auf schwach verteidigte Systeme durchführen kann, scheitert es bei komplexen Aufgaben und der vollständigen Codeausführung, während US-Modelle ihre Führungsrolle in diesem...
Warum relevant
ExploitBench-Tests und Misserfolge beim Code-Ausführen Im Rahmen der Bewertung wurden die Modelle auf der ExploitBench-Plattform getestet, die entwickelt wurde und die Fähigkeiten zur Erstellung...
Einordnung
SvyTech ordnet die Meldung aus interestingengineering.com als Teil des Themenfelds Technologie ein und verweist auf den Originalartikel, damit Leser Fakten, Quelle und Kontext nachvollziehen koennen.
Als eines der leistungsfähigsten großen Sprachmodelle Chinas gilt Kimi K3; in den durchgeführten Tests erzielte es im Bereich der Cybersicherheitsfähigkeiten einen Wert von 32,2 Prozent, während führende US-Modelle durchschnittlich eine Erfolgsquote von 76,2 Prozent verzeichneten.
ExploitBench-Tests und Misserfolge beim Code-Ausführen Im Rahmen der Bewertung wurden die Modelle auf der ExploitBench-Plattform getestet, die entwickelt wurde und die Fähigkeiten zur Erstellung Software-Schwachstellen misst.
In Tests zu 41 verschiedenen, nach 2023 im Chrome-V8-Browsermotor entdeckten echten Sicherheitslücken belegte das chinesische KI-Modell Kimi K3 mit einer Erfolgsquote von 32,2 Prozent den zweiten chinesischen Open-Source-Modell GLM-5.2 (32,4 Prozent) übertrifft.
Technik und Auswirkungen
Dennoch gelang es Kimi K3 in keiner der 41 Aufgaben, die Phase der zufälligen Codeausführung (ACE) zu erreichen, die eine vollständige Kontrolle des Zielsystems ermöglicht. Im Gegensatz dazu gelang es führenden US-Modellen, in denselben Tests die vollständige Ausführung eines durchschnittlichen Codes über 20 Aufgaben zu bewältigen.
Quellenprofil
Quelle und redaktionelle Angaben
- Quelle
- interestingengineering.com
- Originaltitel
- Siber Güvenlik Testlerinde ABD Modelleri Çinli Kimi K3'ü Geride Bıraktı
- Canonical
- https://svytech.de/artikel/us-modelle-uberholen-chinesisches-ki-modell-kimi-k3-in-cybersicherheits-tests
- Quell-URL
- https://interestingengineering.com/ai-robotics/us-models-beat-chinas-kimi-k3
Aehnliche Inhalte
Verwandte Themen und interne Verlinkung
Weitere Artikel aus aehnlichen Themenfeldern, damit Leser direkt im selben Kontext weiterlesen koennen.

US Army testet KI-System COA-GPT zur Beschleunigung von Entscheidungen im Einsatzgebiet
Die US-Armee hat im Rahmen des Manövers Project Convergence Capstone 6 in Kalifornien die KI-gestützte Planungsplattform COA-GPT getestet, die darauf abzielt, Entscheidungszeiten durch die Integration 4-Modellen und militärischer Expertise verkürzen. Das vom Army Research Laboratory entwickelte System soll menschliche Kommandeure nicht ersetzen, sondern durch eine intuitive grafische Schnittstelle und die Generierung alternativer Pläne in Echtzeit unterstützen, wobei die Architektur für zukünftige Erweiterungen und die Optimierung der Mensch-KI-Zusammenarbeit konzipiert wurde.
25.07.2026


