Das AI Security Institute und CAISI haben Moonshot AIs Modell Kimi K3 auf Cyber-Fähigkeiten getestet und dabei erhebliche Unterschiede zu US-Spitzenmodellen festgestellt. Während führende US-Modelle auf der ExploitBench 76 Prozent erreichen, schafft Kimi K3 nur 32 Prozent. Besonders interessant: Die Sicherheitsmechanismen des Modells konnten weder die Entwicklung von Exploits noch Angriffssimulationen verhindern. Der Test illustriert sowohl die bestehende Leistungslücke zwischen chinesischen und westlichen KI-Modellen als auch mögliche Sicherheitsrisiken bei der Fähigkeit zur Schadensverursachung.