Moonshot präsentiert mit Kimi K3 eines der stärksten quelloffenen Sprachmodelle, dessen Benchmark-Leistung etablierten Frontier-Modellen beeindruckend nahekommt. Unabhängige Tests deuten jedoch auf erhebliche praktische Schwächen hin: K3 scheitert bei Zuverlässigkeit, arbeitet langsam und ist kostspielig im Betrieb. Der Testbericht hinterfragt kritisch die Diskrepanz zwischen Benchmark-Zahlen und realer Anwendbarkeit und ordnet die Bedeutung des Modells für die Open-Source-Landschaft, KI-Sicherheit und den technologischen Wettbewerb zwischen USA und China ein.