Moonshots Kimi K3 dominiert Frontend-Code, scheitert aber bei komplexer Mathematik

Moonshots Kimi K3 schlägt Claude und GPT bei Frontend, bleibt bei komplexer Mathematik aber weit zurück
8/10 The Decoder (DE) 19.07.2026 Benchmarks & Evals Coding-Modelle Frontier-Modelle

Moonshots Kimi K3 hat als erstes chinesisches Modell die Spitzenposition in der Frontend-Kodierung erreicht und übertrifft dabei Claude Fable 5 und GPT-5.6 Sol deutlich. Dieser Durchbruch unterstreicht den technologischen Fortschritt chinesischer KI-Laboratorien bei praktischen Entwickleraufgaben. Allerdings offenbaren sich erhebliche Lücken bei komplexer Mathematik: Mit nur 39 Prozent Erfolgsquote im FrontierMath-Benchmark liegt K3 weit hinter westlichen Spitzenmodellen zurück, die fast 90 Prozent erreichen. Das Modell zeigt damit ein differenziertes Stärkenprofil – exzellent bei Frontend-Code, aber mit deutlicher Grenze bei abstrakten mathematischen Problemen.

Zum Originalartikel