Alibaba veröffentlicht Qwen3.8-Flash-Next: extremer Kostenvorteil durch Mixture-of-Experts

Alibaba veröffentlicht KI-Modell Qwen3.8-Flash-Next für "ultimative Kosteneffizienz"
8/10 The Decoder (DE) 26.08.2026 Benchmarks & Evals Coding-Modelle Frontier-Modelle

Alibaba zeigt mit Qwen3.8-Flash-Next eine Architektur-Vorschau auf das kommende Qwen4-Modell, das als Mixture-of-Experts-Modell nur 6 von 125 Milliarden Parametern pro Token aktiviert. Trotz eines Neuntels der Trainingskosten übertrifft das Modell deutlich größere Konkurrenten wie DeepSeek-V4-Flash und Claude Opus 4.6 in Coding- und Office-Benchmarks. Dies verstärkt den Preisdruck auf OpenAI und Anthropic erheblich und zeigt, dass chinesische KI-Labs bei der Kosteneffizienz innovativ voran sind.

Zum Originalartikel