Alibabas Qwen-Audio-3.0-TTS-Plus führt Text-to-Speech-Ranking an

Qwen-Audio-3.0-TTS-Plus von Alibaba schlägt die Konkurrenz im Text-to-Speech-Ranking
6/10 The Decoder (DE) 21.07.2026 Benchmarks & Evals Frontier-Modelle Multimodal

Alibaba präsentiert Qwen-Audio-3.0-TTS-Plus, das in der Speech Arena Leaderboard von Artificial Analysis die Konkurrenzmodelle verdrängt hat. Das Modell besticht durch Unterstützung von 16 Sprachen und innovative Stilsteuerung via natürlicher Sprache oder Tags wie [angry], was emotionale und ausdrucksstarke Sprachausgabe ermöglicht. Ein Trade-off zeigt sich bei der Geschwindigkeit: Mit 16 Zeichen pro Sekunde liegt das Modell deutlich hinter anderen Lösungen zurück. Das Ranking-Ergebnis unterstreicht Chinas Fortschritte bei Sprach-KI und zeigt, dass alternative Frontier-Modelle-Labore innovativ mithalten können.

Zum Originalartikel