DeepSeek veröffentlicht V4.1-Flash, ein multimodales Frontier-Modell mit 552 Milliarden Parametern, das den KV-Cache-Speicher auf ein Viertel reduziert und damit die Kosten für KI-Agenten massiv senkt. Trotz nur 16 Milliarden aktiven Parametern pro Token übertrifft das unter MIT-Lizenz freigegebene Modell etablierte Konkurrenten wie Claude Opus 3.5 und GPT-4 Sonnet beim Coding-Benchmark DeepSWE. Die Veröffentlichung verstärkt den Wettbewerb in der Frontier-Model-Liga und könnte Enterprise-Agenten erstmals wirklich wirtschaftlich machen.