DeepSeek V4.1-Flash: Chinesisches Frontier-Modell halbiert KI-Agenten-Kosten

Neues Deepseek-Modell V4.1-Flash senkt Speicherbedarf für KI-Agenten

DeepSeek veröffentlicht V4.1-Flash, ein multimodales Frontier-Modell mit 552 Milliarden Parametern, das den KV-Cache-Speicher auf ein Viertel reduziert und damit die Kosten für KI-Agenten massiv senkt. Trotz nur 16 Milliarden aktiven Parametern pro Token übertrifft das unter MIT-Lizenz freigegebene Modell etablierte Konkurrenten wie Claude Opus 3.5 und GPT-4 Sonnet beim Coding-Benchmark DeepSWE. Die Veröffentlichung verstärkt den Wettbewerb in der Frontier-Model-Liga und könnte Enterprise-Agenten erstmals wirklich wirtschaftlich machen.

Zum Originalartikel