DeepSeek V4.1 Flash
MIT-lizenziert, 1 Mio. Kontext, Bildverstehen - und auf Agenten-Benchmarks vor dem eigenen V4 Pro.
- Denkleistung 7,8
- Programmieren 8,4
- Agentik 8,2
- Tempo 8,5
- Preis-Leistung 9,9
Gewichtung: Denkleistung 30 % · Programmieren 25 % · Agentik 25 % · Tempo 10 % · Preis-Leistung 10 %
Zum Preis: Offizielle DeepSeek-API zu Stoßzeiten (Mo-Fr 01:00-04:00 und 06:00-10:00 UTC); außerhalb die Hälfte (0,15 $ / 0,60 $). Open Weights unter MIT-Lizenz: auch selbst hostbar.
Worum es geht
V4.1 Flash ist DeepSeeks Antwort auf die Frage, wie viel Modell man für 0,30 $ je Million Tokens bekommt: 552 Mrd. Parameter in einer neuen Encoder-Decoder-Architektur, von denen beim Lesen nur 8 Mrd. und beim Schreiben 16 Mrd. aktiv sind. Der Speicherbedarf pro Token liegt bei rund einem Viertel des Vorgängers V4 Flash - deshalb reicht das Kontextfenster jetzt bis 1 Mio. Tokens.
Das Bildverstehen, bei V4 Flash noch eine experimentelle Nebenvariante, ist fest eingebaut. Auf Terminal-Bench 2.1 liegt das Modell mit 90,6 Punkten knapp vor Claude Opus 5, und DeepSeek selbst lässt es seit dem 14. September in der eigenen App an Stelle des größeren V4 Pro laufen.
Die MIT-Lizenz ist der freieste Rahmen im Feld - kommerzielle Nutzung ohne Auflagen, auch in eigenen Produkten. Wer die offizielle API nutzt, zahlt werktags in den Stoßzeiten das Doppelte des Nachttarifs; wer selbst hostet, braucht für 552 Mrd. Parameter trotz der geringen Aktivierung ernsthafte Hardware.
Neu in dieser Version
Gegenüber dem Vorgänger DeepSeek V4 Flash:
-
Encoder-Decoder-Architektur
Eingabe und Ausgabe laufen über getrennte Pfade mit 8 bzw. 16 Mrd. aktiven Parametern. Der KV-Cache schrumpft auf etwa ein Viertel von V4 Flash, der SSD-Bedarf auf rund ein Achtel.
-
Kontext von 256K auf 1 Mio. Tokens
Erstmals das volle Millionen-Fenster bei DeepSeek - zum selben Preis wie kurze Anfragen.
-
Bildverstehen fest eingebaut
Die Vision-Fähigkeit der experimentellen August-Variante ist jetzt Teil des Hauptmodells; die alten IDs deepseek-v4-flash und deepseek-v4-flash-vision-exp werden darauf umgeleitet.
-
Preissenkung
Ausgabe-Tokens kosten 1,20 $ statt 3,96 $ je Million zu Stoßzeiten - etwa 70 % weniger als V4 Pro.
Stärken und Schwächen
Dafür spricht
- MIT-Lizenz ohne Nutzungsauflagen
- Bildverstehen und 1 Mio. Kontext in der günstigsten Preisklasse
- Auf Terminal-Bench 2.1 (90,6) vor Claude Opus 5 und vor dem eigenen V4 Pro
- Ausgabepreis rund 70 % unter V4 Pro
Das schränkt ein
- Nur wenige Tage alt - unabhängige Nachmessungen stehen noch aus
- Zeitabhängige API-Preise: zu Stoßzeiten das Doppelte
- Selbsthosten erfordert trotz sparsamer Aktivierung viel Speicher (552 Mrd. Parameter)
Benchmarks
| Benchmark | Ergebnis | Einordnung |
|---|---|---|
| Terminal-Bench 2.1 | 90,6 | Claude Opus 5: 89,1 |
| GPQA Diamond | 90,9 % | Angabe von DeepSeek |
| Codeforces | 3471 | Rating, Angabe von DeepSeek |
Benchmark-Werte stammen von den Anbietern oder unabhängigen Auswertungen und sind untereinander nur bedingt vergleichbar.