← Alle KI-Modelle
DeepSeek deepseek.com

DeepSeek V4.1 Flash

MIT-lizenziert, 1 Mio. Kontext, Bildverstehen - und auf Agenten-Benchmarks vor dem eigenen V4 Pro.

Rang 9 von 22 Open Weights Veröffentlicht 10. September 2026 deepseek-flash
83,3 von 100
  • Denkleistung 7,8
  • Programmieren 8,4
  • Agentik 8,2
  • Tempo 8,5
  • Preis-Leistung 9,9

Gewichtung: Denkleistung 30 % · Programmieren 25 % · Agentik 25 % · Tempo 10 % · Preis-Leistung 10 %

Kontextfenster 1 Mio. Tokens Eingabe
Maximale Ausgabe 384K Tokens
Eingabe je 1 Mio. 0,30 $ Tokens
Ausgabe je 1 Mio. 1,20 $ Tokens
Aus dem Cache 0,01 $ je 1 Mio. Tokens

Zum Preis: Offizielle DeepSeek-API zu Stoßzeiten (Mo-Fr 01:00-04:00 und 06:00-10:00 UTC); außerhalb die Hälfte (0,15 $ / 0,60 $). Open Weights unter MIT-Lizenz: auch selbst hostbar.

Worum es geht

V4.1 Flash ist DeepSeeks Antwort auf die Frage, wie viel Modell man für 0,30 $ je Million Tokens bekommt: 552 Mrd. Parameter in einer neuen Encoder-Decoder-Architektur, von denen beim Lesen nur 8 Mrd. und beim Schreiben 16 Mrd. aktiv sind. Der Speicherbedarf pro Token liegt bei rund einem Viertel des Vorgängers V4 Flash - deshalb reicht das Kontextfenster jetzt bis 1 Mio. Tokens.

Das Bildverstehen, bei V4 Flash noch eine experimentelle Nebenvariante, ist fest eingebaut. Auf Terminal-Bench 2.1 liegt das Modell mit 90,6 Punkten knapp vor Claude Opus 5, und DeepSeek selbst lässt es seit dem 14. September in der eigenen App an Stelle des größeren V4 Pro laufen.

Die MIT-Lizenz ist der freieste Rahmen im Feld - kommerzielle Nutzung ohne Auflagen, auch in eigenen Produkten. Wer die offizielle API nutzt, zahlt werktags in den Stoßzeiten das Doppelte des Nachttarifs; wer selbst hostet, braucht für 552 Mrd. Parameter trotz der geringen Aktivierung ernsthafte Hardware.

Neu in dieser Version

Gegenüber dem Vorgänger DeepSeek V4 Flash:

  1. Encoder-Decoder-Architektur

    Eingabe und Ausgabe laufen über getrennte Pfade mit 8 bzw. 16 Mrd. aktiven Parametern. Der KV-Cache schrumpft auf etwa ein Viertel von V4 Flash, der SSD-Bedarf auf rund ein Achtel.

  2. Kontext von 256K auf 1 Mio. Tokens

    Erstmals das volle Millionen-Fenster bei DeepSeek - zum selben Preis wie kurze Anfragen.

  3. Bildverstehen fest eingebaut

    Die Vision-Fähigkeit der experimentellen August-Variante ist jetzt Teil des Hauptmodells; die alten IDs deepseek-v4-flash und deepseek-v4-flash-vision-exp werden darauf umgeleitet.

  4. Preissenkung

    Ausgabe-Tokens kosten 1,20 $ statt 3,96 $ je Million zu Stoßzeiten - etwa 70 % weniger als V4 Pro.

Stärken und Schwächen

Dafür spricht

  • MIT-Lizenz ohne Nutzungsauflagen
  • Bildverstehen und 1 Mio. Kontext in der günstigsten Preisklasse
  • Auf Terminal-Bench 2.1 (90,6) vor Claude Opus 5 und vor dem eigenen V4 Pro
  • Ausgabepreis rund 70 % unter V4 Pro

Das schränkt ein

  • Nur wenige Tage alt - unabhängige Nachmessungen stehen noch aus
  • Zeitabhängige API-Preise: zu Stoßzeiten das Doppelte
  • Selbsthosten erfordert trotz sparsamer Aktivierung viel Speicher (552 Mrd. Parameter)

Benchmarks

BenchmarkErgebnisEinordnung
Terminal-Bench 2.1 90,6 Claude Opus 5: 89,1
GPQA Diamond 90,9 % Angabe von DeepSeek
Codeforces 3471 Rating, Angabe von DeepSeek

Benchmark-Werte stammen von den Anbietern oder unabhängigen Auswertungen und sind untereinander nur bedingt vergleichbar.