← Alle KI-Modelle
Google deepmind.google

Gemini 3.5 Flash-Lite

Googles Einstiegsmodell für sehr hohe Stückzahlen - 0,30 $ je Million bei Millionen-Kontext.

Rang 20 von 21 Proprietär Veröffentlicht 15. April 2026 gemini-3.5-flash-lite
70,6 von 100
  • Denkleistung 6,5
  • Programmieren 6,5
  • Agentik 6,2
  • Tempo 9,5
  • Preis-Leistung 9,8

Gewichtung: Denkleistung 30 % · Programmieren 25 % · Agentik 25 % · Tempo 10 % · Preis-Leistung 10 %

Kontextfenster 1 Mio. Tokens Eingabe
Maximale Ausgabe 32K Tokens
Eingabe je 1 Mio. 0,30 $ Tokens
Ausgabe je 1 Mio. 2,50 $ Tokens
Aus dem Cache 0,03 $ je 1 Mio. Tokens

Worum es geht

Flash-Lite ist die günstigste aktuelle Stufe mit ordentlicher Qualität. Es richtet sich an Anwendungen, bei denen der Preis pro Anfrage der entscheidende Faktor ist und die Aufgaben einfach genug bleiben: Kategorisieren, Extrahieren, kurze Antworten.

Wie alle Gemini-Modelle hat es das volle 1-Mio.-Kontextfenster - ungewöhnlich für diese Preisklasse.

Neu in dieser Version

Gegenüber dem Vorgänger Gemini 2.5 Flash-Lite:

  1. Deutlich besseres Reasoning

    Schließt einen guten Teil der Lücke zur Flash-Linie, bleibt aber im Einstiegssegment.

  2. Werkzeugnutzung

    Funktionsaufrufe sind in dieser Preisklasse neu - macht das Modell als Vorfilter in Agentenketten brauchbar.

Stärken und Schwächen

Dafür spricht

  • Sehr günstig bei vollem Millionen-Kontext
  • Hoher Durchsatz, niedrige Latenz

Das schränkt ein

  • Schwach bei Reasoning und Coding
  • Ausgabepreis mit 2,50 $ vergleichsweise hoch für die Klasse