Modellspezifikation · 2026-08-30

Gemini 3.5 Flash-Lite
Standard $0.30 / $2.50

Stand 2026-08-30 nennt die offizielle Preistabelle Standard $0.30 Input / $2.50 Output pro Million Tokens (Output inklusive Thinking). Stabile ID gemini-3.5-flash-lite, 1,048,576 Input, 65,536 Output. QCode bietet die Gemini-Serie derzeit nicht an.

Aktualisiert 2026-10-08

Ein API-Key für Claude, GPT und chinesische Modelle, Bezahlung pro Token.

#gemini-3.5-flash-lite#$0.30 / $2.50#1,048,576#Hoher Durchsatz

Kernpunkte

$0.30 / $2.50

Standardpreis / 1M Tokens

Offiziell Standard: $0.30 Input (Text/Bild/Video/Audio), $2.50 Output inklusive Thinking. Gegenüber 3.5 Flash mit $1.50 / $9.00 ist der Input etwa 5× günstiger.

1,048,576

Input-Limit

Input token limit laut offizieller Modelltabelle, identisch mit 3.5 Flash.

65,536

Output-Limit

Output token limit laut offizieller Modelltabelle. Einige Übersichtsseiten runden auf 64,000; diese Seite verwendet 65,536 aus der Modelltabelle.

2026-07

Letzte Aktualisierung der Modellseite

Latest update der offiziellen Modellseite: Juli 2026. Versionen: Stable gemini-3.5-flash-lite.

Was 3.5 Flash-Lite ist

Google beschreibt ein latenzarmes, kosteneffizientes multimodales Flash-Modell für Sub-Agents mit hohem Durchsatz, Dokumentenanalyse und einfache Extraktion. Eingaben: Text, Bild, Video, Audio, PDF. Ausgabe: Text. Die Fähigkeitentabelle ähnelt 3.5 Flash: Caching, Code Execution, Function Calling, Search Grounding, Thinking. Computer Use ist Preview. Keine Audiogenerierung, keine Bildgenerierung, keine Live API.

Wonach weiterhin gesucht wird

Lite-Suchanfragen sind Abrechnungsfragen, keine Launch-News. 3.5 Flash Standard kostet $1.50 / $9.00; Lite kostet $0.30 / $2.50. Verwechseln Sie die ID nicht mit gemini-3.1-flash-lite – das ist eine andere, günstigere Flash-Lite-Linie ($0.25 Text-/Bild-/Video-Input). Diese Seite behandelt nur 3.5 Flash-Lite.

Zeitachse

2026-07

Latest update der Modellseite: Juli 2026. Stabile ID gemini-3.5-flash-lite.

Preistabelle

Am 2026-08-30 weiterhin gelistet: Standard $0.30 / $2.50. Batch / Flex $0.15 / $1.25. Priority $0.54 / $4.50.

2026-08-30

Dieser Abruf der Modellseite und der Preistabelle. Die Einführungspreise von 3.6 / 3.7 gehören zu einer anderen Flash-SKU – übertragen Sie sie nicht auf Lite.

Bestätigt vs. Stolperfallen

Bestätigt

Stabile ID gemini-3.5-flash-lite; 1,048,576 / 65,536; Standard $0.30 / $2.50. Quellen: offizielle Modellseite und Preise, abgerufen am 2026-08-30.

Stolperfallen

Schreiben Sie 3.5 Flash-Lite nicht als 3.1 Flash-Lite. Bei den Fenstergrößen gilt die Modelltabelle mit 65,536, nicht Übersichtsseiten, die 64,000 angeben. QCode bietet die Gemini-Serie derzeit nicht an.

Lite vs. 3.5 Flash

3.5 Flash-Lite (diese Seite)

Hoher Durchsatz, niedrigerer Preis, Sub-Agents oder Extraktion. Kalkulieren Sie mit $0.30 / $2.50.

3.5 Flash

Wenn Sie mehr Reasoning-Tiefe benötigen, nutzen Sie gemini-3.5-flash zum Standardpreis von $1.50 / $9.00. Der Input kostet etwa das 5-Fache des Lite-Tarifs.

So rufen Sie es auf

Setzen Sie bei Gemini API / AI Studio / Vertex model=gemini-3.5-flash-lite. Die Fähigkeiten entnehmen Sie der Modellseite. Behandeln Sie Computer Use als Preview. Tauschen Sie die 3.1-ID nicht einfach aus.

Auf QCode

QCode bietet die Gemini-Serie derzeit nicht an. Bitte nutzen Sie Claude, GPT oder chinesische Modelle (z. B. claude-sonnet-5-5, gpt-6.1-sol, glm-5.3). Für Googles eigenen Weg nutzen Sie die Gemini API.

FAQ

Wie lautet die Modell-ID?

gemini-3.5-flash-lite. Die offizielle Modellseite kennzeichnet sie als Stable.

Was berechnet Google aktuell?

Standard: $0.30 Input / $2.50 Output pro Million Tokens, Output inklusive Thinking. Batch / Flex $0.15 / $1.25. Priority $0.54 / $4.50. Abgerufen am 2026-08-30.

Wie viel günstiger als 3.5 Flash?

3.5 Flash Standard kostet $1.50 / $9.00. Lite-Input kostet etwa ein Fünftel; Output $2.50 statt $9.00.

Sind es 64k oder 65,536 Fenstergröße?

Die Modelltabelle nennt Output token limit 65,536. Einige Übersichtsseiten sagen 64,000. Diese Seite folgt der Modelltabelle.

Kann es Bilder oder Audio generieren?

Nein. Als Eingabe sind Bild, Video, Audio und PDF möglich; die Ausgabe ist Text. Bildgenerierung, Audiogenerierung und die Live API werden nicht unterstützt.

Kann ich es über QCode aufrufen?

Nein. QCode bietet die Gemini-Serie derzeit nicht an. Bitte nutzen Sie Claude, GPT oder chinesische Modelle (z. B. claude-sonnet-5-5, gpt-6.1-sol, glm-5.3).

Quellen

ai.google.dev-Modellseite /gemini-api/docs/models/gemini-3.5-flash-lite (Last updated 2026-07-30 UTC); Preise unter /gemini-api/docs/pricing, Abschnitt Gemini 3.5 Flash-Lite. Die Preise für 3.5 Flash stammen von derselben Preisseite. Abgerufen am 2026-08-30.

Zuerst den offiziellen Preis von Lite lesen

Die Spezifikationen von 3.5 Flash-Lite folgen der Dokumentation von Google. QCode bietet die Gemini-Serie derzeit nicht an; nutzen Sie Claude, GPT oder chinesische Modelle.

Verwandt

Nicht mit Google / DeepMind verbunden. Preise und Kontextfenster folgen ai.google.dev. QCode bietet die Gemini-Serie derzeit nicht an.

Erst testen, dann entscheiden

Unsicher bei der Tarifwahl? Beginnen Sie mit Starter ($8.57/Monat) und wechseln Sie auf einen höheren Tarif, wenn Sie zufrieden sind — der ungenutzte Wert des alten Tarifs geht auf Ihr Guthaben zurück.