Gemini 3.5 Flash-Lite
Standard $0.30 / $2.50
Stand 2026-08-30 nennt die offizielle Preistabelle Standard $0.30 Input / $2.50 Output pro Million Tokens (Output inklusive Thinking). Stabile ID gemini-3.5-flash-lite, 1,048,576 Input, 65,536 Output. QCode bietet die Gemini-Serie derzeit nicht an.
Aktualisiert 2026-10-08
Ein API-Key für Claude, GPT und chinesische Modelle, Bezahlung pro Token.
- Bezahlung pro Token — aktuelle Preise unter /models
- Zahlung per Karte (Visa / Mastercard / AMEX), Apple Pay, Google Pay oder Krypto
- Selbstbedienung: aufladen und sofort aktivieren
Kernpunkte
Standardpreis / 1M Tokens
Offiziell Standard: $0.30 Input (Text/Bild/Video/Audio), $2.50 Output inklusive Thinking. Gegenüber 3.5 Flash mit $1.50 / $9.00 ist der Input etwa 5× günstiger.
Input-Limit
Input token limit laut offizieller Modelltabelle, identisch mit 3.5 Flash.
Output-Limit
Output token limit laut offizieller Modelltabelle. Einige Übersichtsseiten runden auf 64,000; diese Seite verwendet 65,536 aus der Modelltabelle.
Letzte Aktualisierung der Modellseite
Latest update der offiziellen Modellseite: Juli 2026. Versionen: Stable gemini-3.5-flash-lite.
Was 3.5 Flash-Lite ist
Google beschreibt ein latenzarmes, kosteneffizientes multimodales Flash-Modell für Sub-Agents mit hohem Durchsatz, Dokumentenanalyse und einfache Extraktion. Eingaben: Text, Bild, Video, Audio, PDF. Ausgabe: Text. Die Fähigkeitentabelle ähnelt 3.5 Flash: Caching, Code Execution, Function Calling, Search Grounding, Thinking. Computer Use ist Preview. Keine Audiogenerierung, keine Bildgenerierung, keine Live API.
Wonach weiterhin gesucht wird
Lite-Suchanfragen sind Abrechnungsfragen, keine Launch-News. 3.5 Flash Standard kostet $1.50 / $9.00; Lite kostet $0.30 / $2.50. Verwechseln Sie die ID nicht mit gemini-3.1-flash-lite – das ist eine andere, günstigere Flash-Lite-Linie ($0.25 Text-/Bild-/Video-Input). Diese Seite behandelt nur 3.5 Flash-Lite.
Zeitachse
Latest update der Modellseite: Juli 2026. Stabile ID gemini-3.5-flash-lite.
Am 2026-08-30 weiterhin gelistet: Standard $0.30 / $2.50. Batch / Flex $0.15 / $1.25. Priority $0.54 / $4.50.
Dieser Abruf der Modellseite und der Preistabelle. Die Einführungspreise von 3.6 / 3.7 gehören zu einer anderen Flash-SKU – übertragen Sie sie nicht auf Lite.
Bestätigt vs. Stolperfallen
Bestätigt
Stabile ID gemini-3.5-flash-lite; 1,048,576 / 65,536; Standard $0.30 / $2.50. Quellen: offizielle Modellseite und Preise, abgerufen am 2026-08-30.
Stolperfallen
Schreiben Sie 3.5 Flash-Lite nicht als 3.1 Flash-Lite. Bei den Fenstergrößen gilt die Modelltabelle mit 65,536, nicht Übersichtsseiten, die 64,000 angeben. QCode bietet die Gemini-Serie derzeit nicht an.
Lite vs. 3.5 Flash
3.5 Flash-Lite (diese Seite)
Hoher Durchsatz, niedrigerer Preis, Sub-Agents oder Extraktion. Kalkulieren Sie mit $0.30 / $2.50.
3.5 Flash
Wenn Sie mehr Reasoning-Tiefe benötigen, nutzen Sie gemini-3.5-flash zum Standardpreis von $1.50 / $9.00. Der Input kostet etwa das 5-Fache des Lite-Tarifs.
So rufen Sie es auf
Setzen Sie bei Gemini API / AI Studio / Vertex model=gemini-3.5-flash-lite. Die Fähigkeiten entnehmen Sie der Modellseite. Behandeln Sie Computer Use als Preview. Tauschen Sie die 3.1-ID nicht einfach aus.
Auf QCode
QCode bietet die Gemini-Serie derzeit nicht an. Bitte nutzen Sie Claude, GPT oder chinesische Modelle (z. B. claude-sonnet-5-5, gpt-6.1-sol, glm-5.3). Für Googles eigenen Weg nutzen Sie die Gemini API.
FAQ
Wie lautet die Modell-ID?
gemini-3.5-flash-lite. Die offizielle Modellseite kennzeichnet sie als Stable.
Was berechnet Google aktuell?
Standard: $0.30 Input / $2.50 Output pro Million Tokens, Output inklusive Thinking. Batch / Flex $0.15 / $1.25. Priority $0.54 / $4.50. Abgerufen am 2026-08-30.
Wie viel günstiger als 3.5 Flash?
3.5 Flash Standard kostet $1.50 / $9.00. Lite-Input kostet etwa ein Fünftel; Output $2.50 statt $9.00.
Sind es 64k oder 65,536 Fenstergröße?
Die Modelltabelle nennt Output token limit 65,536. Einige Übersichtsseiten sagen 64,000. Diese Seite folgt der Modelltabelle.
Kann es Bilder oder Audio generieren?
Nein. Als Eingabe sind Bild, Video, Audio und PDF möglich; die Ausgabe ist Text. Bildgenerierung, Audiogenerierung und die Live API werden nicht unterstützt.
Kann ich es über QCode aufrufen?
Nein. QCode bietet die Gemini-Serie derzeit nicht an. Bitte nutzen Sie Claude, GPT oder chinesische Modelle (z. B. claude-sonnet-5-5, gpt-6.1-sol, glm-5.3).
Quellen
ai.google.dev-Modellseite /gemini-api/docs/models/gemini-3.5-flash-lite (Last updated 2026-07-30 UTC); Preise unter /gemini-api/docs/pricing, Abschnitt Gemini 3.5 Flash-Lite. Die Preise für 3.5 Flash stammen von derselben Preisseite. Abgerufen am 2026-08-30.
Zuerst den offiziellen Preis von Lite lesen
Die Spezifikationen von 3.5 Flash-Lite folgen der Dokumentation von Google. QCode bietet die Gemini-Serie derzeit nicht an; nutzen Sie Claude, GPT oder chinesische Modelle.
Verwandt
Gemini 3.5 Flash Leitfaden
Das Flash-Modell ohne Lite aus derselben Generation, $1.50 / $9.00.
Gemini 3.6 Flash Leitfaden
Eine neuere Flash-SKU.
Gemini 3.7 Flash Preise
So lesen Sie Einführungspreise.
Nicht mit Google / DeepMind verbunden. Preise und Kontextfenster folgen ai.google.dev. QCode bietet die Gemini-Serie derzeit nicht an.