Gemini 3.5 Flash
Stabile ID gemini-3.5-flash
Stand 2026-08-30 führt die offizielle Modellseite weiterhin die stabile ID gemini-3.5-flash: 1,048,576 Input, 65,536 Output, Standard $1.50 / $9.00 pro Million Tokens (der Output umfasst das Thinking). Die Standardstufe für Thinking ist medium. QCode bietet die Gemini-Reihe derzeit nicht an.
Aktualisiert 2026-10-08
Ein API-Key für Claude, GPT und chinesische Modelle, Bezahlung pro Token.
- Bezahlung pro Token — aktuelle Preise unter /models
- Zahlung per Karte (Visa / Mastercard / AMEX), Apple Pay, Google Pay oder Krypto
- Selbstbedienung: aufladen und sofort aktivieren
Das Wichtigste
Standardpreis / 1M Tokens
Offizielle Preise, Standard: $1.50 Input, $9.00 Output einschließlich Thinking-Tokens. Batch / Flex kosten $0.75 / $4.50. Das ist nicht der Einführungspreis von 3.6 / 3.7.
Input-Limit
Offizielle Modelltabelle, Input token limit. What's new nennt zudem ein Kontextfenster von 1M.
Output-Limit
Offizielle Modelltabelle, Output token limit. What's new rundet auf 65k. Diese Seite verwendet 65,536 aus der Modelltabelle.
Standard-Thinking
What's new in Gemini 3.5 Flash: Der Standard wurde von high bei 3 Flash Preview auf medium gesetzt. Optionen: minimal / low / medium / high. Senden Sie thinking_budget nicht in derselben Anfrage mit.
Was 3.5 Flash ist
Ein stabiles Flash-SKU der Gemini API. Offizielle Positionierung: dauerhaft Spitzenleistung für Agenten und Coding. Eingaben: Text, Bild, Video, Audio, PDF. Ausgabe: Text. Die Fähigkeitentabelle umfasst Caching, Codeausführung, Function Calling, Search Grounding, strukturierte Ausgaben, URL-Kontext und Thinking. Computer Use ist Preview. Keine Audiogenerierung, keine Bildgenerierung und keine Live API.
Wonach weiterhin gesucht wird
3.6 / 3.7 Flash sind bereits GA, mit Einführungspreis $0.75 / $3.75 bis 2026-12-31. Die Suchen nach 3.5 Flash lauten inzwischen „Ist meine alte ID noch die günstige?“ Der offizielle Standardpreis beträgt weiterhin $1.50 / $9.00 – nicht günstiger als der Einführungspreis von 3.6 / 3.7. Am 2026-08-30 wird 3.5 Flash weiterhin für das Schreiben genannt.
Zeitleiste
Modellseite, Latest update: May 2026. Stabile ID gemini-3.5-flash; der Preview-Alias gemini-3-flash-preview ist weiterhin aufgeführt.
What's new FAQ: Wissensstand Januar 2025. Nutzen Sie Search Grounding für neuere Fakten.
Dieser Abruf: Modellseite, Preistabelle und What's new (Fußzeile 2026-08-26) stimmen weiterhin mit diesen Angaben überein. Der Einführungspreis von 3.6 / 3.7 gilt bis 2026-12-31.
Bestätigt vs. Stolperfallen
Bestätigt
Stabile ID gemini-3.5-flash; 1,048,576 / 65,536; Standard $1.50 / $9.00; Standard-Thinking medium; Computer Use Preview. Quellen: offizielle Modellseite und Preise, abgerufen am 2026-08-30.
Stolperfallen
Verstehen Sie 3.5 Flash nicht als das günstigere Flash: Der Einführungspreis von 3.6 / 3.7 liegt bei $0.75 Input / $3.75 Output bis 2026-12-31. Außerdem bietet QCode die Gemini-Reihe derzeit nicht an.
3.5 vs. neuere Flash-Versionen
Bei 3.5 Flash bleiben
Ihr Workflow ist auf gemini-3.5-flash festgelegt, oder Sie gleichen alte Evals und Prompts ab. Kalkulieren Sie mit $1.50 / $9.00.
3.6 / 3.7 Flash ansehen
Sie möchten den Einführungspreis oder das aktuelle Arbeitspferd-Flash von Google. Der Einführungspreis von 3.7 beträgt $0.75 / $3.75 bis 2026-12-31, danach $1.50 / $7.50. Maßgeblich ist die Preistabelle von Google.
So rufen Sie es auf
Setzen Sie bei Gemini API / AI Studio / Vertex model=gemini-3.5-flash. Verwenden Sie thinking_level (Standard medium). Senden Sie thinking_budget nicht in derselben Anfrage mit. Die offizielle Dokumentation empfiehlt, temperature / top_p / top_k auf den Standardwerten zu belassen. Behandeln Sie Computer Use als Preview.
Bei QCode
QCode bietet die Gemini-Reihe derzeit nicht an; bitte nutzen Sie Claude, GPT oder chinesische Modelle, etwa claude-sonnet-5-5, gpt-6.1-sol oder glm-5.3. Um gemini-3.5-flash aufzurufen, nutzen Sie die offizielle Gemini API von Google.
FAQ
Wie lautet die Modell-ID?
gemini-3.5-flash. Die offizielle Modellseite kennzeichnet sie als Stable. Der Preview-Alias gemini-3-flash-preview ist weiterhin aufgeführt.
Was berechnet Google derzeit?
Standard: $1.50 Input / $9.00 Output pro Million Tokens, Output einschließlich Thinking. Batch / Flex $0.75 / $4.50. Priority $2.70 / $16.20. Preisseite abgerufen am 2026-08-30.
Wie lautet die Standardstufe für Thinking?
medium, geändert von high bei Gemini 3 Flash Preview. Optionen: minimal, low, medium, high. Nicht mit thinking_budget kombinieren.
Wie lautet der Knowledge Cutoff?
Offizielle FAQ: Januar 2025. Für neuere Fakten nutzen Sie Search Grounding.
Kann es Bilder oder Audio generieren?
Nein. Als Eingabe sind Bild, Video, Audio und PDF möglich; die Ausgabe ist Text. Bildgenerierung, Audiogenerierung und die Live API werden nicht unterstützt. Computer Use bleibt in der Preview.
Kann ich es über QCode aufrufen?
Nein. QCode bietet die Gemini-Reihe derzeit nicht an; bitte nutzen Sie Claude, GPT oder chinesische Modelle, etwa claude-sonnet-5-5, gpt-6.1-sol oder glm-5.3.
Quellen
ai.google.dev Modellseite /gemini-api/docs/models/gemini-3.5-flash (Last updated 2026-07-21 UTC); What's new /gemini-api/docs/whats-new-gemini-3.5 (Last updated 2026-08-26 UTC); Preise /gemini-api/docs/pricing, Abschnitt Gemini 3.5 Flash. Abgerufen am 2026-08-30.
Lesen Sie zuerst die offizielle ID und den Preis
Die Spezifikationen von 3.5 Flash folgen der Google-Dokumentation. QCode bietet die Gemini-Reihe derzeit nicht an; bitte nutzen Sie Claude, GPT oder chinesische Modelle.
Verwandt
Gemini 3.5 Pro Guide
Pro-Seite derselben Generation auf dieser Website.
Gemini 3.6 Flash Guide
Die nächste Flash-SKU und die Einführungspreise.
Gemini 3.7 Flash Guide
Googles aktuelles Flash-Arbeitspferd.
Nicht mit Google / DeepMind verbunden. Preise und Kontextfenster folgen ai.google.dev. QCode bietet die Gemini-Reihe derzeit nicht an. Maßgeblich für die Modellverfügbarkeit ist /models.