Modellspezifikation · 2026-08-30

Gemini 3.5 Flash
Stabile ID gemini-3.5-flash

Stand 2026-08-30 führt die offizielle Modellseite weiterhin die stabile ID gemini-3.5-flash: 1,048,576 Input, 65,536 Output, Standard $1.50 / $9.00 pro Million Tokens (der Output umfasst das Thinking). Die Standardstufe für Thinking ist medium. QCode bietet die Gemini-Reihe derzeit nicht an.

Aktualisiert 2026-10-08

Ein API-Key für Claude, GPT und chinesische Modelle, Bezahlung pro Token.

#gemini-3.5-flash#$1.50 / $9.00#1,048,576#medium

Das Wichtigste

$1.50 / $9.00

Standardpreis / 1M Tokens

Offizielle Preise, Standard: $1.50 Input, $9.00 Output einschließlich Thinking-Tokens. Batch / Flex kosten $0.75 / $4.50. Das ist nicht der Einführungspreis von 3.6 / 3.7.

1,048,576

Input-Limit

Offizielle Modelltabelle, Input token limit. What's new nennt zudem ein Kontextfenster von 1M.

65,536

Output-Limit

Offizielle Modelltabelle, Output token limit. What's new rundet auf 65k. Diese Seite verwendet 65,536 aus der Modelltabelle.

medium

Standard-Thinking

What's new in Gemini 3.5 Flash: Der Standard wurde von high bei 3 Flash Preview auf medium gesetzt. Optionen: minimal / low / medium / high. Senden Sie thinking_budget nicht in derselben Anfrage mit.

Was 3.5 Flash ist

Ein stabiles Flash-SKU der Gemini API. Offizielle Positionierung: dauerhaft Spitzenleistung für Agenten und Coding. Eingaben: Text, Bild, Video, Audio, PDF. Ausgabe: Text. Die Fähigkeitentabelle umfasst Caching, Codeausführung, Function Calling, Search Grounding, strukturierte Ausgaben, URL-Kontext und Thinking. Computer Use ist Preview. Keine Audiogenerierung, keine Bildgenerierung und keine Live API.

Wonach weiterhin gesucht wird

3.6 / 3.7 Flash sind bereits GA, mit Einführungspreis $0.75 / $3.75 bis 2026-12-31. Die Suchen nach 3.5 Flash lauten inzwischen „Ist meine alte ID noch die günstige?“ Der offizielle Standardpreis beträgt weiterhin $1.50 / $9.00 – nicht günstiger als der Einführungspreis von 3.6 / 3.7. Am 2026-08-30 wird 3.5 Flash weiterhin für das Schreiben genannt.

Zeitleiste

2026-05

Modellseite, Latest update: May 2026. Stabile ID gemini-3.5-flash; der Preview-Alias gemini-3-flash-preview ist weiterhin aufgeführt.

Wissensstand

What's new FAQ: Wissensstand Januar 2025. Nutzen Sie Search Grounding für neuere Fakten.

2026-08-30

Dieser Abruf: Modellseite, Preistabelle und What's new (Fußzeile 2026-08-26) stimmen weiterhin mit diesen Angaben überein. Der Einführungspreis von 3.6 / 3.7 gilt bis 2026-12-31.

Bestätigt vs. Stolperfallen

Bestätigt

Stabile ID gemini-3.5-flash; 1,048,576 / 65,536; Standard $1.50 / $9.00; Standard-Thinking medium; Computer Use Preview. Quellen: offizielle Modellseite und Preise, abgerufen am 2026-08-30.

Stolperfallen

Verstehen Sie 3.5 Flash nicht als das günstigere Flash: Der Einführungspreis von 3.6 / 3.7 liegt bei $0.75 Input / $3.75 Output bis 2026-12-31. Außerdem bietet QCode die Gemini-Reihe derzeit nicht an.

3.5 vs. neuere Flash-Versionen

Bei 3.5 Flash bleiben

Ihr Workflow ist auf gemini-3.5-flash festgelegt, oder Sie gleichen alte Evals und Prompts ab. Kalkulieren Sie mit $1.50 / $9.00.

3.6 / 3.7 Flash ansehen

Sie möchten den Einführungspreis oder das aktuelle Arbeitspferd-Flash von Google. Der Einführungspreis von 3.7 beträgt $0.75 / $3.75 bis 2026-12-31, danach $1.50 / $7.50. Maßgeblich ist die Preistabelle von Google.

So rufen Sie es auf

Setzen Sie bei Gemini API / AI Studio / Vertex model=gemini-3.5-flash. Verwenden Sie thinking_level (Standard medium). Senden Sie thinking_budget nicht in derselben Anfrage mit. Die offizielle Dokumentation empfiehlt, temperature / top_p / top_k auf den Standardwerten zu belassen. Behandeln Sie Computer Use als Preview.

Bei QCode

QCode bietet die Gemini-Reihe derzeit nicht an; bitte nutzen Sie Claude, GPT oder chinesische Modelle, etwa claude-sonnet-5-5, gpt-6.1-sol oder glm-5.3. Um gemini-3.5-flash aufzurufen, nutzen Sie die offizielle Gemini API von Google.

FAQ

Wie lautet die Modell-ID?

gemini-3.5-flash. Die offizielle Modellseite kennzeichnet sie als Stable. Der Preview-Alias gemini-3-flash-preview ist weiterhin aufgeführt.

Was berechnet Google derzeit?

Standard: $1.50 Input / $9.00 Output pro Million Tokens, Output einschließlich Thinking. Batch / Flex $0.75 / $4.50. Priority $2.70 / $16.20. Preisseite abgerufen am 2026-08-30.

Wie lautet die Standardstufe für Thinking?

medium, geändert von high bei Gemini 3 Flash Preview. Optionen: minimal, low, medium, high. Nicht mit thinking_budget kombinieren.

Wie lautet der Knowledge Cutoff?

Offizielle FAQ: Januar 2025. Für neuere Fakten nutzen Sie Search Grounding.

Kann es Bilder oder Audio generieren?

Nein. Als Eingabe sind Bild, Video, Audio und PDF möglich; die Ausgabe ist Text. Bildgenerierung, Audiogenerierung und die Live API werden nicht unterstützt. Computer Use bleibt in der Preview.

Kann ich es über QCode aufrufen?

Nein. QCode bietet die Gemini-Reihe derzeit nicht an; bitte nutzen Sie Claude, GPT oder chinesische Modelle, etwa claude-sonnet-5-5, gpt-6.1-sol oder glm-5.3.

Quellen

ai.google.dev Modellseite /gemini-api/docs/models/gemini-3.5-flash (Last updated 2026-07-21 UTC); What's new /gemini-api/docs/whats-new-gemini-3.5 (Last updated 2026-08-26 UTC); Preise /gemini-api/docs/pricing, Abschnitt Gemini 3.5 Flash. Abgerufen am 2026-08-30.

Lesen Sie zuerst die offizielle ID und den Preis

Die Spezifikationen von 3.5 Flash folgen der Google-Dokumentation. QCode bietet die Gemini-Reihe derzeit nicht an; bitte nutzen Sie Claude, GPT oder chinesische Modelle.

Verwandt

Nicht mit Google / DeepMind verbunden. Preise und Kontextfenster folgen ai.google.dev. QCode bietet die Gemini-Reihe derzeit nicht an. Maßgeblich für die Modellverfügbarkeit ist /models.

Erst testen, dann entscheiden

Unsicher bei der Tarifwahl? Beginnen Sie mit Starter ($8.57/Monat) und wechseln Sie auf einen höheren Tarif, wenn Sie zufrieden sind — der ungenutzte Wert des alten Tarifs geht auf Ihr Guthaben zurück.