DeepSeek V4 Flash 0731
Historischer Eintrag: DeepSeek hat diese Version am 2026-09-10 eingestellt
Öffentliche Beta-API am 2026-07-31. Die Modell-ID bleibt deepseek-v4-flash. Die Agent-Benchmarks sprangen nach oben; V4-Pro und die App blieben an diesem Tag unverändert.
Aktualisiert 2026-09-20
Ein API-Key für Claude, GPT und chinesische Modelle, Bezahlung pro Token.
- Bezahlung pro Token — aktuelle Preise unter /models
- Zahlung per Karte (Visa / Mastercard / AMEX), Apple Pay, Google Pay oder Krypto
- Selbstbedienung: aufladen und sofort aktivieren
Highlights
Gleicher API-Name
Die bestehende Flash-ID auf 0731 zeigen lassen. Keine Umbenennung im Client.
Kontext / max. Output
Offizielle Preisseite. Thinking-Effort: low / high / max.
Cache-Miss / Output
Cache-Treffer $0.0028. Spitzen-/Nebenzeit ab 2026-08-16 16:00 UTC.
Terminal Bench 2.1
Offiziell: Harness Minimal + max. DeepSWE 54.4 (Preview lag bei 7.3).
Was 0731 tatsächlich ist
Diese Seite hält fest, was DeepSeek damals offiziell zum Flash-Post-Training vom 2026-07-31 sagte: gleiche Flash-Struktur und -Größe, neu gemachtes Post-Training; HF nennt etwa 304B (in der Community wird oft 284B/13B aktive MoE als Kurzform genannt); MIT-Gewichte; der Checkpoint enthält DSpark Speculative Decoding. Am 2026-09-10 veröffentlichte DeepSeek V4.1-Flash und stellte den API-Namen deepseek-v4-flash ein – diese Anfragen werden von DeepSeek-V4.1-Flash bedient und zum Flash-Preis abgerechnet. Dies ist also ein historischer Vergleich, nicht die aktuelle Version.
Warum sich die Stimmung über Nacht drehte
Berichterstattung und offizielle Benchmarks von damals (2026-07-31): Das Preview-Flash wirkte mittelmäßig, die AA-Werte von 0731 näherten sich der Frontier vom März 2026 an (etwa 50–52) und machten es zum Volumenführer bei OpenCode; LocalLLaMA nannte es „fünf Monate alte Frontier, die Sie zu Hause betreiben können“. All das ist die Erzählung zu 0731, keine aktuelle Verfügbarkeit – die aktuelle Flash-Stufe ist V4.1-Flash seit dem 2026-09-10.
Zeitachse
2026-04-24 V4-Pro / V4-Flash kamen in die API (Preview).
2026-07-31 öffentliche Beta von Flash 0731. Changelog: nur Flash, nennt die Responses API und Codex.
2026-09-10 DeepSeek veröffentlichte V4.1-Flash; deepseek-v4-flash wurde eingestellt und an DeepSeek-V4.1-Flash weitergeleitet, abgerechnet zum Flash-Preis (Preis-Fußnote (1)).
Bestätigte Fakten vs. Angaben, die Sie mit Vorsicht behandeln sollten
Bestätigt
Die obigen Benchmarks sind die damaligen eigenen Angaben von 0731; 1M/384K; MIT; drei Effort-Stufen; native Responses API; die Evaluation lief in DeepSeek Harness Minimal. Die DeepSeek-Release-Notiz vom 2026-09-10 und die Preis-Fußnote bestätigen, dass deepseek-v4-flash und deepseek-v4-flash-vision-exp eingestellt wurden, von DeepSeek-V4.1-Flash bedient und zum Flash-Preis abgerechnet werden.
Angaben, die Sie mit Vorsicht behandeln sollten
AA 52 gegenüber 55 bei Sonnet 5 ist eine unabhängige Bewertung, kein offizielles „wir schlagen Sonnet“. Die „196GB“ im Blog sind kein Datenblatt. Und „0731 ist nach wie vor das heutige Flash“ stimmt ebenfalls nicht: DeepSeek hat es am 2026-09-10 eingestellt.
Schnellvergleich
vs. Claude Sonnet 5
AA 52 vs. 55. Kosten/Aufgabe ca. $0.06 vs. $1.54. Flash ist schneller und offen. Sonnet gewinnt bei Instruktions-Stack und Claude-Code-Standards.
vs. V4-Pro 0813
0731 schlug Preview Pro. Nach dem 13.08. ist 0813 das Flaggschiff (TB2.1 87.9, DeepSWE 62.7). Flash bleibt die günstige Standardspur.
So rufen Sie es auf
Offiziell: api.deepseek.com, Modell deepseek-v4-flash. Dazu ein Anthropic-kompatibler Pfad sowie Responses-/Codex-Dokumentation. Lokal: HF deepseek-ai/DeepSeek-V4-Flash-0731 mit vLLM/SGLang-DSpark-Flags. OpenCode Go/Free listen ebenfalls Flash.
Bei QCode
Bauen Sie nicht auf der Version 0731 auf: DeepSeek hat den Namen deepseek-v4-flash eingestellt, und Anfragen damit werden von DeepSeek-V4.1-Flash zum Flash-Preis bedient. Setzen Sie für neue Integrationen deepseek-v4.1-flash ein, wie in /models von QCode aufgeführt; für den Pro-Tarif deepseek-v4-pro. Diese Seite trifft keine Aussage zur Verfügbarkeit von 0731.
FAQ zu Flash 0731
Ist 0731 ein neues Modell?
Gleiche Flash-Struktur mit neuem Post-Training, und der API-Name blieb für das Release vom 2026-07-31 unverändert. Seit dem 2026-09-10 hat DeepSeek deepseek-v4-flash jedoch eingestellt und leitet es an V4.1-Flash weiter; das beschreibt also nur 0731 zum damaligen Zeitpunkt.
Kann ich es lokal betreiben?
Ja, MIT-Gewichte. Die volle Größe braucht viel Unified Memory oder mehrere GPUs; Laptops mit 16 GB brauchen eine Quantisierung statt des vollständigen Checkpoints.
Ist es besser als Sonnet 5?
Bei der AA-Intelligenz leicht zurück (52 vs. 55). Bei Preis und Geschwindigkeit weit voraus. Wählen Sie nach Stack, nicht nach Trophäe.
Macht die Preisgestaltung ab dem 16.08. das Angebot zunichte?
Der Output zur Spitzenzeit kostet $1.32; außerhalb der Spitzenzeit $0.66. Immer noch deutlich unter dem Bereich von $10/$15 bei Sonnet 5.
Warum sind die offiziellen Benchmarks so viel höher als mein Claude-Code-Lauf?
Verwendet wurden Harness Minimal + max. Ein anderes Harness verändert das Ergebnis.
Flash oder Pro?
Flash als Standard (Parallelität 2500). Schwere Agent-Aufgaben auf Pro 0813 eskalieren (Parallelität 500).
Quellen
DeepSeek-Changelog, die Release-Notiz news260910 und Models & Pricing (erfasst am 2026-09-18); der offizielle Blog aus der Zeit von 0731 und Bewertungen von Drittanbietern. Einstellung und vorübergehende Weiterleitung beruhen auf der Preis-Fußnote (1).
Flash in einen Multi-Modell-Mix einbinden
Diese Seite ist der historische Eintrag zu 0731. Setzen Sie für neue Integrationen deepseek-v4.1-flash aus /models von QCode ein, oder deepseek-v4-pro für den Pro-Tarif.
Verwandte Themen
Flash vs. Sonnet 5
Vollständiges AA-Scoreboard.
V4-Pro 0813
Das Flaggschiff, das darauf folgte.
DeepSeek Harness
Die offizielle Minimal-Shell hinter den Benchmarks.
Diese Seite bewahrt die offiziellen Benchmarks vom 2026-07-31 und die damaligen Zahlen von Drittanbietern, ohne zu behaupten, dass die Version noch verfügbar ist. Die aktuelle Flash-Stufe ist V4.1-Flash seit dem 2026-09-10; maßgeblich sind die Dokumentation von DeepSeek und /models von QCode.