Historischer Eintrag · Build vom 31.07.2026

DeepSeek V4 Flash 0731
Historischer Eintrag: DeepSeek hat diese Version am 2026-09-10 eingestellt

Öffentliche Beta-API am 2026-07-31. Die Modell-ID bleibt deepseek-v4-flash. Die Agent-Benchmarks sprangen nach oben; V4-Pro und die App blieben an diesem Tag unverändert.

Aktualisiert 2026-09-20

Ein API-Key für Claude, GPT und chinesische Modelle, Bezahlung pro Token.

#deepseek-v4-flash#0731#TB2.1 82.7#$0.14 / $0.28

Highlights

deepseek-v4-flash

Gleicher API-Name

Die bestehende Flash-ID auf 0731 zeigen lassen. Keine Umbenennung im Client.

1M / 384K

Kontext / max. Output

Offizielle Preisseite. Thinking-Effort: low / high / max.

$0.14 / $0.28

Cache-Miss / Output

Cache-Treffer $0.0028. Spitzen-/Nebenzeit ab 2026-08-16 16:00 UTC.

82.7

Terminal Bench 2.1

Offiziell: Harness Minimal + max. DeepSWE 54.4 (Preview lag bei 7.3).

Was 0731 tatsächlich ist

Diese Seite hält fest, was DeepSeek damals offiziell zum Flash-Post-Training vom 2026-07-31 sagte: gleiche Flash-Struktur und -Größe, neu gemachtes Post-Training; HF nennt etwa 304B (in der Community wird oft 284B/13B aktive MoE als Kurzform genannt); MIT-Gewichte; der Checkpoint enthält DSpark Speculative Decoding. Am 2026-09-10 veröffentlichte DeepSeek V4.1-Flash und stellte den API-Namen deepseek-v4-flash ein – diese Anfragen werden von DeepSeek-V4.1-Flash bedient und zum Flash-Preis abgerechnet. Dies ist also ein historischer Vergleich, nicht die aktuelle Version.

Warum sich die Stimmung über Nacht drehte

Berichterstattung und offizielle Benchmarks von damals (2026-07-31): Das Preview-Flash wirkte mittelmäßig, die AA-Werte von 0731 näherten sich der Frontier vom März 2026 an (etwa 50–52) und machten es zum Volumenführer bei OpenCode; LocalLLaMA nannte es „fünf Monate alte Frontier, die Sie zu Hause betreiben können“. All das ist die Erzählung zu 0731, keine aktuelle Verfügbarkeit – die aktuelle Flash-Stufe ist V4.1-Flash seit dem 2026-09-10.

Zeitachse

2026-04-24

2026-04-24 V4-Pro / V4-Flash kamen in die API (Preview).

2026-07-31

2026-07-31 öffentliche Beta von Flash 0731. Changelog: nur Flash, nennt die Responses API und Codex.

2026-09-10

2026-09-10 DeepSeek veröffentlichte V4.1-Flash; deepseek-v4-flash wurde eingestellt und an DeepSeek-V4.1-Flash weitergeleitet, abgerechnet zum Flash-Preis (Preis-Fußnote (1)).

Bestätigte Fakten vs. Angaben, die Sie mit Vorsicht behandeln sollten

Bestätigt

Die obigen Benchmarks sind die damaligen eigenen Angaben von 0731; 1M/384K; MIT; drei Effort-Stufen; native Responses API; die Evaluation lief in DeepSeek Harness Minimal. Die DeepSeek-Release-Notiz vom 2026-09-10 und die Preis-Fußnote bestätigen, dass deepseek-v4-flash und deepseek-v4-flash-vision-exp eingestellt wurden, von DeepSeek-V4.1-Flash bedient und zum Flash-Preis abgerechnet werden.

Angaben, die Sie mit Vorsicht behandeln sollten

AA 52 gegenüber 55 bei Sonnet 5 ist eine unabhängige Bewertung, kein offizielles „wir schlagen Sonnet“. Die „196GB“ im Blog sind kein Datenblatt. Und „0731 ist nach wie vor das heutige Flash“ stimmt ebenfalls nicht: DeepSeek hat es am 2026-09-10 eingestellt.

Schnellvergleich

vs. Claude Sonnet 5

AA 52 vs. 55. Kosten/Aufgabe ca. $0.06 vs. $1.54. Flash ist schneller und offen. Sonnet gewinnt bei Instruktions-Stack und Claude-Code-Standards.

vs. V4-Pro 0813

0731 schlug Preview Pro. Nach dem 13.08. ist 0813 das Flaggschiff (TB2.1 87.9, DeepSWE 62.7). Flash bleibt die günstige Standardspur.

So rufen Sie es auf

Offiziell: api.deepseek.com, Modell deepseek-v4-flash. Dazu ein Anthropic-kompatibler Pfad sowie Responses-/Codex-Dokumentation. Lokal: HF deepseek-ai/DeepSeek-V4-Flash-0731 mit vLLM/SGLang-DSpark-Flags. OpenCode Go/Free listen ebenfalls Flash.

Bei QCode

Bauen Sie nicht auf der Version 0731 auf: DeepSeek hat den Namen deepseek-v4-flash eingestellt, und Anfragen damit werden von DeepSeek-V4.1-Flash zum Flash-Preis bedient. Setzen Sie für neue Integrationen deepseek-v4.1-flash ein, wie in /models von QCode aufgeführt; für den Pro-Tarif deepseek-v4-pro. Diese Seite trifft keine Aussage zur Verfügbarkeit von 0731.

FAQ zu Flash 0731

Ist 0731 ein neues Modell?

Gleiche Flash-Struktur mit neuem Post-Training, und der API-Name blieb für das Release vom 2026-07-31 unverändert. Seit dem 2026-09-10 hat DeepSeek deepseek-v4-flash jedoch eingestellt und leitet es an V4.1-Flash weiter; das beschreibt also nur 0731 zum damaligen Zeitpunkt.

Kann ich es lokal betreiben?

Ja, MIT-Gewichte. Die volle Größe braucht viel Unified Memory oder mehrere GPUs; Laptops mit 16 GB brauchen eine Quantisierung statt des vollständigen Checkpoints.

Ist es besser als Sonnet 5?

Bei der AA-Intelligenz leicht zurück (52 vs. 55). Bei Preis und Geschwindigkeit weit voraus. Wählen Sie nach Stack, nicht nach Trophäe.

Macht die Preisgestaltung ab dem 16.08. das Angebot zunichte?

Der Output zur Spitzenzeit kostet $1.32; außerhalb der Spitzenzeit $0.66. Immer noch deutlich unter dem Bereich von $10/$15 bei Sonnet 5.

Warum sind die offiziellen Benchmarks so viel höher als mein Claude-Code-Lauf?

Verwendet wurden Harness Minimal + max. Ein anderes Harness verändert das Ergebnis.

Flash oder Pro?

Flash als Standard (Parallelität 2500). Schwere Agent-Aufgaben auf Pro 0813 eskalieren (Parallelität 500).

Quellen

DeepSeek-Changelog, die Release-Notiz news260910 und Models & Pricing (erfasst am 2026-09-18); der offizielle Blog aus der Zeit von 0731 und Bewertungen von Drittanbietern. Einstellung und vorübergehende Weiterleitung beruhen auf der Preis-Fußnote (1).

Flash in einen Multi-Modell-Mix einbinden

Diese Seite ist der historische Eintrag zu 0731. Setzen Sie für neue Integrationen deepseek-v4.1-flash aus /models von QCode ein, oder deepseek-v4-pro für den Pro-Tarif.

Verwandte Themen

Diese Seite bewahrt die offiziellen Benchmarks vom 2026-07-31 und die damaligen Zahlen von Drittanbietern, ohne zu behaupten, dass die Version noch verfügbar ist. Die aktuelle Flash-Stufe ist V4.1-Flash seit dem 2026-09-10; maßgeblich sind die Dokumentation von DeepSeek und /models von QCode.

Erst testen, dann entscheiden

Unsicher bei der Tarifwahl? Beginnen Sie mit Starter ($8.57/Monat) und wechseln Sie auf einen höheren Tarif, wenn Sie zufrieden sind — der ungenutzte Wert des alten Tarifs geht auf Ihr Guthaben zurück.