GA · 2026-08-13

DeepSeek V4 Pro 0813
Flagship GA

App, Web und API verweisen mit deepseek-v4-pro jetzt auf den 0813-Build. Laut DeepSeek sind die Fortschritte bei Produktiv-Agents das Kernstück – nicht noch eine reine Labortabelle.

Aktualisiert 2026-09-21

Claude, GPT und chinesische Modelle mit einem Key, Bezahlung pro Token; verfügbare Modelle unter /models.

#deepseek-v4-pro#0813#1.6T-Klasse#TB2.1 87.9

Highlights

1.6T–1.7T

HF-Modellgröße

Die Angaben zur Gesamtparameterzahl variieren je nach Quelle (HF und Broker-Research widersprechen sich); ca. 49B aktiviert. MIT-Gewichte.

$0.66 / $1.98

QCode-Katalogpreis (pro Million Tokens)

Folgt den offiziellen Peak-/Off-Peak-Preisen: Off-Peak kostet etwa die Hälfte des Peak-Preises. Für Cache-Treffer gibt es zusätzlich einen Rabatt. Concurrency 500.

87.9

Terminal Bench 2.1

Offiziell Minimal+max. DeepSWE 62.7 (Preview Pro: 12.8). HLE mit Tools 60.0.

1M / 384K

Kontext / max. Output

Low-/High-/Max-Effort. Responses API + Codex-Ein-Klick-Skript.

Was 0813 ändert

0813 löst V4-Pro Preview ab. Reuters berichtete über die offizielle Veröffentlichung als Schritt, mit dem DeepSeek Personal, Rechenleistung und Mittelbeschaffung hochfährt. Simon Willison merkte an, dass es keine hübsche Ankündigungsseite gab – dieser Guide ist das menschenlesbare Changelog.

Worüber gestritten wird

Die eigene Tabelle von HF stellt 0813 neben Fable 5 (mit Fallback), Kimi K3 und Opus 4.8. Bei TB2.1 herrscht praktisch Gleichstand mit Fable (87.9 vs 88.0). Die größere Geschichte sind die Preise: Am 08-13 wurden die offiziellen Peak-/Off-Peak-Regeln angekündigt, gültig ab 08-17 – Spitzenzeiten sind 9:00–12:00 und 14:00–18:00 Uhr Pekinger Zeit, Off-Peak kostet den halben Preis, und der Peak-Output liegt +350 % über dem Stand vor der Änderung.

Zeitachse

2026-04-24

V4-Pro Preview in der API.

2026-08-13

0813 GA in App, Web und API. Reuters am selben Tag.

2026-08-16 16:00 UTC

Peak/Off-Peak. Peak-Output $3.96, Off-Peak $1.98.

Bestätigt vs. Vorsicht

Bestätigt

Offizielle Benchmark-Tabelle auf HF; MIT-Repo; gleicher Modellname; drei Effort-Stufen; Codex-Responses-Pfad.

Vorsicht

Viele Diagramme mit „V4 Pro 45 vs Sol 57“ kursieren weiterhin; sie beschreiben den Preview-Build vor 0813. Artificial Analysis bewertet das 0813-Release mit 53.

Flash oder Pro wählen

Bei Flash (V4.1) bleiben

Flash ist jetzt V4.1 (0731 wird am 2026-09-10 eingestellt). Günstiger.

Auf 0813 umsteigen

Anspruchsvollere Produktiv-Agents, HLE mit Tools, wenn Flash an Grenzen stößt. 500 Concurrency.

So rufen Sie es auf

model=deepseek-v4-pro auf api.deepseek.com (OpenAI- oder Anthropic-Base). Lokal: HF 0813 + DSpark. OpenCode Go listet DeepSeek V4 Pro.

Bei QCode

QCode listet derzeit deepseek-v4-pro unter /models. Diese Seite ist ein öffentliches Changelog; ob das Modell verfügbar ist, bestimmt die aktuelle Liste unter /models.

0813 FAQ

Muss ich den Modellnamen ändern?

Nein. Behalten Sie deepseek-v4-pro bei. 0813 ist der neue Standard hinter diesem Namen.

Offene Gewichte?

Ja, MIT auf Hugging Face.

Besser als Fable 5?

Insgesamt nicht. TB2.1 ist ein Gleichstand; bei DeepSWE/HLE liegt weiterhin Fable vorn (mit Fallback). Pro punktet bei Preis und Self-Hosting.

Besser als GPT-5.6 Sol?

Sie zielen auf unterschiedliche Aufgaben. GPT-5.6 Sol ist das geschlossene Reasoning-Flaggschiff mit 61 im Artificial Analysis Intelligence Index; V4 Pro 0813 erreicht dort 53 und punktet bei Preis und offenen Gewichten. Der weiterhin kursierende Wert „Pro 45“ beschreibt den Preview-Build vor 0813.

Flash oder Pro 0813?

Zuerst Flash. Pro, wenn Flash an der anspruchsvollen Agent-Schleife scheitert.

Wann ändern sich die Preise?

2026-08-16 16:00 UTC, Spitzenzeiten 01:00–04:00 und 06:00–10:00 UTC.

Quellen

DeepSeek-Changelog 2026-08-13; Preisseite; HF Pro-0813; Reuters 2026-08-13.

Schwere Aufgaben an ein günstigeres Flaggschiff-Modell routen

Behalten Sie Claude / GPT dort, wo sie weiterhin vorn liegen; nutzen Sie 0813, wenn offene Gewichte und Preis zählen.

Verwandt

Nicht mit DeepSeek verbunden. Seit dem 2026-08-17 folgen die Preise dem offiziellen Peak-/Off-Peak-Schema (Off-Peak kostet etwa die Hälfte des Peak-Preises); die Katalogpreise von QCode geben die offiziellen Änderungen weiter, und maßgeblich ist die aktuelle /models-Liste.

Erst testen, dann entscheiden

Unsicher bei der Tarifwahl? Beginnen Sie mit Starter ($8.57/Monat) und wechseln Sie auf einen höheren Tarif, wenn Sie zufrieden sind — der ungenutzte Wert des alten Tarifs geht auf Ihr Guthaben zurück.