Preisänderung · geprüft am 2026-10-08

DeepSeek-V4-Preiserhöhung im Überblick
Nach der Einführung von Peak-/Off-Peak-Preisen

Stand 2026-10-08 rechnet DeepSeek laut offizieller Preistabelle weiter nach Spitzen- und Nebenzeiten ab: Spitzenzeit ist montags bis freitags 01:00-04:00 und 06:00-10:00 UTC, ausgenommen chinesische Feiertage; alle übrigen Stunden einschließlich Wochenende kosten die Hälfte. Die englische Tabelle nennt US-Dollar (Output von deepseek-v4-pro: $3.96 zur Spitzenzeit, $1.98 außerhalb, pro Million Tokens), und das Flash-Modell heißt jetzt deepseek-flash. Das Schema gilt seit dem 2026-08-17; damals stieg der Peak-Output von V4-Pro auf ¥27 pro Million Tokens (laut Caixin und guancha.cn etwa +350 %).

Aktualisiert 2026-10-08

Preise ändern sich: Bei QCode zahlen Sie für Claude, GPT und chinesische Modelle pro Token — aktuelle Preise unter /models.

#deepseek v4 price hike#peak/off-peak pricing#+350 %#halber Preis außerhalb der Spitzenzeiten

Vier wichtige Zahlen

+350 %

Anstieg beim Peak-Output von V4-Pro

Der Peak-Output stieg von ¥6 auf ¥27 pro Million Tokens. Der Input mit Cache-Treffer legte am stärksten zu – um bis zu 1100 %.

+400 %

Maximaler Anstieg bei V4-Flash

Bei der Änderung zum 2026-08-17 wurde die leichtgewichtige Stufe im gleichen Zug angehoben (laut Caixin, 21.08.). Mit dem Release von V4.1-Flash am 2026-09-10 hat DeepSeek die API-Preise nach eigenen Angaben gesenkt; Stand 2026-10-08 nennt die englische Tabelle für deepseek-flash außerhalb der Spitzenzeit $0.15 Input (Cache-Miss) und $0.6 Output pro Million Tokens. Off-Peak bleibt bei der Hälfte des Peak-Preises.

9-12 / 14-18

Peak-Zeiten (Pekinger Zeit)

Offizieller Wortlaut: Spitzenzeit ist montags bis freitags 01:00-04:00 und 06:00-10:00 UTC, ausgenommen chinesische Feiertage (9:00-12:00 und 14:00-18:00 Pekinger Zeit). Alle übrigen Stunden, einschließlich Wochenenden und chinesischer Feiertage ganztägig, gelten als Nebenzeit (geprüft am 2026-10-08).

08-17

Inkrafttreten

Warnhinweis in der Konsole am 06.08. → offizielle Ankündigung am 13.08. (am selben Tag wie V4 Pro GA) → Inkrafttreten um Mitternacht Pekinger Zeit am 17.08.; im offiziellen Changelog steht dafür 16:00 UTC am 16. August 2026.

Was sich tatsächlich geändert hat

Stand 2026-10-08 rechnet die DeepSeek API weiterhin zeitabhängig ab: Außerhalb der Spitzenzeiten gilt der halbe Preis. Das Schema gilt seit dem 2026-08-17, als DeepSeek seine API von einheitlichen Preisen auf zeitabhängige Peak-/Off-Peak-Preise umgestellt hat: Jede abrechenbare Position wird zu Spitzenzeiten teurer und fällt außerhalb davon auf den halben Preis zurück. Offiziell ist von „einer Rückkehr zu wertbasierter Token-Preisgestaltung“ die Rede – der 2,5-fache Aktionsrabatt vom Mai und die Niedrigpreisstrategie sind beendet, damit wird Rechenbudget frei, um „stärkere große Modelle zu entwickeln“. Die Erhöhung wurde am selben Tag wie V4 Pro GA (0813) angekündigt und trat innerhalb von zwei Wochen in Kraft.

Reaktion des Marktes

Die Preiserhöhung wurde zusammen mit „V4 Pro GA mit deutlich stärkeren Agent-Fähigkeiten“ bekannt gegeben und branchenweit als Wandel von DeepSeek vom „Preisbrecher“ zur wertbasierten Preisgestaltung gelesen. Die Tabelle wurde danach zweimal überarbeitet: Am 2026-09-10 kamen mit V4.1-Flash neue Preise, und die Flash-Stufe wurde gesenkt; der Changelog-Eintrag vom 2026-09-10 nahm die V4-Pro-Weiterleitung zurück und behielt V4 Pro zu unveränderten Konditionen bei. In der Entwickler-Diskussion geht es weiterhin darum, die Zahlen neu durchzurechnen: Off-Peak-Planung plus Optimierung der Cache-Treffer. Die offizielle Preistabelle mit Stand 2026-10-08: Das Flash-Modell heißt deepseek-flash (Version DeepSeek-V4.1-Flash); die alten Namen deepseek-v4-flash und deepseek-v4-flash-vision-exp werden weiterhin angenommen, die zugehörigen Modelle sind jedoch abgeschaltet, und Anfragen bedient DeepSeek-V4.1-Flash zum Flash-Preis. Die englische Tabelle nennt US-Dollar, die chinesische Yuan.

Zeitleiste

2026-08-06

Warnhinweis in der Entwicklerkonsole: „Wir planen in Kürze eine breite Preiserhöhung der API, die voraussichtlich deutlich ausfallen wird.“

2026-08-13

Offizielle Ankündigung: Details zu Peak-/Off-Peak-Preisen + V4 Pro GA am selben Tag.

2026-08-17

Am 2026-08-17 treten die neuen Preise in Kraft. Am 2026-08-21 wurde V4-Flash-Vision-Exp zum Preis von V4-Flash veröffentlicht; am 2026-09-10 wurden sowohl dieses als auch deepseek-v4-flash abgeschaltet. Die alten Namen werden weiter angenommen und von DeepSeek-V4.1-Flash zum Flash-Preis bedient; der offizielle Modellname lautet jetzt deepseek-flash.

Bestätigt vs. Vorsicht

Bestätigt

Wörtlich in der offiziellen DeepSeek-Dokumentation nachprüfbar (2026-10-08): Off-Peak kostet die Hälfte des Peak-Preises; Spitzenzeit ist werktags 01:00-04:00 und 06:00-10:00 UTC, ausgenommen chinesische Feiertage; die neuen Preise gelten seit 16:00 UTC am 16. August 2026; der Peak-Output von V4-Pro kostet in der chinesischen Tabelle 27,0 Yuan pro Million Tokens, in der englischen $3.96. Die Anstiegswerte +350 %/+1100 %/+400 % stammen aus der Berichterstattung von Caixin und guancha.cn.

Vorsicht

Die Schlagzeile „11-fache Preiserhöhung“ bezieht sich auf eine einzelne Position – den Input mit Cache-Treffer (¥0.025→¥0.3). Nicht alles wurde 11-mal so teuer. Rechnen Sie mit Ihrem eigenen Aufrufprofil nach und lassen Sie nicht die einzelne größte Position die Bewertung bestimmen.

So senken Sie die Kosten nach der Erhöhung

Planung in Off-Peak-Zeiten

Verlegen Sie Batch-Jobs, Evals und nächtliche Builds aus den Spitzenzeiten heraus: Aus den offiziellen Spitzenzeiten abgeleitet, gelten werktags 04:00-06:00 UTC und 10:00 UTC bis 01:00 UTC des Folgetags sowie Wochenenden und chinesische Feiertage ganztägig als Nebenzeit, zum halben Peak-Preis.

Caching und Modell-Staffelung

Nutzen Sie lange Präfixe wiederholt, um den Rabatt für Cache-Treffer mitzunehmen; verlagern Sie Routinearbeiten auf Flash oder ein anderes günstiges Modell und reservieren Sie Pro für die schwierigen Aufgaben.

So rechnen Sie Ihre Zahlen durch

Drei Schritte: ① Ziehen Sie Ihr Aufrufprofil (Verhältnis von Input/Output/Cache-Treffern); ② bewerten Sie es neu mit den neuen Peak- und Off-Peak-Preisen; ③ verschieben Sie jede aufschiebbare Last in Off-Peak-Zeitfenster. Bei den meisten Batch-lastigen Workloads bleibt die angepasste Summe gleich oder sinkt sogar.

Bei QCode

Bei QCode rufen Sie mit einem Key deepseek-v4.1-flash und deepseek-v4-pro auf; der alte Name deepseek-v4-flash funktioniert weiterhin. Abgerechnet wird pro Token, die Preise je Modell stehen unter /models. Die Peak-/Off-Peak-Werte sowie Yuan- und Dollarpreise auf dieser Seite stammen aus DeepSeeks eigener Preistabelle und sind keine QCode-Preise.

FAQ

Wann hat DeepSeek die Preise erhöht?

Die Erhöhung trat am 2026-08-17 um Mitternacht (Pekinger Zeit) in Kraft; der offizielle Changelog nennt 16:00 UTC am 16. August 2026. Der Warnhinweis in der Konsole kam am 08-06, die offizielle Ankündigung am 08-13, am selben Tag wie V4 Pro GA.

Wie stark sind die Preise gestiegen?

Zum 2026-08-17: Peak-Output von V4-Pro ¥27 pro Million Tokens; laut Caixin und guancha.cn entsprach das etwa +350 %, Input mit Cache-Treffer bis zu +1100 %, V4-Flash bis zu +400 %; Off-Peak jeweils zur Hälfte des Peak-Preises. Mit dem Release von V4.1-Flash am 2026-09-10 hat DeepSeek die API-Preise nach eigenen Angaben gesenkt; Stand 2026-10-08 lautet der offizielle Modellname der Flash-Stufe deepseek-flash (DeepSeek-V4.1-Flash), außerhalb der Spitzenzeit $0.15 Input (Cache-Miss) und $0.6 Output pro Million Tokens.

Wie sind Peak- und Off-Peak-Zeitfenster definiert?

Laut offizieller Tabelle (Stand 2026-10-08): Spitzenzeit ist montags bis freitags 01:00-04:00 und 06:00-10:00 UTC, ausgenommen chinesische Feiertage (9:00-12:00 und 14:00-18:00 Pekinger Zeit). Alle übrigen Stunden, einschließlich Wochenenden und chinesischer Feiertage ganztägig, sind Nebenzeit.

Lohnt sich DeepSeek nach der Erhöhung noch?

Stand 2026-10-08 nennt die englische Tabelle für deepseek-v4-pro außerhalb der Spitzenzeit $0.66 Input (Cache-Miss) und $1.98 Output pro Million Tokens, also die Hälfte des Peak-Preises. Wenn Sie Ihre Last planen und Caching nutzen können, bleibt der tatsächliche Kostenanstieg überschaubar; rechnen Sie zuerst Peak und Off-Peak mit Ihrem eigenen Anfrage-Mix durch.

Steigen auch die Preise bei QCode?

QCode rechnet pro Token ab, die Preise je Modell stehen unter /models. Die Peak-/Off-Peak-Werte auf dieser Seite stammen aus DeepSeeks offizieller Preistabelle und sind keine QCode-Preise; für QCode gilt /models.

Ist die „11-fache Erhöhung“ real?

Der größte Einzelposten ist real (Cache-Treffer-Input ¥0.025→¥0.3), die meisten abrechenbaren Posten sind jedoch deutlich weniger gestiegen. Kalkulieren Sie mit Ihrem eigenen Aufrufprofil, nicht mit der größten Einzelzahl.

Quellen

DeepSeek-API-Dokumentation: Models & Pricing (englische Tabelle in USD, chinesische in Yuan) und die Changelog-Einträge vom 2026-09-10 und 2026-08-13, abgerufen am 2026-10-08. Historische Anstiegswerte: DeepSeeks Preishinweis (2026-08-13, berichtet von Xinhua Finance), Guancha (2026-08-17), Caixin (2026-08-21), Kaiyuan Securities (2026-08-06), Zusammenfassungen auf Xueqiu.

Ein Key für DeepSeek V4 Pro und V4.1 Flash

QCode rechnet pro Token ab; Preise je Modell und die aktuelle Modellliste stehen unter /models.

Erst testen, dann entscheiden

Unsicher bei der Tarifwahl? Beginnen Sie mit Starter ($8.57/Monat) und wechseln Sie auf einen höheren Tarif, wenn Sie zufrieden sind — der ungenutzte Wert des alten Tarifs geht auf Ihr Guthaben zurück.