Am 13. August 2026 kündigte DeepSeek eine Erhöhung der API Preise für die V4 Pro und V4 Flash Modelle um 50 % bis 1.100 % an.
Forschungsantwort

Create a landscape editorial hero image for this Studio Global article: What new API pricing did DeepSeek announce for its V4 models, when does it take effect, and what are the key details about the models' conte. Article summary: On August 13, 2026, DeepSeek announced major API price increases for its V4-Pro and V4-Flash models, with new peak/off-peak billing tiers taking effect at **16:00 UTC on August 16, 2026** [1][4]. The increases range from. Topic tags: general, academic, documentation, general web, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
Am 13. August 2026 gab DeepSeek eine massive Anpassung der API-Preise für seine V4-Pro- und V4-Flash-Modelle bekannt. Die neuen Peak-/Off-Peak-Tarife treten am 16. August 2026 um 16:00 UTC in Kraft . Die Preise steigen je nach Modell, Token-Typ und Nutzungszeit um 50 % bis 1.100 % gegenüber den aktuellen Sätzen
. Damit endet die Ära der extrem günstigen Preise, mit der DeepSeek bisher für Aufsehen gesorgt hatte.
DeepSeek ist der erste große KI-API-Anbieter, der eine strukturelle zeitabhängige Preiserhöhung einführt, die an das Strompreismodell mit Peak- und Off-Peak-Tarifen angelehnt ist . Die Off-Peak-Preise liegen bei 50 % der Peak-Preise, was bedeutet, dass API-Aufrufe während der Hauptzeiten doppelt so teuer sind
. Die Peak-Zeiten (UTC) liegen Berichten zufolge zwischen 01:00–04:00 und 06:00–10:00 Uhr
.
| Token-Typ | Aktueller Preis | Neu: Off-Peak | Neu: Peak |
|---|---|---|---|
| Input (Cache-Miss) | 0,435 $ | ~0,44–0,49 $ (gesch.) | ~0,87–0,98 $ (gesch.) |
| Output | 0,87 $ | 1,98 $ | 3,96 $ |
| Token-Typ | Aktueller Preis | Neu: Off-Peak | Neu: Peak |
|---|---|---|---|
| Input (Cache-Miss) | 0,14 $ | ~0,21 $ (gesch.) | ~0,42 $ (gesch.) |
| Output | 0,28 $ | 0,63 $ | 1,26 $ |
(Die Preise für Input-Cache-Miss in den neuen Tarifen wurden auf Basis der bestätigten Output-Multiplikatoren geschätzt. Die Preissprünge beim Output wurden von mehreren Quellen bestätigt .)
Cached-Input-Token bleiben deutlich günstiger. Bei V4-Pro liegt der Preis für Cache-Hit-Input bei etwa 0,004 $ pro 1 Mio. Token – ein Rabatt von etwa 100x, der Entwickler dazu anregen soll, ihre Caching-Strategien zu optimieren .
Beide V4-Modelle sind reine Textmodelle mit Mixture-of-Experts (MoE)-Architektur und werden unter der MIT-Lizenz veröffentlicht, was bedeutet, dass sie vollständig quelloffen und selbst hostbar sind .
| Spezifikation | DeepSeek V4-Pro | DeepSeek V4-Flash |
|---|---|---|
| Gesamtparameter | 1,6 Billionen | 284 Milliarden |
| Aktive Parameter pro Token | ~49 Milliarden | ~13 Milliarden |
| Kontextfenster | 1.000.000 Token | 1.000.000 Token |
| Maximale Ausgabelänge | 384.000 Token | 384.000 Token |
| Lizenz | MIT | MIT |
Beide Modelle unterstützen drei Reasoning-Modi: Non-think (schnell, intuitiv), Think High (logische Analyse mit Gedankenkette) und Think Max (tiefgehendes Reasoning) .
Die neuen Preise verändern die Wettbewerbsposition von DeepSeek grundlegend. Der folgende Vergleich basiert auf den Standard-API-Preisen für kurze Kontexte pro 1 Mio. Token aller Anbieter.
| Modell | Input (pro 1 Mio.) | Output (pro 1 Mio.) |
|---|---|---|
| DeepSeek V4-Pro (Peak) | ~0,87–0,98 $ | 3,96 $ |
| DeepSeek V4-Flash (Peak) | ~0,42 $ | 1,26 $ |
| OpenAI GPT-5.6 Luna | 0,20 $ | 1,20 $ |
| Anthropic Claude Fable 5 | 10,00 $ | 50,00 $ |
(Quellen: DeepSeek , OpenAI
, Anthropic
)
OpenAI senkte die Preise für GPT-5.6 Luna am 30. Juli 2026 um 80 % auf 0,20 $ Input und 1,20 $ Output pro 1 Mio. Token . Das Wettbewerbsbild hat sich dadurch drastisch verändert:
War DeepSeek einst die klare Budget-Option, steht es nun einem aggressiven Preis führer in OpenAIs günstigstem Modell gegenüber .
Anthropics Flaggschiff-Reasoning-Modell kostet 10 $ Input und 50 $ Output pro 1 Mio. Token . Auf diesem Niveau bleibt DeepSeek das Preis-Leistungs-Angebot:
Selbst zu den neuen, höheren Preisen bleiben beide DeepSeek-Modelle dramatisch günstiger als das Spitzenmodell von Anthropic .
Die Preise von xAI für Grok 4.6 waren in den bereitgestellten Quellen nicht verfügbar, sodass ein direkter Vergleich nicht möglich ist.
DeepSeek nannte die stark gestiegene Nachfrage, die die Inferenzkapazität überlastet, als Hauptgrund für die Erhöhung . Die V4-Modelle erlangten nach ihrem Preview-Start im April 2026 eine enorme Verbreitung, was zu GPU-Kapazitätsengpässen führte, die das Unternehmen zu seinen bisherigen extrem niedrigen Preisen nicht mehr abfedern konnte
.
Mehrere Marktfaktoren kamen zusammen:
Die Preiserhöhungen von DeepSeek marken das Ende seiner Ära als der mit Abstand günstigste API-Anbieter an der Spitze der KI-Modelle. Das Unternehmen rückt nun bei einigen Kennzahlen näher an OpenAIs günstigstes Modell heran, unterbietet jedoch das Premium-Segment von Anthropic noch um eine Größenordnung. Für Entwickler bedeutet die Kombination aus Peak-/Off-Peak-Preisen, tiefen Caching-Rabatten und MIT-lizenzierten Open Weights, dass die Architektur des Workloads – und nicht die reine Modellwahl – zunehmend die endgültige API-Rechnung bestimmen wird.
Studio Global AI
Diese Seite enthält eine quellengestützte Antwort, die Sie in Studio Global fortsetzen können.
Am 13. August 2026 kündigte DeepSeek eine Erhöhung der API Preise für die V4 Pro und V4 Flash Modelle um 50 % bis 1.100 % an.
Am 13. August 2026 kündigte DeepSeek eine Erhöhung der API Preise für die V4 Pro und V4 Flash Modelle um 50 % bis 1.100 % an. Beide V4 Modelle bieten ein Kontextfenster von 1 Million Token, sind MIT lizenziert und unterstützen eine maximale Ausgabe von bis zu 384.000 Token [1].
Als Grund nennt DeepSeek die enorm gestiegene Nachfrage und Engpässe bei der GPU Kapazität.