DeepSeek stellt die API Abrechnung für V4 Pro und V4 Flash seit dem 17. August 2026 auf Peak und Off Peak Tarife um. Beim V4 Pro kostet eine Million Ausgabe Tokens außerhalb der Spitzenzeiten 13,50 Yuan statt zuvor 6 Yuan; zu Peak Zeiten sind es 27 Yuan.
Forschungsantwort

Create a landscape editorial hero image for this Studio Global article: What did DeepSeek announce about its V4 API pricing and V4 Pro launch on August 13, 2026—effective at midnight Beijing time on August 17—inc. Article summary: DeepSeek’s August 13 announcement paired a production V4 Pro release with materially higher, time-variable API prices. It is strong evidence that DeepSeek is no longer competing principally on the lowest possible token r. Topic tags: general, news, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
DeepSeek bündelt in seiner Ankündigung vom 13. August 2026 drei wichtige Schritte: die allgemeine Veröffentlichung von DeepSeek-V4-Pro-0813, eine grundlegende Änderung der V4-API-Preise und die Open-Source-Freigabe von DeepSeek Harness (dsh) v0.1.
Damit geht es nicht mehr nur um ein neues Sprachmodell. DeepSeek stärkt zugleich seine Position bei Coding- und Agenten-Anwendungen – und macht deutlich, dass besonders leistungsfähige Inferenz nicht dauerhaft zum extrem niedrigen Einheitspreis angeboten werden soll.
Für V4 Pro und V4 Flash hat DeepSeek die bisherige einheitliche Abrechnung durch Peak- und Off-Peak-Tarife ersetzt. Die Änderung trat am 17. August 2026 um 00:00 Uhr Pekinger Zeit in Kraft, also am 16. August um 16:00 Uhr UTC. Die Off-Peak-Preise entsprechen der Hälfte der Peak-Preise. Die ausgewiesenen Spitzenzeiten liegen montags bis freitags zwischen 09:00 und 12:00 Uhr sowie 14:00 und 18:00 Uhr Pekinger Zeit; alle übrigen Zeiten gelten als Off-Peak. 9
14
Für das V4 Pro ergeben sich pro einer Million Tokens folgende Off-Peak-Preise:
| Abrechnungskategorie | Bisheriger Preis | Neuer Off-Peak-Preis | Veränderung |
|---|---|---|---|
| Input aus dem Cache | 0,025 Yuan | 0,15 Yuan | +500 % |
| Nicht gecachter Input | 3 Yuan | 4,50 Yuan | +50 % |
| Ausgabe | 6 Yuan | 13,50 Yuan | +125 % |
Die Angaben stammen aus der Ankündigung und den verfügbaren Preisübersichten zu DeepSeek. 11
16
Zu Peak-Zeiten verdoppeln sich die neuen Off-Peak-Preise. Beim V4 Pro bedeutet das 0,30 Yuan pro einer Million gecachter Input-Tokens, 9 Yuan für eine Million nicht gecachter Input-Tokens und 27 Yuan für eine Million Ausgabe-Tokens. 11
13
Die Auswirkungen fallen je nach Token-Kategorie sehr unterschiedlich aus. Beim gecachten Input ist der prozentuale Anstieg im Off-Peak-Vergleich am größten. Das ist vor allem für Agenten relevant, die in mehreren Arbeitsschritten immer wieder dieselben Projektdateien, Anweisungen oder Gesprächskontexte übertragen. Auch Ausgaben werden erheblich teurer: Der Preis steigt von zuvor 0,87 US-Dollar auf 1,98 US-Dollar pro einer Million Tokens außerhalb der Spitzenzeiten und auf 3,96 US-Dollar zu Peak-Zeiten. 6
9
Über die gesamte V4-Familie hinweg sprach DeepSeek von Erhöhungen zwischen 50 und 1.100 Prozent – abhängig vom Modell, der Token-Kategorie und dem Nutzungszeitpunkt. 2 Für Entwickler wird die Kostenplanung damit komplizierter: Nicht nur die Modellwahl, sondern auch der Zeitpunkt der Ausführung beeinflusst die Rechnung.
V4-Pro-0813 ist die allgemein verfügbare Version von DeepSeeks Spitzenmodell V4 Pro. In der von DeepSeek veröffentlichten Vergleichstabelle schneidet die neue Version bei mehreren Coding- und Agenten-Benchmarks deutlich besser ab als die vorherige V4-Pro-Preview.
Bei Terminal-Bench 2.1 steigt der Wert demnach von 72,1 auf 87,9. Beim Softwareentwicklungs-Benchmark DeepSWE verbessert sich das Ergebnis von 12,8 auf 62,7. 4
40
Wichtig ist dabei eine häufige Verwechslung: Der Wert 7,3 gehört laut Model Card zur V4-Flash-Preview, nicht zur V4-Pro-Preview. Für den Vergleich V4 Pro Preview gegen V4-Pro-0813 ist daher 12,8 die korrekte Ausgangszahl. 40
DeepSeeks Model Card ordnet V4-Pro-0813 bei ausgewählten Tests in die Nähe von Modellen wie Claude Opus 4.8, Claude Fable 5, Kimi K3 und GLM-5.2 ein. Das Ergebnis ist jedoch kein durchgängiger Sieg. V4-Pro-0813 liegt bei manchen Vergleichen vorn, bei anderen – etwa bestimmten Wissens-, Repository- und Agentenbewertungen – hinter den Wettbewerbern. 35
36
40
Diese Zahlen sind als vom Anbieter gemeldete Benchmark-Ergebnisse einzuordnen. Sie belegen nicht unabhängig, dass V4 Pro konkurrierende Systeme generell übertrifft. Eine verfügbare Analyse weist darauf hin, dass unabhängige Überprüfungen bislang begrenzt sind und Resultate je nach Testumgebung, Prompting, eingesetzten Tools und Bewertungsverfahren variieren können. 41
Parallel zu V4-Pro-0813 hat DeepSeek DeepSeek Harness v0.1 veröffentlicht – ein Open-Source-Framework für Agenten unter der MIT-Lizenz. Das Projekt wurde als Alternative zu Produkten wie Anthropics Claude Code positioniert. 18
22
Die Software selbst ist kostenlos. Bezahlt werden müssen jedoch die Modelle oder APIs, die über das Framework angesprochen werden. Die tatsächlichen Betriebskosten hängen daher vom Inferenzverbrauch und von der gewählten Modellkonfiguration ab, nicht von einem zusätzlichen Harness-Abonnement. 17
23
Gerade die Kombination aus Modell und Framework ist strategisch interessant. DeepSeek stellt die Workflow-Schicht für Coding- und Automatisierungsagenten frei zur Verfügung und verdient an den Modellaufrufen, die diese Workflows antreiben. Für Entwickler zählt damit weniger der Preis eines einzelnen Prompts als die Frage, wie viel eine komplette Aufgabe über mehrere Schritte hinweg kostet.
Die neuen Tarife beweisen nicht, dass günstige KI-Tokens in der gesamten Branche verschwinden. Sie zeigen aber, dass DeepSeeks frühere Flatrate-Preise für einen leistungsfähigeren Produktionsdienst keine dauerhafte Festlegung waren.
Die Peak-/Off-Peak-Abrechnung erfüllt dabei zwei Funktionen. Sie erhöht die Einnahmen in Zeiten hoher Nachfrage und soll zugleich Ressourcen gleichmäßiger verteilen. Für Entwickler entsteht ein Anreiz, aufschiebbare Aufgaben wie Batch-Verarbeitung, Tests oder Indexierung in günstigere Zeitfenster zu verlegen. Interaktive Anwendungen während der Spitzenzeiten werden dagegen am teuersten. 14
Der größere Wandel liegt in der Verschiebung von der Token-Ökonomie zur Aufgabenökonomie. Ein Modell kann trotz höherer Token-Preise wirtschaftlich sein, wenn es eine Coding- oder Rechercheaufgabe mit weniger Fehlversuchen, weniger Orchestrierung und weniger menschlicher Kontrolle erledigt. Umgekehrt führt ein niedriger Token-Preis nicht automatisch zu niedrigen Gesamtkosten, wenn ein Agent zahlreiche Wiederholungen benötigt oder unzuverlässige Ergebnisse liefert.
DeepSeeks Ankündigung wirkt deshalb weniger wie ein Abschied vom Preiswettbewerb als wie eine Neupositionierung: V4-Pro-0813 liefert ein leistungsfähigeres Premium-Modell, DeepSeek Harness eine offene Agenten-Schicht und die zeitabhängige Abrechnung monetarisiert knappe oder besonders gefragte Rechenkapazität.
Die verfügbaren Belege stützen damit den Schritt hin zu vollständigen Agenten-Workflows. Sie belegen jedoch noch nicht, dass DeepSeek den reinen Modell-Endpunkt bereits durch ein vollständig integriertes Geschäft für die Lieferung kompletter Aufgaben ersetzt hat.
Studio Global AI
Diese Seite enthält eine quellengestützte Antwort, die Sie in Studio Global fortsetzen können.
DeepSeek stellt die API Abrechnung für V4 Pro und V4 Flash seit dem 17. August 2026 auf Peak und Off Peak Tarife um.
DeepSeek stellt die API Abrechnung für V4 Pro und V4 Flash seit dem 17. August 2026 auf Peak und Off Peak Tarife um. Beim V4 Pro kostet eine Million Ausgabe Tokens außerhalb der Spitzenzeiten 13,50 Yuan statt zuvor 6 Yuan; zu Peak Zeiten sind es 27 Yuan.
V4 Pro 0813 verbessert sich laut DeepSeeks eigenen Benchmarks unter anderem bei Terminal Bench 2.1 und DeepSWE deutlich.