16 sierpnia 2026 DeepSeek zastąpił stałe stawki za tokeny cennikiem z podziałem na godziny szczytu i poza szczytem – ceny V4 Pro wzrosły nawet o 1555% w przypadku trafień w pamięci podręcznej. Niezależne testy Composio wykazały, że model DeepSeek V4 Flash osiąga średnio tylko 53,8% skuteczności w rzeczywistych, wiel...
Research answer

Create a landscape editorial hero image for this Studio Global article: What pricing changes did DeepSeek implement for its V4 API models on August 16, 2026, how does the new peak and off-peak tiered structure co. Article summary: **Pi Agent** led in both success rate (20/30) and cost efficiency ($0.028/task).. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence
16 sierpnia 2026 roku chińska firma DeepSeek wprowadziła jedną z najbardziej znaczących zmian w cenniku API na rynku sztucznej inteligencji. Zamiast stałych stawek za tokeny, wprowadzono system godzin szczytu i poza szczytem, co w skrajnych przypadkach oznacza wzrost kosztów nawet o 1555% dla niektórych typów tokenów . W tym samym tygodniu niezależna firma testująca Composio ujawniła, że flagowy model DeepSeeka, V4 Flash, wykonał poprawnie tylko 53,8% rzeczywistych zadań agentowych w ośmiu różnych środowiskach uruchomieniowych. To ujawniło ogromną przepaść między wynikami w rankingach a niezawodnością w produkcji
. Te dwa wydarzenia zmuszają przedsiębiorstwa do ponownego przemyślenia całkowitych kosztów i dojrzałości środowisk wdrożeniowych wymaganych do skalowania DeepSeek V4.
Od godziny 16:00 UTC 16 sierpnia 2026 DeepSeek zmienił dotychczasową stałą stawkę na dwupoziomowy model cenowy dla wersji V4-Flash i V4-Pro . Godziny szczytu to 01:00–04:00 UTC oraz 06:00–10:00 UTC (łącznie 7 godzin dziennie), a pozostałe godziny są poza szczytem
. Stawki poza szczytem są dokładnie o połowę niższe niż w szczycie, ale każda kategoria tokenów i tak odnotowała wzrost netto w porównaniu z poprzednim stałym cennikiem
.
| Model | Typ tokena | Poprzednia stawka stała | Poza szczytem (nowa) | Szczyt (nowy) | Zmiana efektywna |
|---|---|---|---|---|---|
| V4-Flash | Wejście (brak trafienia w cache) | 0,14 $ | 0,21 $ | 0,42 $ | +50% poza szczytem, +200% szczyt |
| V4-Flash | Wejście (trafienie w cache) | 0,0028 $ | 0,007 $ | 0,014 $ | +150% poza szczytem, +400% szczyt |
| V4-Flash | Wyjście | 0,28 $ | 0,42 $ | 0,84 $ | +50% poza szczytem, +200% szczyt |
| V4-Pro | Wejście (brak trafienia w cache) | 0,435 $ | 0,99 $ | 1,98 $ | +128% poza szczytem, +355% szczyt |
| V4-Pro | Wejście (trafienie w cache) | 0,003625 $ | 0,03 $ | 0,06 $ | +728% poza szczytem, +1,555% szczyt |
| V4-Pro | Wyjście | 0,87 $ | 1,98 $ | 3,96 $ | +128% poza szczytem, +355% szczyt |
Źródło danych cenowych: opublikowany cennik DeepSeek i niezależne narzędzia śledzące .
Najbardziej ekstremalny wzrost dotyczy trafień w pamięć podręcznej dla V4-Pro – z 0,003625 $ do 0,06 $ w szczycie, czyli o około 1555% . DeepSeek tłumaczy zmianę chęcią efektywniejszego alokowania zasobów i zachęcania użytkowników do planowania niepilnych zadań poza godzinami szczytu
.
W sierpniu 2026 roku niezależna firma testująca Composio przetestowała DeepSeek V4 Flash w ośmiu różnych środowiskach uruchomieniowych (tzw. harnessach) na 30 celowo trudnych, wieloetapowych zadaniach, korzystających z żywych narzędzi, takich jak Gmail, GitHub, Slack i Google Sheets . Każde zadanie miało limit czasu 900 sekund, a wszystkie środowiska korzystały z tych samych hostowanych narzędzi MCP Composio
.
Ogólny wynik: na 240 uruchomień tylko 129 zakończyło się sukcesem – ogólny wskaźnik powodzenia to 53,8%. Tylko 6 z 30 zadań zostało ukończonych pomyślnie przez wszystkie środowiska .
| Środowisko | Wskaźnik powodzenia (na 30 zadań) | Koszt na udane zadanie |
|---|---|---|
| Pi Agent | 20/30 (66,7%) | 0,028 $ |
| Prime Agent | ~15/24 (62,5% ważnych uruchomień) | 0,131 $ |
| OMP (Oh My Pi) | 17/30 (56,7%) | 0,103 $ |
| Claude Code | 16/30 (53,3%) | 0,195 $ |
| Codex | 16/30 (53,3%) | 0,081 $ |
| Deep Agents (LangChain) | 16/30 (53,3%) | 0,045 $ |
| Hermes Agent | 15/30 (50,0%) | 0,056 $ |
| OpenCode | 14/30 (46,7%) | 0,067 $ |
Dane z opublikowanych wyników Composio .
Pi Agent okazał się najlepszy zarówno pod względem skuteczności (20/30), jak i opłacalności (0,028 $ za zadanie) . Co istotne, różne środowiska wygrywały w różnych kategoriach – skuteczności, kosztów i szybkości – co oznacza, że wybór środowiska uruchomieniowego jest równie ważny, co możliwości samego modelu
. Różnica 20 punktów procentowych między najlepszym a najgorszym środowiskiem pokazuje, jak bardzo wyniki zależą od frameworka agentowego, konfiguracji narzędzi, buforowania, ponawiania prób i stosu dostawcy
.
Połączenie wyższych cen i nierównych wyników w rzeczywistych zastosowaniach zmieniło analityczne oceny przydatności DeepSeek V4 dla przedsiębiorstw.
Jak zauważył VentureBeat, ten sam model V4 Flash dawał znacząco różne wyniki w zależności od środowiska, konfiguracji narzędzi i stosu buforowania. To sugeruje, że firmy muszą inwestować w dojrzałość środowisk uruchomieniowych równie mocno, co w wybór samego modelu . Sam Composio podkreśla, że sam wybór środowiska zmieniał skuteczność o trzy zadania, koszt o prawie 3x, a szybkość o 2,2x
.
Nawet poza godzinami szczytu każdy typ tokena jest droższy niż poprzednio. Analitycy twierdzą, że zmienia to rachunek zwrotu z inwestycji dla zastosowań agentowych o dużej objętości, szczególnie w przypadku botów obsługi klienta i potoków generowania kodu, które wcześniej opierały się na agresywnie niskich cenach DeepSeeka .
Oficjalne benchmarki agentowe DeepSeeka (82,7 w Terminal-Bench 2.1, 70,3 w Toolathlon-Verified) wyglądają imponująco, ale rzeczywisty wskaźnik powodzenia na poziomie 53,8% przypomina, że wyniki w rankingach nie gwarantują niezawodności w środowiskach produkcyjnych z żywymi API, limitami stawek i stanowymi przepływami pracy .
Ruch API przechodzi przez serwery w Chinach, co stwarza wyzwania związane z zgodnością regulacyjną dla firm z sektorów regulowanych. Analitycy zalecają staranne planowanie architektury pod kątem zarządzania danymi, audytu i kontroli uprawnień narzędzi . Dla branż regulowanych jedyną realną ścieżką do wdrożenia produkcyjnego jest hostowanie modelu na własnej infrastrukturze z wykorzystaniem otwartych wag
.
Ramy decyzyjne firmy BayTech Consulting zalecają DeepSeek V4 do nieczułych na dane podsumowań dokumentów, generowania kodu w otwartych repozytoriach i tworzenia treści na dużą skalę. Jednak podkreślają potrzebę rygorystycznej oceny każdego obciążenia przed wdrożeniem produkcyjnym .
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
16 sierpnia 2026 DeepSeek zastąpił stałe stawki za tokeny cennikiem z podziałem na godziny szczytu i poza szczytem – ceny V4 Pro wzrosły nawet o 1555% w przypadku trafień w pamięci podręcznej.
16 sierpnia 2026 DeepSeek zastąpił stałe stawki za tokeny cennikiem z podziałem na godziny szczytu i poza szczytem – ceny V4 Pro wzrosły nawet o 1555% w przypadku trafień w pamięci podręcznej. Niezależne testy Composio wykazały, że model DeepSeek V4 Flash osiąga średnio tylko 53,8% skuteczności w rzeczywistych, wieloetapowych zadaniach agentowych, a różnica między najlepszym a najgorszym środowiskiem urucho...
Analitycy ostrzegają, że gwałtowny wzrost kosztów i słaba wydajność w rzeczywistych scenariuszach wymuszają na firmach ostrożne, selektywne wdrażanie modeli DeepSeek, najlepiej z wykorzystaniem własnej infrastruktury.