| Rodzaj tokena | Cena obecna | Nowa – poza szczytem | Nowa – szczyt |
|---|---|---|---|
| Wejściowy (brak trafienia w cache) | $0,435 | ~$0,44–$0,49 (szac.) | ~$0,87–$0,98 (szac.) |
| Wyjściowy | $0,87 | $1,98 | $3,96 |
| Rodzaj tokena | Cena obecna | Nowa – poza szczytem | Nowa – szczyt |
|---|---|---|---|
| Wejściowy (brak trafienia w cache) | $0,14 | ~$0,21 (szac.) | ~$0,42 (szac.) |
| Wyjściowy | $0,28 | $0,63 | $1,26 |
(Ceny dla wejściowych tokenów z chybionym cache w nowych taryfach są szacowane na podstawie potwierdzonych mnożników dla tokenów wyjściowych. Skoki cen dla wyjściowych są potwierdzone przez wiele źródeł .)
Tokeny wejściowe pobrane z cache pozostają drastycznie tańsze. Dla V4-Pro trafienie w cache to koszt około $0,004 za 1 mln tokenów, czyli blisko 100-krotnie mniej – to silna zachęta dla programistów do optymalizacji cache'owania .
Oba modele przeznaczone są wyłącznie do tekstu i oparte na architekturze Mixture-of-Experts (MoE). Są w pełni open-weight, dostępne na licencji MIT, co oznacza możliwość samodzielnego hostowania .
| Specyfikacja | DeepSeek V4-Pro | DeepSeek V4-Flash |
|---|---|---|
| Całkowita liczba parametrów | 1,6 biliona | 284 miliardy |
| Aktywne parametry na token | ~49 miliardów | ~13 miliardów |
| Okno kontekstu | 1 000 000 tokenów | 1 000 000 tokenów |
| Maksymalna długość odpowiedzi | 384 000 tokenów | 384 000 tokenów |
| Licencja | MIT | MIT |
Oba modele oferują trzy tryby wnioskowania: Non-think (szybki, intuicyjny), Think High (analityczny z łańcuchem myśli) oraz Think Max (dogłębne rozumowanie) .
Nowe ceny całkowicie zmieniają pozycjonowanie DeepSeek na rynku. Poniższe zestawienie uwzględnia standardowe stawki API dla krótkiego kontekstu (za 1 mln tokenów) dla wszystkich dostawców.
| Model | Wejście (za 1 mln) | Wyjście (za 1 mln) |
|---|---|---|
| DeepSeek V4-Pro (szczyt) | ~$0,87–$0,98 | $3,96 |
| DeepSeek V4-Flash (szczyt) | ~$0,42 | $1,26 |
| OpenAI GPT-5.6 Luna | $0,20 | $1,20 |
| Anthropic Claude Fable 5 | $10,00 | $50,00 |
OpenAI 30 lipca 2026 roku obniżyło ceny GPT-5.6 Luna o 80%, do $0,20 za wejście i $1,20 za wyjście na 1 mln tokenów . Obraz konkurencji zmienił się diametralnie:
Flagowy model Anthropic do zaawansowanego rozumowania kosztuje $10 (wejście) i $50 (wyjście) za 1 mln tokenów . Przy takich stawkach DeepSeek wciąż pozostaje opcją ekonomiczną:
Nawet przy nowych, wyższych stawkach, oba modele DeepSeek pozostają znacznie bardziej przystępne cenowo niż topowa oferta Anthropica .
Ceny dla Grok 4.6 nie były dostępne w dostarczonych źródłach, więc nie można dokonać bezpośredniego porównania.
DeepSeek jako główny powód podaje gwałtownie rosnący popyt przeciążający moce obliczeniowe . Modele V4 po premierze w kwietniu 2026 roku zyskały ogromną popularność, tworząc wąskie gardła w dostępie do procesorów graficznych (GPU), których firma nie mogła już dłużej pokrywać przy ultra-niskich cenach
.
Nałożyło się na to kilka czynników:
Podwyżki cen DeepSeek oznaczają koniec ery, w której chiński startup był powszechnie uznawany za najbardziej przystępnego cenowo dostawcę zaawansowanych modeli AI. Teraz jego ceny w niektórych aspektach zbliżyły się do najtańszej oferty OpenAI, wciąż jednak pozostają o rząd wielkości niższe od premium tieru Anthropica. Dla programistów połączenie taryf szczytowych/pozaszczytowych, głębokich zniżek za cache i w pełni otwartej licencji MIT oznacza, że o ostatecznym rachunku za API coraz częściej decydować będzie architektura i harmonogram pracy, a nie tylko sam wybór modelu.