| 13 czerwca 2026 |
| 744 mld parametrów całkowitych, 40 mld aktywnych, kontekst 1 mln tokenów; uznany za najlepszy model open-weight na świecie w indeksie Artificial Analysis Intelligence Index |
| DeepSeek | V4-Flash / V4-Pro | Czerwiec–sierpień 2026 | V4-Flash: 0,14 USD/min tokenów wejściowych; V4-Pro: 0,435 USD/min po obniżce cen w czerwcu 2026 |
| Alibaba | Qwen 3.7 Max / Plus / Flash | Maj–czerwiec 2026 | Flagowy model MoE z 2,8 bln parametrów; Qwen3.7 Max: 1,25/3,75 USD za milion tokenów; Qwen3.6 Flash: 0,19/1,13 USD |
| Moonshot AI | Kimi K3 | 16 lipca 2026 | 2,8 bln parametrów całkowitych, ~50 mld aktywnych, kontekst 1 mln; obiecano pełne open-source do 27 lipca |
| Z.ai | Model konkurencyjny dla Fable 5 | Koniec czerwca 2026 | Zaprezentowany wkrótce po tym, jak Anthropic wycofał dwa zaawansowane modele na żądanie rządu USA |
Różnica w kosztach jest ekstremalna. DeepSeek V4-Flash kosztuje 0,14 USD za milion tokenów wejściowych – ponad 100 razy taniej niż Anthropic Claude Fable 5 . Alibaba Qwen3.6 Flash kosztuje 0,19 USD za milion tokenów wejściowych, podczas gdy amerykańskie modele, takie jak GPT-5.5 i Claude Opus 4.8, są przy porównywalnej wydajności od 7 do 12 razy droższe . Nawet Kimi K3, najdroższy chiński model (3 USD za milion tokenów wejściowych, 15 USD za wyjściowe), jest wciąż znacznie tańszy od amerykańskich odpowiedników, a dodatkowo jego wagi open-source pozwalają na całkowicie darmowe uruchomienie we własnym zakresie .