Alibaba Qwen 3.7 Max, wprowadzony w maju 2026 roku, to flagowy model mieszanki ekspertów (MoE) z 2,8 biliona parametrów, który w testach porównawczych dorównywał lub przewyższał model Fable 5 od Anthropic, przy mniej więcej jednej szóstej kosztów . Dla zastosowań o dużej objętości Alibaba oferuje Qwen3.6 Flash za jedyne 0,19 USD za milion tokenów wejściowych .
Zhipu AI GLM-5.2, wydany 13 czerwca 2026 roku, wykorzystuje architekturę MoE z 744 miliardami parametrów (40 miliardów aktywnych), oknem kontekstowym 1 miliona tokenów i został uznany za model open-weight nr 1 w indeksie Artificial Analysis Intelligence Index . Wyceniony na 1,40 USD za milion tokenów wejściowych i 4,40 USD za milion wyjściowych, jest około 5-6 razy tańszy od amerykańskich modeli z czołówki .
Moonshot AI Kimi K3, zaprezentowany 16 lipca 2026 roku, to największy kiedykolwiek ogłoszony system AI typu open-weight: łącznie 2,8 biliona parametrów, okno kontekstowe 1 miliona tokenów i natywne rozumienie obrazu . Moonshot obiecał udostępnienie pełnych wag do 27 lipca 2026 roku . Jego cena API wynosi 3 USD za milion tokenów wejściowych i 15 USD za milion wyjściowych, co czyni go najdroższym chińskim modelem – ale wciąż tańszym od porównywalnych ofert amerykańskich .
Różnica w kosztach między chińskimi a amerykańskimi modelami z czołówki jest ekstremalna:
| Model | Cena wejściowa (za 1M tokenów) | Cena wyjściowa (za 1M tokenów) |
|---|---|---|
| DeepSeek V4-Flash | 0,14 USD | 0,28 USD |
| Alibaba Qwen3.6 Flash | 0,19 USD | 1,13 USD |
| Zhipu GLM-5.2 | 1,40 USD | 4,40 USD |
| Alibaba Qwen3.7 Max | 1,25 USD | 3,75 USD |
| Moonshot Kimi K3 | 3,00 USD | 15,00 USD |
| Anthropic Claude Fable 5 (szac.) | ~15,00 USD | ~50,00 USD |
| OpenAI GPT-5.5 (szac.) | ~5,00 USD | ~15,00 USD |
Źródła: Na podstawie poprzedniej tabeli oraz
Liczby mówią same za siebie: szacunkowy koszt uruchomienia DeepSeek V4-Flash w teście porównawczym to 3 centy, podczas gdy GPT-5.5 kosztuje 1,86 USD, a Claude Fable 5 – 3,33 USD . Inwestor venture capital Marc Andreessen zauważył, że GLM-5.2 jest „pierwszym chińskim modelem AI, który bez żadnych kompromisów dorównuje, a często przewyższa publiczne modele AI z dużych amerykańskich laboratoriów” – i to za ułamek ceny .
Drugim ostrzem chińskiej strategii jest udostępnianie wag modeli. Modele takie jak GLM-5.2 (licencja MIT), Kimi K3 (obiecywana zmodyfikowana licencja MIT) i seria Qwen można swobodnie pobierać, co oznacza, że każdy może je uruchomić, modyfikować lub dostrajać bez ponoszenia kosztów za token . Ta strategia „rozdawania modeli” pustoszy rynek średniej półki, gdzie amerykańskie firmy pobierały niegdyś wysokie ceny .
Kluczowym punktem zwrotnym był czerwiec 2026 roku, kiedy administracja Trumpa poprosiła Anthropic o zaprzestanie działania jego dwóch najbardziej zaawansowanych systemów AI (Fable i Mythos) ze względów bezpieczeństwa narodowego . W ciągu dwóch tygodni Z.ai zaprezentował model, który ściśle rywalizował z ofertą Anthropic – był tańszy i nie podlegał amerykańskim ograniczeniom . Chińskie firmy dostrzegły szansę i pospieszyły, by ją wykorzystać .
Reakcja USA jest chaotyczna. Anthropic zastosował się do prośby rządu. Google podobno ma problemy z najnowszą wersją swojego modelu Gemini, podczas gdy chińskie modele zamykają lukę . Nie ogłoszono żadnych skoordynowanych działań politycznych; analitycy zauważają, że kontrole eksportu układów scalonych nie powstrzymały chińskich firm przed osiągnięciem konkurencyjnej wydajności dzięki wydajności architektonicznej (np. MoE, hybrydowa uwaga), a nie sile obliczeniowej .
Tymczasem amerykańskie firmy coraz częściej testują i przyjmują chińskie modele ze względów kosztowych, co dodatkowo podważa przewagę amerykańskich laboratoriów AI .