Zhipu AI GLM-5.2, wydany 13 czerwca 2026 roku, wykorzystuje architekturę MoE z 744 miliardami parametrów (40 miliardów aktywnych), oknem kontekstowym 1 miliona tokenów i został uznany za model open-weight nr 1 w indeksie Artificial Analysis Intelligence Index . Wyceniony na 1,40 USD za milion tokenów wejściowych i 4,40 USD za milion wyjściowych, jest około 5-6 razy tańszy od amerykańskich modeli z czołówki
.
Moonshot AI Kimi K3, zaprezentowany 16 lipca 2026 roku, to największy kiedykolwiek ogłoszony system AI typu open-weight: łącznie 2,8 biliona parametrów, okno kontekstowe 1 miliona tokenów i natywne rozumienie obrazu . Moonshot obiecał udostępnienie pełnych wag do 27 lipca 2026 roku
. Jego cena API wynosi 3 USD za milion tokenów wejściowych i 15 USD za milion wyjściowych, co czyni go najdroższym chińskim modelem – ale wciąż tańszym od porównywalnych ofert amerykańskich
.
Różnica w kosztach między chińskimi a amerykańskimi modelami z czołówki jest ekstremalna:
Liczby mówią same za siebie: szacunkowy koszt uruchomienia DeepSeek V4-Flash w teście porównawczym to 3 centy, podczas gdy GPT-5.5 kosztuje 1,86 USD, a Claude Fable 5 – 3,33 USD . Inwestor venture capital Marc Andreessen zauważył, że GLM-5.2 jest „pierwszym chińskim modelem AI, który bez żadnych kompromisów dorównuje, a często przewyższa publiczne modele AI z dużych amerykańskich laboratoriów” – i to za ułamek ceny
.
Drugim ostrzem chińskiej strategii jest udostępnianie wag modeli. Modele takie jak GLM-5.2 (licencja MIT), Kimi K3 (obiecywana zmodyfikowana licencja MIT) i seria Qwen można swobodnie pobierać, co oznacza, że każdy może je uruchomić, modyfikować lub dostrajać bez ponoszenia kosztów za token . Ta strategia „rozdawania modeli” pustoszy rynek średniej półki, gdzie amerykańskie firmy pobierały niegdyś wysokie ceny
.
Kluczowym punktem zwrotnym był czerwiec 2026 roku, kiedy administracja Trumpa poprosiła Anthropic o zaprzestanie działania jego dwóch najbardziej zaawansowanych systemów AI (Fable i Mythos) ze względów bezpieczeństwa narodowego . W ciągu dwóch tygodni Z.ai zaprezentował model, który ściśle rywalizował z ofertą Anthropic – był tańszy i nie podlegał amerykańskim ograniczeniom
. Chińskie firmy dostrzegły szansę i pospieszyły, by ją wykorzystać
.
Reakcja USA jest chaotyczna. Anthropic zastosował się do prośby rządu. Google podobno ma problemy z najnowszą wersją swojego modelu Gemini, podczas gdy chińskie modele zamykają lukę . Nie ogłoszono żadnych skoordynowanych działań politycznych; analitycy zauważają, że kontrole eksportu układów scalonych nie powstrzymały chińskich firm przed osiągnięciem konkurencyjnej wydajności dzięki wydajności architektonicznej (np. MoE, hybrydowa uwaga), a nie sile obliczeniowej
.