Хвиля релізів охоплює кілька китайських лабораторій, кожна з яких просуває межі розміру, можливостей та доступності моделей.
Серія DeepSeek V4 націлена на лідерство за вартістю. V4-Flash коштує $0,14 за мільйон вхідних токенів — більш ніж у 100 разів дешевше за Anthropic Claude Fable 5 за підрахунками дослідницької фірми Artificial Analysis . V4-Pro після зниження ціни в червні 2026 року зупинився на $0,435 за мільйон вхідних токенів .
Alibaba Qwen 3.7 Max, запущений у травні 2026 року, є флагманською моделлю з 2,8 трильйона параметрів на основі архітектури mixture-of-experts (MoE). Він зрівнявся або перевершив Anthropic Fable 5 за тестами приблизно за шосту частину вартості . Для високонавантажених завдань Alibaba пропонує Qwen3.6 Flash всього за $0,19 за мільйон вхідних токенів .
Zhipu AI GLM-5.2, випущений 13 червня 2026 року, використовує архітектуру MoE з 744 мільярдами параметрів (40 мільярдів активних), контекстним вікном на 1 мільйон токенів і посів перше місце серед моделей з відкритою вагою в Індексі інтелекту Artificial Analysis . За ціни $1,40 за вхідний та $4,40 за вихідний мільйон токенів, він приблизно в 5-6 разів дешевший за американські фронтирні моделі .
Moonshot AI Kimi K3, представлений 16 липня 2026 року, є найбільшою системою штучного інтелекту з відкритою вагою, коли-небудь анонсованою: 2,8 трильйона загальних параметрів, контекстне вікно на 1 мільйон токенів і вбудоване розуміння зображень . Moonshot пообіцяв випустити повні ваги до 27 липня 2026 року . Ціна API становить $3 за вхідний та $15 за вихідний мільйон токенів, що робить її найдорожчою китайською моделлю, але все ще дешевшою за порівнянні американські пропозиції .
Різниця у вартості між китайськими та американськими фронтирними моделями є екстремальною:
| Модель | Вхідні токени (за 1 млн) | Вихідні токени (за 1 млн) |
|---|---|---|
| DeepSeek V4-Flash | $0,14 | $0,28 |
| Alibaba Qwen3.6 Flash | $0,19 | $1,13 |
| Zhipu GLM-5.2 | $1,40 | $4,40 |
| Alibaba Qwen3.7 Max | $1,25 | $3,75 |
| Moonshot Kimi K3 | $3,00 | $15,00 |
| Anthropic Claude Fable 5 (прибл.) | ~$15,00 | ~$50,00 |
| OpenAI GPT-5.5 (прибл.) | ~$5,00 | ~$15,00 |
Джерела: таблиця та
Цифри говорять самі за себе: V4-Flash від DeepSeek коштує приблизно 3 центи за тест, тоді як GPT-5.5 — $1,86, а Claude Fable 5 — $3,33 . Венчурний капіталіст Марк Андріссен зазначив, що GLM-5.2 став «першою китайською AI-моделлю, яка без компромісів відповідає і часто перевершує публічні моделі великих американських лабораторій» — за частку ціни .
Другий напрямок китайської стратегії — випуск моделей з відкритою вагою. Моделі, такі як GLM-5.2 (ліцензія MIT), Kimi K3 (обіцяна модифікована ліцензія MIT) та серія Qwen, є вільно завантажуваними, що означає, що кожен може запускати, налаштовувати або донавчати їх без оплати за токен . Ця стратегія «роздачі моделей» підриває середній сегмент ринку, де американські фірми раніше встановлювали високі ціни .
Ключовим поворотним моментом став червень 2026 року, коли адміністрація Трампа попросила Anthropic припинити роботу двох своїх найдосконаліших систем (Fable та Mythos) з міркувань національної безпеки . Протягом двох тижнів Z.ai представив модель, яка тісно конкурувала з пропозиціями Anthropic — доступніша та без американських обмежень . Китайські компанії побачили вікно можливостей і кинулися його заповнювати .
Реакція США поки що фрагментована. Anthropic виконав вимогу уряду. Google, за повідомленнями, має труднощі з останньою версією своєї моделі Gemini, оскільки китайські моделі скорочують розрив . Жодних скоординованих контрзаходів з боку США не оголошено; аналітики зазначають, що експортний контроль на мікросхеми не завадив китайським фірмам досягти конкурентної продуктивності завдяки архітектурній ефективності (наприклад, MoE, гібридна увага), а не грубій обчислювальній потужності .
Тим часом американські компанії все частіше тестують і впроваджують китайські моделі з міркувань економії, що ще більше підриває перевагу американських AI-лабораторій на домашньому ринку .