O Qwen 3.7 Max da Alibaba, lançado em maio de 2026, é um modelo carro-chefe de 2,8 trilhões de parâmetros com arquitetura de mistura de especialistas (MoE) que pareceu igualar ou superar o Fable 5 da Anthropic em benchmarks, por cerca de um sexto do custo . Para uso de alto volume, o Qwen3.6 Flash da Alibaba custa apenas US$ 0,19 por milhão de tokens de entrada .
O GLM-5.2 da Zhipu AI, lançado em 13 de junho de 2026, usa uma arquitetura MoE de 744 bilhões de parâmetros (40 bilhões ativos) com uma janela de contexto de 1 milhão de tokens e foi classificado como o modelo de peso aberto nº 1 no Índice de Inteligência Artificial Analysis . Com preço de US$ 1,40 por milhão de tokens de entrada e US$ 4,40 por milhão de saída, ele prejudica os modelos de fronteira dos EUA em cerca de 5 a 6 vezes .
O Kimi K3 da Moonshot AI, revelado em 16 de julho de 2026, é o maior sistema de IA de peso aberto já anunciado: 2,8 trilhões de parâmetros totais, uma janela de contexto de 1 milhão de tokens e compreensão visual nativa . A Moonshot prometeu disponibilizar os pesos abertos completos até 27 de julho de 2026 . O preço de sua API é de US$ 3 por milhão de tokens de entrada e US$ 15 por milhão de saída, tornando-o o modelo chinês mais caro — ainda assim abaixo das ofertas comparáveis dos EUA .
O fosso de custo entre os modelos de fronteira chineses e americanos é extremo:
| Modelo | Preço de Entrada (por 1M de tokens) | Preço de Saída (por 1M de tokens) |
|---|---|---|
| DeepSeek V4-Flash | $0,14 | $0,28 |
| Alibaba Qwen3.6 Flash | $0,19 | $1,13 |
| Zhipu GLM-5.2 | $1,40 | $4,40 |
| Alibaba Qwen3.7 Max | $1,25 | $3,75 |
| Moonshot Kimi K3 | $3,00 | $15,00 |
| Anthropic Claude Fable 5 (est.) | ~$15,00 | ~$50,00 |
| OpenAI GPT-5.5 (est.) | ~$5,00 | ~$15,00 |
Fontes: Tabela anterior e
Os números contam a história: estima-se que o V4-Flash da DeepSeek custe 3 centavos de dólar por teste de benchmark, contra US$ 1,86 do GPT-5.5 e US$ 3,33 do Claude Fable 5 . O capitalista de risco Marc Andreessen observou que o GLM-5.2 foi "o primeiro modelo de IA chinês a igualar e frequentemente vencer os modelos públicos de IA dos grandes laboratórios americanos sem concessões" — por uma fração do preço .
O segundo vetor da estratégia chinesa é o lançamento de pesos abertos. Modelos como GLM-5.2 (licença MIT), Kimi K3 (licença MIT Modificada prometida) e a série Qwen podem ser baixados gratuitamente, o que significa que qualquer pessoa pode executá-los, modificá-los ou ajustá-los sem custo por token . Essa estratégia de "doar modelos" corrói o mercado intermediário, onde as empresas dos EUA costumavam cobrar preços premium .
Um ponto de virada importante ocorreu em junho de 2026, quando o governo Trump pediu à Anthropic que interrompesse as operações de seus dois sistemas de IA mais avançados (Fable e Mythos) por motivos de segurança nacional . Em duas semanas, a Z.ai revelou um modelo que rivalizava de perto com as ofertas da Anthropic — mais acessível e sem restrições dos EUA . As empresas chinesas viram uma oportunidade e correram para preencher a lacuna .
A resposta dos EUA tem sido fragmentada. A Anthropic cumpriu a solicitação do governo. O Google, segundo relatos, está enfrentando dificuldades com a versão mais recente de seu modelo Gemini, enquanto os modelos chineses fecham a lacuna . Nenhuma contramedida política coordenada importante foi anunciada; analistas observam que os controles de exportação de chips não impediram as empresas chinesas de alcançar desempenho competitivo por meio de eficiência arquitetural (por exemplo, MoE, atenção híbrida) em vez de poder computacional bruto .
Enquanto isso, empresas dos EUA estão cada vez mais testando e adotando modelos chineses por razões de custo, corroendo ainda mais a vantagem de jogar em casa dos laboratórios americanos de IA .