O principal motor é o preço. O DeepSeek V4 Flash custa US$ 0,14 por milhão de tokens de entrada e US$ 0,28 por milhão de tokens de saída — cerca de US$ 0,03 por teste de benchmark, tornando-o o modelo de IA mais barato para executar globalmente . Testes independentes da empresa de pesquisa Artificial Analysis mostram que ele é cerca de 105 vezes mais barato que o Claude Fable 5 da Anthropic para executar em uma avaliação de benchmark padrão . Startups de IA no exterior que mudaram para modelos chineses relataram redução nos custos mensais de inferência em 60% a 85% .
A enxurrada de modelos chineses de baixo custo criou o que o Los Angeles Times descreve como uma "zona da morte para qualquer um que não tenha tecnologia de ponta ou preços competitivos" .
Nenhuma evidência de cortes de preços específicos da xAI (Grok) foi encontrada nas fontes disponíveis.
O Kimi K3 da Moonshot AI, lançado em 16-17 de julho de 2026, causou um choque separado, mas relacionado, no mercado. É um modelo de mistura de especialistas (MoE) com 2,8 trilhões de parâmetros e uma janela de contexto de 1 milhão de tokens, com preço de US$ 3 por milhão de tokens de entrada e US$ 15 por milhão de tokens de saída (com entrada em cache a US$ 0,30) . Embora seja o modelo mais caro que um laboratório chinês já lançou, ele ainda assim custava cerca de 70% menos que o Claude Fable 5 da Anthropic (Fable 5 custa US$ 10/US$ 50 por milhão de tokens) .
O Kimi K3 foi lançado com pesos abertos (agendado para 27 de julho), tornando a inteligência de nível de fronteira abertamente disponível. O anúncio desencadeou uma liquidação na Nasdaq, enquanto os investidores reavaliam o cenário competitivo para as empresas de IA dos EUA . Seu preço é cerca de um terço do modelo Fable da Anthropic .
Em 6 de agosto de 2026, a DeepSeek avisou sobre um aumento de preço "significativo" em seus serviços de API, instando os desenvolvedores a "planejar seu uso de acordo" . A empresa não especificou as novas taxas exatas ou uma data de vigência, apenas que o aumento seria "relativamente grande" . O preço atual do V4 Flash permanece em US$ 0,14 de entrada / US$ 0,28 de saída por milhão de tokens .
Os analistas interpretam isso como um sinal de que o preço ultra-barato do DeepSeek pode ter sido uma estratégia insustentável de 'loss leader' para conquistar participação de mercado e que a empresa agora se sente confiante o suficiente em sua base de usuários para aumentar os preços . Observadores também notam que a DeepSeek já havia feito um corte permanente de 75% em seu modelo carro-chefe V4-Pro em maio de 2026, comprimindo ainda mais as margens . O Taipei Times informou que "algumas das empresas de IA mais badaladas da China estão aumentando as taxas à medida que suas ofertas de código aberto ganham tração entre empresas e programadores em todo o mundo" .
As guerras de IA não são mais apenas sobre pontuações em benchmarks. Elas são sobre o custo da inteligência em si. Os laboratórios chineses provaram que um desempenho próximo ao da fronteira poderia ser entregue a uma fração do preço americano, forçando toda a indústria a redefinir as expectativas. Os próximos meses mostrarão se a guerra de preços continuará a se aprofundar ou se o mercado se estabilizará — mas, por enquanto, a era da IA chinesa chocantemente barata já remodelou o cenário global.