A mudança ocorreu cerca de três semanas depois do lançamento público da família GPT-5.6, em 9 de julho de 2026 . Segundo a OpenAI, a redução foi possível graças a ganhos de eficiência na arquitetura e na infraestrutura de atendimento dos modelos. Analistas e veículos especializados também relacionaram o anúncio à pressão por custos menores no mercado corporativo de inteligência artificial .
Descrito pela OpenAI como o modelo mais rápido e acessível da linha, o GPT-5.6 Luna teve uma redução de 80% nos preços da API . Os valores da categoria padrão passaram a ser:
| Métrica | Preço anterior por 1 milhão de tokens | Novo preço por 1 milhão de tokens |
|---|---|---|
| Entrada | US$ 1,00 | US$ 0,20 |
| Entrada em cache | — | US$ 0,10 |
| Saída | US$ 6,00 | US$ 1,20 |
Considerando apenas a soma dos preços de entrada e saída, o custo do Luna passa a ser de US$ 1,40 por milhão de tokens . A cobrança é feita de acordo com o volume de tokens processados pela API.
Para comparação, o GPT-5.6 Terra, modelo intermediário voltado a equilibrar capacidade e custo, caiu de US$ 2,50 para US$ 2,00 por 1 milhão de tokens de entrada e de US$ 15,00 para US$ 12,00 por 1 milhão de tokens de saída. Já o GPT-5.6 Sol continua custando US$ 5,00 na entrada e US$ 30,00 na saída, por milhão de tokens .
Os novos preços entraram em vigor imediatamente em 30 de julho e se aplicam ao nível padrão da API .
A empresa apresentou duas explicações relacionadas para o corte.
Em seu anúncio oficial, a OpenAI afirmou que aprimorou todas as camadas do sistema, incluindo o código e as ferramentas de otimização responsáveis por executar os modelos. A promessa é entregar “substancialmente mais inteligência por dólar” e avançar a relação entre desempenho e preço .
Parte dos ganhos veio de melhorias nos kernels — componentes de código usados no processamento do modelo. De acordo com a empresa, esse trabalho reduziu em 20% o custo total de atendimento dos modelos, enquanto outros testes elevaram em mais de 15% a eficiência na geração de tokens .
A OpenAI também afirmou que o próprio GPT-5.6 Sol ajudou a reescrever automaticamente kernels usados em produção, contribuindo para uma redução de 20% nos custos de execução .
A redução também acontece em um momento de maior pressão sobre os gastos corporativos com IA. Empresas têm sido mais cuidadosas ao adotar modelos caros quando ainda não está claro o retorno sobre o investimento .
Além disso, modelos de pesos abertos mais baratos, incluindo alternativas desenvolvidas na China, aumentaram a pressão sobre empresas como OpenAI e Anthropic para provar que seus sistemas justificam preços mais altos . A Reuters resumiu o cenário dizendo que os cortes refletem tanto os ganhos de eficiência do GPT-5.6 quanto o maior escrutínio das despesas com IA por parte das empresas .
O CEO da OpenAI, Sam Altman, anunciou a mudança no X, antigo Twitter, com a seguinte mensagem: “Queremos oferecer a melhor relação entre preço e inteligência em todos os níveis” .
Para quem usa a API em aplicações de alto volume, a queda de 80% no preço do Luna pode reduzir significativamente o custo de tarefas que priorizam velocidade e eficiência. O modelo tende a ser especialmente atraente para automações, fluxos de atendimento e outros serviços que processam grandes quantidades de texto, embora a escolha final dependa da capacidade exigida pela aplicação .
Os cortes também se refletem na forma como o uso dos modelos é contabilizado em assinaturas pagas do ChatGPT Work e do Codex. Na prática, assinantes corporativos podem realizar mais trabalho com IA sem aumentar o gasto, porque Luna e Terra passam a consumir menos créditos de uso .
A decisão marca uma mudança importante na estratégia de preços da OpenAI. Em vez de manter o valor dos modelos recém-lançados, a empresa está usando ganhos de eficiência para tornar as versões mais acessíveis — ao mesmo tempo em que responde a clientes corporativos mais sensíveis a custos e a uma disputa cada vez mais intensa no mercado de IA.