Durante o podcast 'Hard Fork', Satya Nadella confessou ser um 'tokenmaxxer' e determinou que seus funcionários parem de usar modelos de IA de fronteira para resolver problemas rotineiros, um hábito que classificou com... O recado coincide com uma guinada estratégica na Microsoft, que incluiu o cancelamento de licenç...

Create a landscape editorial hero image for this Studio Global article: What did Microsoft CEO Satya Nadella say about tokenmaxxing — the wasteful overuse of powerful AI models for routine tasks — at The New York. Article summary: On the June 10, 2026 live taping of *The New York Times*' "Hard Fork" podcast, Microsoft CEO Satya Nadella delivered a striking warning to his own employees about **tokenmaxxing** — the wasteful habit of using the most p. Topic tags: general, news, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "On the supply side, Nadella says that AI companies and policy makers must build out "a ubiquitous grid of energy and tokens," which is the task" source context "Microsoft CEO warns that we must 'do something useful' with AI or they'll lose 'social permission' to burn electricity o" Reference image 2: visual
Em uma gravação ao vivo do podcast "Hard Fork", do The New York Times, o CEO da Microsoft, Satya Nadella, foi além de discutir o potencial da inteligência artificial e expôs um dos segredos mais incômodos da tecnologia. Ele repreendeu seus próprios funcionários por estarem queimando dinheiro ao usar os modelos de IA mais poderosos — e caros — para tarefas corriqueiras. Confira o que ele disse, por que isso é tão relevante agora e como essa fala se conecta a uma transformação profunda na forma como a Microsoft planeja lucrar na era da IA.
Questionado sobre o "tokenmaxxing" — o hábito perdulário e viciante de usar IA de ponta para perguntas banais —, Nadella foi direto. Antes que o coapresentador Casey Newton terminasse a pergunta, ele respondeu: "Muito."
Em seguida, fez uma confissão surpreendente: "Eu também sou um tokenmaxxer, é viciante." Mas logo emendou uma ressalva crucial: "É preciso dar um passo atrás quando a novidade passar e se perguntar: 'O que estou tentando criar?'"
Sua principal diretriz foi memorável pela clareza: "Não usem modelos de fronteira para problemas que não são de fronteira." Ele pediu que os colaboradores calibrem o uso da IA, citando o modo automático do Copilot como uma ferramenta que já existe para direcionar cada tarefa ao modelo de tamanho adequado, que é muito mais barato.
Aquilo não foi um comentário casual de entrevista. Foi um CEO mirando diretamente um problema cultural e financeiro dentro das paredes da sua própria empresa, sinalizando o fim da "fase de novidade da IA".
A bronca pública de Nadella é apenas a ponta de um iceberg muito maior. A economia da IA mudou drasticamente, e o velho hábito de sempre acionar o modelo mais potente para qualquer pergunta se tornou uma ameaça direta às margens de lucro. As IAs agênticas, que encadeiam múltiplas chamadas de modelo para completar uma tarefa, podem consumir até 1.000 vezes mais tokens do que uma consulta simples .
Para se ter uma ideia concreta da explosão de custos, Peter Steinberger, criador do OpenClaw, afirmou que sua equipe gastou mais de US$ 1,3 milhão em tokens rodando agentes de IA . Até a Microsoft sentiu a pressão; a empresa cancelou licenças diretas do Claude Code e passou a direcionar engenheiros para o GitHub Copilot CLI, não só por preferência de fornecedor, mas porque o custo de usar modelos de IA de terceiros para codificação rotineira estava saindo do controle
.
O próprio Nadella resumiu isso a uma verdade simples: trate a IA de ponta como um recurso industrial escasso e caro, não como uma utilidade gratuita .
O alerta de Nadella no "Hard Fork" está diretamente ligado a uma transformação abrangente do modelo de negócios central da Microsoft. A empresa está abandonando o mundo onde podia simplesmente cobrar uma taxa fixa por usuário humano para entrar em outro, no qual o consumo imprevisível (e explosivo) de agentes de IA é que dita a conta.
1. Casamento entre Modelo e Tarefa como Competência Central
A busca por eficiência vai muito além de um memorando sobre corte de gastos. No Microsoft Build 2026, Nadella apresentou uma visão na qual cada empresa precisa construir sua própria "inteligência de fronteira" — uma combinação de modelos, dados e avaliações privadas — em vez de depender cegamente de um único e caríssimo modelo de linguagem de grande escala . Sua ordem para evitar modelos de ponta para problemas simples é um princípio fundamental de negócio, e não só uma requisição do departamento de TI.
2. Agentes de IA Gerenciados como Funcionários
Nadella vem consistentemente defendendo que agentes de IA sejam tratados como "funcionários digitais". Isso vai além da filosofia e chega ao licenciamento. A Microsoft estaria planejando novos planos empresariais do Microsoft 365 que cobram por agente, e não por usuário humano, exigindo que os agentes tenham identidade, endereço de e-mail e políticas de acesso próprios, como qualquer outro colaborador . Como o próprio Nadella colocou, o negócio está migrando de uma "empresa de ferramentas para o usuário final" para uma "empresa de infraestrutura para dar suporte a agentes que realizam trabalho"
.
3. A Transição para a Precificação Híbrida
O futuro da receita da Microsoft depende de um novo modelo de precificação que Nadella delineou na teleconferência de resultados do terceiro trimestre de 2026: uma mudança da "tradicional cobrança por usuário para o emergente modelo de usuários mais consumo" . Quase 60% dos clientes da área de atendimento ao consumidor já estão em créditos baseados em uso, e a empresa migrou o GitHub Copilot para uma precificação alinhada ao uso a partir de 1º de junho de 2026
. O velho modelo SaaS de cobrança fixa por pessoa simplesmente não sobrevive quando um único fluxo de trabalho agêntico pode consumir mais computação que milhares de interações humanas; a Microsoft agora mescla uma licença básica previsível com cobranças adicionais para computação pesada
.
4. Uma Indústria Forçada a se Tornar Eficiente
O comentário de Nadella reflete uma realidade estrutural em todo o cenário de IA. OpenAI, Anthropic e GitHub faturam por consumo de tokens, o que fundamentalmente recompensa a eficiência e pune o desperdício . Uma projeção do Goldman Sachs indica que a carga de trabalho agêntica poderá impulsionar um aumento de 24 vezes no consumo de tokens até 2030, atingindo espantosos 120 quatrilhões de tokens por mês
. Nesse ambiente, as empresas que dominarem a disciplina de enviar o resumo de um e-mail para um modelo pequeno e barato — e reservar o poder de ponta para problemas genuinamente complexos — vencerão em estrutura de custos. As que não fizerem isso vão se afogar nas próprias contas de nuvem
.
A confissão de Nadella — "Eu também sou um tokenmaxxer" — não foi só um momento de honestidade cativante. Foi uma diretriz cultural e estratégica cuidadosamente calibrada, sinalizando que a era da IA na Microsoft deixou para trás o estágio experimental e despreocupado para inaugurar uma fase em que disciplina de custo, roteamento inteligente de modelos e licenciamento baseado em agentes definirão os vencedores e perdedores do mundo corporativo.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Durante o podcast 'Hard Fork', Satya Nadella confessou ser um 'tokenmaxxer' e determinou que seus funcionários parem de usar modelos de IA de fronteira para resolver problemas rotineiros, um hábito que classificou com...
Durante o podcast 'Hard Fork', Satya Nadella confessou ser um 'tokenmaxxer' e determinou que seus funcionários parem de usar modelos de IA de fronteira para resolver problemas rotineiros, um hábito que classificou com... O recado coincide com uma guinada estratégica na Microsoft, que incluiu o cancelamento de licenças do Claude Code e a transição para um modelo híbrido de cobrança de IA, que mescla uma taxa fixa por usuário com custos...
A declaração reflete um momento de amadurecimento do mercado, impulsionado pelo fato de que fluxos de trabalho com agentes de IA podem consumir até mil vezes mais tokens do que uma consulta simples, tornando a escolha...