Microsoft is de primaire investeerder in OpenAI en de exclusieve wederverkoper van haar modellen via Azure, maar intern ontdekte men dat ingenieurs dure frontier-modellen gebruikten voor triviale taken, wat kosten dreef die zelfs het eigen financiële team niet kon tolereren . Executive Vice President Jay Parikh stuurde een e-mail met de boodschap 'tokenmaxxen is niet waar we voor optimaliseren' en kondigde aan dat divisies vanaf juli 2026 AI-tokenbudgetdoelstellingen zouden krijgen .
'Tokenmaxxen' werd een verslavend spelletje. Ingenieurs concurreerden op interne ranglijsten om zoveel mogelijk tokens te verbruiken — de AI-equivalent van het behandelen van rekenkracht als fantasy-footballpunten . De praktijk dreef het verbruik op zonder meetbare bedrijfswaarde, omdat bedrijven ontdekten dat 'AI overal tegenaan gooien' de kosten opdreef zonder een evenredige productiviteitspiek .
Satya Nadella moest zelf ingrijpen en vertelde medewerkers te stoppen met het gebruiken van de krachtigste AI-modellen voor elke taak en het model te matchen met het probleem . Het bedrijf schakelde zijn interne standaardmodel over op de goedkopere GPT-5.6 en trok Claude Code-licenties voor de meeste medewerkers in om het bloeden te stoppen .
De industrie beweegt van tokenvolume als ijdelheidsstatistiek naar resultaatgericht meten van AI-rendement.
Ranglijsten verdwijnen. Amazon en Meta hebben allebei interne AI-tokenranglijsten afgeschaft nadat medewerkers ze manipuleerden . Meta-CTO Andrew Bosworth waarschuwde personeel: 'Niet alle beweging is vooruitgang en tokenverbruik alleen is geen maatstaf voor impact van welke aard dan ook' .
Tokentelling vervangen door implementatiestatistieken. Amazon verving zijn 'KiroRank'-systeem door 'genormaliseerde implementaties' — het tellen van AI-ondersteunde code die daadwerkelijk in productie gaat .
Budgetbeheer over maximalisatie van gebruik. Atlassian legde uitgaven aan banden nadat de maandelijkse AI-rekening was opgelopen van ruwweg $5 miljoen naar meer dan $15 miljoen . Citi trok tijdelijk de toegang tot de nieuwste Claude- en ChatGPT-modellen voor ontwikkelaars in nadat zij 'de primaire aanjager van verhoogd enterprise-verbruik' van gepoolde AI-credits waren geworden .
Per-ingenieurcaps en modellen op maat. Meta overweegt per-ingenieur AI-tokencaps . Bedrijven stappen over op 'model-level entitlements' die het juiste (goedkopere) model aan de juiste rol koppelen, en stellen uitgavendrempelalarmen in . Anthropic heeft enterprise-uitgavenbeheercontroles uitgebracht nadat 78% van de bedrijven melding maakte van verrassende AI-rekeningen .
De kernles: tokens zijn geen stoelen — in tegenstelling tot traditionele SaaS schaalt generatieve AI de kosten met elke prompt, poging en agent-loop . De industrie behandelt AI nu niet als een onbeperkt productiviteitselixir, maar als een beheerde hulpbron die dezelfde financiële discipline vereist als elke andere kritieke input. Succes wordt gemeten aan de hand van opgeleverde code, opgeloste tickets of omzetimpact, en niet aan de hand van het aantal verbrande tokens.