Microsoft je primárním investorem OpenAI a výhradním prodejcem jejích modelů přes Azure, ale uvnitř firmy se ukázalo, že inženýři používali drahé „frontier“ modely na triviální úkoly, čímž hnali náklady do takové výše, že je neuneslo ani vlastní finanční oddělení . Výkonný viceprezident Jay Parikh poslal interní e-mail se slovy: „Tokenmaxxing není to, pro co se optimalizujeme“ a oznámil, že od července 2026 dostanou divize rozpočtové cíle na tokeny .
„Tokenmaxxing“ se stal hrou. Inženýři soutěžili na interních žebříčcích, kdo spotřebuje víc tokenů – AI obdoba fantasy fotbalu, kde se body počítají z utracených peněz za výpočetní výkon . Praxe nafukovala spotřebu bez měřitelného přínosu, protože firmy zjistily, že „házet AI na všechno“ zvedá náklady, ale produktivita neroste úměrně .
Sám generální ředitel Satya Nadella musel zakročit a nařídit inženýrům, aby přestali používat nejvýkonnější modely na každý problém a začali model přiřazovat k náročnosti úkolu . Firma přepnula výchozí model na levnější GPT-5.6 a většině zaměstnanců zrušila licence na Claude Code, aby zastavila krvácení rozpočtu .
Celé odvětví se odklání od objemu tokenů jako marnivostního ukazatele k měření návratnosti investic podle výsledků.
Konec tokenových žebříčků. Amazon i Meta zrušily interní žebříčky spotřeby tokenů poté, co je zaměstnanci začali obcházet . Technologický ředitel Meta Andrew Bosworth varoval: „Pohyb není totéž co pokrok a samotná spotřeba tokenů není měřítkem žádného dopadu“ .
Nahrazení tokenů metrikami nasazení. Amazon nahradil systém „KiroRank“ ukazatelem „normalizovaná nasazení“ – počítá se jen kód s asistencí AI, který se skutečně dostane do produkce .
Limity na inženýra a vrstvení modelů. Meta zvažuje zavedení limitů spotřeby tokenů na jednoho inženýra . Firmy zavádějí „oprávnění na úrovni modelu“, která levnější model přiřadí ke správné roli, a nastavují výstrahy při překročení nákladů .
Rozpočtová správa místo maximalizace používání. Atlassian zastropoval výdaje poté, co mu měsíční účet za AI vyletěl zhruba z 5 milionů dolarů na více než 15 milionů . Citi dočasně zrušilo přístup k nejnovějším modelům Claude a ChatGPT pro vývojáře poté, co se staly „hlavním hybatelem zvýšené podnikové spotřeby“ sdružených AI kreditů . Anthropic v reakci na to, že 78 % firem hlásí nečekané účty za AI, nasadil nástroje pro kontrolu podnikových výdajů .
Základní ponaučení: tokeny nejsou místa (seats) – na rozdíl od tradičního SaaS generativní AI škáluje náklady s každým promptem, opakováním a smyčkou agenta . Odvětví teď k AI nepřistupuje jako k neomezenému elixíru produktivity, ale jako k řízenému zdroji, který vyžaduje stejnou finanční disciplínu jako jakýkoli jiný kritický vstup. Úspěch se měří podle dodaného kódu, vyřešených ticketů nebo dopadu na tržby, nikoli podle spálených tokenů.