Microsoft є головним інвестором OpenAI та ексклюзивним продавцем її моделей через Azure, але всередині компанії виявилося, що інженери використовували дорогі передові моделі для дріб'язкових завдань, що призвело до витрат, які фінансовий відділ не міг ігнорувати . Виконавчий віцепрезидент Джей Паріх розіслав електронний лист із повідомленням: «токенмаксинг — це не те, на що ми оптимізуємося», і оголосив, що з липня 2026 року кожен підрозділ отримає цільові показники бюджету на токени ШІ
.
«Токенмаксинг» перетворився на гейміфіковану поведінку. Інженери змагалися на внутрішніх таблицях лідерів, намагаючись максимізувати використання токенів — ШІ-еквівалент того, як фанати набирають очки у фентезі-футболі . Така практика роздувала споживання без вимірної бізнес-цінності, оскільки компанії виявили, що «кидати ШІ на все підряд» підвищує витрати без пропорційного зростання продуктивності
.
Самому Сатьї Наделлі довелося втрутитися — він закликав співробітників перестати використовувати найпотужніші ШІ-моделі для кожного завдання і обирати модель відповідно до складності проблеми . Компанія змінила внутрішню модель за замовчуванням на дешевшу GPT-5.6 та анулювала ліцензії Claude Code для більшості працівників, щоб зупинити фінансову «кровотечу»
.
Галузь переходить від обсягу токенів як метрики марнославства до вимірювання результатів, заснованого на віддачі від ШІ.
Відмова від таблиць лідерів за токенами. Amazon та Meta скасували внутрішні таблиці лідерів за використанням токенів ШІ після того, як працівники почали зловживати системою . Технічний директор Meta Ендрю Босворт попередив співробітників: «Не будь-який рух є прогресом, і використання токенів саме по собі не є мірилом впливу будь-якого роду»
.
Заміна лічильників токенів на метрики розгортання. Amazon замінив свою систему «KiroRank» на «нормалізовані розгортання» — враховується лише код, створений за допомогою ШІ, який дійсно потрапляє у виробництво .
Індивідуальні ліміти та поділ моделей за рівнями. Meta розглядає можливість запровадження індивідуальних лімітів на токени ШІ для кожного інженера . Компанії переходять на «прив'язку моделей до рівня доступу», яка закріплює відповідну (дешевшу) модель за відповідною роллю, і встановлюють сповіщення про перевищення лімітів витрат
.
Бюджетне управління замість максимізації використання. Atlassian обмежила витрати після того, як щомісячний рахунок за ШІ зріс приблизно з $5 мільйонів до понад $15 мільйонів . Citi тимчасово заборонив доступ до найновіших моделей Claude та ChatGPT для розробників після того, як вони стали «основною причиною підвищеного корпоративного споживання» спільних ШІ-кредитів
. Anthropic випустила корпоративні інструменти контролю витрат після того, як 78% бізнесів повідомили про несподівані рахунки за ШІ
.
Головний урок: токени — це не місця — на відміну від традиційного SaaS, генеративний ШІ масштабує витрати з кожним запитом, повторною спробою та циклом агента . Галузь більше не розглядає ШІ як безмежний еліксир продуктивності, а як регульований ресурс, що потребує такої ж фінансової дисципліни, як і будь-який інший критичний компонент. Успіх тепер вимірюють кількістю випущеного коду, вирішених завдань або впливом на дохід, а не сирим обсягом спалених токенів.