Microsoft — главный инвестор OpenAI и эксклюзивный реселлер ее моделей через Azure, но внутри компании выяснилось, что инженеры использовали дорогие передовые модели для тривиальных задач, раздувая расходы до такой степени, что даже собственный финансовый отдел не мог их терпеть . Исполнительный вице-президент Джей Парих разослал электронное письмо с заявлением: «Токенмаксинг — это не то, на чем мы фокусируемся», и объявил, что с июля 2026 года у каждого подразделения появятся бюджетные лимиты на токены ИИ .
«Токенмаксинг» превратился в геймифицированное поведение. Инженеры соревновались во внутренних таблицах лидеров, чтобы максимизировать использование токенов — ИИ-эквивалент фэнтези-футбола, где вместо очков считали затраты на вычисления . Эта практика раздувала потребление без измеримой бизнес-ценности, так как компании обнаружили, что «кидать ИИ на всё» повышает затраты без пропорционального роста производительности .
Самому Сатье Наделла пришлось вмешаться. Он сказал сотрудникам перестать использовать самые мощные модели ИИ для каждой задачи и призвал подбирать модель под сложность проблемы . Компания переключила внутреннюю модель по умолчанию на более дешевую GPT-5.6 и отозвала у большинства сотрудников лицензии на Claude Code, чтобы остановить утечку средств .
Отрасль переходит от объема токенов как метрики тщеславия к измерению отдачи от ИИ на основе результатов.
Отказ от таблиц лидеров по токенам. Amazon и Meta свернули внутренние таблицы лидеров по использованию токенов ИИ после того, как сотрудники начали их накручивать . Технический директор Meta Эндрю Босуорт предупредил персонал: «Не любое движение — это прогресс, и использование токенов само по себе не является мерой какого-либо воздействия» .
Замена подсчета токенов метриками внедрения. Amazon заменил свою систему «KiroRank» на «нормализованные внедрения» — подсчет кода, написанного с помощью ИИ, который реально попадает в продакшн .
Лимиты на инженера и многоуровневое моделирование. Meta рассматривает введение лимитов на токены ИИ для каждого инженера . Компании переходят к «правам на уровне модели», которые закрепляют за определенной ролью правильную (более дешевую) модель, и устанавливают оповещения при превышении порогов расходов .
Бюджетное управление вместо максимизации использования. Atlassian ограничил расходы после того, как ежемесячный счет за ИИ взлетел с примерно 5 миллионов долларов до более чем 15 миллионов . Citi временно отозвал доступ к новейшим моделям Claude и ChatGPT для разработчиков после того, как они стали «основной причиной повышенного корпоративного потребления» объединенных ИИ-кредитов . Anthropic выпустил корпоративные инструменты контроля расходов в ответ на то, что 78% компаний сообщили о неожиданных счетах за ИИ .
Главный урок: токены — это не «сиденья». В отличие от традиционного SaaS, где затраты масштабируются через подписки или количество пользователей, генеративный ИИ масштабирует затраты с каждым запросом, повторной попыткой и циклом работы агента . Индустрия теперь относится к ИИ не как к безлимитному эликсиру производительности, а как к управляемому ресурсу, требующему такой же финансовой дисциплины, как и любой другой критически важный ввод. Успех измеряется выпущенным кодом, решенными тикетами или влиянием на выручку, а не «сожженными» токенами.