Decyzja Microsoftu nie jest odosobnionym cięciem kosztów. To głośny sygnał, że era „tokenmaxxingu” – traktowania maksymalnego zużycia tokenów AI jako miary produktywności i innowacji – dobiega końca w całej branży technologicznej .
Trzy konkretne naciski zmusiły Microsoft do narzucenia wewnętrznej dyscypliny w zakresie AI:
Niekontrolowane koszty wewnętrzne. Zespoły inżynieryjne Microsoftu swobodnie korzystały z zaawansowanych modeli AI za pośrednictwem GitHub Copilot, co spowodowało, że zużycie tokenów i koszty inferencji wzrosły daleko poza poziom, który firma uznała za zrównoważony. Wewnętrzne wytyczne Copilot przyznawały, że wielu inżynierów wydaje „w zakresie od setek dolarów miesięcznie do kilku tysięcy dolarów na tokeny” . E-mail Parkha wyraźnie stwierdzał, że od lipca 2026 roku każdy dział będzie działał w ramach docelowego budżetu tokenów AI, a poszczególni pracownicy będą mogli śledzić swoje własne zużycie za pomocą wewnętrznego panelu .
Błędne zachęty. Inżynierowie zaczęli traktować wysokie zużycie tokenów jako oznakę produktywności – praktykę znaną w branży jako tokenmaxxing. Microsoft odkrył jednak, że więcej tokenów nie przekłada się na większą wartość biznesową. Parikh jawnie przeformułował cel firmy: „Nie optymalizujemy pod kątem mniejszej liczby tokenów. Optymalizujemy pod kątem wpływu na token” .
Problem wiarygodności. Jako firma sprzedająca subskrypcje AI – Azure OpenAI Service, GitHub Copilot, Microsoft 365 Copilot – Microsoft nie mógł wiarygodnie mówić klientom o kontrolowaniu kosztów AI, podczas gdy jego własne zespoły spalały tokeny bez ograniczeń . E-mail Parkha zauważał, że firma będzie „zarządzać wydatkami na tokeny z taką samą dyscypliną, jaką stosujemy do każdego innego krytycznego zasobu” .
Zmiany polityki weszły w życie natychmiast w lipcu 2026 roku :
Ruch Microsoftu jest jednym z punktów danych w znacznie szerszej korekcie zachodzącej w całej branży technologicznej. „Tokenmaxxing” – praktyka agresywnego zwiększania zużycia tokenów AI jako miary innowacji – rozpowszechniła się w firmach technologicznych mniej więcej od końca 2025 do połowy 2026 roku, ale teraz gwałtownie upada, ponieważ ekonomia się nie sprawdziła .
Przekroczenie budżetu Ubera. Uber Technologies wyczerpał cały swój budżet AI na 2026 rok w ciągu zaledwie kilku miesięcy. Jego CTO publicznie oświadczył: „Zbliżamy się do końca tak zwanej ery tokenmaxxingu”, dodając, że surowe zużycie tokenów nie przekładało się na wymierne zyski . Firma przechodzi teraz w kierunku optymalizacji kosztu na interakcję poprzez buforowanie promptów, bardziej wydajne modele domyślne i lepszą widoczność zużycia .
Ostrzeżenie Gartnera. Gartner przewidział, że koszty kodowania AI wkrótce przewyższą średnie pensje deweloperów w modelach cenowych opartych na zużyciu, zmuszając dyrektorów finansowych w różnych branżach do domagania się dyscypliny kosztowej .
Matematyka startupów. Startupy wykazały, że zmiana modeli może obniżyć koszty inferencji o około 90%. Lindy.ai na przykład przeniósł 100% swojego ruchu API z Claude na DeepSeek z dnia na dzień, powołując się na około 90% niższe koszty inferencji dla porównywalnej jakości wyników w swoim podstawowym zestawie zadań . Tak dramatyczne oszczędności sprawiają, że stare myślenie „więcej tokenów = lepiej” jest finansowo nie do utrzymania .
Werdykt Forbes i Fortune. Wiele mediów biznesowych ogłosiło, że era tokenmaxxingu strukturalnie się skończyła. Przedsiębiorstwa porzucają surowe zużycie jako metrykę na rzecz wdrożeń stawiających na efektywność, routingu modeli (używanie tańszych modeli do prostszych zadań) i rozliczeń opartych na wynikach, które usuwają zachętę do maksymalizacji tokenów . Forbes scharakteryzował tokenmaxxing jako „fazę przejściową w adopcji AI”, która pomogła znormalizować użycie, ale „nie jest zrównoważonym modelem operacyjnym” .
Wzór w branży jest teraz jasny: firmy, które początkowo zachęcały do nieograniczonego używania AI, teraz wprowadzają budżety, przechodzą na tańsze modele i wymagają, aby każdy wydany token był powiązany z mierzalnym wynikiem biznesowym. Dyrektor ds. klientów ServiceNow ostrzegł, że tokenmaxxing to cykl szumu AI . Werdykt Fortune był bezlitosny: „Tokenmaxxing nie żyje. Nie przyniósł firmom oczekiwanego zwrotu z inwestycji w AI” .
Wewnętrzne budżety tokenów Microsoftu i domyślny model GPT-5.6 są podręcznikowym przykładem tego ogólnobranżowego rachunku sumienia – pochodzącego nie od marudera AI, ale od jednego z największych inwestorów w tym sektorze. Jeśli firma sprzedająca subskrypcje AI potrzebuje budżetu, przesłanie dla każdego innego przedsiębiorstwa jest jasne.