微軟從2025年12月開始,向旗下體驗與裝置部門(含Windows、Microsoft 365、Teams、Outlook與Surface工程團隊)的數千名員工發放Anthropic的Claude Code存取權 。這項實驗雖然大受歡迎,但基於Token的計費方式很快就變成財務問題。多份報導指出,該計畫在幾個月內就燒光了全年的AI預算,致使該公司在2026年5月14日開始取消大部分的內部授權
。
這項轉移的最後期限為2026年6月30日,也就是微軟會計年度的最後一天。這個時間點說明了,此舉既是預算維穩,也是產品策略的展現 。受影響的工程師被引導轉向使用微軟旗下的GitHub Copilot CLI
。該公司強調,Anthropic的Claude模型仍可透過Microsoft Foundry及Microsoft 365 Copilot內部取得,但其介面與成本持有模式正在發生顯著改變
。
成本失控最戲劇化的例子,莫過於Uber。技術長普拉文·內帕里·納加(Praveen Neppalli Naga)在2026年4月向《The Information》證實,公司早在該會計年度開始不到四個月,就已耗盡全年的AI工具預算 。主要的驅動力,源自2025年12月上線後,Claude Code在約5,000名工程師之間被快速且廣泛地採用
。
Uber內部同樣依賴一個按AI使用量排名的團隊排行榜,這促使Claude Code的採用率在兩個月內從32%飆升至84% 。到了4月,95%的Uber工程師每月都在使用AI工具,高達70%的提交程式碼為AI生成
。據報,個別工程師每月的API成本甚至落在500至2,000美元之間
。
然而,即便有著如此驚人的採用數字,其商業案例依然難以證明。Uber營運長安德魯·麥克唐納(Andrew Macdonald)在《Rapid Response》Podcast上公開表示,他無法在AI支出與消費者產品改善之間建立直接連結。「這種連結還沒出現,」他說,「或許隱性地有更多東西產出,但要將這些統計數字直接連結到『好,現在我們實際上多推出了25%對消費者有用的功能』,是非常困難的」。技術長納加則對《The Information》直言:「我現在得重新來過,因為我原本認為需要的預算,早就爆掉了」
。
許多事件的根源,是一種被「古德哈特定律」(Goodhart's law)精準捕捉的管理失靈:「當一項測量指標變成了目標,它就不再是個好指標」。企業為了展現AI導入成效,創造了依據Token消耗量或AI工具調用次數為員工排名的內部排行榜。而員工理性地選擇「優化指標」而非「優化成果」。結果就是爆發了大量低價值、非必要的AI調用,這些呼叫帶來了排行榜的名次,卻沒有換來任何商業價值,反而直接墊高了基礎設施成本
。
這些事件的共通點,並不在於AI工具的失敗,而是在於:當獎勵機制只針對「無上限的消耗」時,會產生比原本想要取代的工作更昂貴的「反常激勵」。企業正從單純的「導入量」轉向追問「可衡量的商業價值」:AI輔助究竟有沒有改善最終交貨的成果?
原本那場AI導入的賽跑,現在正演變成一場被迫的成本節制運動。「能燒多少Token就燒多少」的時代正在終結,而「用實際產出來證明花費合理性」的時代,才正要開始。