Google 的回應分為兩波:
Gemini 3.5 Flash Low 代表的是一種更為精確的手術式修正:它不僅是給開發者更多原始配額(供給面止血),而是給了他們一種方法,使每個任務消耗更少的 Token(需求面的控制)。
Google 的官方文件描述這個 Low 變體「針對需要較少步驟的程式碼和代理任務有了顯著改進,能在低延遲與低成本下提供強大的品質」。該公司表示,與現已更名為 Medium 的變體相比,Low 變體產生的輸出 Token 大約減少了 45%
。
對於開發者來說,這意味著他們現在可以在 API 呼叫中明確設定 thinking_level: "low"。
在 Gemini 3.5 Flash 的發布過程中,最大的 API 陷阱之一就是「未經公告」地將預設的 thinking_level 從 high 改為 medium。那些直接從 gemini-3-flash-preview 搬遷程式碼、卻沒有明確設定推理等級的開發者,在不知不覺中獲得了不同的推理行為 。這意味著,即使 Low 變體已經推出,許多開發者因為沒有注意到預設值已經轉移,依然在簡單任務上消耗著過多的 Token。
Low 變體本質上完成了這個修正:它為開發者提供了一個明確、有文件記錄且專為 Flash 系列原先設計的那些「成本敏感型工作」而生的等級。
Gemini 3.5 Flash Low 的推出,結合了 9 倍配額增長以及預設推理等級的調整,已經穩定了 Antigravity 的開發體驗。現在開發者可以:
Low 變體並非取代 Google 的配額增長——而是這一切的互補。結合使用新推理等級與擴充至 9 倍的配額,開發者現在終於能順利完成有意義的程式開發過程,而不會在一個下午就觸及限制、或燒光整月的 Antigravity 預算。