Gemini 3.7 Flash 於 2026 年 8 月 13 日推出,定位是 Google 面向程式設計與 AI 代理工作流程的生產力型模型。 API 入門價格至 2026 年 12 月 31 日為每百萬個輸入 token 0.75 美元、輸出 token 3.75 美元;2027 年 1 月 1 日起將分別調升至 1.50 美元與 7.50 美元。
研究答案

Create a landscape editorial hero image for this Studio Global article: What is Gemini 3.7 Flash, when did it launch, where is it available, and why does Google call it its fastest-growing model ever despite disc. Article summary: Gemini 3.7 Flash is Google’s production “workhorse” Gemini model for complex coding, web development, and tool-using agents. It launched on August 13, 2026, and is available through the Gemini API/AI Studio, Google Antig. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
Gemini 3.7 Flash 是 Google 最新的生產力型「主力模型」,鎖定複雜程式設計、網頁開發、工具調用,以及需要多次往返的 AI 代理工作流程。模型於 2026 年 8 月 13 日推出,可透過 Gemini API、Google AI Studio、Google Antigravity 與 Gemini Enterprise Agent Platform 使用。
它真正吸引開發者的地方,不是每一項智慧基準都拿下第一,而是把接近前沿的能力、高輸出速度與低 API 入門價格放在同一個組合裡。對需要反覆讀取上下文、呼叫工具、檢查結果並重試的代理系統而言,這種取捨可能比單一跑分更重要。
Google 將 Gemini 3.7 Flash 稱為「史上成長最快的模型」,但目前提供的資料並未披露足以驗證這項說法的數字。現有證據沒有列出使用者基數、統計期間、活躍開發者數、token 用量,也沒有指出比較對象。
因此,較穩妥的結論是:Google 正把 Flash 定位為能快速吸引開發者採用的模型,而低廉的上市價格,以及它在 Google 多項開發者產品中的整合,確實支撐這項策略。至於「成長最快」這個最高級描述,現階段應視為尚未量化的公司宣稱,不能當成已獲獨立證實的市場統計。
Gemini 3.7 Flash 的 API 入門價格有效至 2026 年 12 月 31 日:
自 2027 年 1 月 1 日起,標準價格將變為每百萬個輸入 token 1.50 美元、每百萬個輸出 token 7.50 美元,正好是入門價的兩倍。Google 列出的折扣或批次處理價格,也會由輸入/輸出每百萬 token 0.375/1.875 美元,調升至 0.75/3.75 美元。
這個到期日對產品規劃相當重要。若某項工作負載在上市優惠期間看起來特別便宜,開發團隊在確定長期架構前,應先用 2027 年價格重新估算成本。
不過,token 單價只是代理系統成本的一部分。實際支出還會受到上下文長度、工具呼叫次數、失敗重試、快取輸入、推理強度與輸出量影響。基準測試中的單次任務成本,也不能直接等同於完整生產工作流程的保證價格。
Artificial Analysis 的獨立報告給予 Gemini 3.7 Flash 56 分 Intelligence Index,高於 Claude Sonnet 5 的 55 分,但略低於 GPT-5.6 Terra 的 57 分。
速度則是它最鮮明的差異化優勢。Artificial Analysis 測得其輸出速度約為每秒 340 個 token,平均每項任務的時間分數為 1.7,並指出在最高推理設定下,Flash 比 GPT-5.6 Terra 快約 40%。
這些數字反映的是模型或供應商環境中的測量結果,不代表所有應用都會獲得相同體驗。網路狀況、供應商路由、提示詞大小、工具延遲與推理設定,都可能改變使用者實際感受到的端到端回應時間。
Google 表示,Gemini 3.7 Flash 相比 Gemini 3.6 Flash,在軟體工程、除錯、問題修復、網頁開發與代理工作流程方面都有顯著進步。目前資料中的代表性結果包括:
這些結果顯示 Flash 是具備實力的程式與終端機代理模型,但不是所有項目都領先。以引用的 Terminal-Bench 成績來看,GPT-5.6 Terra 仍在前面;Flash 的優勢主要來自更快的生成速度與較低的入門價格。
在高推理強度下,ARC Prize 公布 Gemini 3.7 Flash 的成績為:
考慮到所公布的單項成本,這是相當強的成本效益表現。不過,ARC-AGI 成績應被視為基準訊號,而不是軟體代理可靠度的直接預測。真實環境中的代理可能需要多次模型呼叫、外部工具、錯誤重試,還可能處理遠大於基準任務的上下文。
這張表不是 सार्व用的模型排行榜。不同基準來自不同評測,現有來源也沒有建立一場涵蓋所有模型的單一受控測試;價格則可能反映不同的託管方式、折扣條件或供應狀態。
現有比較透露出一個清楚的定位選擇。Gemini 3.7 Flash 在引用的 Intelligence Index 上接近前沿,但沒有拿下最高分:GPT-5.6 Terra 以 57 分略勝,且在 Google 引用的 Terminal-Bench 比較中也領先。
Google 強調的是智慧、延遲與成本之間的平衡。對 AI 代理平台來說,一個速度足以支援互動式開發、價格又低到可以反覆呼叫的模型,可能比一個在狹窄基準上取勝、但速度較慢且成本更高的模型更實用。這對程式助手、自動化問題修復、網頁開發代理,以及需要不斷讀取上下文、呼叫工具、檢視結果並再次嘗試的系統尤其重要。
在 2026 年 8 月的密集發表潮中,這種取捨更加明顯。Qwen3.8-Max 帶來強勁的代理與軟體工程競爭,GLM-5.3 與 Nemotron 3.5 Lightning 從價格和效率施壓,而 Claude Opus 5 與 GPT-5.6 則鎖定更高階的能力市場。
Gemini 3.7 Flash 最適合被理解為一款高吞吐量的主力模型,而不是無可爭議的智慧冠軍。它的核心優勢是 Intelligence Index 56、約每秒 340 個 token 的生成速度、穩健的程式與終端機代理成績,以及異常低廉的上市入門價格。
對開發者而言,最大的注意事項可能不是技術,而是財務:每百萬個輸入/輸出 token 0.75/3.75 美元的優惠價格只到 2026 年 12 月 31 日,隔天起便改為 1.50/7.50 美元。
Google 的「成長最快」說法未來或許會被數據證實,但在目前缺乏使用量資料的情況下,證據真正支持的,是另一個較窄的判斷:Google 正試圖讓快速、負擔得起的推理成為開發者大規模部署 AI 代理的預設選項,而不是已經證明 Gemini 3.7 Flash 在模型採用率上創下紀錄。
Studio Global AI
這個頁面包含附來源佐證的答案,你可以在 Studio Global 內繼續追問。
Gemini 3.7 Flash 於 2026 年 8 月 13 日推出,定位是 Google 面向程式設計與 AI 代理工作流程的生產力型模型。
Gemini 3.7 Flash 於 2026 年 8 月 13 日推出,定位是 Google 面向程式設計與 AI 代理工作流程的生產力型模型。 API 入門價格至 2026 年 12 月 31 日為每百萬個輸入 token 0.75 美元、輸出 token 3.75 美元;2027 年 1 月 1 日起將分別調升至 1.50 美元與 7.50 美元。
Artificial Analysis 的 Intelligence Index 給予 56 分,輸出速度約每秒 340 個 token;它的主要賣點是速度與推理成本,而非在所有智慧基準上奪冠。