Gemini 3.7 Flash 於 2026 年 8 月 13 日推出,主打複雜編程、網頁開發、工具調用同多步驟 AI 代理工作流程。 2026 年 12 月 31 日前,API 輸入及輸出價格分別係每百萬 token 0.75 美元同 3.75 美元;2027 年 1 月 1 日起加倍至 1.50 美元同 7.50 美元。
研究答案

Create a landscape editorial hero image for this Studio Global article: What is Gemini 3.7 Flash, when did it launch, where is it available, and why does Google call it its fastest-growing model ever despite disc. Article summary: Gemini 3.7 Flash is Google’s production “workhorse” Gemini model for complex coding, web development, and tool-using agents. It launched on August 13, 2026, and is available through the Gemini API/AI Studio, Google Antig. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
Gemini 3.7 Flash 於 2026 年 8 月 13 日登場,Google 將佢包裝成最新一代面向生產環境嘅「工作馬」模型,重點唔係單一 benchmark 稱王,而係複雜編程、網頁開發、工具調用,以及需要模型不停讀取上下文、執行工具、檢查結果再重試嘅多步驟代理工作流程。模型可經 Gemini API、Google AI Studio、Google Antigravity 同 Gemini Enterprise Agent Platform 使用。
對開發者嚟講,Gemini 3.7 Flash 最吸引嘅地方係三樣嘢放埋一齊:接近前沿嘅能力、非常高嘅輸出速度,同埋推出初期相對低廉嘅 API 價格。換句話講,佢未必係「最聰明」嗰個,但可能係最適合大量、重複調用嘅嗰個。
Google 稱 Gemini 3.7 Flash 係公司史上增長最快嘅模型。不過,現有資料冇有披露用嚟核實呢個講法所需嘅關鍵數字,包括總使用基數、統計期間、活躍開發者數目、token 用量,或者具體比較對象。
所以,較穩妥嘅解讀係:Google 正努力令 Flash 快速滲透開發者市場,而低廉嘅推出價,以及佢同 Google 多個開發者產品嘅整合,正好配合呢個策略。至於「增長最快」呢個超級形容詞,目前應該當作未量化嘅公司聲稱,而唔係已經獨立證實嘅市場統計。
Gemini 3.7 Flash 嘅限時入門價格有效至 2026 年 12 月 31 日:
由 2027 年 1 月 1 日開始,標準價格會變成:
換句話講,兩項價格都係原本入門價嘅兩倍。列明嘅折扣或 batch 類價格,亦會由每百萬輸入/輸出 token 0.375/1.875 美元,上調至 0.75/3.75 美元。
呢個日期對生產環境部署尤其重要。假如團隊只用 2026 年嘅推廣價去計算一個長期架構,去到 2027 年可能會低估成本。較實際嘅做法係,一開始就用 1.50/7.50 美元嘅標準價重新估算。
當然,token 價格唔等於完整 AI 代理嘅實際成本。最終支出仲會受上下文長度、工具調用次數、失敗重試、快取輸入、推理強度同輸出量影響。benchmark 入面計出嚟嘅每項任務成本,亦唔應該直接當成生產工作流程嘅保證價錢。
Artificial Analysis 嘅獨立比較顯示,Gemini 3.7 Flash 嘅 Intelligence Index 得分係 56,高過 Claude Sonnet 5 嘅 55,但略低於 GPT-5.6 Terra 嘅 57。
真正令 Flash 拉開距離嘅係速度。Artificial Analysis 測得佢大約每秒輸出 340 個 token,平均 Time per Task 分數係 1.7;喺最高推理設定下,Flash 比 GPT-5.6 Terra 快約 40%。
不過,呢啲數字反映嘅係特定模型或服務供應商環境嘅測試表現,唔代表每個應用都會有相同體驗。網絡狀況、服務商路由、prompt 大小、工具延遲同推理設定,都可以改變由輸入到完成任務嘅實際時間。
Google 表示,相比 Gemini 3.6 Flash,3.7 Flash 喺軟件工程、debug、處理 issue、網頁開發同代理工作流程方面都有明顯進步。
現有編程數據包括:
呢啲結果顯示,Flash 係一個有實力嘅編程及 terminal-agent 模型,但唔係所有測試都贏。至少喺上述 Terminal-Bench 比較,GPT-5.6 Terra 仍然領先;Flash 嘅核心優勢就係速度,以及推出初期較低嘅成本。
喺高推理強度下,ARC Prize 公布 Gemini 3.7 Flash 嘅成績如下:
以 benchmark 分數同報告成本一齊睇,呢個組合相當亮眼。不過,ARC-AGI 主要係能力指標,唔可以直接預測一個軟件代理喺真實環境嘅可靠程度。生產代理可能要連續調用模型多次、使用外部工具、重試失敗操作,亦可能處理遠比 benchmark 任務更長嘅上下文。
上表唔係一張可以直接決定勝負嘅總排行榜。不同模型嘅 benchmark 來自不同評測,資料亦冇建立一個涵蓋所有模型嘅單一受控測試;價格則可能受託管方式、折扣、地區或供應情況影響。
由現有比較睇,Gemini 3.7 Flash 嘅定位相當清楚:佢接近前沿,但唔係追求每一項 benchmark 嘅最高分。GPT-5.6 Terra 喺引用嘅 Intelligence Index 以 57 分略勝,而喺 Google 列出嘅 Terminal-Bench 比較亦領先。
Google 真正押注嘅係「能力—延遲—成本」之間嘅平衡。一個反應夠快、價格夠低,可以畀代理反覆調用嘅模型,對開發者平台嚟講,可能比一個只喺窄門 benchmark 贏出、但較慢同較貴嘅模型更實用。
呢種取向特別適合編程助手、自動處理 issue、網頁開發代理,以及需要不斷讀取上下文、調用工具、檢查結果同再次嘗試嘅工作流程。2026 年 8 月嘅模型市場亦令呢場競爭更白熱化:Qwen3.8-Max 加強軟件工程及代理競爭,GLM-5.3 同 Nemotron 3.5 Lightning 向價格及效率施壓,而 Claude Opus 5 同 GPT-5.6 就瞄準更高階能力。
Gemini 3.7 Flash 最適合被理解成一部高吞吐量「工作馬」,而唔係已經坐穩 AI 智力王座嘅模型。佢嘅最佳賣點係 Intelligence Index 56、約 340 tokens/秒輸出速度、紮實嘅編程及 terminal-agent 成績,以及推出初期非常進取嘅價格。
對開發者而言,最大嘅提醒反而係財務規劃:0.75/3.75 美元嘅入門價格只到 2026 年 12 月 31 日,翌日開始就會變成 1.50/7.50 美元。
Google 所講嘅「增長最快」日後可能會被數據證實,但以目前公開證據,只能確認 Google 正透過快速、平價嘅推理服務,推動 Flash 成為開發者同 AI 代理大規模使用嘅預設選擇;未足以證明佢已經創下模型採用速度紀錄。
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
Gemini 3.7 Flash 於 2026 年 8 月 13 日推出,主打複雜編程、網頁開發、工具調用同多步驟 AI 代理工作流程。
Gemini 3.7 Flash 於 2026 年 8 月 13 日推出,主打複雜編程、網頁開發、工具調用同多步驟 AI 代理工作流程。 2026 年 12 月 31 日前,API 輸入及輸出價格分別係每百萬 token 0.75 美元同 3.75 美元;2027 年 1 月 1 日起加倍至 1.50 美元同 7.50 美元。
Google 稱佢係公司史上增長最快嘅模型,但目前未公開使用基數、統計期間、token 用量或比較對象,因此呢個講法仍然只係未有數據支持嘅公司聲稱。