Google 将 Gemini 3.5 Pro 从六月发布日期推迟到七月——CEO Sundar Pichai 在 I/O 2026 大会上说“再给我们一个月”,现场一片哗然。 与此同时,Gemini 3.5 Flash 在 I/O 大会上如期上线,在 11 项智能体基准测试中超越上一代 Gemini 3.1 Pro,速度提升约 4 倍,每 token 成本降低 25%–40%。
研究答案

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for Search & fact-check with cited sources for What led to Google delaying the release of Gemini 3.5. Article summary: Google has pushed Gemini 3.5 Pro's release from June to July to gather more real-world feedback from early testers and make performance tweaks, after CEO Sundar Pichai already drew audible audience groans at I/O 2026 by . Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fak
Google 已将 Gemini 3.5 Pro 的发布时间从六月推迟至七月,理由是需要在早期测试者中收集更多真实世界反馈并进行性能优化 。CEO Sundar Pichai 在 2026 年 5 月 19 日的 Google I/O 大会上首次宣布了这一推迟,他对现场观众表示该模型“还没准备好”,并请求“再给一个月”——据 Business Insider 报道,现场响起了明显的嘘声
。截至六月下旬,该模型仍仅面向部分企业用户提供有限的 Vertex AI 预览版
。
相比之下,Gemini 3.5 Flash 在 I/O 大会上准时上线,并立即树立了新的标杆:它在大多数编码和智能体基准测试中超越了上一代的 Gemini 3.1 Pro,运行速度快约 4 倍,每 token 成本降低 25%–40% 。开发者对谷歌的沉默和反复错过截止日期表示失望,尤其是考虑到 OpenAI 和 Anthropic 等竞争对手仍在持续发布新模型
。
此次延迟源于早期测试中发现的性能质量问题,而非安全或基础设施问题 。据 Business Insider 报道,谷歌正在利用额外时间收集早期测试者的反馈,并根据真实世界的业务用例调整模型
。社交媒体上的爆料显示,早期测试者报告该模型“在处理困难任务时变得懒惰”,这促使谷歌推迟发布,并可能在此基础上推出 200 万 token 记忆和 Deep Think 推理等改进功能
。
Pichai 在 I/O 大会上的发言设定了一个糟糕的预期。他在台上说:“我知道你们迫不及待想拿到它。再给我们一个月,我们把它带给你们” 。当时没有给出模型尚未准备好的具体原因
。随后六月截止日期在没有官方解释的情况下再次延期,给人留下了承诺落空的印象
。
Gemini 3.5 Flash 于 2026 年 5 月 19 日全面上线——也就是发布当天——并立即挑战了 Pro 层的性能等级 。
谷歌公布的关键基准测试结果:
谷歌声称,3.5 Flash 的输出 tokens 每秒速度大约是其他前沿模型的 4 倍 。API 定价约为每百万 tokens 输入 1.50 美元 / 输出 9 美元,输入价格比 Gemini 3.1 Pro 便宜约 40%
。
在已发布的 15 项基准测试中,Gemini 3.5 Flash 有 11 项超越了 Gemini 3.1 Pro 。然而,在 Humanity‘s Last Exam (40.2% 对比 44.4%) 和 ARC-AGI-2 (72.1% 对比 77.1%) 等纯推理基准测试中,它仍落后于 Pro 模型,因此并非在所有维度上都是直接升级
。
开发者对谷歌的沟通方式和开发节奏提出了尖锐批评。
当 Gemini 3.5 Pro 最终到来时,预计将弥补 Flash 在推理方面的不足。已确认的功能包括 200 万 token 的上下文窗口——这是所有生产模型中最大的——以及 Deep Think 推理模式 。定价预计约为每百万 tokens 输入 1.50 美元 / 输出 9 美元,与 Flash 层级相似
。
虽然此次延迟令开发者感到沮丧,但最终可能会带来更强的产品。然而,通过做出明确的“下个月”承诺,然后在延期时保持沉默,谷歌在竞争对手稳定发布新品的背景下,进一步加剧了开发者的不满。
结论: 此次延迟源于性能质量问题,而非安全或基础设施问题。与此同时,Gemini 3.5 Flash 已经是生产环境中智能体工作负载的最佳选择——它作为一款高性价比的替代方案,在开发者最看重的基准测试中超越了去年的 Pro 模型。
Studio Global AI
此页面包含一个有来源支持的答案,您可以在 Studio Global 内继续。
Google 将 Gemini 3.5 Pro 从六月发布日期推迟到七月——CEO Sundar Pichai 在 I/O 2026 大会上说“再给我们一个月”,现场一片哗然。
Google 将 Gemini 3.5 Pro 从六月发布日期推迟到七月——CEO Sundar Pichai 在 I/O 2026 大会上说“再给我们一个月”,现场一片哗然。 与此同时,Gemini 3.5 Flash 在 I/O 大会上如期上线,在 11 项智能体基准测试中超越上一代 Gemini 3.1 Pro,速度提升约 4 倍,每 token 成本降低 25%–40%。
开发者对谷歌的沉默和反复跳票感到沮丧,尤其是在 OpenAI 和 Anthropic 持续发布更新的大环境下,这种落差尤为刺眼。