Gemini 3.5 Pro 延期,谷歌先推两款 Flash 新模型
谷歌上线 Gemini 3.6 Flash 与 3.5 Flash-Lite,主打效率与低成本,旗舰 3.5 Pro 仍…
7 月 21 日,谷歌在没有预告的情况下,在 Google AI Studio 和 Gemini 模型选择器中上线了两款新模型:Gemini 3.6 Flash 与 Gemini 3.5 Flash-Lite。前者主打更强的编码与 Agent 能力,后者定位更轻量、更低成本的大规模调用。与此同时,原本计划 6 月发布的旗舰模型 Gemini 3.5 Pro 仍未亮相,引发外界对谷歌前沿模型节奏的讨论。
Gemini 3.6 Flash:成本更低,速度更快
谷歌表示,相比上一代 Flash,Gemini 3.6 Flash 在编码、推理与工具调用上有所提升,同时通过减少输出 token 降低运行成本。官方展示的一项内部测试显示,完成同一任务时,新模型相比 3.5 Flash 减少了 55.8% 的 token 消耗,任务评分从 85 提升至 100。
在公开 benchmark 上,谷歌重点强调代码与 Agent 能力:
- DeepSWE 代码评测得分 49%,高于上一代的 37%。
- OSWorld-Verified 得分 83%,高于 3.5 Flash 的 78.4%。
- MLE Bench 得分 63.9%,相比上一代的 49.7% 有明显提升。
但根据 Artificial Analysis 的发布前测试,Gemini 3.6 Flash 在 Intelligence Index 上仅获 50 分,与 3.5 Flash 持平,意味着综合「智力」并无明显升级。其优势在于速度:完成 Intelligence Index 任务的平均耗时约 1.3 分钟,相比 3.5 Flash 的 2.7 分钟缩短一半。
定价方面,Gemini 3.6 Flash 输入 1.50 美元/百万 token、输出 7.50 美元/百万 token,输入价格与上一代持平,输出成本进一步下降。
Gemini 3.5 Flash-Lite:速度大幅提升,价格未降
Flash-Lite 是 Flash 系列中更轻量的版本。根据 Artificial Analysis 数据,Gemini 3.5 Flash-Lite 生成速度约 350 token/秒,任务完成时间从上代 3.1 Flash-Lite 的约 1.6 分钟下降到约 0.6 分钟。
但价格并未同步下降。Gemini 3.5 Flash-Lite 输入 0.30 美元/百万 token、输出 2.50 美元/百万 token,相比 3.6 Flash 便宜不少,但与上一代 3.1 Flash-Lite 相比,单价并未进一步降低。
能力层面,新模型在不同思考等级下均有提升,并内置 Computer Use 能力,可帮助 Agent 操作电脑环境。具体表现包括:Terminal-Bench 2.1 从 31% 提升到 54%,GDM-MRCR v2 从 60.1% 提升到 72.2%,GDPval-AA v2 从 642 提升到 1140。在 SWE-Bench Pro 中,3.5 Flash-Lite 以 54.2% 超过上一代定位更高的 Gemini 3 Flash 的 49.6%。
此外,谷歌还推出了面向网络安全场景的 Gemini 3.5 Flash Cyber,该模型不公开提供,仅通过 CodeMender 平台向政府与可信合作伙伴开放。
Gemini 3.5 Pro 延期:旗舰答卷迟迟未交
Gemini 3.5 Pro 自 5 月 I/O 大会预告「接下来一个月左右」上线以来多次跳票。彭博社 7 月 16 日报道,其发布时间已落后原计划数月,谷歌正继续优化编码能力。路透社最新报道显示,谷歌仍未给出具体上线时间,仅表示正与合作伙伴测试并将「很快」推出。
随着 Agent 进入企业工作流,代码能力已成为衡量模型实际生产价值的重要指标。路透社指出,华尔街正等待 Gemini 3.5 Pro 来判断 Google DeepMind 能否跟上 OpenAI 和 Anthropic 的节奏。在 3.5 Pro 延期的同时,GLM-5.2、Kimi K3 等国产模型也在快速追赶。
谷歌 CEO Sundar Pichai 近期多次强调成本优势,并表示企业若将大部分 AI 工作负载迁移到 Gemini 模型,每年可节省超过 10 亿美元。在 Alphabet 第二季度财报电话会议上,Gemini 3.5 Pro 的进展预计将成为投资者关注的焦点。
