桃子桃子快讯
返回首页
模型发布

谷歌连发三款 Gemini 模型,Agent 运行成本成新焦点

谷歌推出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber,分别面向编…

2026.07.22 · 周三5 分钟阅读

谷歌于 7 月 22 日凌晨一口气发布三款 Gemini 模型:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 和 Gemini 3.5 Flash Cyber。三款新模型均聚焦 Agent 工作流,分别在 Token 效率、响应速度和网络安全方向做出强化。同时,谷歌方面确认仍在合作伙伴测试阶段的 Gemini 3.5 Pro 尚未发布,并首次公开预告 Gemini 4,称该模型已启动公司迄今规模最大的预训练任务。

三款模型定位各异

Gemini 3.6 Flash 是此次更新的主力,面向编程、知识工作和多模态任务。根据 Artificial Analysis 的 Intelligence Index,3.6 Flash 的任务输出 Token 消耗较 3.5 Flash 减少约 17%;在 DeepSWE v1.1 软件工程 Agent 评测中,输出 Token 消耗由 3.5 Flash 的平均约 27.6 万个降至约 9.7 万个,降幅接近 65%。在 DeepSWE v1.1、MLE-Bench、GDPval-AA v2 和 OSWorld-Verified 等多项测试中,3.6 Flash 的得分均明显高于 3.5 Flash 和 3.1 Pro。

Gemini 3.5 Flash-Lite 主打低延迟和高吞吐量,输出速度可达每秒 350 个 Token,输入与输出价格分别为每 100 万 Token 0.3 美元和 2.5 美元。与 3.1 Flash-Lite 相比,该模型在 Terminal-Bench 2.1、GDM-MRCR v2 和 GDPval-AA v2 等测试中得分均有显著提升,并在 SWE-Bench Pro 和 OSWorld-Verified 中超过了定位更高的 Gemini 3 Flash。

Gemini 3.5 Flash Cyber 基于 3.5 Flash 微调,专门用于发现、验证和修复网络安全漏洞。该模型与谷歌代码安全 Agent CodeMender 配合使用,CodeMender 会并行运行多个 3.5 Flash Cyber Agent 并合并分析结果。在 CyberGym 测试中,配合 Agent 调用 5 次模型时得分 83.2%,表现接近同类前沿安全模型。考虑到漏洞修复技术的双重用途,谷歌暂不向普通开发者开放该模型,将先在政府机构和可信合作伙伴中开展试点。

价格与接入渠道

Gemini 3.6 Flash 的输入价格为每 100 万 Token 1.5 美元,输出价格为 7.5 美元,输出价格低于上一代 Flash。Gemini 3.5 Flash-Lite 和 3.6 Flash 已通过 Google AI Studio、Android Studio、Gemini API 以及 Google Antigravity 向开发者开放,企业客户可在 Gemini Enterprise Agent Platform 中使用,普通用户可在 Gemini 应用中调用,3.5 Flash-Lite 还将在后续接入谷歌搜索。Computer Use 已成为 Gemini API 和 Gemini Enterprise 的内置客户端工具。

竞争压力与延期悬念

第三方榜单对 3.6 Flash 的评价并非全面领先。Artificial Analysis 数据显示,该模型在输出速度上居于前列,但 Intelligence 得分约为 50,落后于 Claude Fable 5、GPT-5.6 Sol、Kimi K3、Grok 4.5、GLM-5.2 以及 Meta 的 Muse Spark 1.1 等模型;单任务成本约 0.50 美元,相较 DeepSeek、MiniMax、GLM、Muse Spark 和 Grok 等也更贵。文章同时提到,上周月之暗面发布的 Kimi K3 在前端编程测试中已排到榜首,国产模型正成为全球前沿竞争中的重要力量。

用户原定今年 6 月见到的 Gemini 3.5 Pro 已两度延期。谷歌表示该模型正在与合作伙伴测试,将在准备就绪后尽快发布;同时将目光投向更远的 Gemini 4,并称相关预训练是公司迄今规模最大的一次。可以预见,谷歌下一阶段的牌面仍是 3.5 Pro 的实际交付能力与 Gemini 4 的训练进展,而这一轮 Flash 系列更新,则把重点放在了 Agent 时代更现实的指标——每一次任务的总成本。

信源