桃子桃子快讯
返回首页
模型发布

谷歌连发三款 Gemini Flash 模型主打省 token,旗舰 3.5 Pro 延期市值蒸发 2000 亿美元

谷歌推出 Gemini 3.6 Flash 等三款效率型模型,因旗舰 3.5 Pro 延期,公司股价单日跌约 4.4%,…

2026.07.22 · 周三6 分钟阅读

Alphabet 财报发布前一天,谷歌一口气推出三款全新的 Gemini Flash 系列模型,主打「快速、低成本」,重点优化复杂智能体工作流的运行效率并压缩 token 消耗。与此同时,原计划于 6 月推出的旗舰模型 Gemini 3.5 Pro 仍处测试阶段,受此消息影响,Alphabet 股价单日下跌约 4.4%,市值蒸发约 2000 亿美元。

三款 Flash 模型全部押注效率

本次发布的三款模型分别是 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 与面向安全场景的 Gemini 3.5 Flash Cyber。核心策略一致:用更低的 token 成本覆盖大多数企业使用场景。

  • Gemini 3.6 Flash:系列主力款。知识截止至 2026 年 3 月,在编程、知识型任务与多模态推理上有所提升,并将平均输出 token 消耗降低 17%;在部分场景下输出 token 最多可减少 65%。
    • 输入价格:1.50 美元 / 百万 token
    • 输出价格:7.50 美元 / 百万 token(自 9 美元下调)
    • 在 SWE-Bench Pro、OSWorld-Verified 等代理与编程基准上击败旧款 3 Flash;终端工作台 2.1 评分从 31% 提升至 54%
  • Gemini 3.5 Flash-Lite:系列中最快、最高性价比的版本,每秒可生成 350 个 token,面向高吞吐智能体搜索与大规模文档处理。
    • 输入价格:0.30 美元 / 百万 token
    • 输出价格:2.50 美元 / 百万 token
  • Gemini 3.5 Flash Cyber:基于 3.5 Flash 微调,专为网络安全漏洞发现与修复场景,已集成进 DeepMind 的代码安全智能体 CodeMender。

两款消费级模型已向 Gemini 企业用户与应用用户开放,Flash-Lite 也将在不久后接入 Google 搜索。

旗舰缺席,3.6 Flash 表现不敌一线对手

3.6 Flash 在成本与效率上的取舍明确,但在关键基准测试中并未对一线对手形成压制。

  • 在多数核心基准上落后于 Anthropic Claude Sonnet 5 与 OpenAI GPT-5.6;
  • 在智能体编程等任务上也开始被 Grok 4.5 甩开;
  • 价格与 Grok 4.5、GPT-5.6 大致持平,未形成明显价差优势。

企业反馈则偏向正面。Heavia、Harvey 等客户表示,在视觉处理、图表分析与数据提取等任务中,3.6 Flash 多模态表现有显著增强。谷歌 CEO Sundar Pichai 在早前采访中透露,组合使用 Flash 系列模型每年可为公司节省超过 10 亿美元。

Gemini 3.5 Flash Cyber 对标网络安全专用赛道

针对「Anthropic Mythos」等高价安全模型,谷歌推出 Flash Cyber 作为「高性价比替代」。

  • 在 CyberGym 基准测试中取得 83.2%,仅比 OpenAI GPT-5.5-Cyber 的 85.6% 低约 2 个百分点,但模型规模显著更小;
  • Google 云漏洞研究团队使用该模型扫描公开 API,两小时内发现了远程代码执行漏洞并生成可绕过防护的有效利用代码;
  • Big Sleep 团队在 Chrome 与 Safari 关键漏洞检测中超越标准 Flash 与 Claude Opus 4.6:在 V8 引擎的代码扫描中,Flash Cyber 发现 55 个确认问题(标准 3.5 Flash 47 个、Opus 4.6 36 个),其中 10 个漏洞其他模型完全未识别。

相较 Mythos 每百万输入 10 美元、输出 50 美元的高定价,Flash Cyber 成本优势明显。谷歌强调该模型「攻守兼备」,因此访问受限:仅通过 CodeMender 试点计划向政府机构与可信合作伙伴开放,与 Anthropic 对 Mythos、OpenAI 对 GPT-5.6 防御能力的限制策略一致。

旗舰延期,市值承压

相比模型本身,更受关注的是「没发布的东西」。

  • 原计划 6 月推出的 Gemini 3.5 Pro 仍在测试,消息称其在编程能力上未达内部预期;
  • 6 月下旬团队尝试通过更新训练数据改进,结果仍不理想;
  • 据 10 名现任与前任员工透露,多个层级的产品协调与将 AI 融入搜索、地图、YouTube 等庞大产品体系的复杂性,可能拖慢了发布节奏;
  • 公开榜单前十中,谷歌目前没有一款模型上榜。

对此,谷歌将目光投向下一阶段:已启动「迄今为止最雄心勃勃的预训练」,目标直指 Gemini 4,但目前尚未对外交付能力。同时,谷歌也在研发自研芯片以更低成本运行 Gemini。

短期看,三款 Flash 模型共同传递了「效率优先」的策略,用「便宜 + 快速」占领中端市场,并为旗舰模型争取时间。这场赌局能否成立,将取决于 Gemini 3.5 Pro 何时落地,以及 Gemini 4 最终能否不只是「训练中的承诺」。

参考资料:

信源