桃子桃子快讯
返回首页
产品功能

谷歌 Gemini 3.6 Flash 上线遇冷,3.5 Pro 延期、Gemini 4 已启动最大规模预训练

谷歌推出三款 Gemini 新模型,3.6 Flash 因前端生成与空间推理表现差遭开发者批评,3.5 Pro 确认延期…

2026.07.22 · 周三3 分钟阅读

谷歌 DeepMind 近日通过 Vertex AI 一次性推出三款新模型——Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 与 Gemini 3.5 Flash Cyber,覆盖速度、视觉与网络安全场景。但最受关注的旗舰款 Gemini 3.5 Pro 并未同期发布,谷歌同时确认 Gemini 4 已启动「目前最雄心勃勃的预训练」。

三款新模型同时上线,3.6 Flash 主打性价比

谷歌 DeepMind 在官方公告中将三款模型差异化定位:

  • Gemini 3.6 Flash:定位性价比路线,强调在视觉理解与长上下文基准测试中的领先表现;
  • Gemini 3.5 Flash-Lite:主打速度,官方称每秒可输出约 350 个 token;
  • Gemini 3.5 Flash Cyber:面向网络安全场景的专用模型。

在谷歌自测中,Gemini 3.6 Flash 在代码相关任务上落后于多款外部模型,但在视觉与上下文基准测试中持续位居前列。

社区实测口碑走低:前端与空间推理双双翻车

上线后,开发者社区对 Gemini 3.6 Flash 的反馈迅速分化,批评集中在两类能力:

  • 前端代码生成:开发者通过 2-shot 等方式测试其界面生成能力,反馈普遍指出输出代码逻辑混乱、组件嵌套错位、交互无法投入使用,被部分网友评价为「见过的最差结果」;
  • 空间推理:在逐帧测试中,模型对基础位置、方向关系的判断准确率较 3.5 Flash 明显退步,即便开启高推理模式也未带来改善。

此外,有开发者指出模型的「知识截止时间」与实际表现存在落差,怀疑其实际可用知识仍停留在较早时间点,称其为「未完成的模型」。在第三方综合测评 Artificial Analysis 上,Gemini 3.6 Flash 的得分与 3.5 Flash 持平,未能拉开差距。

3.5 Pro 延期,Gemini 4 已启动最大规模预训练

伴随本次发布,谷歌在公告中确认两项关键信息:

  • Gemini 3.5 Pro 尚未完成,未给出明确上线时间表;
  • Gemini 4 已启动预训练,团队对当前进展「感到振奋」。

据 CNBC 报道,这是谷歌有史以来规模最大的预训练项目。外部分析认为,3.5 Pro 延期或与算力向 Gemini 4 倾斜有关;但在行业算力紧缺、竞品迭代加速的背景下,发布一款口碑偏低的产品,也引发了外界对谷歌发布节奏与资源分配策略的讨论。

信源