Google 上线 Gemini 3.6 Flash 与 3.5 Flash Lite
Google 发布两款 Gemini 新模型,分别主打智能体与编码前沿性能,以及高吞吐低延迟场景,已在 Gemini A…
Google 近日推出两款 Gemini 系列新模型——Gemini 3.6 Flash 与 Gemini 3.5 Flash Lite,已在 Gemini App、Google AI Studio、Vertex AI 以及 Antigravity 等多个渠道同步开放。官方将 3.6 Flash 定位为目前最具智能水平的主力模型,重点面向智能体(agentic)与编码场景的持续前沿性能;3.5 Flash Lite 则聚焦高吞吐、低延迟执行,用于规模化运行大量智能体与子智能体任务。
Gemini 3.6 Flash:面向智能体与编码的主力模型
根据 Google 官方描述,Gemini 3.6 Flash 被定位为「迄今最具智能水平、可持续提供前沿性能的模型」,核心卖点集中在智能体工作流与编程任务上的稳定表现。Flash 系列通常以速度与成本优势见长,但 3.6 Flash 的官方措辞明显抬高了对其推理与编码能力的预期,暗示该版本在能力上向更高端档位靠拢。不过截至目前,Google 尚未公开具体的 benchmark 数据、参数规模、上下文窗口或定价信息,具体能力边界仍需后续实测与第三方评测验证。
Gemini 3.5 Flash Lite:高吞吐低延迟的轻量版本
Gemini 3.5 Flash Lite 与 3.6 Flash 形成互补,官方将其定义为「高吞吐、低延迟执行」的选择,目标是支撑大规模智能体任务以及子智能体(subagent)工作流的并发调用。在企业级与开发者场景中,这类轻量模型通常用于分类、路由、工具调用等高频但单次复杂度不高的环节,其实际价值取决于延迟、价格窗口与质量之间的平衡。官方同样未披露该模型的详细参数与基准成绩。
渠道与可用性
两款模型均在以下渠道同步上线:
- Gemini App(消费端产品)
- Google AI Studio(开发者试用)
- Android Studio
- Vertex AI(企业 API)
- Antigravity(Google 的智能体开发环境)
此外,Google 还预告 Gemini 3.5 Flash Cyber 将作为 CodeMender 项目的独占模型,以「有限访问试点」的形式开放,面向代码安全与修复方向。CodeMender 是 Google DeepMind 此前披露的 AI 自动修复代码漏洞项目,Flash Cyber 的接入意味着该工作流获得了专属模型支持。
小结
整体来看,本次发布延续了 Google 近期「按档位细化 Flash 系列」的节奏:一端用 3.6 Flash 强化推理与编码的智能上限,另一端用 3.5 Flash Lite 覆盖规模化、低成本的执行需求,配合 Antigravity 与 CodeMender 等应用场景,逐步构建覆盖开发者与企业用户的完整模型矩阵。后续值得关注的,是官方何时补齐 benchmark、价格与上下文长度等关键参数。
