桃子桃子快讯
返回首页
模型发布

Google 推出 Gemini 3.6 Flash:token 效率明显提升

Jeff Dean 在 X 上宣布 Gemini 3.6 Flash 模型相比 3.5 Flash 在 token 效率…

2026.07.21 · 周二2 分钟阅读

Google 首席科学家 Jeff Dean 近日在 X 平台发文,介绍了新发布的 Gemini 3.6 Flash 模型,并重点强调了其在 token 效率方面的改进。据 Jeff Dean 介绍,Gemini 3.6 Flash 相比上一代 3.5 Flash 模型明显更加 token 效率(token efficient),他还在帖子中附上了一段并排对比演示,直观展示两代模型在同等任务下的 token 消耗差异。

发布背景与信息来源

本次消息并非通过 Google 官方博客或完整发布会公布,而是由 Jeff Dean 以个人 X 账号形式率先分享,属于社交平台层面的一手披露。Jeff Dean 作为 Google 高级 Fellow 及 Google DeepMind 首席科学家,其发布内容具有较高可信度,但目前原帖尚未提供完整的官方文档、benchmark 数值或 API 定价等细节。

核心改进:token 效率

本次更新的核心亮点集中在 token 效率层面。token 是大模型处理和计费的基本单位,token 消耗越少,意味着:

  • 同样任务下 API 调用成本更低
  • 更长的上下文窗口可被有效利用
  • 推理延迟和吞吐量有望改善

Jeff Dean 对参与该模型研发与发布的团队表示肯定,但未给出具体的效率提升比例、benchmark 分数或上下文窗口规格等量化数据。

后续关注点

截至目前,Google 尚未发布与 Gemini 3.6 Flash 配套的完整技术报告或详细 changelog,开发者和用户尚需等待官方渠道进一步披露模型的具体参数、定价、性能基准以及上线渠道等关键信息,以全面评估本次迭代的实际价值。

信源