模型发布
千问办公上线 Qwen3.8-Flash,速度翻倍、Token 消耗降至四分之一
8月26日,千问办公全量上线 Qwen3.8-Flash 并推出标准模式,单任务生成速度提升约100%,Token消耗平…
2026.08.27 · 周四约 2 分钟阅读
8月26日晚,阿里千问办公全量上线最新模型 Qwen3.8-Flash,并同步推出面向所有用户的「标准模式」。官方表示,基于该模型的新模式在真实办公场景测试中,单任务生成速度提升约100%,Token消耗平均减少75%。未来千问办公的模型供给将简化为「标准模式」与「高级模式」两种,其中95%的日常任务可在标准模式下完成,仅5%复杂任务需要调用高级模式。
模型与产品双向协同
Qwen3.8-Flash 采用全新架构,在千亿级总参数规模下实现了对 Claude Opus 4.6 的性能超越。千问大模型团队与千问办公团队联合推出办公专属版本,针对多步规划、工具选择、上下文压缩等高频办公场景进行专项训练调优,并通过推理优化和定制 Harness 架构进一步提升吞吐效率。
「不可能三角」被打破
在真实 AI 应用场景中,高性能通常与高成本、高延迟挂钩,而低成本方案往往需要在智能水平上做出让步。官方认为,Agent 与模型的深度协同优化正在打破性能、成本与速度三者之间的「不可能三角」。
面向 Agent 的体验升级
随着模型智能密度的持续提升,以及千问办公与底层模型的双向优化,Agent 有望告别 Token 焦虑,在复杂办公流程中提供更充足的调用余量。标准模式的全面上线,被视为这一调整落地的第一步,后续千问办公将围绕模型能力与 Agent 协同持续迭代。
(本文内容综合自千问官方授权量子位转载的发布信息。)
