桃子桃子快讯
返回首页
模型发布

千问办公上线 Qwen3.8-Flash,速度翻倍、Token 消耗降至四分之一

8月26日,千问办公全量上线 Qwen3.8-Flash 并推出标准模式,单任务生成速度提升约100%,Token消耗平…

2026.08.27 · 周四2 分钟阅读

8月26日晚,阿里千问办公全量上线最新模型 Qwen3.8-Flash,并同步推出面向所有用户的「标准模式」。官方表示,基于该模型的新模式在真实办公场景测试中,单任务生成速度提升约100%,Token消耗平均减少75%。未来千问办公的模型供给将简化为「标准模式」与「高级模式」两种,其中95%的日常任务可在标准模式下完成,仅5%复杂任务需要调用高级模式。

模型与产品双向协同

Qwen3.8-Flash 采用全新架构,在千亿级总参数规模下实现了对 Claude Opus 4.6 的性能超越。千问大模型团队与千问办公团队联合推出办公专属版本,针对多步规划、工具选择、上下文压缩等高频办公场景进行专项训练调优,并通过推理优化和定制 Harness 架构进一步提升吞吐效率。

「不可能三角」被打破

在真实 AI 应用场景中,高性能通常与高成本、高延迟挂钩,而低成本方案往往需要在智能水平上做出让步。官方认为,Agent 与模型的深度协同优化正在打破性能、成本与速度三者之间的「不可能三角」。

面向 Agent 的体验升级

随着模型智能密度的持续提升,以及千问办公与底层模型的双向优化,Agent 有望告别 Token 焦虑,在复杂办公流程中提供更充足的调用余量。标准模式的全面上线,被视为这一调整落地的第一步,后续千问办公将围绕模型能力与 Agent 协同持续迭代。

(本文内容综合自千问官方授权量子位转载的发布信息。)

信源