桃子桃子快讯
返回首页
产品功能

Qwen Intelligence 正式发布,含三款 SOTA 移动智能体

通义千问推出 Qwen Intelligence 平台,含三款移动智能体并同步开源基准测试套件。

2026.09.23 · 周三3 分钟阅读

通义千问(Qwen)正式推出面向移动端的个人智能体平台 Qwen Intelligence,首发即带来三款 SOTA 级别的智能体,覆盖任务规划、应用执行与创意生成三大场景,并同步开放配套基准测试套件,供社区评估与对标。

产品定位:移动端的「个人智能」入口

Qwen Intelligence 将自身定位为「personal intelligence within everyone's reach」(触手可及的个人智能),主攻移动端使用场景。官方将其拆分为三个分工明确的智能体,分别负责思考、执行与创作三类核心能力,调度上采用 API-first 策略,仅在必要时回退到 GUI 操作,以平衡稳定性与覆盖面。

三款智能体一览

  • Mobile Planner Agent(移动规划智能体):负责复杂任务的拆解与编排,在 MobilePA-Bench、MobilePA-Bench Business 与 Memory 三个子榜上均位列第一,是整套产品的「大脑」。
  • Mobile-Use Agent(移动执行智能体):负责把事情做完,官方称其端到端成功率约 90%;在 MobileWorld 上得分 82.1,MobileWorld-Real 92.2,AndroidDaily 97.2。
  • Mobile Creative Agent(移动创作智能体):支持一句话生成可直接使用的创作内容,图像生成耗时约 3 秒,官方称速度约为同类产品的 2 倍。

开源基准:评测体系一同公开

Qwen 同步开放了四项基准测试,覆盖规划、跨应用执行、真实设备表现与安全性等维度:

  • MobilePA-Bench:聚焦任务规划能力。
  • MobileWorld(GitHub 开源):评估智能体在模拟移动环境下的综合表现。
  • MobileWorld-Real:在真实设备上进行的评测。
  • MobileWorld-Safety:专门考察安全合规表现。

官方同时上线了 Leaderboard 排行榜,方便研究者与开发者横向对比。

行业意义

Qwen Intelligence 的发布意味着通义千问把竞争焦点从基础对话能力扩展到端侧智能体生态。三大智能体加开源基准形成「能力 + 评测」的完整闭环,与 Apple Intelligence、Anthropic 的 Computer Use 等移动端智能体路线形成正面竞争。对移动开发者而言,开放的基准套件与排行榜也提供了直接的参照系,有助于后续接入、调优与差异化定位。

信源