产品功能
ChatGPT 桌面端语音上线:可语音调度多 Agent 与 Codex
OpenAI 今日向桌面端 ChatGPT 推送语音模式,基于 GPT-Live 模型支持语音控制电脑与多 Agent…
2026.07.24 · 周五约 2 分钟阅读
OpenAI 今日宣布 ChatGPT 语音模式正式登陆桌面端应用,基于其新发布的全双工语音模型 GPT-Live,用户可通过语音直接操控电脑,并调度在 ChatGPT Work 与 Codex 中运行的多个 Agent 协同完成任务。该功能今日起在全球范围内向 Plus、Pro、Business、Edu 与 Enterprise 订阅用户开放,覆盖 macOS 与 Windows 平台。
核心能力:语音即控制入口
本次桌面端语音模式的关键升级在于「语音 + Agent」的联动。据 OpenAI 介绍,GPT-Live 模型具备同时说与听的能力,可在 ChatGPT 应用内实时协调多任务执行:
- 用户可直接用语音指挥 Codex 中的 Agent 完成编程任务;
- 语音模式下能同时与多个 Agent 沟通,分配与追踪工作;
- 全双工特性意味着对话无需等待模型响应结束,可随时打断或追加指令。
跨平台覆盖与路线图
在桌面端首发的同时,OpenAI 也给出了移动端的接入方式:用户可通过 ChatGPT iOS 应用的远程配对功能,在手机上使用语音控制 Codex 中的 Agent。Android 端的远程语音支持将在后续推出。
关联更新:Health in ChatGPT 启动美国用户灰度
与此同时,OpenAI 还宣布「Health in ChatGPT」开始向美国用户推送。该功能允许用户将 Apple Health 及受支持的医疗记录安全接入 ChatGPT,使其在对话中结合个人健康数据理解上下文、追踪指标变化,并提供更具针对性的健康信息解读。
订阅门槛与可用性
- 平台:macOS、Windows(桌面端首发)
- 订阅档位:Plus、Pro、Business、Edu、Enterprise
- 地区:全球逐步开放
- 移动端:iOS 远程配对可用,Android 即将上线
至此,ChatGPT 的语音交互从移动端扩展到桌面生产力场景,并首次与 Agent 体系深度结合,标志着 OpenAI 正在把语音打造为跨设备、跨任务的主要交互入口之一。
