桃子桃子快讯
返回首页
模型发布

OpenAI 联合创始人首次披露 GPT-Live 实时音频新架构

Greg Brockman 在 X 上透露 GPT-Live 是面向实时音频的新架构与技术栈,细节尚未公布。

2026.08.04 · 周二2 分钟阅读

OpenAI 联合创始人 Greg Brockman 近日在 X 平台发文,首次披露一项名为「GPT-Live」的新架构。据其描述,GPT-Live 是一套面向实时音频场景设计的全新架构与技术栈(stack),但相关推文未提供更多技术细节、发布时间或能力说明。

来源与可信度

该消息直接来自 OpenAI 联合创始人 Greg Brockman 的个人 X 账号,属于官方一手信息源,具备较高可信度。然而,由于原文仅为一句简介式的预告,缺乏可验证的技术参数、产品形态或发布时间表,目前尚无法对其技术路线与定位做出具体判断。

行业背景

实时音频交互是当前大模型竞争的热点方向之一,OpenAI 此前已通过 Realtime API、ChatGPT 高级语音模式等产品布局语音对话能力。GPT-Live 若确为全新架构,可能意味着 OpenAI 在端到端实时音频处理上将有底层技术革新,而非仅在现有模型上叠加语音功能。

信息缺口

截至目前,OpenAI 官方渠道尚未发布与 GPT-Live 相关的博客、论文或文档,Brockman 的这条推文也未附带更多说明。对于以下关键问题,外界仍无答案:

  • GPT-Live 是否为独立模型,还是 Realtime API 的底层重构;
  • 与现有 GPT-4o 语音模式相比,在延迟、自然度和多语言能力上有何差异;
  • 是否面向开发者开放,以及定价策略如何。

后续 OpenAI 是否会通过官方博客或发布会进一步披露 GPT-Live 的技术细节,值得持续关注。

信源