模型发布
OpenAI 联合创始人首次披露 GPT-Live 实时音频新架构
Greg Brockman 在 X 上透露 GPT-Live 是面向实时音频的新架构与技术栈,细节尚未公布。
2026.08.04 · 周二约 2 分钟阅读
OpenAI 联合创始人 Greg Brockman 近日在 X 平台发文,首次披露一项名为「GPT-Live」的新架构。据其描述,GPT-Live 是一套面向实时音频场景设计的全新架构与技术栈(stack),但相关推文未提供更多技术细节、发布时间或能力说明。
来源与可信度
该消息直接来自 OpenAI 联合创始人 Greg Brockman 的个人 X 账号,属于官方一手信息源,具备较高可信度。然而,由于原文仅为一句简介式的预告,缺乏可验证的技术参数、产品形态或发布时间表,目前尚无法对其技术路线与定位做出具体判断。
行业背景
实时音频交互是当前大模型竞争的热点方向之一,OpenAI 此前已通过 Realtime API、ChatGPT 高级语音模式等产品布局语音对话能力。GPT-Live 若确为全新架构,可能意味着 OpenAI 在端到端实时音频处理上将有底层技术革新,而非仅在现有模型上叠加语音功能。
信息缺口
截至目前,OpenAI 官方渠道尚未发布与 GPT-Live 相关的博客、论文或文档,Brockman 的这条推文也未附带更多说明。对于以下关键问题,外界仍无答案:
- GPT-Live 是否为独立模型,还是 Realtime API 的底层重构;
- 与现有 GPT-4o 语音模式相比,在延迟、自然度和多语言能力上有何差异;
- 是否面向开发者开放,以及定价策略如何。
后续 OpenAI 是否会通过官方博客或发布会进一步披露 GPT-Live 的技术细节,值得持续关注。
