产品功能
Agora 推出 Conversational AI Engine,接入 GPT-Live-1 实时语音模型
实时通信平台声网 Agora 发布对话式 AI 引擎,集成可同步听说能力的 GPT-Live-1 模型。
2026.09.12 · 周六约 2 分钟阅读
实时通信平台声网 Agora 宣布推出 Conversational AI Engine(对话式 AI 引擎),并接入名为 GPT-Live-1 的实时语音模型。该引擎运行在 Agora 自有的实时音视频网络上,旨在把 AI 协作者直接带入实时通话场景,实现人机共同参与的多方对话。
核心能力:同步听说
根据 Agora 方面披露的信息,GPT-Live-1 的关键特性是能够「同时听、同时说」,即在保持低延迟语音交互的前提下,并行处理语音听写(ASR)与语音播报(TTS)任务,避免传统语音助手常见的「听完再说」式回合切换延迟。Agora 表示,该能力使其对话式 AI 引擎可以在不打断通话节奏的情况下,实时理解对方语义并即时回应。
产品定位与技术架构
Conversational AI Engine 将 Agora 的实时通信网络(用于传输语音流)与对话式 AI 能力整合在一起,开发者可以在通话链路中直接挂载 AI Copilot,让其参与多人语音会话。Agora 称,这套架构面向需要 AI 实时介入的客服、协作、陪伴等场景,强调低时延与可扩展性。
信息局限
目前公开信息仍较有限,关于 GPT-Live-1 的模型来源(是否为 OpenAI 官方模型、是否由 Agora 自行微调或蒸馏)、参数量、上下文长度、benchmark 表现以及定价策略均未披露。Agora 官方及 TestingCatalog 在 X 上发布的内容以能力描述为主,缺少可量化的技术细节。后续有待官方发布完整文档或定价页面后,再做进一步评估。
