研究论文
Google AMIE 医疗 AI 首次实现实时视频问诊
Google Research 与 DeepMind 推进 AMIE,基于 Gemini 与 Astra 多智能体架构,…
2026.08.12 · 周三约 2 分钟阅读
Google Research 与 Google DeepMind 近日联合推进其研究性医疗 AI 系统 AMIE,向实时临床视频问诊场景延伸,并称这是同类能力中首次由 AI 系统完成的演示。AMIE 基于 Gemini 与 Project Astra 构建,采用多智能体架构,现已具备解读视觉与听觉线索、引导虚拟体检以及实时诊断推理的能力。
研究设计与评估方式
研究团队在一项随机对照试验中,对 AMIE 的视频问诊表现进行了评估。试验使用模拟患者演员与一组初级保健医生进行对比,由临床评估人员从多个核心临床能力维度对 AMIE 进行评判,包括:
- 病史采集的全面性
- 诊断准确性
- 处置方案的合理性
- 沟通质量
结果显示,临床评估人员对 AMIE 在上述维度上的表现给予了正面评价。与此同时,参与模拟的患者演员也表达了对视频问诊体验的偏好,认为其优于此前 AMIE 的纯文本聊天形式。
技术基础与架构
AMIE 的此次升级建立在 Google 的 Gemini 大模型与 Project Astra 实时多模态交互能力之上,通过多智能体架构将视觉理解、语音交互与临床推理整合在同一系统中。这意味着 AI 不仅能处理文字问诊,还能观察患者的表情、动作、肤色等视觉信号,并结合语音信息进行综合判断,向真实临床场景中的「看—问—诊」流程靠拢。
仍处研究阶段,距离临床落地尚远
Google 强调,AMIE 目前仍是一个研究系统,在负责任地部署到真实临床环境之前,还需要更多研究工作。此次演示的意义更多在于展示医疗 AI 在多模态实时交互方向上的潜力,而非宣告产品化时间表。该研究的具体论文与方法细节已发布在 Google Research 博客上,供学术界进一步审视。
