Google Gemini Live 上线 Live Avatar,支持实时动画虚拟人对话
Google 为 Gemini Live 推出 Live Avatar 动画虚拟人功能,可在对话中实时唇形同步并切换表情…
Google 近日对 Gemini 3.8 Live 推送更新,新增名为「Live Avatar」的可视化虚拟人功能,让用户在对话过程中不仅能听到模型的语音回复,还能同步观看一个动画形象作出对应的口型与表情。这是 Google 在多模态实时交互方向上的又一次产品迭代。
核心功能:实时唇形同步与表情动画
据 Google 介绍,Live Avatar 能够在对话进行时驱动动画形象实时唇形同步,并根据语境展示不同的面部表情。Google 强调,该功能可在其支持的 97 种语言之间平滑切换,官方原话称「不会降低视频保真度或出现视觉漂移」。Google 公开的演示视频展示了虚拟人分别在英语和日语之间切换说话,画面中口型动画与语音内容保持一致。
附加能力:对话中调取信息
除语音与表情输出外,Live Avatar 还可在对话过程中直接在屏幕上拉取并展示信息,意味着这一动画形象具备一定的「看屏作答」能力,而非仅作为被动输出表情的虚拟形象存在。不过,原文未给出这一能力的具体技术细节或使用场景。
现阶段可用范围:仅限企业版
需要注意的是,Live Avatar 目前仅向 Gemini Enterprise(企业版)客户开放,尚未对个人用户或普通订阅用户推出。Google 也尚未公布该功能何时向更广泛用户群开放的计划。考虑到企业级部署通常涉及数据合规与品牌定制需求,Live Avatar 短期内更可能面向客户服务、虚拟主播、企业培训等 B 端场景落地。
小结
总体来看,Live Avatar 是 Google 把 Gemini 从纯语音助手向可视化虚拟人延伸的一次尝试,重点解决多语种切换时的口型一致性与表情自然度问题。但目前功能仍处企业版封闭测试阶段,公开技术细节有限,其实际表现与后续开放节奏有待进一步观察。
