新上线昨天0 投票
Gemini 3.8 Live 携 Live Avatar 登场:Google 的 AI 终于有了「脸」
从「能听会说」到「有表情的数字人」
Google 在 Gemini 3.8 Live 模型发布约一周后,又推出了配套的 Live Avatar 功能。这套组合让用户在与模型对话时,不再只是面对一段文字或语音,而是能看到一个会实时回应的动画 AI 形象——它会对口型、做表情,并在对话过程中把信息直接展示在屏幕上。
从官方演示来看,Live Avatar 在英语和日语之间切换时,嘴型动画都能与所说内容对齐。Google 表示,该功能可在其支持的 97 种语言之间平滑过渡,且「不会降低视频保真度,也不会产生视觉漂移」。
当前仅面向企业客户
和许多前沿 AI 能力一样,Live Avatar 暂时只对 Gemini Enterprise 客户开放。Google 会提供一组预设头像供企业选择,同时也允许组织创建自己的专属形象。
在安全层面,Google 称 Live Avatar 的输出会带有不可见的 SynthID 水印,并配套相关保障措施,以「尊重身份」。
为什么这件事值得关注
此前发布的 Gemini 3.8 Live 模型主打「近实时处理视觉输入」,而 Live Avatar 则补上了输出端的临场感。两者结合,意味着 AI 助手正从「工具」向「可交互的数字角色」演进——这对客服、在线教育、虚拟主播等场景有直接想象空间。
不过,企业级优先的策略也说明,这类高算力、高保真的实时数字人距离普通消费者还有一段距离。Google 显然在先用 B 端场景验证稳定性与合规性,再考虑更大范围的开放。
(本文基于 The Verge 报道整理,具体功能细节以 Google 官方说明为准。)
