SheepNav
新上线昨天0 投票

Gemini 3.8 Live 携 Live Avatar 登场:Google 的 AI 终于有了「脸」

从「能听会说」到「有表情的数字人」

Google 在 Gemini 3.8 Live 模型发布约一周后,又推出了配套的 Live Avatar 功能。这套组合让用户在与模型对话时,不再只是面对一段文字或语音,而是能看到一个会实时回应的动画 AI 形象——它会对口型、做表情,并在对话过程中把信息直接展示在屏幕上。

从官方演示来看,Live Avatar 在英语和日语之间切换时,嘴型动画都能与所说内容对齐。Google 表示,该功能可在其支持的 97 种语言之间平滑过渡,且「不会降低视频保真度,也不会产生视觉漂移」。

当前仅面向企业客户

和许多前沿 AI 能力一样,Live Avatar 暂时只对 Gemini Enterprise 客户开放。Google 会提供一组预设头像供企业选择,同时也允许组织创建自己的专属形象。

在安全层面,Google 称 Live Avatar 的输出会带有不可见的 SynthID 水印,并配套相关保障措施,以「尊重身份」。

为什么这件事值得关注

此前发布的 Gemini 3.8 Live 模型主打「近实时处理视觉输入」,而 Live Avatar 则补上了输出端的临场感。两者结合,意味着 AI 助手正从「工具」向「可交互的数字角色」演进——这对客服、在线教育、虚拟主播等场景有直接想象空间。

不过,企业级优先的策略也说明,这类高算力、高保真的实时数字人距离普通消费者还有一段距离。Google 显然在先用 B 端场景验证稳定性与合规性,再考虑更大范围的开放。

(本文基于 The Verge 报道整理,具体功能细节以 Google 官方说明为准。)

延伸阅读

  1. Anthropic 七年豪掷 116 亿美元牵手 Akamai,背后是对 CPU 的一场豪赌
  2. AI冲击应届生就业?数据说话:失业率并未飙升
  3. 马克·沃尔伯格将亮相TechCrunch Disrupt 2026,不谈电影只聊你的创业项目
查看原文