Google 的全新 Gemini 3.8 Live 更新让用户在与模型对话的同时,能够观看一个动画 AI 虚拟形象实时作出回应。“Live Avatar”将在对话过程中实现口型同步并展现不同的面部表情,但目前仅面向 Gemini Enterprise 客户开放。
正如 Google 所指出的,Live Avatar 可以在其支持的 97 种语言之间自由切换,“而不会降低视频保真度或引入视觉漂移”。在 Google 分享的一段视频中,Live Avatar 分别用英语和日语讲话,其在两种语言中的嘴部动画都与所说的内容保持一致。它还能在讲话的同时在屏幕上调出相关信息。
Live Avatar 的发布距 Google 发布全新 Gemini 3.8 Live 模型约一周时间,该公司表示该模型“能够以近乎实时的速度处理视觉输入”。虽然 Google 将为用户提供一个预设虚拟形象库供其选择,但也将允许企业机构创建自己的形象。Google 表示,Live Avatar 的输出内容附带其不可见的 SynthID 水印,并配有“尊重身份”的安全保障措施。