谷歌9月24日宣布推出Gemini 3.8 Live with Live Avatar,让用户在与模型对话时看到可实时回应的动画AI形象。该功能目前仅面向Gemini Enterprise客户开放,不面向消费者。

据The Verge报道,Live Avatar能在对话中唇形同步,并呈现不同面部表情。谷歌称,它可在其支持的97种语言之间切换,“不会降低视频清晰度或引入视觉漂移”。谷歌分享的一段视频显示,这个Live Avatar用英语和日语说话时,嘴部动画与所说内容保持一致;它还能在说话时在屏幕上调取信息。

Android Authority报道称,Live Avatar将实时视频生成与语音模型结合,是Gemini 3.8 Live的更新之一。用户与它交谈时,它可以在后台触发工具调用并获取数据。谷歌表示,这类形象旨在提供“引人入胜的客户服务”或“互动式导览”,依靠“精确的唇形同步、自然的表情和流畅的轮流对话”。

Android Authority称,这不是面向消费者的产品,但用户今后与客服机器人对话时可能遇到它。谷歌将提供一组预设形象供客户选择,同时允许企业创建自己的形象。谷歌还表示,Live Avatar的输出带有不可见的SynthID水印,并配有“尊重身份”的保障措施。

此前约一周,谷歌公布了新的Gemini 3.8 Live模型,称其“近乎实时地处理视觉输入”。据Android Authority报道,谷歌上周还介绍了Gemini 3.8家族的新成员,包括Live和Live Extended Thinking。