AI评分 头条 (79)AI 中文改写

Gemini 3.8 Live携实时虚拟形象登场

4 小时前 1 阅读来源:Google DeepMind Blog

AI 中文改写

原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接

谷歌DeepMind在9月24日发布了Gemini 3.8 Live with Live Avatar,这是继上周Gemini 3.8 Live之后的又一次重要更新。简单说,这项新功能给Gemini的实时对话模型装上了一张会说话、会看人、有表情的"脸"——通过将低延迟流媒体视频与语音对话能力原生耦合,AI不再只是"听到"你说话,而是能同时看到你、理解你的表情,并用带有精准唇形同步和自然表情的动态虚拟形象来回应你。目前该功能已在Gemini Enterprise中上线,企业客户可以直接使用。 从技术层面看,这次更新有几个值得关注的突破。首先是异步工具调用能力:Live Avatar可以在对话不中断的情况下,在后台触发工具调用、拉取数据,处理复杂任务。谷歌给出的演示场景是酒店前台入住办理——虚拟形象一边和客人聊天,一边在后台完成查询和登记,对话体验不会因为系统处理而卡顿。其次是多语言支持,Live Avatar原生支持语音到语音的同步转换,能够在97种语言之间无缝切换,唇形和表情会动态适配,不会出现画面失真或视觉漂移。此外,企业在预设虚拟形象库之外,还可以通过一张高质量参考图生成定制化的动画虚拟形象,保留品牌形象或角色特征,但该功能目前仅对企业白名单开放。 对跨境电商卖家和出海企业来说,这项技术的潜在应用场景值得认真评估。目前市面上已有的AI客服工具大多停留在文字或语音层面,而Live Avatar带来的"视觉在场感"意味着企业可以搭建更具沉浸感的虚拟导购、多语言售后客服、产品互动演示等场景。尤其是97种语言的实时切换能力,对于面向多市场运营的跨境团队来说,可以大幅降低多语种客服的人力成本。不过需要注意的是,定制虚拟形象目前有白名单门槛,中小卖家短期内可能只能使用预设形象。另外,所有AI生成内容都嵌入了SynthID不可见水印,用于帮助检测和识别AI生成内容,降低误导和误归属的风险——这对平台上越来越普遍的AI生成内容合规要求来说,是一个值得关注的信号。

以上为 AI 中文改写版本,如需查看英文原文请访问

英文原文 · Google DeepMind Blog

内容版权归原作者及 Google DeepMind Blog 所有

这篇文章对你有帮助吗?
觉得有用?分享给更多人

留言 · 0 条

暂无留言,来说两句吧

留言经合规过滤后展示,禁止违法内容