header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
扫码下载APP

谷歌上线Gemini 3.8 Live的Live Avatar实时虚拟形象功能

动察 Beating AI 快讯,谷歌在上周发布 Gemini 3.8 Live 之后,于今日推出 Gemini 3.8 Live with Live Avatar:把实时语音对话和低延迟流式视频生成绑定,让企业客服、导览等场景里的智能体能「听、看、说」,并配上口型同步、自然表情和流畅轮流发言。该功能即日起在 Gemini Enterprise 可用。


Live Avatar 可同时处理画面和声音,后台异步调用工具(例如酒店办理入住)时对话不中断;支持在 97 种语言 间无缝切换且口型、表情跟着变。企业可用预设形象,也可用参考图定制品牌形象(定制目前需企业白名单)。所有音视频输出都带 SynthID 水印,便于识别为 AI 生成内容。

AI 解读
谷歌把实时语音、流式视频生成和后台工具调用打包进 Gemini Enterprise。上周 Gemini 3.8 Live 以 82.6 分登顶 Artificial Analysis 语音榜,9 月 24 日 3.8 TTS 开放 30 秒声音复刻,今日 Live Avatar 让企业客服、导览智能体同步听看说,并在 97 种语言间切换口型与表情。此前 3.1 Flash Live 压延迟、3.5 Live Translate 做流式对译,Gemini 月活破 10 亿后已有 63% 用户用语音、超 20% Live 交互用到摄像头或屏幕共享。更值得注意的细节是企业定制形象需白名单且音视频默认带 SynthID 水印:声音复刻与虚拟形象前后脚商品化,身份授权和合成识别先被做成企业采购的合规闸门,背后是可控的多模态 Agent 入口之争。
展开
举报 纠错/举报
纠错/举报
提交
新增文库
仅自己可见
公开
保存
选择文库
新增文库
取消
完成