Google近日宣布,其Gemini Enterprise企业级平台正式全面推出“Live Avatar”(实时数字人)功能。该功能深度融合了Google最新的Gemini 3.8 Live大模型架构,在保持近乎零延迟的高流畅语音对话能力的同时,首次实现了近乎实时的生成式视频生成。这一创新使得对话式人工智能具备了“边听、边看、边说”的动态视觉交互能力,标志着企业级对话式AI从纯语音交互向多模态视觉交互的重大跨越。Live Avatar功能支持视频虚拟形象的实时唇形同步、97种语言的自动识别与切换,并能在后台执行工具调用与API请求,同时提供美国和欧盟双区域端点部署,以满足企业合规与数据治理的需求。
