Gemini3.8Live 升级语音智能:对话、推理与任务执行进一步融合
22 小时前

谷歌近日推出了Gemini3.8Live和Gemini3.8Live Extended Thinking两款新模型。这两款模型新增了近实时推理、语音与思考同步处理、后台工具和API调用等核心功能,支持97种语言的自动检测和切换,以及近实时视觉定位。模型还能通过语言提示告知用户其思考状态。目前,这两款模型已登陆相关开发者平台,覆盖多个应用场景,并在多项测试中表现优异。谷歌已与多个平台展开合作,便于开发者集成使用,且模型生成的音频均嵌入了SynthID水印。此次升级将实时语音交互从简单的“听与说”提升到了理解、推理和任务执行层面,推动了语音AI向持续、多任务的智能体交互形态发展。