Google推出Gemini 3.5 Transcribe 语音转文字准确度进一步提升
11 小时前

Google近日推出了Gemini系列的新语音转文字模型——Gemini 3.5 Transcribe,号称该系列中准确度最高。该模型面向开发者、企业及普通用户,显著提升了在嘈杂环境、复杂专业术语及自然口语下的转写能力。它不仅能识别说话人意图并自动整理输出,还能智能识别自我修正,过滤口头禅,将口语内容转为格式化文本。此外,该模型支持超过85种语言,包括多语言混说,并允许用户添加自定义词汇以提高识别精度。Gemini 3.5 Transcribe已集成到Android版Gboard和Mac版Gemini应用中,并通过Gemini API向开发者开放预览,还计划引入Chrome浏览器,实现网页语音输入。