据unite.ai报道,ElevenLabs发布了文本转语音模型Eleven v4及其低延迟版本Eleven v4 Turbo,称其为该公司迄今为止最具表现力的模型。这两款新模型现已在ElevenAgents、ElevenCreative及ElevenAPI平台上线,免费账户也可使用。Eleven v4基于全新架构,能够解析文本中的语气、节奏、情绪、角色和语境,并新增了说话人身份捕捉方法,以保持音色一致性,同时支持场景级上下文,使对话更加自然。用户可以使用自然语言和内联音频标签来控制演绎效果,且SSML标签在v4中已停用。两款模型均支持90余种语言,并具备即时语音克隆功能,仅需10秒音频即可实现高保真采集,且所有克隆均需声音所有者验证授权。Eleven v4在2026年9月Artificial Analysis Provider Voice Arena榜单中位列第一,定价沿用现有积分结构,免费额度为每月1万积分。
