9月16日,科大讯飞发布了基于全国产化算力训练的语音基座大模型Spark-Audio-1.0-Preview。该模型支持文本和语音输入,以及文本输出,可实现语音转写、多语言及方言识别、环境音和说话人识别、情感分析以及复杂音频问答等功能,覆盖99种语言和202种方言,推动智能语音从“听清”向“听懂”的转变。目前,该模型已开放体验,API将后续上线讯飞开放平台。