字节跳动发布了音频创作模型Seed Audio1.0,该模型已在火山方舟体验中心开放测试。它突破了传统多模型拼接混音的限制,通过统一框架端到端生成完整声音作品。Seed Audio1.0具备精准时空编排、稳定音色演绎和地道多语种支持三大核心能力,在九大类创作场景中音频可用率超90%,多语言生成自然度优秀。该模型降低了高质量音频制作门槛,未来团队计划融合多模态输入、探索可控翻译技术等,进一步优化相关能力。