字节跳动发布音视频全双工大模型SeedRealtime
12 小时前

2026年8月5日,字节跳动正式发布原生音视频全双工大模型SeedRealtime,该模型采用统一架构,原生融合音频、视频和文本,支持在连续多模态信息流中实时交互,实现“边看、边听、边说”。相比传统级联系统,SeedRealtime减少了延迟和信息损耗,提升了对话节奏的自然度。目前,该模型已在豆包App全量上线。