千问新一代原生全模态模型Qwen3.8-Omni-Flash已正式上线。该模型支持文本、图像、音频和视频输入,具备1M长上下文处理能力,可自主规划任务并调用工具完成创作。在延续原有能力基础上,该模型扩展了音视频处理能力,可处理数小时长音视频,完成会议纪要提炼等任务,并适用于音乐视频制作、短剧翻译等音视频创作场景,还能将长视频转化为信息资产。其实时交互版本则适用于口语陪练等场景。官方同步扩展了Qwen-MM-Plugins,并开源了Qwen-Live Harness。与上一代相比,该模型平均得分提升超26%,且API音视频输入价格大幅下降。目前,该模型已上线千问AI平台。
