阿里巴巴旗下Qwen团队近日推出新一代原生全模态模型Qwen3.8-Omni-Flash,该模型融合了音频、视频理解与AI智能体能力,支持文本、图像、音频、视频四种输入,并提供100万Token上下文窗口。据Qwen官方介绍,与上一代Qwen3.5-Omni-Plus相比,Qwen3.8-Omni-Flash在29项基准测试中平均成绩提升超25%,且显著降低了音频和音视频处理成本。