DeepSeek-V4 首个实验性多模态视觉模型开源
3 小时前

2026年8月31日,DeepSeek正式开源其V4系列首个实验性多模态模型DeepSeek-V4-Flash-Vision-Exp,采用MIT许可证。该模型基于V4-Flash架构,加入视觉模块,具备图片理解能力,可描述图片、识别截图文字、分析图表等,支持JPEG、PNG、GIF、WebP格式。模型参数规模达305B,在纯文本Agent任务上表现与V4-Flash相当,在视觉理解Agent基准测试中性能大幅提升,多模态Agent能力接近Opus-4.8。