9月10日,DeepSeek V4.1 Flash正式发布。该模型具备原生多模态能力,支持100万Token上下文及384K输出,采用非对称激活技术,显著降低了缓存和显存需求,同时API价格大幅下降。然而,其权重高达510GB,本地自部署需8卡节点,导致总拥有成本(TCO)上升。在七项测试中,DeepSeek V4.1 Flash在代码生成和智能体任务等五项测试中表现优于V4 Pro,仅在推理任务两项测试中稍逊一筹。在金融投研领域,该模型可重算估值底稿,行业研究建实体页能力仅次于GPT-6 Astra,回测口径严谨但缺乏交易约束。
