9月10日,DeepSeek正式推出其全新模型结构系列中的最小尺寸模型——DeepSeek V4.1 Flash。该模型具备原生多模态视觉理解能力,通过大幅减少KV Cache缓存大小,与上一代相比,对HBM的需求降至1/4,对SSD的需求降至1/8。在Agent使用场景中,这一改进显著降低了缓存命中的费用,从而大幅削减了Agent类任务的使用成本。