DeepSeek算子负责人:《我不得不把才华埋葬在昨天》
5 小时前

近日,DeepSeek正式发布v4.1 Flash模型,该模型为552B参数的MoE架构,采用Causal-Encoder-Decoder结构,具备原生多模态视觉理解能力。其输入激活8B、输出激活16B,推理成本显著降低,对HBM需求减少至上一代的1/4,SSD需求减少至1/8。在基准测试中,v4.1 Flash性能超越前代旗舰模型v4 Pro。DeepSeek同步下调了Flash系列定价,并采用峰谷定价机制。该模型已上线DeepSeek API,支持企业级工具链与私有化部署。其算子负责人刘胜与发文《我不得不把才华埋葬在昨天》,坦言AI正加速替代人类算子工程师,未来将转向‘机甲驾驶员’角色,即通过AI Agent优化算子性能。