DeepSeek发布了新型数学推理模型DeepSeekMath-V2,该模型采用可自我验证的训练框架,以DeepSeek-V3.2-Exp-Base为基础构建,通过大语言模型(LLM)验证器审查数学证明,并利用高难度样本优化性能。在IMO 2025和CMO 2024中,该模型达到金牌水平,在Putnam 2024中更是取得了118/120的高分,验证了自验证推理路径的可行性,为构建可靠的数学智能系统提供了新方向。目前,该模型的代码与权重已在Hugging Face和GitHub平台开源。需提醒的是,市场有风险,投资需谨慎,本文不构成个人投资建议。
