DeepSeek-V3 & R1 合体：快手开源 "Auto Think" 大模型，可根据问题自动调节思考深度 - AI

Just Quick Just Quality

热门话题

白天

搜索

资讯

DeepSeek-V3 & R1 合体：快手开源 "Auto Think" 大模型，可根据问题自动调节思考深度

2025-06-04 / 阅读约2分钟

来源：IT之家

快手 Kwaipilot 团队开源了 KwaiCoder-AutoThink-preview 自动思考大模型，该模型融合了“思考”和“非思考”能力，号称“DeepSeek-V3 & R1 合体”，具备根据问题难度自动切换思考形态的能力。

感谢IT之家网友软媒新友2178118 的线索投递！

IT之家 6 月 4 日消息，快手 Kwaipilot 团队近日开源了 KwaiCoder-AutoThink-preview 自动思考大模型，针对近期深度思考大模型存在的“过度思考”问题进行了深入研究。团队提出了一种全新的自动思考模型训练范式，同时基于传统强化学习算法（GRPO），提出了带有过程监督的强化学习方法 Step-SRPO，以进一步提升模型在复杂任务中的表现。

据介绍，该模型融合了“思考”和“非思考”能力，号称“DeepSeek-V3 & R1 合体”，具备根据问题难度自动切换思考形态的能力。通过进行这种思考形态训练，模型在多个“思考”和“非思考”评测榜单上均实现了性能提升，其中在部分代码和数学类的任务上，开启自动思考模式下的模型得分提升高达 20 分左右。官方表示，在部分榜单中，即使模型没有开启思考模式，受益于更优的推理形态，性能也有小幅上涨。