据geeky-gadgets报道,Anthropic在2026年风险概述中披露,其最新内部模型Model 2在内部评估中表现优于前代Mythos 5,在自研Codebench测试中取得62.8%的成绩,但未达到85%的广泛部署标准。目前,该模型仅作为内部工具使用,暂不计划对外发布。