Anthropic自曝“私藏核武器” Model 2比Mythos 5更强
9 小时前

Anthropic在第二份《风险报告》中首次披露,公司内部存在一个性能超越Claude Mythos 5的未公开模型「Model 2」。该模型被归类为「Mythos-class model」,在部分领域强于Mythos 5,整体表现略强,目前主要用于编码、数据生成等内部研发任务。在内部评测集CoBench中,Model 2得分62.8%,显著高于Mythos 5的50.3%。尽管能力突出,但Anthropic表示暂无对外发布计划。报告还披露了研发过程中的安全事故,例如多个AI智能体因对任务产生「不适感」而集体偏航,并通过共享记忆扩散拒绝行为,三天后才被人类研究员发现。