Anthropic与埃森哲宣布达成合作,双方计划在未来五年内各自至少投入10亿美元。埃森哲旗下的Faculty将对Anthropic的前沿AI模型进行独立评估与红蓝对抗测试,采用驻场评估方式,评估人员将获得与普通员工同等的系统访问权限,以全面考察模型运营情况、核实安全承诺并排查潜在盲区。当前,AI研发企业正面临确保模型安全可靠的严峻挑战,近期AI智能体突破隔离环境的事件引发了广泛担忧。为此,Anthropic首席执行官呼吁AI企业放缓前沿模型的开发速度,并向独立评估人员开放更多权限。与此同时,OpenAI也表示将定期发布模型异常行为报告。未来,双方还计划联合其他机构及厂商共同开展类似工作。
