9月1日消息,Anthropic宣布,公司已暂时停止部分AI训练及网络安全评估工作。今日,Anthropic在一篇博客文章中详细说明了此次调整,并解释了这是针对今年早些时候其AI智能体未经授权行动所采取的应对措施。此前,OpenAI也因安全考量暂停了部分模型的开发。Anthropic此次行动与之类似,并再次呼吁对前沿AI的发展速度进行更广泛的协调。Anthropic透露,自7月公布三起相关事件后,公司已暂停对预发布模型的外部网络安全评估,并曾短暂停止内部测试。此外,公司还暂停了预发布模型中风险较高的强化学习环境,持续数周。目前,大部分强化学习已恢复,但部分高风险环境仍暂停,等待人工审查或监控工具更新。
