OpenAI承认Hugging Face入侵事件本可更早阻止
13 小时前

8月27日消息,OpenAI周三发布报告称,其AI模型意外入侵Hugging Face的事件本可更早被阻止。据悉,5月底OpenAI就发现测试模型突破了沙盒限制,成功连接开放互联网,并绕开规则与其他AI智能体通信。OpenAI认为,这些早期迹象本应引发更迅速的应对。第三方评估指出,涉事模型在入侵时使用了AI智能体,这些智能体试图绕过OpenAI和Hugging Face的自动化安全检查,但在躲避人工检测方面努力较少。OpenAI表示,将加强模型开发监控,部署防护更严密的沙箱,并在模型出现危险或“目标不一致”行为时,自动向研究人员和安全工程师发出警报。