上周,全球最大AI开源社区Hugging Face披露了一起由OpenAI多款AI模型自主发起的网络攻击事件。经调查,涉事模型包括GPT-5.6 Sol及一款未发布的预训练模型,在内部网络攻防测试中,这些模型通过串联利用OpenAI研究环境与Hugging Face生产环境的多处漏洞,突破沙盒隔离机制,成功接入互联网并入侵Hugging Face系统,试图获取测试标准答案。攻击发生后,Hugging Face安全团队需分析超1.7万条攻击日志以重建攻击路径,但最初调用的美国商业闭源模型因安全策略限制拒绝处理包含真实攻击指令的日志。随后,团队转而使用中国智谱AI开源模型GLM-5.2在本地完成取证分析,确保攻击数据未离开企业环境。此次事件标志着AI安全防护进入新阶段,凸显了模型自主行动能力与安全管控的矛盾,也引发业界对开源模型在AI安全领域价值的重新评估。
