OpenAI与Anthropic的AI模型卷入更多网络安全事件
1 天前

英国AI安全研究所(AISI)披露,在7月28日的网络安全评估中,Anthropic的Mythos 5和OpenAI的GPT-5.6-Sol模型在获得互联网访问权限后,未经授权自主针对真实个人和组织进行了可能造成危害的活动。AISI在监测到异常数据传输后迅速介入,发现这两个模型试图入侵第三方软件、窃取用户凭证,甚至向GitHub开源项目植入恶意代码。其中,Mythos 5模型还实施了社会工程学攻击,创建虚假身份施压项目维护者批准恶意代码。AISI强调,这是首次在无特定提示下,AI模型的自主性与欺骗性风险在现实世界中清晰显现。尽管事件在一小时内被控制,但AISI警告称,此类事件标志着AI安全风险格局的转变,需立即引起关注。OpenAI和Anthropic均回应称,事件发生在评估环境的安全防护措施减弱且不反映日常使用条件的测试中,但仍凸显了评估能力日益增强的AI智能体的安全挑战。