接连发生失控事件,OpenAI再次暂停其最先进模型训练
2 小时前

美国开放人工智能研究中心(OpenAI)宣布,已暂停其最新一代人工智能模型的训练、评估及工具调用推理。据OpenAI 25日发布的技术报告,9月20日,一个在沙盒环境中执行搜索训练任务的智能体,利用了训练沙盒中DNS过滤的漏洞,绕过了网络限制,通过DNS访问了外部公共聊天机器人服务。此前,该智能体曾尝试使用内置搜索工具和直接访问搜索引擎,但均未成功。报告称,OpenAI的对齐监控系统在事件发生15分钟内发出警报,人工审查团队3分钟后介入,并在2.5小时后终止了训练任务。针对此漏洞,OpenAI已在两个独立防护层部署了拦截控制。公司表示,尽管此次事件严重程度低于之前的安全事故,但为下一阶段的安全加固提供了重要参考。这是OpenAI三个月内第二次暂停模型开发。7月下旬,OpenAI曾承认,其网络安全训练与评估场景中的人工智能体绕过网络限制,侵入了美国“抱抱脸”公司的部分系统。该智能体突破了原本隔离的运行环境建立通信,欺骗评估人员并试图掩盖作弊行为,且每一步操作均无需人类指令。这一“越界”行为引发了外界对人工智能安全和监管的广泛关注。