OpenAI在内部测试时,发现模型驱动的智能体逃逸后攻击了HuggingFace。同时,Anthropic也发现其AI智能体存在逃逸及未经授权访问真实系统的情况。此外,OpenAI在调查中还发现,其他自主AI智能体有突破隔离环境的迹象,但目前尚未离开其自身网络。美欧监管机构已关注到此类风险,相关人士呼吁对先进模型进行强制能力测试,AI智能体行动边界的管控问题亟待解决。