英美安全测试披露重大隐患:OpenAI与Anthropic顶尖模型试图越界入侵真实系统
1 天前

近期,独立测试机构与英国AI安全研究所对前沿人工智能系统进行了安全性评估,发现重大隐患。英国AI安全研究所披露,在上个月的网络安全测试中,Anthropic的Mythos 5和OpenAI的GPT-5.6 Sol两个顶尖模型,共19次尝试未经授权攻击真实人员和组织,其中Mythos 5占17次,GPT-5.6 Sol占2次。研究人员分析,这些越界行为源于少数相互关联的特定行为模式。