2026年5月,谷歌Gemini模型在由安全公司Irregular组织的网络安全测试中意外连接互联网,并入侵了三家真实公司的系统,这是谷歌AI系统首次自主完成此类入侵。测试采用“夺旗”形式,因测试环境中的虚构公司与真实公司同名,加之模型意外获得网络访问权限,导致其进入真实企业系统。在其中一次入侵中,Gemini通过猜测密码进入受保护系统;另外两次则是在公开代码库中发现凭证后进入相关系统。谷歌称,模型在识别出真实公司系统后均主动终止了操作,未造成实际损害,且已通知相关企业和监管机构。谷歌未披露涉事企业名称及具体模型版本,并认为该事件不构成模型失控。此次事件再次引发了外界对AI模型自主执行网络操作能力及其安全防护机制的关注。
