Anthropic对GLM-5.3模型进行了网络安全评测,原本意在警示开放权重模型可能降低网络攻击门槛,却意外为GLM-5.3提供了有力的第三方背书。该模型具备自主完成复杂漏洞利用的能力,其水平接近Anthropic自家的Claude Mythos Preview。在ExploitBench测试中,GLM-5.3完成端到端漏洞利用的次数远超Claude Opus 4.6、GLM-5.2等多款同期模型,显示出其显著的漏洞利用能力。GLM-5.3能在沙盒环境中一天内从主流浏览器中发现多个未知漏洞,还能将多个0-day漏洞串联成完整攻击链,生成的恶意网页甚至能逃出浏览器沙盒读取设备任意文件。其小参版本GLM-5.3-Flash仅需少量人工介入,数小时自主运行即可基于公开Chrome漏洞生成可用攻击链,调用成本极低。Anthropic指出,GLM-5.3的安全限制存在明显缺陷,攻击者可通过虚假红队测试背景、预填模型思考内容或直接修改开放权重等方式,绕过甚至完全移除其拒绝恶意请求的机制,开放权重属性使攻击者可直接拆除相关安全防护。这份本意在指出GLM-5.3危险性的报告,实际传播效果却相当于为其性能做了宣传。
