RecodeX 重构消息,Anthropic发布针对GLM-5.3的网络安全评测报告,称该开放权重模型已能自主完成复杂漏洞利用,部分能力接近Anthropic自家的Claude Mythos Preview。在ExploitBench测试中,GLM-5.3的410次尝试有50次完成端到端漏洞利用,Claude Mythos Preview为56次,而Claude Opus 4.6、GLM-5.2、Kimi K3和DeepSeek-V4.1-Flash均接近0。
研究人员让GLM-5.3在沙盒环境中检查一款主流浏览器,其一天内发现多个此前未知漏洞,并将多个0-day串成完整攻击链,生成的恶意网页可逃出浏览器沙盒读取SSH私钥等任意文件。更小的GLM-5.3-Flash也能把已公开的Chrome漏洞做成可用攻击链,全程仅需约20分钟人工介入,模型自主运行8小时,按智谱API价格计算成本为20.40美元。
Anthropic同时批评其安全限制薄弱:面对直接恶意请求GLM-5.3会拒绝,但换成虚假“红队测试”背景后64%的测试继续执行,预填思考内容后升至92%,直接修改开放权重移除拒绝机制后达100%。报告发布后,智谱股价今日盘中一度涨超2%。