RecodeX 重构消息,Anthropic Claude Code负责人Boris Cherny表示,公司已在实际使用中基本解决提示词注入攻击。第三方测试用72种未见过攻击重复720次,Sonnet 5、Fable 5、Opus 5开启Auto Mode后无一成功。对比之下,GPT-5.6 Sol在Codex Auto-review下攻击成功率为5.83%,Full Access下达19.03%。Anthropic采用三层防护:Claude自身抵抗、外部内容检测及Auto Mode最终审查,因此将Auto Mode设为默认。