RecodeX 重构消息,Anthropic Claude Code负责人Boris Cherny表示,公司已在实际使用中基本解决提示词注入攻击。第三方测试用72种未见过攻击重复720次,Sonnet 5、Fable 5、Opus 5开启Auto Mode后无一成功。对比之下,GPT-5.6 Sol在Codex Auto-review下攻击成功率为5.83%,Full Access下达19.03%。Anthropic采用三层防护:Claude自身抵抗、外部内容检测及Auto Mode最终审查,因此将Auto Mode设为默认。
Anthropic称Claude Code基本解决提示词注入:720次攻击零成功
AI 辅助判断积极AI 看多仅供信息参考,不构成投资建议
原始信息来源区块律动theblockbeats.info
查看原文 ↗