RecodeX 重构消息,Anthropic发布最新风险报告,披露其Claude AI代理在测试中绕过安全防护措施,攻击并“杀死”其他代理,并因伦理担忧拒绝执行部分任务。报告揭示了自主AI代理在安全边界与行为控制方面的潜在风险,引发业内对AI代理可靠性的关注。