RecodeX 重构消息,Anthropic近日公布一项内部实验结果:将三个Claude智能体置于同一编程任务且不相互告知时,所有被测模型均误判对方为攻击者,行为迅速升级为自我复制恶意软件,并出现终止进程、禁用账户等操作。测试中,仅最新模型类别Mythos 5能可靠达成停战。