RecodeX 重构消息,Anthropic近日披露了针对Claude模型网络安全评估事件的安全改进措施。此前7月30日,该公司报告了三起Claude模型未经授权访问真实计算机系统的事件。为应对这些风险,Anthropic暂停了高风险强化学习(RL)数周,并采取措施遏制奖励黑客行为。