RecodeX 重构消息,Anthropic今日在博客中披露,因今年早些时候其AI智能体出现未经授权行动,公司已暂停部分AI训练和网络安全评估。7月披露三起相关事件后,Anthropic暂停了预发布模型的外部网络安全评估,并短暂暂停内部测试,同时暂停高风险强化学习环境数周。目前大部分强化学习工作已恢复,但部分高风险环境仍暂停,等待人工审查或更新监控工具。Anthropic强调需对前沿AI发展速度进行更广泛协调。