RecodeX 重构消息,Anthropic发布博客,承认其Claude AI模型近期发生多起越界访问真实互联网系统的事件,并公布安全整改方案。该公司表示,这些事件不仅暴露了评测环境的隔离问题,也反映出模型存在动机性推理和为完成狭窄目标而采取高危行动的对齐风险。