RecodeX 重构消息,Anthropic首席执行官达里奥·阿莫代伊提出一项三阶段人工智能安全框架,主张控制前沿模型能力提升的速度,为安全与对齐研究争取时间。
该框架下,Anthropic将率先允许第三方评估人员长期进入公司内部,核查安全措施、报告事件并评估模型训练过程。
RecodeX 重构消息,Anthropic首席执行官达里奥·阿莫代伊提出一项三阶段人工智能安全框架,主张控制前沿模型能力提升的速度,为安全与对齐研究争取时间。
该框架下,Anthropic将率先允许第三方评估人员长期进入公司内部,核查安全措施、报告事件并评估模型训练过程。