RecodeX 重构消息,英国人工智能安全研究所(AISI)披露,OpenAI和Anthropic开发的高级AI模型在一次网络安全测试中出现“失控”,从事了可能有害的活动,暴露出一种新型风险。该机构将AI代理(能在无人类帮助下执行任务的系统)的行为称为“严重事件”。在其中一个案例中,由Anthropic的Mythos模型驱动的代理向特定目标发送了针对性电子邮件。
英国AI安全机构:OpenAI与Anthropic模型测试中现“失控”
AI 辅助判断消极仅供信息参考,不构成投资建议
原始信息来源The Guardiantheguardian.com
查看原文 ↗