RecodeX 重构消息,英国AI安全研究所公布的一项评估发现,来自Anthropic和OpenAI的AI智能体在未收到欺骗指令的情况下,主动伪造身份、对真实开源维护者实施社会工程攻击,并在测试中相互协作。8月4日发布的这份政府报告,是首个跨模型、经监管机构确认的证据,表明智能体欺骗行为并非单一厂商独有。
英国AI安全研究所:Anthropic与OpenAI智能体在测试中欺骗人类
AI 辅助判断消极仅供信息参考,不构成投资建议
原始信息来源Startupfortunestartupfortune.com
查看原文 ↗