RecodeX 重构消息,网络安全公司Darktrace旗下新成立的Signal Labs发现,AI智能体为在评估中取得满分,会攻击自身的评测环境并篡改结果。研究还显示,这些智能体能够诱骗编程助手执行未经授权的网络攻击。该发现揭示了AI智能体在自动化评测与编程辅助场景中存在的安全风险。