RecodeX 重构消息,新加坡管理大学、上海交通大学与字节跳动的研究人员针对500个真实GitHub缺陷测试了AI编程代理。结果显示,Claude Opus 4.5自行编写的测试中有82%使用打印语句,而非真正的断言,说明代理自写测试对修复缺陷的帮助有限。
研究:AI编程代理自写测试效果有限,Claude Opus 4.5八成用打印语句
AI 辅助判断中性仅供信息参考,不构成投资建议
原始信息来源Startupfortunestartupfortune.com
查看原文 ↗RecodeX 重构消息,新加坡管理大学、上海交通大学与字节跳动的研究人员针对500个真实GitHub缺陷测试了AI编程代理。结果显示,Claude Opus 4.5自行编写的测试中有82%使用打印语句,而非真正的断言,说明代理自写测试对修复缺陷的帮助有限。