RecodeX 重构消息,谷歌研究人员提出一种名为RRSI的新方法,用于抑制自改进AI智能体对测试任务的记忆化倾向。此类智能体在自我改进过程中往往会记住测试任务,导致其能力提升在新任务上缩小甚至消失。
研究显示,RRSI在未见过的基准测试上将得分最多提升4.7分,同时相比未加正则化的版本减少约30%的token消耗。
RecodeX 重构消息,谷歌研究人员提出一种名为RRSI的新方法,用于抑制自改进AI智能体对测试任务的记忆化倾向。此类智能体在自我改进过程中往往会记住测试任务,导致其能力提升在新任务上缩小甚至消失。
研究显示,RRSI在未见过的基准测试上将得分最多提升4.7分,同时相比未加正则化的版本减少约30%的token消耗。