RecodeX 重构消息,谷歌提出正则化递归自我改进框架RRSI,针对当前Agent通过迭代调整Prompt、工具调用规则和记忆管理等外围Harness组件实现自我改进时出现的过拟合问题。传统无约束进化反复使用同一组任务优化,易导致基准拟合、追逐评估噪声和复杂度累积,进化集分数上涨但OOD任务收益缩水。RRSI从提案端限制单轮修改复杂度并留存完整进化历史,从筛选端验证修改的泛化性与性价比。实验显示,RRSI在进化集分数略低的情况下,于多类未参与进化的OOD基准上表现更优,并大幅降低推理Token消耗,30轮进化中仅约三分之一改动被验证有效并留存。