RecodeX 重构消息,一项名为EvoHarnessRL的研究论文在arXiv预印本平台公开,提出通过强化学习训练自进化的运行时框架,以提升长时程LLM智能体的任务表现。该框架可使智能体在运行过程中动态调整策略,适应复杂场景。论文已发布,但未披露代码与详细实验数据。