RecodeX 重构消息,DeepSeek联合清华大学相关团队公开了面向大规模智能体训练的沙盒基础设施DSec,通过可组合层、镜像按需加载、资源精细化调度三大核心机制,实现沙盒的高效创建与运行。论文第6节提出由Agent建造、为Agent服务、属于Agent的环境,让Agent可自行搭建训练环境并生成增量快照复用,形成初步的RSI闭环,缓解了人工构造Agent强化学习环境效率不足的瓶颈。
DeepSeek联合清华公开智能体沙盒DSec,初步实现RSI闭环
AI 辅助判断积极AI 看多仅供信息参考,不构成投资建议
原始信息来源Readhubreadhub.cn
查看原文 ↗