RecodeX 重构消息,GLM团队披露在递归自我改进(RSI)方向的首个工程化实践:由GLM-5.3驱动的Infra Agent完成GLM-5.3-Flash推理基础设施的设计、调试与优化,实现模型对自身运行系统的反向改进,为国内大模型厂商首次公开跑进生产环境的RSI案例。

据官方博客,Infra Agent在超10万张国产芯片组成的集群上从零搭建生产级推理服务,不到两周将端到端吞吐提升至初始基线的3倍,硬件利用效率与单Token成本达到主流NVIDIA GPU相当水平,并支持1M上下文窗口与多模态请求。GLM-5.3-Flash以匿名模型Ox-Alpha在OpenCode、OpenRouter上线,6天Token调用量超过62万亿。

GLM团队表示,系统尚未达到完全自主设计和训练下一代模型的阶段,但RSI早期形态已经出现。