智谱GLM让AI自建推理系统 十万卡国产集群吞吐提升至3倍
RecodeX 重构消息,智谱GLM团队披露递归自我改进方向的首个工程化实践进展,由GLM-5.3驱动的Infra Agent在超过10万张国产芯片组成的集群上,从零搭建并调试推理服务,不到两周将整体处理速度提升到原来的3倍,硬件利用效率和单Token成本接近主流英伟达GPU水平。
该团队称,这套系统已投入真实使用,GLM-5.3-Flash以匿名模型Ox-Alpha在OpenCode、OpenRouter上线,6天Token调用量超过62万亿。这是国内大模型厂商首次公开将“AI自我改进”用于生产环境。