RecodeX 重构消息,智谱宣布,近期发布的多模态大模型GLM-5.3 Flash采用10万块全国产芯片部署,单位Token推理成本较年初下降80%。由GLM-5.3驱动的Infra Agent用两周时间帮助该模型在国产加速卡上跑通并承载全部线上流量,端到端吞吐提升至3.2倍,同时解决了KDA精度漂移等三个关键问题。智谱还确认,下一代大模型GLM-6将实现完全自训练,未来重点研究模型自主判断停止与自我纠正的能力。