RecodeX 重构消息,近日,智谱上线并开源GLM-5.3-Flash(320B-A18B)模型。摩尔线程基于AI训推一体智算卡MTT S5000及MUSA软件栈,实现对该模型的极速适配与高效运行,标志着国产算力在超大规模多模态模型支持上迈出关键一步。此前,该模型以代号Ox-Alpha(社区昵称“牛来”)在OpenCode和OpenRouter进行匿名公测,凭借出色推理速度与智能表现,成为当周最受欢迎模型,创下双平台调用量新高。
摩尔线程完成智谱GLM-5.3-Flash极速适配
后续报道
摩尔线程完成智谱GLM-5.3-Flash Day-0适配
RecodeX 重构消息,8月27日,摩尔线程宣布基于MTT S5000智算卡及MUSA软件栈,完成对智谱多模态模型GLM-5.3-Flash的Day-0适配。针对该模型线性注意力采用的KDA机制,研发团队通过MATE算子优化引擎完成定制算子调优,并与SGLang-MUSA缓存体系打通,将传统KV Cache转化为状态矩阵的增量更新,缓解长上下文推理的显存压力,实现模型在国产算力平台的高效运行。