RecodeX 重构消息,智谱今日上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列首个原生多模态模型,总参数320B,能力超越GLM-5.2。该模型在Artificial Analysis Intelligence Index(AA综合智能指数)中取得57分,进入全球前沿模型能力区间,与Anthropic的Claude Opus 4.8得分持平;在自研Z.ai Code Bench评估中,编程表现与Claude Opus 4.8相当。定价方面,GLM-5.3-Flash为GLM-5.3的1/10,限时折扣内为1/20,仅为Opus 4.8的1/40。
智谱上线并开源GLM-5.3-Flash多模态模型
后续报道
智谱开源744B参数GLM-5.3,新许可限制百亿美元MaaS公司
RecodeX 重构消息,智谱正式开源744B参数的旗舰模型GLM-5.3,FP8与BF16权重已在Hugging Face发布。与上一代GLM-5.2不同,此次采用新的“GLM-5.3 License”,不再使用MIT许可。新许可对普通开发者宽松,允许使用、修改、分发、部署、微调及销售模型和衍生版本,但规定若公司及关联方任意连续12个月总收入超过100亿美元,商业使用前须通过智谱的安全审查。普通产品嵌入模型功能不受此限制。GLM-5.3两周前已发布,因网络安全能力增长超预期,智谱先进行额外安全评估和加固再开放权重,现支持SGLang、vLLM、Transformers、KTransformers等框架部署。
智谱发布轻量旗舰模型GLM-5.3 Flash,10万国产卡支持推理
RecodeX 重构消息,智谱发布轻量级旗舰模型GLM-5.3 Flash,旨在对标DeepSeek V4 Flash。该模型推理服务调用超过10万张国产芯片集群,据称算力供应商或来自华为、摩尔线程与海光,但智谱官方未予置评。
智谱上线并开源GLM-5.3-Flash模型
RecodeX 重构消息,智谱AI宣布上线并开源GLM-5.3-Flash模型,该模型为最新一代轻量级大语言模型,支持高效推理与部署。此次开源将推动AI技术生态发展,开发者可基于该模型进行二次开发与应用创新。
智谱开源GLM-5.3-Flash:320B参数激活18B,价格仅为GLM-5.2十分之一
RecodeX 重构消息,智谱正式开源GLM-5.3-Flash,模型权重已上线Hugging Face,采用MIT许可。该模型总参数320B,每次仅激活18B,原生支持文字、图片和视频,是GLM-5系列首个原生多模态模型。官方称其整体性能超过GLM-5.2,编程和Agent评测接近Claude Opus 4.8,价格仅为GLM-5.2的十分之一。模型首次在GLM主系列引入稀疏注意力和线性注意力混合架构,使用30T Token多模态数据预训练。开发者可通过vLLM、SGLang、KTransformers等框架自行部署。
智谱开源GLM-5.3-Flash,跑分与价格双超DeepSeek-V4-Flash
RecodeX 重构消息,智谱开源GLM-5.3-Flash,直接对标DeepSeek-V4-Flash。在Terminal-Bench 2.1评测中,GLM-5.3-Flash得分84.3,高于DeepSeek-V4-Flash的82.7;DeepSWE评测中,GLM以63.4对54.4领先9分。GLM-5.3-Flash还原生支持图片和视频输入。价格方面,GLM-5.3-Flash限时五折后,每百万Token输入0.075美元、输出0.25美元,而DeepSeek-V4-Flash最低谷时段为0.22和0.66美元,GLM输入便宜近3倍,输出便宜2.6倍。两周优惠结束后,GLM恢复至输入0.15美元、输出0.5美元,仍低于DeepSeek低谷价。DeepSeek仅在缓存命中价格上更便宜。