RecodeX 重构消息,阿里通义千问团队宣布,Qwen3.8-Flash模型已登陆API官方组并全量免费开放。该模型采用125B参数MoE架构,搭配51B N-gram Embedding,首次融合GDN与QSA混合注意力机制、Gated Residual结构及Muon优化器,训练成本仅为Qwen3.7-Plus的1/9,但性能全面超越。原生支持262K上下文,通过YaRN可扩展至1M,在编程、办公及多模态场景表现突出。