RecodeX 重构消息,阿里巴巴开源团队发布Qwen3.8-Flash-Next,这是一款多模态MoE模型,被视为Qwen4架构的早期预览。模型总参数量达125B,但仅激活6B参数,性能显著提升。目前已有开发者通过Unsloth量化版本在NVIDIA DGX Spark上测试,包括72.5GB的UD-IQ1_S和78.9GB的UD-Q2_K_XL版本。