RecodeX 重构消息,AMD发布Instella-MoE-16B-A3B,一款完全开放的混合专家大语言模型,总参数16B,每个token仅激活2.8B参数,基于Instinct MI300X/MI325X GPU训练,并公开全部训练权重与代码。
AMD发布Instella-MoE-16B-A3B,一款完全开放的混合专家大语言模型,总参数16B,每个token仅激活2.8B参数,基于Instinct MI300X/MI325X GPU训练,并公开全部训练权重与代码。
AI 辅助判断积极仅供信息参考,不构成投资建议
原始信息来源Marktechpostmarktechpost.com
查看原文 ↗