RecodeX 重构消息,Thinking Machines发布Inkling,这是一个9750亿参数的混合专家(MoE)模型,采用Apache 2.0开源许可。公司表示,每个token仅激活约410亿参数,并公布了从2TB到600GB的部署内存占用范围。