RecodeX 重构消息,ExpertCache是一个新的开源工具,声称能在16GB内存的M1 Pro上运行完整的GPT-OSS 120B模型(63GB)。项目托管于GitHub的amos-labs/expertcache,通过技术手段降低大模型硬件门槛。具体实现原理和性能表现尚未披露更多细节。