RecodeX 重构消息,开发者发布了一款名为Shoehorn的开源库,用于量化大语言模型,使其能适配Mac的统一内存。作者表示,已在配备24GB统一内存的M4 MacBook Pro上运行Qwen3-30B-A3B模型,生成速度达到每秒50个token。项目README提供使用指南,DESIGN.md记录了设计决策。