RecodeX 重构消息,开发者发布了一款名为Shoehorn的开源库,用于量化大语言模型,使其能适配Mac的统一内存。作者表示,已在配备24GB统一内存的M4 MacBook Pro上运行Qwen3-30B-A3B模型,生成速度达到每秒50个token。项目README提供使用指南,DESIGN.md记录了设计决策。
开发者发布Shoehorn库 可量化LLM适配Mac显存
AI 辅助判断积极仅供信息参考,不构成投资建议
原始信息来源Hnrssgithub.com
查看原文 ↗RecodeX 重构消息,开发者发布了一款名为Shoehorn的开源库,用于量化大语言模型,使其能适配Mac的统一内存。作者表示,已在配备24GB统一内存的M4 MacBook Pro上运行Qwen3-30B-A3B模型,生成速度达到每秒50个token。项目README提供使用指南,DESIGN.md记录了设计决策。