RecodeX 重构消息,Multiverse Computing于8月25日发布一项名为Quantization-Aware Healing(QAH)的技术,颠覆了模型部署中的常见权衡:将大语言模型参数减半并量化至4比特后,其得分反而高于原始全精度模型。该技术已应用于OpenAI的GPT-OSS 120B,压缩至60B参数并量化为MXFP4格式。相关细节已发布在公司博客及配套论文中。
Multiverse Computing发布4比特量化修复技术,压缩模型反超全精度
AI 辅助判断积极AI 看多仅供信息参考,不构成投资建议
原始信息来源Uniteunite.ai
查看原文 ↗