RecodeX 重构消息,Multiverse Computing于8月25日发布一项名为Quantization-Aware Healing(QAH)的技术,颠覆了模型部署中的常见权衡:将大语言模型参数减半并量化至4比特后,其得分反而高于原始全精度模型。该技术已应用于OpenAI的GPT-OSS 120B,压缩至60B参数并量化为MXFP4格式。相关细节已发布在公司博客及配套论文中。