RecodeX 重构消息,三星研究院提出每权重0.1比特的压缩方法,将Llama2-13B模型压缩到不足0.9GB。与此同时,苹果正与初创公司PrismML就一项竞争性技术展开洽谈,该技术已能在iPhone上运行270亿参数模型。