RecodeX 重构消息,清华大学与Z.ai的研究人员开发出名为IndexCache的稀疏注意力优化技术,可将长上下文AI模型(如DeepSeek和GLM系列)的推理速度提升高达1.82倍,同时减少75%冗余计算,适用于生产级应用。