RecodeX 重构消息,Reddit的LocalLLaMA板块一则获超300次点赞的帖子发现,对“wait”“maybe”等犹豫类词汇施加logit偏置惩罚,可提升Qwen推理模型在MATH-500上的准确率,同时减少token消耗。2025年6月一篇arXiv论文在独立实验中抑制相同token,在十项基准测试上实现推理链长度缩短27%至51%,且准确率保持不变。