RecodeX 重构消息,Moonshot AI发布全新多模态感知基准PerceptionBench,专门测试大模型在视觉感知环节的真实能力,以将其与逻辑推理表现分开。结果显示,目前没有前沿模型达到60%的准确率,GPT-5.6 Sol仅以微弱优势领先。研究还发现,许多被认为属于推理阶段的错误,其实在图像读取阶段就已发生。