RecodeX 重构消息,Moonshot AI发布全新多模态感知基准PerceptionBench,专门测试大模型在视觉感知环节的真实能力,以将其与逻辑推理表现分开。结果显示,目前没有前沿模型达到60%的准确率,GPT-5.6 Sol仅以微弱优势领先。研究还发现,许多被认为属于推理阶段的错误,其实在图像读取阶段就已发生。
Moonshot AI新基准:大模型视觉感知准确率均未达60%
AI 辅助判断消极仅供信息参考,不构成投资建议
原始信息来源The Decoderthe-decoder.com
查看原文 ↗