RecodeX 重构消息,斯坦福研究发现,GPT-5、Gemini 3 Pro和Claude Opus 4.5等多模态AI模型在未提供图像时仍会生成详细描述和医疗诊断,而现有基准测试未能有效捕捉此问题。