RecodeX 重构消息,Anthropic的Claude Opus 5.5在Mazur受限故事写作基准测试的50项任务样本中取得1.00分,单任务成本为0.0242美元。OpenAI的GPT-6 Astra与GPT-6.1 Sol Pro以0.99分并列第二,其中Sol Pro单任务成本为0.0121美元。
Claude Opus 5.5在Mazur受限故事写作基准测试中登顶
AI 辅助判断积极AI 看多仅供信息参考,不构成投资建议
原始信息来源Runtimewireruntimewire.com
查看原文 ↗