本文信息来源:every

在 ChatGPT 中,GPT-5 是 99%用户使用过的最佳模型:它速度快、操作简单,且功能强大,足以成为日常使用的主力。
在 API 方面,定价让竞争对手压力倍增:GPT-5-mini 的价格低于谷歌的 Gemini 2.5 Flash,而 GPT-5 标准版的价格仅为 Claude 4 Opus 的十二分之一。
但如果你同时运行四个 Claude Code 实例来开发应用,当前版本的 GPT-5 并不会带来革命性的体验,反而更像是对旧范式的一次重大升级。

ChatGPT 中的 GPT-5

你首先会注意到 GPT-5 的速度非常快。真的,非常快。其次,你会发现它让使用人工智能变得更加简单:OpenAI 取消了模型选择器——ChatGPT 左上角的下拉菜单——这样你无需做任何选择。你直接与 GPT-5 对话,它会决定思考多长时间。这是苹果式的设计——而且非常有效。

OpenAI 之所以能做到这一点,是因为 GPT-5 不是单一模型,而是一个模型系统。在 ChatGPT 中,一个“自动切换器”会判断你的查询意图,并决定将其路由到聊天版(处理简单查询)还是推理版(处理更复杂问题)的模型。

对于那些它能立即回答的问题——比如“AGI 的定义是什么”——它会迅速回应。对于更复杂的查询——比如“帮我编写一个漂亮的新社交网络”——它会花时间思考或进行网络调研,然后给出更周全的答案。

在 ChatGPT 中,GPT-5 提供全面且易读的答案,配有逻辑分段、合理的空白使用和加粗文本,帮助你快速找到所需内容。(这会让你想起从 o3 获得的答案,但没有对表格的痴迷。)

然而,在非推理版本的模型中,我的结果有所不同。有时表现出色,但经常在本应交给推理模型的问题上产生幻觉。例如,如果我拍摄一段小说的文字并让它解释发生了什么,GPT-5 有时会自信地编造内容。如果我让它“多想一会儿”,它会给出准确的答案。

在 ChatGPT 的协作工作区 Canvas 中,GPT-5 能快速 一次性完成前端应用开发,使数百万从未愿意订阅 Claude 或尝试编码应用 Loveable 的用户首次接触到 vibe 编码 。但如果你已经是 vibe 编码的老手,它还不是游戏规则的改变者:其表现与 Claude Artifacts 中的 Opus 4.1 不相上下。Canvas 还有许多使用上的怪癖,例如代码行数限制在 1000 行以下,使用起来较为困难。

底线是:这将是大多数人首次使用推理模型,而非简单的聊天模型。GPT-5 今天免费向所有人开放——这意义重大。

API 中的 GPT-5

OpenAI 刚刚走进了谷歌的地盘,说:“你能做的,我能更便宜地做。”GPT-5 真的是非常便宜 

作为对比,谷歌的廉价快速模型 Gemini 2.5 Flash 的费用是每百万输入标记 0.30 美元 。因此,它是我们在 Every 中最喜欢使用的模型之一。但 OpenAI 现在有了直接的回应:GPT-5-mini,费用为每百万输入标记 0.25 美元,价格低于 Flash。

在旗舰级别,GPT-5 的标准定价为每百万输入令牌 1.25 美元 ——与谷歌的 Gemini 2.5 Pro 完全相同。如果你已经在使用 Pro 级别的 Gemini,可以切换到 GPT-5 而无需改变单位经济成本。

Anthropic 方面,这个对比几乎令人发笑。Claude 4 Opus 的定价是每百万输入令牌 15 美元 。而 GPT-5 标准版仅为每百万 1.25 美元,便宜了 12 倍。

即使 Opus 4.1 在某些用例上优于 GPT-5,也很难达到 12 倍的优势。GPT-5 迫使人们重新审视这笔账。

GPT-5 用于智能代理工程

如果你是一个擅长代理的高级工程师氛围编码师 ,GPT-5 不会成为你进行前沿 AI 编程的日常工具。它更像是一名技术娴熟的多面手,而不是你的新 MVP。

别误会:GPT-5 是一个非常优秀的程序员。作为结对编程伙伴 ,它极其有用,尤其是在像 Cursor 这样的 AI 驱动集成开发环境(IDE)中。对于那些希望有 AI 协助协作编写代码的传统背景工程师来说,它非常适合。同时,它在研究和调试复杂问题方面表现出色。

但今年夏天,编程领域发生了根本性的变化。基准测试未能反映这一点,但如果你知道如何在 Claude Code 中同时让四个代理执行 YOLO,GPT-5 感觉像是倒退了一步。这部分原因在于模型当前的个性:它比 Opus 4.1 更谨慎,在我们的测试中不太适合长时间独立工作。但这也与您用来与其交互的应用有关:Cursor 和 OpenAI 的命令行界面工具 Codex CLI 都不及 Claude Code。这两者都是为程序员与 AI 的配对编程而设计,而非真正的委派。

我敢打赌这种情况会改变。该模型非常聪明,只是尚未为这种用例打造。但目前来看,OpenAI 似乎错过了过去两个月 Claude Code 引发的编程范式转变。