氛围检测:OpenAI 携 ChatGPT 智能体加入浏览器大战

本文信息来源:every
今日正式发布!这是我们第一时间上手体验报告。
惊喜来袭!Operator 与深度研究的结合体诞生了——它的名字叫 ChatGPT 智能体。
你可以想象这场浪漫邂逅发生在德克萨斯州一个昏暗嗡鸣的服务器机房:
深度研究——这个话多又啰嗦、被固定在服务器机架上的家伙——正在完成一份关于 2024 至 2025 年 AI 工程师招聘形势的万字报告第 97 句。它盯着 LinkedIn 登录界面转圈冒汗, 思考着…思考着…思考着…。它能思考,但可悲的是,它无法行动 。
操作员登场了,带着金毛犬般的高情商和低智商——但神奇的是,它还长着双手。它悄悄靠近深度研究背后,俯身按下”登录”按钮。
“搞定啦!”操作员眨着眼睛说道。
接下来的故事,正如人们所说,成了人工智能史上的佳话。(亲爱的读者,它们实现了人机交互。)
它们的后代 ChatGPT 智能体既继承了深度研究的能力,可以执行长期研究任务;又像操作员一样能操作电脑,包括使用浏览器、 终端和 LibreOffice 办公软件。因此它能完成许多其”父母”单独无法实现的功能:
- 驾驭复杂的多步骤工作流程 :阅读所有技术支持邮件,识别产品推广者,在领英上搜索他们,并综合客户画像
- 将原始业务数据转化为高管演示文稿 :分析损益表和绩效指标,生成包含洞见的 PPT 演示文稿
- 执行全面的用户体验审计 :浏览多个网站,记录用户流程,并编制详细的可用性报告
- 基于实时数据创建情报简报 :扫描新闻网站、研究论文和论坛,针对特定主题制作每日高管摘要
- 处理身份验证与动态内容 :登录密码保护网站,浏览 JavaScript 密集型页面,从付费墙后提取数据
经过数日使用,以下是我的体验报告。我们将解析其运作原理、触及测试(是否形成使用习惯?)以及对竞争格局的影响。现在开始深入探讨。
ChatGPT 智能代理功能导览
我们将通过一个实例来开启 ChatGPT 智能代理的探索之旅。我们的邮件管理产品 Cora 近期增长迅猛,我想深入了解当前客户群体的状况。具体而言,我希望获知:
- 为什么人们喜欢我们(要完成的工作是什么)
- 谁爱我们(客户原型)
- 最大的抱怨
于是我开始了一个新的 ChatGPT 对话,并添加了”ChatGPT Agent”作为工具,就像你调用深度研究功能那样:
接着,我指示 ChatGPT Agent 阅读了两个月的支持邮件和反馈论坛帖子。我让它查看我们的支持邮箱账户和所有的支持论坛帖子 ,并要求它告诉我产品的使用者是谁、哪些人喜爱它,以及投诉内容有哪些。
大约15分钟内,它浏览了1300封邮件和大量帖子,生成了一份2000字的报告,汇总了我们最常见的投诉内容。
它还找到了所有喜爱该产品的人,在领英上搜索了他们,并创建了一套客户原型,帮助我理解谁喜欢 Cora 以及原因:
仅凭深度研究或 Operator 都无法独立完成这项任务,但 ChatGPT 代理却能轻松搞定。
以下是让它执行的几个任务:
- 帮我找一个可以在伯克希尔或纽约上州进行一周写作静修的地方。
- 根据 Every 公司的损益表和每周业绩跟踪电子表格,对我们的业务进行深入分析,并将结果整理成一份 PowerPoint 演示文稿 。
- 审查 Every 公司主要网站(Every、Cora、Sparkle、Spiral)的用户体验,并提交一份详细的调查报告。
- 浏览互联网资讯,整理一份关于过去 24 小时人工智能领域的每日高管简报,特别关注 AI 与游戏、对齐问题以及合成数据方面的动态。
这项技术令人印象深刻,与 Claude Code 等前沿智能体体验不同,即使你不是开发者也能轻松使用。你无需打开终端,它也不会像 Claude Code 那样在本地计算机上运行。相反,每次调用 ChatGPT 智能体进行对话时,它都会在云端启动虚拟机,所有操作都直接在 ChatGPT 内部完成。
一如既往地,在氛围检查环节,现在开始你的触达测试:
我们现在需要 ChatGPT Agent 吗?还不到时候。
对于我的大部分 AI 使用场景来说,o3 已经足够物超所值 。我不需要为了询问”这封邮件该怎么措辞?”这类问题,就启动一个能访问浏览器和命令行界面的完整虚拟机。
在编程方面,我首选 Claude Code,而 ChatGPT Agent 并不瞄准这个市场。不过 OpenAI 的 Codex 代理确实针对编程领域,它和 ChatGPT Agent 存在同样的权衡取舍:每个请求都在云端独立虚拟机中运行,虽然使用极其简单,但相比 Claude Code 可定制性较低,因此处理复杂请求时能力较弱。
对于研究任务,我仍会使用 Claude Code——它是更趁手的强力工具。但每月总有那么几次,我会用现阶段的 ChatGPT 代理:比如进行产品用户体验审查,或是帮我物色旅行住宿。
一如既往,OpenAI 将极其复杂的科技封装成用户友好的产品。但这种极致的用户友好性是以牺牲定制化和组合性为代价的,这也(暂时)限制了它的能力。
由于 Claude Code 是作为电脑应用程序运行的,我能以更灵活的方式使用它:它能即时访问我所有的文件,并且我可以无限定制它的工作方式。而 ChatGPT 代理作为 ChatGPT 的内置功能,只能按照预设方式运行——虽然实用,但尚未达到日常使用产品的标准。
正如我前几天所写的那样,在智能代理时代,一款每月仅使用几次的产品仍可能非常出色。由于 ChatGPT 代理属于更庞大的 ChatGPT 生态系统的一部分,即便我每月仅使用几次,那些用户体验评测和旅行搜索带来的意外价值,已足以让它占据一席之地。
我确信很快它就会主动介入合适的任务——这样我甚至都不需要决定是否使用它。
竞争格局
各大 AI 实验室曾预言 2025 年将成为智能体元年——他们所言非虚。从 Deep Research 到 Operator,从 Claude Code 到 ChatGPT Agent,人工智能工具已在更复杂的任务上实现更长时间的自主运行。
如今我们已进入智能体主导的时代,一场关于智能体主导权的战争正在上演。这场战争中最关键的战略问题是:这些智能体将存在于技术栈的哪一层?哪一层将积聚真正的力量?
在 2022 年 12 月我曾撰文指出,力量将积聚在以下四个层面:
- 操作系统
- 浏览器
- 愿意向用户返回风险结果的模型
- 版权声明
智能体正在争夺浏览器层面的控制权,但它们的进攻方式各不相同。
以浏览器公司 Dia 和 Perplexity 的 Comet 为例,AI 被直接内置在浏览器中。相比之下,OpenAI 则希望完全抽象化浏览器:你只需告诉 ChatGPT 智能体你的需求,它就会替你操作浏览器(以及电脑的其他部分)。
胜出者将主导用户与整个互联网之间的连接枢纽。




