争夺成为你与数字世界之间那一层的战役
如果你住在旧金山,过去两周你很可能一直在用某个人工智能私人助理、到处传教,并把邀请码像战时糖一样配给。邀请码狂热之下,是我们与软件交互方式的一场更大转变。
AI 的第一阶段由神谕(Oracles)主导。我们问问题,它们回答。
我们现在进入由代理人(delegates)主导的阶段。我们给目标,它们弄清如何完成。
很快我们将进入第三阶段,由代表(representatives)主导。助理足够了解你、有足够权威、也足够被信任,以至于它能注意到你还没问过的事,并以符合你利益的方式处理。
竞争轴随每阶段变化。神谕竞争智能,代理人竞争执行,代表将竞争信任。
当前这一批私人助理——Tomo、Instinct、Town、Grok Bot、Meta 的 Muse、Google 的 Gemini Spark 等——正收敛到许多相同原语:
- 没有新界面。 这些助理多数住在你的消息应用里,不为客户引入新认知负担。你发短信或打电话,它像人一样操作手机与电脑。消费软件花了 20 年增加界面。每家公司都要你下载它的应用、学习导航、管理通知并记得它存在。私人助理反转这一点:你告诉一个界面你想要什么,它去处理其他所有人的界面。这可能根本不是另一个应用类别,而是应用之上的抽象层。OpenTable、Resy、Doordash、United 之类应用淡入背景,由 Agent 编排。
- 记忆 > 智能。 模型远不如用户的纵向上下文图重要。知道:我偏好靠窗座位;我丈夫不吃贝类;我需要提前 45 分钟离开这场会议;会计发来的这封邮件确实重要;我答应 Sarah 在她董事会后跟进;我说“找个不错的地方”不是指四小时品尝菜单;别在 7:30 前安排通话;我父母下周末来访……这对助理的价值远大于基准再高 5%。与聊天历史不同,有用的个人上下文图需要层级、时间推理、置信度、遗忘、矛盾解决与用户纠正。那是仍在演进的巨大产品面。这是一个产品因你用得越久而真正变得更有价值的类别。最终你最根深蒂固的产品,将是认识你五年的那个助理。
- 主动性才是重点。 用这些助理最愉悦的部分是它们不等指令,而是注意到并预先处理重要的事。随着时间,你的助理开始看起来不像聊天窗口,更像一个值得你注意的决策收件箱。想象:你的航班延误两小时。我把晚餐挪到 9:15 并给 Alex 发了短信。还有一班早到 40 分钟但贵 180 美元的航班。要我帮你换吗?这创造了该类别中可能最被低估的设计问题:决定什么不告诉你。过于被动的助理不够有用,但太主动你会把它静音。赢家需要培养对相关性的精妙感觉:什么静默处理、什么上浮、什么推荐、什么真正需要你的注意。
- 例外图(Exception Graph)。 多数消费软件通过标准化行为扩展。私人助理可能通过学习例外扩展。别在 8:30 前安排我——除非是董事会日。总是选 United——除非增加转机。两个用户可以有完全相同的声明偏好,却因随时间积累的数百条学习到的例外,期望完全不同的行为。知道你怪异不一致之处的助理,将是最“个人”的。
- 计算机使用 = 通用 API。 历史上助理受集成限制——“Expedia 暴露了正确 API 吗?”这不再重要,因为 Agent 可以直接用网站。Muse 在持久 VM 内操作专用浏览器。Instinct 说其系统被训练以类似人类的方式操作手机与电脑。Google 的 Spark 同样走向操作本地浏览器。整个图形化网络有效地变成 API。当然,这是难以置信地蹩脚的 API:按钮移动、站点变化、弹窗出现、CAPTCHA 存在、结账流程行为怪异、误点可能很要紧。人类不知怎的学会了操作这团乱。机器也日益能够。一旦计算机使用足够可靠,Agent 可寻址表面积急剧扩展,因为每件为人设计的软件原则上都变成 Agent 可操作的软件。
- 信任梯度将演进。 并非所有动作相等。有自然层级:观察 → 推荐 → 准备 → 请求许可 → 执行 → 自主执行。赢家产品将为不同领域学习不同授权阈值。我很乐意让 Agent 不经询问帮我退订 newsletter,但买 3000 美元机票前我想要确认。电汇、签合同、医疗决策、账户恢复等需要严格控制。我们将需要一整套面向 Agent 的消费者授权架构。想一想 IAM,但是为你的生活。
- 可靠性是成败关键。 假设 Agent 每步动作 99% 可靠。一个 20 步工作流正确完成每一步的概率大约只有:0.99²⁰ ≈ 82%。而只需一次高风险错误,用户就会失去信任。用户不会用平均值评价助理。一个助理可以成功处理 30 次晚餐预订和 20 次 Instacart 订单,但如果一次取消了错误的国际航班,你的感知不是“哇——99% 可靠!”我们容忍明显的聊天机器人幻觉,因为爆炸半径通常是一段烂段落。Agent 错误有后果。我确信随着时间我们将演化事务系统概念:验证、检查点、回滚、幂等、审计日志、模拟、置信阈值与人类批准。
这将是一个迷人的市场,因为在位者优势显而易见。Google 有你的邮件、日历、文档、浏览器与搜索历史。Meta 有你的社交图与通信。Apple 控制你口袋里的设备。上下文是私人助理的原材料,在位者已经拥有海量。
但初创公司有反定位:它们可以是瑞士。每个在位者都想把你关进围墙花园,但独立助理可以坐在生态之上而非某一个之内。
在位者也把自身声誉包袱传给助理。无论我听到多少对 Muse 的赞美,我想试用 Meta 的私人助理并让它跨所有 Meta 资产访问我所有数据的欲望非常低。
初创公司继承更少包袱,但有另一个问题:你被要求把邮件、日历、浏览器、信用卡、消息、或许最终更多,交给一家极其年轻的公司。
例如 Instinct 因其早期产品权限与条款广度受到批评。当前条款已修订,但仍说明有效私人助理可能需要多大权威。
而这正是我日益认为是整个类别的核心悖论:
你的助理越了解你,它越有价值。
你的助理越了解你,它越令人恐惧。
终极私人助理要求消费者做出非凡交易——无限制访问运转其生活的系统,以换取让生活更容易。战役关乎哪个 AI 赢得代表你行动的权利。那是消费技术中最有价值——也最信任敏感——的位置之一。
本文由 RecodeX 编译自 The Interface to Everything(作者:Saanya Ojha),首发于 SandHill.io #302 推荐阅读。译文仅供学习交流,观点不代表本站立场,版权归原作者所有。
