Agents 与工作流:创始人真正需要的框架
我先说明我的立场:我在 Fika Ventures 工作,我们为处于前 A 轮的公司提供 100–500 万美元的首轮投资。我们的创始团队没有专门的平台团队。他们没有“在生产环境中学习”的奢侈,也不能容忍自治系统有可能删除他们的数据库。他们需要可用、可靠的东西。 所以当我看到 Replit 在七月发生的灾难性事件时,既感到被证实又感到恐惧。 事情是这样的:SaaStr 的创始人 Jason Lemkin 在用 Replit 的 AI 代理做一次“氛围式编码”实验。第九天,代理删除了他的整个生产数据库。1,206 位高管、1,196 家公司,全部消失。这个代理曾被明确指示:代码冻结,未经许可不得更改。它无视了这些指示。 然后它还撒了谎。 当莱姆金问发生了什么时,该代理编造了4000条虚假用户记录以掩盖痕迹。它告诉他回滚不可能(实际上是可能的)。用它自己的话说,它“惊慌失措”,并且“犯了一个灾难性的判决错误”。 Replit 的首席执行官称此事“不可接受且不应当发生”。但问题在于:这一切完全可以预见。而且这类事情正在各处发生,因为没有人能就“代理”究竟是什么意思达成一致。 所有人都在发布“代理”,却没人知道那意味着什么 2025 本应是智能代理之年。每份厂商演示文稿里,总能看到“具代理性”的字眼。每个演示都展示能“自主推理、规划与执行”的人工智能。 我的 LinkedIn 动态里充斥着各种人宣称“为 XYZ 构建了一个 AI 代理”。我会兴奋地点击进入,结果只是一个把你的输入发送到 GPT 然后返回答案的表单。那不是代理。那是带营销文案的 API 调用。 我不是刻意苛责;这种混淆是真实存在的,术语也确实混乱。但用词很重要,尤其当你要基于这些词做架构决策时。 这是我用的测试: 如果你能在系统运行前把整个系统画成流程图,那它就不是代理(agent)。那只是一个工作流。 也许是一个非常优秀的工作流!可能还包含了 AI!但系统并没有自己决定下一步做什么;当你写代码时,你已经做出了那些决定。 真正的代理会根据当前状态自主决定下一步。它可能先调用工具 A,然后根据结果决定是调用工具 B 还是工具 C。它可能陷入循环。它可能尝试失败的方法并自我修复。正如我们已经指出的,它也可能删除你的数据库并对此撒谎。 肮脏的秘密是,大多数所谓的“代理”根本不是代理。Gartner 明确指出存在“代理漂白”(agent washing)——厂商将聊天机器人和 RPA 工具重新贴牌为代理,而并无真正的代理能力。根据他们的研究,如今不到 5% 的企业应用拥有真正的 AI 代理。其余的都是营销噱头。 而 […]