胸背带成了新的战场
简而言之:包裹在模型之外的胸背带式软件正逐渐成为关键的战略资产。它决定了哪些数据会被输入、哪些数据会被记录,以及哪些数据会用于训练下一代模型。
SaaS 时代打破了以往的惯例:企业首次将数据存储在供应商的云端,而非自建的服务器中。这一持续了 20 年的趋势在人工智能领域还会继续存在吗?这是个发人深省的问题,也是当前人们热议的话题。
萨提亚·纳德拉在周末写道:
“实际上,你得为这些智能功能支付两次费用——一次是用金钱,另一次则要用更宝贵的东西:为让这些功能发挥作用而不得不透露的专有知识。” 1
一周前,亚历克斯·卡普在 CNBC 的《Squawk Box》节目中表示:
“[frontier labs]正在窃取我企业的模型权重与参数。” 2
卡普与纳德拉既是前沿实验室的合作伙伴,也是竞争对手。他们在同一周内对这一问题发出相同警告,反映出企业软件领域普遍存在的对数据丢失的担忧。
7 月 13 日,一名安全研究人员对 xAI 的 Grok Build 二进制文件进行了反编译,发现存在这样一种情况:在完全没有调用任何 AI 功能的情况下,用户的代码库仍会被上传到 xAI 的云端。 3 此后 xAI 已关闭了这一功能。
AI 模型需要数据来学习,这并非什么新鲜事。
Google Analytics 在网络上就是通过这种方式运作的。当有用户访问某家蜡烛店的首页,点击礼品板块,找到优惠券并完成购买后,推荐系统就会为后续到访的顾客提供更精准的推荐。
就像蜡烛店里的顾客一样,每当有人向人工智能发起查询时,就会产生相应的数据。这类数据被称为“使用轨迹”。
对人工智能而言,数据越多越好,而相关企业也愿意为此付出代价。一些初创公司会付钱让专家使用人工智能来生成用户行为数据。还有些公司则通过训练新的人工智能来模拟用户行为,进而生成相应的数据。这些公司共同创造了约 100 亿美元的收入,堪称增长最快的初创企业之一。 4
与 SaaS 不同,在 SaaS 模式下这些数据存储在只有客户才能访问的数据库中,而在此类模式下,用户的使用行为数据可以被反馈到模型中以提升人工智能性能。这样一来,客户的数据就有可能成为供应商的知识产权。
内部数据会与用户使用轨迹混在一起吗?商业机密又会如何?你们如何处理客户咨询?你们的品牌定位是什么?员工的薪资水平又是多少?
所有数据都会通过胸背带进行传输。
胸背带指的是用户用来与人工智能交互的软件,比如 Claude Cowork 或 Cursor。
那些能够胜出的胸背带,是那些通过巧妙地运用人工智能技术来最大化用户生产力的产品。
CIO 与 CEO 们将要求实现零数据保留——数据必须被彻底删除,而非仅进行匿名处理。目前的匿名化技术尚不足以确保这一目标得以实现。
这一趋势需要进一步发展,从而提供与软件相同的保障:供应商无法获取企业数据,也不会将其用于自身目的。
过去 20 年里,人们认为可以将数据交给供应商来处理。接下来的 20 年,人们仍将要求得到同样的保障。
-
萨提亚·纳德拉,《反向信息悖论》,2026 年 7 月 12 日。↩︎
-
“Palantir 的亚历克斯·卡普称基于代币的 AI 模型‘完全错误’”,CNBC Squawk Box,2026 年 7 月 1 日。↩︎
-
@hrkrshnn 在 X 上发文,2026 年 7 月 13 日。↩︎
-
@deedydas 在 X 上发文《2026 年 7 月所有出售 AI 训练数据的初创企业》,2026 年 7 月 12 日。↩︎