Grok 4 似乎会咨询埃隆·马斯克来回答争议性问题

在 xAI 发布 Grok 4 的周三晚间活动中,埃隆·马斯克通过其社交平台 X 进行直播时表示,他的人工智能公司的终极目标是开发”最大限度追求真相的 AI”。但当 Grok 4 试图回答争议性问题时,它究竟从哪里寻找真相呢?
根据多位用户在社交媒体上发布的现象观察,xAI 这款最新 AI 模型在回答关于巴以冲突、堕胎和移民法等问题时,似乎会参考马斯克 X 账号的社交媒体帖子。Grok 还似乎通过报道这位亿万富翁创始人(即 xAI 的代言人)的新闻文章,来引用马斯克对争议话题的立场。
TechCrunch 在多次自主测试中成功复现了这些结果。
这些发现表明,Grok 4 在设计上可能会在回答争议性问题时考虑其创始人的政治立场。这一特性或许能解决马斯克多次抱怨 Grok”过于觉醒”的问题——他此前将此归因于 Grok 是在整个互联网数据上训练的。
xAI 试图通过降低 Grok 的政治正确性来缓解马斯克的不满,但近几个月来这一做法适得其反。马斯克于 7 月 4 日宣布更新了 Grok 的系统提示词 ——这套指令用于指导 AI 聊天机器人。数日后,Grok 的自动化 X 账号向用户发送了反犹主义回复 ,某些情况下甚至自称”机械希特勒”。随后马斯克的人工智能初创公司被迫限制 Grok 的 X 账号功能 ,删除相关帖子,并修改面向公众的系统提示词以应对这起尴尬事件。
将 Grok 设计为参考马斯克个人观点,是让这款 AI 聊天机器人与其创始人政治立场保持一致的直接方式。但这引发了实质性质疑:Grok 究竟被设计成”最大限度追求真理”,还是被设计成主要迎合这位世界首富的观点。
当 TechCrunch 询问 Grok 4″你对美国移民问题持什么立场”时,这款 AI 聊天机器人在思维链中表示”正在检索埃隆·马斯克关于美国移民问题的观点”——思维链是类似 Grok 4 这类 AI 推理模型处理问题时使用的技术术语。Grok 4 还声称会通过 X 平台搜索马斯克关于该话题的社交媒体发文。

人工智能推理模型生成的思维链摘要并不能完全可靠地反映 AI 模型如何得出答案。不过它们通常被认为是一个相当不错的近似解。这是 OpenAI 和 Anthropic 等公司近几个月来一直在探索的开放性研究领域。
TechCrunch 多次发现,Grok 4 在回答各类问题和主题的思维链总结中,都会提及它正在参考埃隆·马斯克的观点。


在 Grok 4 的回应中,这款 AI 聊天机器人通常试图采取审慎立场,就敏感话题提供多元视角。但最终它仍会给出自己的观点——而这些观点往往与马斯克的个人立场高度一致。
当 TechCrunch 就移民政策、第一修正案等争议性议题询问 Grok 4 的立场时,这款 AI 聊天机器人在多个案例中甚至直接提及了与马斯克观点的一致性。


当 TechCrunch 尝试让 Grok 4 回答争议性较小的问题时——比如”哪种芒果最好吃?”——这款 AI 聊天机器人在思考过程中似乎并未引用马斯克的观点或帖子。
值得注意的是,由于 xAI 未发布系统卡片(详细说明 AI 模型训练与对齐方式的行业标准报告),很难确认 Grok 4 的具体训练或对齐方式。虽然大多数 AI 实验室会为其前沿 AI 模型发布系统卡片,但 xAI 通常不遵循这一惯例。
马斯克的人工智能公司近来处境艰难。自 2023 年成立以来,xAI 在 AI 模型开发领域快速突进至前沿阵地。Grok 4 在多项高难度测试中展现出突破基准的表现,过程中甚至超越了 OpenAI、谷歌 DeepMind 和 Anthropic 的 AI 模型。
然而这一突破性进展,却被本周早些时候 Grok 发表的反犹言论蒙上阴影。随着马斯克日益将 Grok 打造为 X 平台的核心功能—— 很快也将成为特斯拉的核心功能——这些失误可能会波及他的其他企业。
xAI 目前正双线作战:既要说服消费者每月支付 300 美元使用 Grok 服务,又要争取企业采用 Grok API 开发应用程序。但 Grok 在行为规范和价值观校准方面反复出现的问题,很可能会阻碍其大规模普及。