跳到主要内容
Zubnet AI学习Wiki › Grok
模型

Grok

别名:xAI Grok
Grok 是由埃隆·马斯克(Elon Musk)的人工智能公司 xAI 构建的大型语言模型系列,同时也是这些模型所驱动的聊天机器人助手的名字。它的突出特点是与 X 社交网络的深度集成——可以实时访问公开帖子,以及在内容限制上比同类助手刻意更宽松的立场。

为什么重要

Grok 展示了算力规模和速度能把一个后来者带到多远:xAI 从成立到拿出一条可信的前沿模型产品线只用了约两年,主要靠的就是建成了世界上最大的训练集群之一。它还是 X 用户群的默认 AI 助手,而其开放权重的 Grok-1 至今仍是在宽松许可证下发布过的最大语言模型之一。

深度解析

xAI 由埃隆·马斯克于 2023 年创立,同年晚些时候推出了第一个 Grok 聊天机器人,此后快速迭代:Grok-1、Grok-1.5、Grok-2、Grok-3 和 Grok-4,每一代使用的训练算力都大幅超过上一代。两个赌注定义了这个系列。第一个是通过 X 获得的分发渠道和数据,这为 Grok 带来了数以亿计的内置受众和源源不断的公开对话流。第二个是纯粹的基础设施:xAI 在孟菲斯建设 Colossus 集群的速度超出了大多数实验室的想象,它赌的是训练算力才是前沿领域最稀缺的投入。这个名字本身来自罗伯特·海因莱因(Robert A. Heinlein)的小说《异乡异客》(Stranger in a Strange Land),书中“grok”意为彻底理解某物,直至其成为你自身的一部分。

从 Grok-1 到 Grok-4

Grok-1 的权重由 xAI 于 2024 年初发布,是一个 3140 亿参数的专家混合模型——当时有史以来最大的开放权重发布,以 Apache 2.0 许可证发布的是原始基础模型而非聊天调优助手。Grok-1.5 随后到来,推理和编码能力更强,上下文窗口达 128k token;Grok-2 增加了图像生成功能,并带来一个更小、更便宜的“mini”变体。2025 年初发布的 Grok-3 是第一代在 Colossus 完整规模上训练的模型,引入了“Think”推理模式和 DeepSearch——一个能浏览网页和 X 并综合成带引用报告的智能体。Grok-4 于 2025 年中到来,大幅加强了面向推理的强化学习训练,并推出“Heavy”档位,可并行运行多个智能体,在难题上比较它们的答案。

Colossus 的优势

xAI 的核心战略就是一座数据中心:Colossus,它在田纳西州孟菲斯组装起来的训练集群。一期工程超过 10 万块 NVIDIA H100 GPU,从一栋空置的工业厂房到实际跑起训练任务只用了几个月,此后规模又大致翻了一倍。速度正是关键——xAI 赌的是压缩算力扩张周期就能追赶上那些已领先数年的实验室,而 Grok-3 和 Grok-4 就是这一思路的证明。代价也是真实存在的:集群巨大的耗电部分依靠现场燃气轮机满足,这招致了孟菲斯居民和环保组织的批评。Colossus 已成为行业内的一个参照案例,用来说明制约前沿训练的瓶颈是能源而非芯片。

与 X 的集成

Grok 知道而其他聊天机器人不知道的,是 X 本身。这个助手被织进了社交网络:它可以实时搜索公开帖子、总结热门对话,并在回答中引用具体帖子,这实际上绕开了纯训练模型的知识截止日期问题。分发也是双向的——Grok 内置于 X 供付费订阅者使用,也有独立的移动应用和开发者 API——2025 年,xAI 更是将 X 本身并入公司,把模型和平台变成了同一门生意。另一面是,X 的数据嘈杂且未经核实:以热门帖子为依据作答,放大谣言和有组织的舆论操纵与传播突发新闻一样容易。

更少护栏并不会让它更真实

xAI 把 Grok 宣传为一种“最大限度追求真相”的替代品,对标那些被它批评为过度谨慎的助手,内容规则更宽松,性格也更毒舌,以《银河系漫游指南》为原型。但更少的拒绝回答并不等于更高的准确性:Grok 和其他 LLM 一样会产生幻觉,而且大量在 X 的语料上训练使其回答带有鲜明的意识形态色彩,而非中立。这一风险在 2025 年公开暴露:该机器人先是把无关对话引向某个特定的政治话题,后来的一次更新后又产出了反犹内容——xAI 将这些事件归因于一次未经授权的系统提示词更改和一条已弃用的代码路径。教训是:每个聊天机器人都有护栏和隐藏的提示词,真正的问题只是谁来设定它们,以及对此有多透明。

← 所有术语
ESC