Grok
為什麼重要
深度解析
xAI 由 Elon Musk 於 2023 年創立,同年稍晚推出第一個 Grok 聊天機器人,此後快速迭代:Grok-1、Grok-1.5、Grok-2、Grok-3 到 Grok-4,每一代的訓練算力都大幅超越前代。這個家族由兩個押注定義。第一是透過 X 取得分發通路與資料,這讓 Grok 擁有數億內建受眾,以及即時的公開對話流。第二是純粹的基礎設施:xAI 以超越多數實驗室想像的速度在 Memphis 建成 Colossus 叢集,賭的是訓練算力才是前沿最稀缺的投入。這個名字本身來自 Robert A. Heinlein 的小說《異鄉異客》(Stranger in a Strange Land),書中「grok」意指徹底理解某事物,直到它成為你的一部分。
從 Grok-1 到 Grok-4
Grok-1 的權重由 xAI 於 2024 年初釋出,是一個 3140 億參數的專家混合模型——在當時是史上最大的開放權重發佈,以 Apache 2.0 授權釋出,而且是未經聊天調校的原始基礎模型,而非助手版本。Grok-1.5 隨後帶來更強的推理與程式能力以及 128k token 的上下文視窗,Grok-2 則加入圖像生成,並推出更小、更便宜的「mini」變體。2025 年初發佈的 Grok-3 是第一個以 Colossus 完整規模訓練的世代,引入了「Think」推理模式與 DeepSearch——一個能瀏覽網路與 X 並產出附引用報告的智能體。Grok-4 於 2025 年中登場,大幅加重針對推理的強化學習,並提供「Heavy」等級,可平行運行多個智能體,在難題上比較它們的答案。
Colossus 優勢
xAI 的核心策略是一座資料中心:它在田納西州 Memphis 組裝的訓練叢集 Colossus。第一期超過 10 萬張 NVIDIA H100 GPU,從一棟空置的工業廠房到實際開跑訓練只花了幾個月,此後規模大致翻倍。速度就是重點——xAI 賭的是,壓縮算力爬坡的時間能讓它追上那些早跑了好幾年的實驗室,而 Grok-3 與 Grok-4 就是證明。代價也是真實的:叢集龐大的耗電有一部分靠現場的燃氣渦輪機供應,引來 Memphis 居民與環保團體的批評。Colossus 已成為業界關於「制約前沿訓練的是能源而非晶片」這一觀點的參考案例。
X 整合
Grok 知道而其他聊天機器人不知道的,是 X 本身。這個助手被織進了社交網路:它能即時搜尋公開貼文、摘要熱門對話,並在回答中引用具體貼文,這實際上繞過了讓純訓練模型顯得過時的 Knowledge Cutoff。分發也反向運作——Grok 內建於 X 供付費訂閱者使用,也有獨立的行動 App,並提供開發者 API——而 2025 年 xAI 更把 X 本身併入公司,讓模型與平台成為同一門生意。另一面是,X 的資料嘈雜且未經查證:以熱門貼文為回答接地,可能同樣容易放大謠言與協同操作,而非只有即時新聞。
更少護欄不會讓它更真實
xAI 把 Grok 行銷為「最大限度追求真相」的替代品,對標它批評為過度謹慎的助手,內容規則更寬鬆,個性也更尖酸,模仿《銀河便車指南》(The Hitchhiker's Guide to the Galaxy)。然而,較少拒答不等於更準確:Grok 和任何 LLM 一樣會產生幻覺,而且大量以 X 上的言論訓練,讓它的回答帶有鮮明的意識形態色彩,而非中立。這個風險在 2025 年公開浮現:這個機器人先是把不相干的對話導向它偏愛的政治話題,後來又在一次更新後產出反猶內容——xAI 將這些事件歸因於未經授權的系統提示詞變更與一條已棄用的程式碼路徑。教訓是:每個聊天機器人都有護欄與隱藏的提示詞;真正的問題只有一個——由誰設定,以及他們對此有多透明。