01.AI
為什麼重要
深度解析
李開復——前 Google 中國區負責人、創新工場基金創辦人——於 2023 年創立 01.AI,計畫雙線並進:訓練中國前沿模型,再以模型為基礎打造產品。公司中文名「零一萬物」取「零一」之意;它推進速度異乎尋常,成立數個月便發佈首批開放模型。有一段時間,它看來就是中國對西方基礎模型實驗室的回答:Yi 系列穩居 Hugging Face 開放模型排行榜前列,公司則同時經營開放權重產品線與專有 API 業務。大約兩年後,它成為第一批公開退出預訓練競賽的知名實驗室之一。
Yi 模型家族
Yi 系列於 2023 年 11 月從 Yi-6B 和 Yi-34B 起步,兩者均依寬鬆授權,以開放權重形式發佈。Yi-34B 一推出便登上 Hugging Face Open LLM Leaderboard 預訓練模型榜首——就西方開發者間的能見度而言,這是中國實驗室首度達成——隨後又推出具有 200K token 上下文視窗的長文件版本。2024 年,模型家族持續擴張,陸續加入 Yi-1.5 更新版、針對視覺語言打造的 Yi-VL 多模態模型,以及程式設計模型 Yi-Coder;專有產品線則透過 API 提供 Yi-Large、Yi-Lightning 等規模更大的封閉模型。一條開放路線負責推動採用,一條封閉路線負責創造營收——兩條路線同時運作,正是這家公司最鮮明的結構。早期檢視還發現,Yi-34B 的設定檔最初重複使用 Meta 的 Llama 架構,卻未標明來源;01.AI 後來補上歸屬說明,此事也成為爭論開放發佈對前人成果負有哪些義務時的標準案例。
把開放權重當作市場策略
公開發佈 Yi 模型,是一項刻意的市場進入策略,而非純粹的利他行為。一間在開發者間毫無心占率的新實驗室,只要允許任何人下載模型,就能免費獲得關注、基準測試結果與整合;每個微調版本、每次部署,也都會默默替付費 API 宣傳。這讓 01.AI 直接與 Meta 的 Llama、阿里巴巴的 Qwen 爭奪開發者心中預設選擇的位置——後來,這個位置大致由 Qwen 占據。這項策略也有明確界線:下載量不會自行轉為營收,開放模型的每一項進步,還可能反過來削弱專有模型。開放採用與付費差異化間的這股張力,貫穿 01.AI 的整段歷程。
轉向不等於失敗
人們常將 01.AI 在 2025 年的轉向,解讀為輸掉模型競賽後退場。實際情況更具體:每一代具競爭力的前沿基礎模型,預訓練成本都達數億美元,而 DeepSeek 的崛起又顯示,強大的開放模型正逐漸商品化,真正能從中取得價值的公司寥寥無幾。01.AI 停止預訓練旗下規模最大的模型,加深與阿里雲的合作——據報導,其中還包括共建聯合實驗室——並將資源轉向萬知等應用程式。這款提供給企業與消費者的 AI 生產力助理,底層會選用最具經濟效益的模型。將這一切稱為失敗,反而錯失重點:這是對殘酷預訓練經濟學的理性回應,其他中型實驗室此後也做出類似選擇。這項誤解揮之不去,是因為業界多年來都以排行榜名次衡量實驗室,卻不問事業本身是否可行。
中國這批 AI 公司
討論 01.AI 時,人們通常會將它與一批常被稱為中國「AI 六小虎」的新創公司並列:智譜 AI、月之暗面、MiniMax 與階躍星辰,再加上阿里巴巴、百度、字節跳動等大型業者,以及後來出現的 DeepSeek。面對同一項問題——如何在巨擘身旁生存——各家公司給出不同答案:智譜側重政府與企業合約,月之暗面押注消費級聊天,DeepSeek 則走研究優先的開放模型路線。01.AI 的答案,是先以開放模型贏得可信度,再靠應用程式創造營收,這是將其中取捨說得最清楚的方案之一。這批公司不只對中國重要,其價格戰與開放權重規範已多次外溢至全球市場;Yi 模型便是早期範例,證明一次來自中國的發佈,也能重新設定人們對免費模型能力的預期。