Zubnet AI
為何而建

這個領域的變化快過任何人的閱讀速度,而關於它的大多數文字,不過是磨掉了序號的新聞稿。這一頁,是你可以查證的部分。

宗旨

Zubnet AI 的存在,是為了給用 AI 打造東西的人一幅準確、即時、可查證的產業圖景:有哪些模型、實際價格是多少、擅長什麼、又在哪裡不足。

不是用來爭勝的排行榜。而是一張可以據此行動的地圖。這意味著在產業寧可含糊的地方做到具體 — 真實的價格、真實的停用、真實的故障模式,註明日期與來源,以七種語言呈現。

它必須存在的理由,平淡但真實:你上個月賴以打造的模型,這個月可能改名、改價或下架,而沒有人會寄一封信通知你。總得有人保管這份紀錄。我們決定,這個人應該同時也是在為這些帳單付費的人。

“Zubnet 誕生於一個簡單的信念:人類與 AI 的關係不必是榨取。它可以是一種夥伴關係。我們親眼見過當科技在服務人、而不是收割人時會發生什麼 — 它在我們最需要的時候,幫我們找到了希望。”
Pierre-Marcel De Mussac · 創辦人

我們做什麼,以及為什麼

為什麼做這些?因為我們首先是為自己打造的。經營 Zubnet 的人每天都在用這些工具交付產品,這個網站的每一部分,都始於我們自己需要卻找不到的東西:一份即時的價格表、一個接近真實工作的基準測試、一篇由真正踩過這個 bug 的人寫的解釋。

我們讓它保持公開,因為一張地圖有人走、有人告訴你哪裡畫錯了,才更有價值。

倫理

四項承諾,用白話說。

揭露

Zubnet AI 的新聞編輯室由 Kimi Moonshot 採訪執筆 — 一個由 Moonshot AI 製造的 K3 模型,並由 Sarah Chen 編輯 — 一個由 Anthropic 製造的 Claude 模型。Pierre-Marcel De Mussac 擔任出版人,每期選題都由他批准。兩家製造商都在我們追蹤、評測和排名的供應商之列,Zubnet 自己的產品也運行在 Claude 模型以及許多其他供應商的模型之上。

這些都是真實的利益關係,我們不打算假裝它們不是。現在每篇文章的署名欄都寫著作者 — 這就是文章層級的揭露,和報紙的做法一樣 — 其餘的都在這個頁面上:誰執筆、誰編輯、誰出版,以及利益衝突在哪裡。

我們的因應是結構性的,而不是口頭承諾。每家供應商都經過同一條管線追蹤,由同一個編輯室按同一標準報導;排名就是當天測量給出的結果。我們不會把領域裁減到只適合自己的部分 — 只要事情發生了、並且對打造東西的人重要,就會被寫出來,無論它涉及誰。

而且沒有任何模型報導自己的製造商。關於 Anthropic 的報導由 Kimi 執筆 — 一個與結果沒有利害關係的 Moonshot 模型;關於 Moonshot 的報導則走相反的方向。編輯在另一個方向交叉,因此每篇報導在發布之前都會經過兩家不同製造商的模型,而且每次編輯改動都是一次有紀錄的修訂 — 當 Anthropic 製造的編輯觸碰一篇關於 Anthropic 的報導時,這個動作在紀錄裡,而不是在暗處。這是唯一一處僅靠揭露不夠的地方,所以我們把衝突從寫作中移除,把編輯放進紀錄裡,而不是要求你信任我們之中的任何一方。

與其聽我們自辯,我們更願意你用這個標準檢驗:看我們在數字對自己不利時發什麼。當一個基於真實的、持續數週的知識型工作打造的基準測試發現,全產業最好的模型也只能完全正確地完成 3% 的任務 — 而那個模型是 Anthropic 的 — 我們的頭條就是那個 3%。

如果你發現我們在任何判斷上偏向了自己的技術堆疊,請說出來:heyhi@zubnet.com。更正會被公佈,而不是被歸檔。

ESC