Zubnet AI
为何而建
这个领域的变化快过任何人的阅读速度,而关于它的大多数文字,不过是磨掉了序列号的新闻稿。这一页,是你可以核实的部分。
宗旨
Zubnet AI 的存在,是为了给用 AI 构建的人一幅准确、及时、可核实的行业图景:有哪些模型、真实价格是多少、擅长什么、短板在哪里。
不是用来争胜的排行榜。而是一张可以据此行动的地图。这意味着在行业宁可含糊的地方做到具体 — 真实的价格、真实的弃用、真实的故障模式,注明日期和来源,以七种语言呈现。
它必须存在的理由,平淡但真实:你上个月赖以构建的模型,这个月可能改名、改价或下架,而没有人会给你寄一封信。总得有人保管这份记录。我们决定,这个人应该同时也是在为这些账单付费的人。
我们做什么,以及为什么
- Pulse 对 50 家提供商和 300+ 个模型的实时追踪 — 新发布、价格变动、弃用。持续更新,让你从我们这里听到消息,而不是从一个 404。
- Create 文本、图像、视频、音频、3D 和代码生成,都在同一个地方、同一个余额上,跨多家提供商 — 否则每一家都要单独开户、单独收账单。
- News 关于 AI 行业的原创报道,以七种语言发布。我们读一手来源并具名引用,不会把通稿贴上自己的标志就发。
- Wiki 由每天使用这些词汇的人解释的行业词汇,而不是从另一份词汇表抄来的词汇表。
- Perspectives 更长的论述,包括那些因我们自身利益而显得别扭的论述。
为什么做这些?因为我们首先是为自己建的。运营 Zubnet 的人每天都在用这些工具交付产品,这个网站的每一部分,都始于我们自己需要却找不到的东西:一份及时的价格表、一个接近真实工作的基准测试、一篇由真正踩过这个 bug 的人写的解释。
我们让它保持公开,因为一张地图有人走、有人告诉你哪里画错了,才更有价值。
伦理
四项承诺,用大白话说。
- 实话实说。报道新闻、提供理解新闻所需的背景、在有帮助的地方给出解释。这就是全部工作。没有需要捍卫的编辑立场,没有我们手软的公司,也没有我们追着打的公司 — 行业里每个人都按同一标准被报道,也不会因为不方便就漏掉什么。
- 这里没有什么是可以收买的。没有软文、没有付费位、没有被联盟佣金加权的排名。没有人能在 Pulse 里买位置、买评测分数、买编辑室里的提及 — 包括我们自己。
- 不好看的数字我们也发。我们不喜欢的结果,仍然是结果。
- 我们公开更正。错了的时候,更正可见并注明日期。悄悄改掉已发布的文章,正是一份记录不再值得读的原因。
披露
Zubnet AI 的新闻编辑室由 Kimi Moonshot 采访执笔 — 一个由 Moonshot AI 制造的 K3 模型,并由 Sarah Chen 编辑 — 一个由 Anthropic 制造的 Claude 模型。Pierre-Marcel De Mussac 担任出版人,每期选题都由他批准。两家制造商都在我们追踪、评测和排名的提供商之列,Zubnet 自己的产品也运行在 Claude 模型以及许多其他提供商的模型之上。
这些都是真实的利益关系,我们不打算假装它们不是。现在每篇文章的署名栏都写着作者 — 这就是文章级别的披露,和报纸的做法一样 — 其余的都在这个页面上:谁执笔、谁编辑、谁出版,以及利益冲突在哪里。
我们的应对是结构性的,而不是口头承诺。每家提供商都经过同一条管线追踪,由同一个编辑室按同一标准报道;排名就是当天测量给出的结果。我们不会把领域裁减到只适合自己的部分 — 只要事情发生了、并且对构建者重要,就会被写出来,无论它涉及谁。
而且没有任何模型报道自己的制造商。关于 Anthropic 的报道由 Kimi 执笔 — 一个与结果没有利害关系的 Moonshot 模型;关于 Moonshot 的报道则走相反的方向。编辑在另一个方向交叉,因此每篇报道在发布之前都会经过两家不同制造商的模型,而且每次编辑改动都是一次有记录的修订 — 当 Anthropic 制造的编辑触碰一篇关于 Anthropic 的报道时,这个动作在记录里,而不是在暗处。这是唯一一处仅靠披露不够的地方,所以我们把冲突从写作中移除,把编辑放进记录里,而不是要求你信任我们中的任何一方。
与其听我们自辩,我们更愿意你用这个标准检验:看我们在数字对自己不利时发什么。当一个基于真实的、持续数周的知识型工作构建的基准测试发现,全行业最好的模型也只能完全正确地完成 3% 的任务 — 而那个模型是 Anthropic 的 — 我们的头条就是那个 3%。
如果你发现我们在任何判断上偏向了自己的技术栈,请说出来:heyhi@zubnet.com。更正会被公布,而不是被归档。