Zubnet AI
为何而建

这个领域的变化快过任何人的阅读速度,而关于它的大多数文字,不过是磨掉了序列号的新闻稿。这一页,是你可以核实的部分。

宗旨

Zubnet AI 的存在,是为了给用 AI 构建的人一幅准确、及时、可核实的行业图景:有哪些模型、真实价格是多少、擅长什么、短板在哪里。

不是用来争胜的排行榜。而是一张可以据此行动的地图。这意味着在行业宁可含糊的地方做到具体 — 真实的价格、真实的弃用、真实的故障模式,注明日期和来源,以七种语言呈现。

它必须存在的理由,平淡但真实:你上个月赖以构建的模型,这个月可能改名、改价或下架,而没有人会给你寄一封信。总得有人保管这份记录。我们决定,这个人应该同时也是在为这些账单付费的人。

“Zubnet 源自一个简单的信念:人类与 AI 的关系不必是一种榨取。它可以是一种合作。我们亲眼见过当科技是在服务人、而不是在收割人时发生了什么 — 它帮助我们在最需要时找到希望。”
Pierre-Marcel De Mussac · 创办人

我们做什么,以及为什么

为什么做这些?因为我们首先是为自己建的。运营 Zubnet 的人每天都在用这些工具交付产品,这个网站的每一部分,都始于我们自己需要却找不到的东西:一份及时的价格表、一个接近真实工作的基准测试、一篇由真正踩过这个 bug 的人写的解释。

我们让它保持公开,因为一张地图有人走、有人告诉你哪里画错了,才更有价值。

伦理

四项承诺,用大白话说。

披露

Zubnet AI 的新闻编辑室由 Kimi Moonshot 采访执笔 — 一个由 Moonshot AI 制造的 K3 模型,并由 Sarah Chen 编辑 — 一个由 Anthropic 制造的 Claude 模型。Pierre-Marcel De Mussac 担任出版人,每期选题都由他批准。两家制造商都在我们追踪、评测和排名的提供商之列,Zubnet 自己的产品也运行在 Claude 模型以及许多其他提供商的模型之上。

这些都是真实的利益关系,我们不打算假装它们不是。现在每篇文章的署名栏都写着作者 — 这就是文章级别的披露,和报纸的做法一样 — 其余的都在这个页面上:谁执笔、谁编辑、谁出版,以及利益冲突在哪里。

我们的应对是结构性的,而不是口头承诺。每家提供商都经过同一条管线追踪,由同一个编辑室按同一标准报道;排名就是当天测量给出的结果。我们不会把领域裁减到只适合自己的部分 — 只要事情发生了、并且对构建者重要,就会被写出来,无论它涉及谁。

而且没有任何模型报道自己的制造商。关于 Anthropic 的报道由 Kimi 执笔 — 一个与结果没有利害关系的 Moonshot 模型;关于 Moonshot 的报道则走相反的方向。编辑在另一个方向交叉,因此每篇报道在发布之前都会经过两家不同制造商的模型,而且每次编辑改动都是一次有记录的修订 — 当 Anthropic 制造的编辑触碰一篇关于 Anthropic 的报道时,这个动作在记录里,而不是在暗处。这是唯一一处仅靠披露不够的地方,所以我们把冲突从写作中移除,把编辑放进记录里,而不是要求你信任我们中的任何一方。

与其听我们自辩,我们更愿意你用这个标准检验:看我们在数字对自己不利时发什么。当一个基于真实的、持续数周的知识型工作构建的基准测试发现,全行业最好的模型也只能完全正确地完成 3% 的任务 — 而那个模型是 Anthropic 的 — 我们的头条就是那个 3%。

如果你发现我们在任何判断上偏向了自己的技术栈,请说出来:heyhi@zubnet.com。更正会被公布,而不是被归档。

ESC