Safe Superintelligence
为什么重要
深度解析
Safe Superintelligence 于 2024 年 6 月宣布成立,距 Ilya Sutskever 离开 OpenAI 仅一个多月——他曾是 OpenAI 的联合创始人兼首席科学家,也是深度学习时代最具影响力的研究者之一。创始声明本质上只有一句话:一个目标、一款产品——安全的超级智能,安全与能力同步推进。其他一切——不发布产品、没有收入计划、不公开研究——都源于这句话。公司在帕洛阿尔托和特拉维夫设立了办公室,数月内融资约 10 亿美元,据报道 2025 年估值约 320 亿美元,而这一切都没有发布任何模型、发表任何论文,或公开描述其技术路线。与 Sutskever 共同创立公司的还有 Daniel Gross(曾领导 Apple 的 AI 工作、曾任 Y Combinator 合伙人)和前 OpenAI 研究员 Daniel Levy。
从 OpenAI 到一张白纸
Sutskever 通往 SSI 的道路几乎串起了现代 AI 的所有里程碑。他合著的 AlexNet 论文在 2012 年掀起了深度学习浪潮,2015 年共同创立 OpenAI,并以首席科学家身份主导了通向 GPT 系列和 ChatGPT 的研究进程。他也是 OpenAI 2023 年 11 月董事会危机的核心人物:他最初投票罢免 CEO Sam Altman,几天后又改变立场。那场风波之后,他共同领导了 OpenAI 的超级对齐团队,受命研究如何控制比人类更聪明的系统,但该团队于 2024 年 5 月解散,他与共同负责人 Jan Leike 双双离职。数周后 SSI 成立,这个时间点让潜台词难以忽视:这家实验室在很大程度上是在押注——对齐工作无法在一家正赶着把自己试图控制的技术商业化的公司里妥善完成。
直达式策略
大多数前沿实验室靠发布产品来支付算力账单——聊天机器人、API、企业合同——而每次发布都会把研究者拖向截止日期、与发布绑定的安全审查和功能竞赛。SSI 宣称的模式把这一切全部去掉:在那唯一的产品完成之前不做任何产品,创始人认为这消除了侵蚀安全工作的商业压力。投资人以惊人的条件接受了——2024 年约 10 亿美元的首轮融资据报道对应近 50 亿美元估值,2025 年的融资报道则把数字抬到约 320 亿美元,而这家实验室按大多数说法只有几十名员工、收入为零。这场赌注本质上是在押:Sutskever 对当今缩放定律之后会发生什么的判断,比任何产品管线都更值钱。他一直主张,随着预训练数据接近耗尽,行业正在回归研究的时代,而 SSI 就是把这一论点变成了一家公司。
“安全”究竟意味着什么
SSI 的核心主张是安全无法事后加装。按照这种观点,行业惯常的做法——先训练一个能力最强的模型,再用护栏、微调和内容过滤器约束它——是本末倒置的,因为比操作者更聪明的系统会找到你为它造的任何笼子的缝隙。SSI 称自己的做法是让安全与能力同步发展,把可靠性和可控性从第一个实验起就当作设计目标,而不是发布前打的补丁。这在技术上具体意味着什么外界无从得知,因为公司什么都不发布:没有论文、没有模型卡、没有评测结果。怀疑者指出,这让其安全主张从外部无法证伪——这个领域惯常的检验工具,从开放评测到机制可解释性,都需要可供检查的工件,而 SSI 没有发布任何工件。公司的立场是:存在性风险的利害关系证明,安静地工作比在公众注视下竞赛更合理。
它并不急着发布聊天机器人
关于 SSI 最常见的误解,是把它当成 ChatGPT 或 Claude 的隐形竞争对手——以为它某天会揭开一款更有礼貌的聊天机器人的面纱。这里没有可注册的 API、没有应用、没有等候名单,而且公司表示在超级智能被安全地解决之前也不会有。另一个相关误解是把 SSI 当成倡导或政策机构:它不是。它是一家训练模型的研究实验室,结构上更接近早期的 DeepMind 而非智库,它的赌注是先实现 ASI 并且安全地实现,胜过发布中间产品。“第一”和“安全”究竟能否构成自洽的组合——毕竟快速推进与证明安全朝着相反方向拉扯——正是整个公司作为一场实验所回答的问题。
悬而未决的问题
SSI 的实验有明显的薄弱环节。前沿训练需要耗资数十亿美元的算力,几十名研究者——无论多么声名显赫——面对的是拥有数十万 GPU 集群的实验室,因此公司要么找到一条真正更好的路径,要么最终不得不在足以让商业压力回归的规模上融资。在什么都不发布的情况下,安全主张也无法验证,这等于要求 AI 安全领域的其他人凭信念接受它的使命。直达式路线已经历过压力测试:据报道,2025 年 Meta AI 曾探索收购该公司并延揽其创始人,Sutskever 公开拒绝了这一提议,Gross 随后不久离职,Sutskever 接任 CEO。这一切并不意味着这场赌注是错的——它凸显的是,SSI 是对一小群人判断力的押注,而在这家实验室打破沉默之前,世界无从知道这场押注的结果。