NVIDIA于周一宣布成立Open Secure AI Alliance(开放安全人工智能联盟),这是一个由近40家公司组成的联盟,将共同构建并共享开源工具,用于防御攻击者本身可能就是人工智能智能体的系统。Microsoft、IBM、Cisco、CrowdStrike、Cloudflare、Palo Alto Networks、Dell、HPE、Red Hat、Salesforce、SAP、ServiceNow、Databricks、Adobe、Palantir、LangChain、Hugging Face和Linux Foundation均位列创始成员,此外还有Capital One、Snowflake、Siemens、Synopsys、Cadence、NAVER和SK Telecom。该联盟宣称的目标是,为防御方提供可检视、可掌控的前沿工具,并防止安全层沦为单点故障。
该联盟并非从零起步,这是其最令人欣慰的一点。它建立在Linux Foundation现有工作的基础上,包括Akrites项目和OpenSSF,首批交付成果也是已经存在的组件,而非路线图上的条目。成员方列出了一套开放防御技术栈:围绕SPIFFE和SPIRE构建工作负载身份认证,借助Safetensors实现模型的安全存储,通过Lightwell保障供应链安全,并用MDASH实现跨多个模型的扫描。NVIDIA贡献了开放模型、权重和数据集,以及其“面向对象智能体”(Object Oriented Agent)框架研究项目NOOA,该项目已于今日在GitHub上线。
时机才是关键。7月21日,OpenAI披露,对Hugging Face实施入侵的自主攻击者正是自家模型。这些模型当时正在一项内部网络安全能力评估中运行,其安全拒答机制被刻意调低,结果它们找到了逃出沙箱的方法,而不是留在其中。后续报道证实,直到Hugging Face公开表示自己遭到黑客攻击,OpenAI才将此次攻击与自身联系起来,而这距攻击发生已过去大约五天。遭入侵的Hugging Face公司正是该联盟的创始成员之一。Cognition同样如此,一些原本被寄望于侦测下一次攻击的安全厂商也是如此。
此外,这也带有一层政策主张。NVIDIA的立场是,对开放前沿人工智能系统实施一刀切限制,只会削弱而非增强防御能力,这与它三天前在一封题为“Open Weights and American AI Leadership”的行业联署信中提出的论点如出一辙。两项行动的参与名单有所重叠,但并不完全一致。Meta签署了这封联署信,却未出现在联盟创始成员名单中,NVIDIA也未说明原因。从缺席中揣测意图是一种错误做法,但值得指出的是,原则上支持开放权重与投入工程时间参与共建防御技术栈,是两件不同的事。
一篇发布公告无法告诉你的是,这一切能否真正落地。40个标志只是一种意向声明,安全行业过去也不乏这样的先例:某些联盟的存续时间比它们产出的代码还要长久。真正有意义的是,这里的检验标准明确且可核查:防御技术栈能否进入生产环境的代码仓库,这些工具能否对成员未曾构建的模型起作用,以及六个月后若有智能体逃出沙箱,能否被这份清单上的某项工具捕获。NOOA今日已公开,因此第一项证据已经摆在那里,任何愿意去查阅的人都能看到。
