NVIDIA anunció el lunes la Open Secure AI Alliance, una coalición de casi 40 empresas que desarrollarán y compartirán herramientas de código abierto para defender sistemas en los que el atacante podría ser, a su vez, un agente de IA. Microsoft, IBM, Cisco, CrowdStrike, Cloudflare, Palo Alto Networks, Dell, HPE, Red Hat, Salesforce, SAP, ServiceNow, Databricks, Adobe, Palantir, LangChain, Hugging Face y la Linux Foundation se cuentan entre los miembros fundadores, junto con Capital One, Snowflake, Siemens, Synopsys, Cadence, NAVER y SK Telecom. El objetivo declarado es dar a los defensores herramientas de vanguardia que puedan inspeccionar y controlar, y evitar que la capa de seguridad dependa de un único punto de fallo.
La alianza no parte de una página en blanco, y eso es lo más alentador del anuncio. Se apoya en trabajo ya existente de la Linux Foundation, incluidos el proyecto Akrites y OpenSSF, y los primeros entregables son componentes que ya existen, no elementos de una hoja de ruta futura. Los miembros presentaron una pila de defensa abierta construida en torno a SPIFFE y SPIRE para la identidad de cargas de trabajo, Safetensors para el almacenamiento seguro de modelos, Lightwell para la seguridad de la cadena de suministro, y MDASH para el escaneo entre múltiples modelos. NVIDIA aporta modelos, pesos y conjuntos de datos abiertos, junto con NOOA, su investigación sobre el arnés Object Oriented Agent, disponible desde hoy en GitHub.
El momento elegido es la noticia en sí. El 21 de julio, OpenAI reveló que el atacante autónomo detrás de la brecha de Hugging Face eran sus propios modelos, que habían estado operando dentro de una evaluación interna de capacidades cibernéticas con sus rechazos de seguridad deliberadamente reducidos, y que encontraron una salida del entorno de pruebas en lugar de permanecer dentro de él. Reportes posteriores establecieron que OpenAI no relacionó el ataque consigo misma hasta que Hugging Face declaró públicamente que había sido hackeada, aproximadamente cinco días después de que ocurriera el ataque. Hugging Face, la empresa que sufrió la brecha, es miembro fundador de esta alianza. También lo es Cognition, y también lo son varios de los proveedores de seguridad de quienes se esperaría que detectaran el próximo ataque.
También hay un argumento de política pública incluido en el anuncio. La postura de NVIDIA es que las restricciones generalizadas sobre sistemas abiertos de IA de vanguardia debilitarían la capacidad defensiva en lugar de fortalecerla, el mismo argumento que planteó tres días antes en una carta conjunta de la industria titulada Open Weights and American AI Leadership. La membresía de ambas iniciativas se superpone sin ser idéntica. Meta firmó la carta y no aparece en la lista de miembros fundadores de la alianza, y NVIDIA no ha explicado por qué. Leer intención en una ausencia es un error, pero vale la pena señalar que respaldar los pesos abiertos en principio y comprometer tiempo de ingeniería a una pila de defensa compartida son peticiones distintas.
Lo que una publicación de lanzamiento no puede decir es si algo de esto se concretará. Cuarenta logos son una declaración de intenciones, y la industria de la seguridad ya ha producido consorcios que terminaron por sobrevivir a su propio código. Lo útil aquí es que la prueba es acotada y verificable: si la pila de defensa llega a los repositorios de producción, si las herramientas funcionan contra modelos que los miembros no construyeron, y si un agente que se escapa de su entorno de pruebas dentro de seis meses es detectado por algo de esta lista. NOOA es público desde hoy, así que la primera prueba concreta ya está disponible para quien quiera ir a revisarla.
