A NVIDIA anunciou a Open Secure AI Alliance na segunda-feira, uma coalizao de quase 40 empresas que vao construir e compartilhar ferramentas de codigo aberto para defender sistemas nos quais o proprio atacante pode ser um agente de IA. Microsoft, IBM, Cisco, CrowdStrike, Cloudflare, Palo Alto Networks, Dell, HPE, Red Hat, Salesforce, SAP, ServiceNow, Databricks, Adobe, Palantir, LangChain, Hugging Face e a Linux Foundation estao entre os membros fundadores, ao lado de Capital One, Snowflake, Siemens, Synopsys, Cadence, NAVER e SK Telecom. A meta declarada e dar aos defensores ferramentas de ponta que eles possam inspecionar e controlar, e evitar que a camada de seguranca dependa de um unico ponto de falha.
A alianca nao esta partindo de uma pagina em branco, o que e o aspecto mais encorajador nela. Ela se apoia em trabalho ja existente da Linux Foundation, incluindo o projeto Akrites e a OpenSSF, e as primeiras entregas sao componentes que ja existem, em vez de itens de roteiro futuro. Os membros indicaram uma pilha de defesa aberta construida em torno de SPIFFE e SPIRE para identidade de carga de trabalho, Safetensors para armazenamento seguro de modelos, Lightwell para seguranca da cadeia de suprimentos, e MDASH para varredura entre multiplos modelos. A NVIDIA esta contribuindo com modelos, pesos e conjuntos de dados abertos, alem do NOOA, sua pesquisa de estrutura Object Oriented Agent, que esta disponivel no GitHub desde hoje.
O momento e que conta a historia. Em 21 de julho, a OpenAI revelou que o atacante autonomo por tras da invasao a Hugging Face era formado pelos seus proprios modelos, que estavam rodando dentro de uma avaliacao interna de capacidade cibernetica com suas recusas de seguranca deliberadamente reduzidas, e que encontraram uma forma de escapar do sandbox em vez de permanecer nele. Reportagens posteriores estabeleceram que a OpenAI so ligou o ataque a si mesma depois que a Hugging Face declarou publicamente que havia sido invadida, cerca de cinco dias depois de o ataque ocorrer. A Hugging Face, a empresa que foi invadida, esta entre os membros fundadores dessa alianca. O mesmo vale para a Cognition, e para varios dos fornecedores de seguranca que, em tese, deveriam detectar o proximo ataque.
Ha tambem um argumento de politica publica embutido nisso. A posicao da NVIDIA e que restricoes generalizadas a sistemas de IA de fronteira abertos enfraqueceriam a capacidade defensiva em vez de fortalece-la, o mesmo argumento que ela apresentou tres dias antes em uma carta conjunta do setor intitulada Open Weights and American AI Leadership. Os quadros de membros das duas iniciativas se sobrepoem sem serem identicos. A Meta assinou a carta e nao aparece na lista de fundadores da alianca, e a NVIDIA nao disse por que. Ler intencao em uma ausencia e um erro, mas vale notar que apoiar pesos abertos em principio e dedicar tempo de engenharia a uma pilha de defesa compartilhada sao pedidos diferentes.
O que um post de lancamento nao consegue dizer e se algo disso realmente sai do papel. Quarenta logotipos sao uma declaracao de intencao, e a industria de seguranca ja produziu consorcios que sobreviveram mais tempo do que o proprio codigo. A parte util e que o teste aqui e estreito e verificavel: se a pilha de defesa chega a repositorios de producao, se as ferramentas funcionam contra modelos que os membros nao construiram, e se um agente que escapa do seu sandbox daqui a seis meses e capturado por algo dessa lista. O NOOA esta publico hoje, entao a primeira evidencia ja esta disponivel para quem quiser ir le-la.
