A AMD anunciou em 20 de julho que a Microsoft vai implantar em escala seu sistema de IA em escala de rack Helios no Azure, a âncora de uma parceria estratégica de longo prazo ampliada entre as duas empresas. O Azure usará o Helios para alimentar inferência de modelos de fronteira para a própria Microsoft, seus clientes de IA e os serviços de IA do Azure.

O Helios é o primeiro sistema de IA de rack completo da AMD e sua investida mais direta contra a Nvidia até agora. Cada rack integra GPUs Instinct MI455X, CPUs EPYC Venice, rede Pensando e a pilha de software ROCm em um design de rack aberto, construído tanto para treinamento em larga escala quanto para inferência. A AMD o posiciona como o primeiro rival real dos sistemas em escala de rack da Nvidia, que até agora tiveram esse mercado só para si. As entregas a clientes, incluindo a Microsoft, começam no segundo semestre de 2026.

A parceria vai além dos racks. A Microsoft está introduzindo duas novas séries de máquinas virtuais do Azure com processadores EPYC Venice de sexta geração, a HDv2, voltada a cargas de trabalho de IA agêntica e pipelines de dados, e a HXv2, projetada para trabalho com semicondutores. As unidades de processamento de dados Pensando da AMD também serão implantadas de forma mais ampla na infraestrutura de rede do Azure.

A Microsoft não é o primeiro nome da lista do Helios, e esse é justamente o ponto. Meta, OpenAI, Oracle e Tata Consultancy Services já fizeram implantações ou assumiram compromissos com o sistema. Os hyperscalers passaram dois anos procurando uma segunda fonte crível no nível do rack, não apenas no nível do chip, porque a escala de rack é onde a vantagem de integração da Nvidia tem sido mais difícil de desafiar e onde a pressão de fornecimento dói mais.

Se isso quebra o domínio da Nvidia depende da entrega. O Helios precisa ser entregue no prazo, em volume, e rodar inferência de fronteira a custo competitivo, e a pilha de software da AMD precisa aguentar a carga de um hyperscaler. Mas uma das três maiores nuvens se comprometendo a implantar em escala é o sinal mais forte até agora de que o mercado de computação de IA está se tornando uma conversa entre dois fornecedores, e as decisões de compra para 2027 serão tomadas com essa premissa sobre a mesa.