AMD a annoncé le 20 juillet que Microsoft déploiera à grande échelle son système IA Helios à l'échelle du rack sur Azure, pièce maîtresse d'un partenariat stratégique de long terme élargi entre les deux entreprises. Azure utilisera Helios pour propulser l'inférence de modèles de frontière pour Microsoft elle-même, ses clients IA et les services Azure AI.
Helios est le premier système IA en rack complet d'AMD et son offensive la plus directe contre Nvidia à ce jour. Chaque rack intègre des GPU Instinct MI455X, des processeurs EPYC Venice, du réseau Pensando et la pile logicielle ROCm dans une conception de rack ouverte, conçue à la fois pour l'entraînement à grande échelle et pour l'inférence. AMD le positionne comme le premier vrai rival des systèmes à l'échelle du rack de Nvidia, qui avaient jusqu'ici ce marché pour eux seuls. Les livraisons aux clients, dont Microsoft, commencent au second semestre 2026.
Le partenariat va au-delà des racks. Microsoft introduit deux nouvelles séries de machines virtuelles Azure sur les processeurs EPYC Venice de sixième génération, HDv2 visant les charges de travail d'IA agentique et les pipelines de données, et HXv2 conçue pour le travail sur les semi-conducteurs. Les unités de traitement de données Pensando d'AMD seront aussi déployées plus largement dans l'infrastructure réseau d'Azure.
Microsoft n'est pas le premier nom sur la liste Helios, et c'est justement le propos. Meta, OpenAI, Oracle et Tata Consultancy Services ont déjà procédé à des déploiements ou pris des engagements envers le système. Les hyperscalers cherchent depuis deux ans une seconde source crédible au niveau du rack, pas seulement au niveau de la puce, car l'échelle du rack est là où l'avantage d'intégration de Nvidia a été le plus difficile à contester et la où la pression sur l'offre fait le plus mal.
Reste à savoir si cela entamera la domination de Nvidia, et tout dépendra de la livraison. Helios doit sortir à temps, en volume, et exécuter l'inférence de frontière à un coût compétitif, et la pile logicielle d'AMD doit tenir sous la charge des hyperscalers. Mais l'engagement d'un cloud du top trois à déployer à grande échelle est le signal le plus fort à ce jour que le marché du calcul IA devient une conversation à deux fournisseurs, et les décisions d'achat pour 2027 se prendront avec cette hypothèse sur la table.
