AMD a annonce le 20 juillet que Microsoft deploiera a grande echelle son systeme IA Helios a l'echelle du rack sur Azure, piece maitresse d'un partenariat strategique de long terme elargi entre les deux entreprises. Azure utilisera Helios pour propulser l'inference de modeles de frontiere pour Microsoft elle-meme, ses clients IA et les services Azure AI.

Helios est le premier systeme IA en rack complet d'AMD et son offensive la plus directe contre Nvidia a ce jour. Chaque rack integre des GPU Instinct MI455X, des processeurs EPYC Venice, du reseau Pensando et la pile logicielle ROCm dans une conception de rack ouverte, concue a la fois pour l'entrainement a grande echelle et pour l'inference. AMD le positionne comme le premier vrai rival des systemes a l'echelle du rack de Nvidia, qui avaient jusqu'ici ce marche pour eux seuls. Les livraisons aux clients, dont Microsoft, commencent au second semestre 2026.

Le partenariat va au-dela des racks. Microsoft introduit deux nouvelles series de machines virtuelles Azure sur les processeurs EPYC Venice de sixieme generation, HDv2 visant les charges de travail d'IA agentique et les pipelines de donnees, et HXv2 concue pour le travail sur les semi-conducteurs. Les unites de traitement de donnees Pensando d'AMD seront aussi deployees plus largement dans l'infrastructure reseau d'Azure.

Microsoft n'est pas le premier nom sur la liste Helios, et c'est justement le propos. Meta, OpenAI, Oracle et Tata Consultancy Services ont deja procede a des deploiements ou pris des engagements envers le systeme. Les hyperscalers cherchent depuis deux ans une seconde source credible au niveau du rack, pas seulement au niveau de la puce, car l'echelle du rack est la ou l'avantage d'integration de Nvidia a ete le plus difficile a contester et la ou la pression sur l'offre fait le plus mal.

Reste a savoir si cela entamera la domination de Nvidia, et tout dependra de la livraison. Helios doit sortir a temps, en volume, et executer l'inference de frontiere a un cout competitif, et la pile logicielle d'AMD doit tenir sous la charge des hyperscalers. Mais l'engagement d'un cloud du top trois a deployer a grande echelle est le signal le plus fort a ce jour que le marche du calcul IA devient une conversation a deux fournisseurs, et les decisions d'achat pour 2027 se prendront avec cette hypothese sur la table.