C’est l’un des signaux les plus clairs envoyés à Nvidia depuis le début de la vague IA. Le 20 juillet 2026, Microsoft a annoncé qu’il déploierait sur Azure Helios, le premier système rack-scale complet d’AMD conçu pour l’intelligence artificielle. Derrière l’annonce d’infrastructure se joue une bataille bien plus large : celle de savoir si le quasi-monopole de Nvidia sur les puces de datacenter peut enfin être entamé.
- ▸Microsoft déploiera le système rack-scale Helios d’AMD sur Azure, avec des livraisons attendues au second semestre 2026.
- ▸Chaque rack Helios intègre 72 accélérateurs Instinct MI455X, des processeurs EPYC Venice et le réseau Pensando, en refroidissement liquide.
- ▸Nvidia contrôle encore environ 95 % du marché des GPU de datacenter : Helios est présenté par AMD comme le premier rival crédible à ses systèmes rack-scale.
Ce qu’annonce vraiment Microsoft #
Dans un billet publié le 20 juillet 2026, Microsoft a confirmé l’extension de son partenariat avec AMD pour intégrer Helios à son cloud Azure. Il ne s’agit pas d’acheter des puces à l’unité, mais de déployer une architecture de référence complète : accélérateurs Instinct MI455X, processeurs EPYC Venice de sixième génération, cartes réseau Pensando et pile logicielle ROCm, le tout dans un châssis refroidi par liquide.
Concrètement, ces racks alimenteront trois nouvelles offres Azure : les machines virtuelles HDv2 pour le traitement de données, les HXv2 orientées conception électronique (EDA), et surtout les ND MI455X v7 dédiées à l’inférence IA. Les premières livraisons sont attendues au second semestre 2026.
- ✓72 accélérateurs Instinct MI455X par rack, en refroidissement liquide
- ✓Processeurs EPYC Venice (6e génération) et réseau Pensando
- ✓Pile logicielle ouverte ROCm, en alternative à CUDA de Nvidia
« Helios est le premier système rack-scale à même de rivaliser avec ceux de Nvidia. »— Positionnement d’AMD, annonce du 20 juillet 2026
Pourquoi c’est un coup porté à Nvidia #
Le poids de l’annonce tient à la position dominante de Nvidia. Selon les estimations relayées par plusieurs médias économiques, le fabricant tiendrait encore près de 95 % du marché des GPU de datacenter. Jusqu’ici, l’avantage de Nvidia ne reposait pas seulement sur ses puces, mais sur des systèmes rack-scale intégrés comme Grace Blackwell puis Vera Rubin, difficiles à égaler pièce par pièce.
En packageant Helios comme un système complet — et non plus comme des composants séparés —, AMD attaque précisément ce terrain. Le fait qu’un hyperscaler de la taille de Microsoft s’engage comme client de référence donne à cette alternative une crédibilité que les benchmarks seuls n’apportent pas.
Les chiffres techniques à retenir #
Sur le papier, la densité de calcul affichée est spectaculaire. Chaque MI455X embarque 432 Go de mémoire HBM4, soit environ 31 To de mémoire à haute bande passante par rack. AMD revendique jusqu’à 2,9 exaFLOPS de calcul FP4 par rack, un format de précision taillé pour l’inférence des grands modèles.
Ces performances restent, à ce stade, des chiffres constructeur : leur traduction réelle dépendra de la maturité de l’écosystème logiciel ROCm face à la domination historique de CUDA, l’argument que Nvidia met le plus en avant.
Une stratégie de diversification des hyperscalers #
L’accord s’inscrit dans une tendance de fond : les géants du cloud cherchent à réduire leur dépendance à un fournisseur unique, autant pour des raisons de coût que d’approvisionnement. Microsoft développe déjà ses propres puces maison, tout en multipliant les fournisseurs externes.
Le marché a réagi immédiatement : l’action AMD a progressé d’environ 5 % dans la foulée de l’annonce, selon plusieurs sources financières. Un signal que les investisseurs prennent au sérieux l’idée d’un duopole en gestation sur l’infrastructure IA.
Ce qu’il faut surveiller maintenant #
L’annonce fixe un cap, pas encore un rapport de force. Trois inconnues décideront de la portée réelle de Helios : le rythme de montée en charge des livraisons au second semestre 2026, la capacité de ROCm à séduire les développeurs habitués à CUDA, et la réponse de Nvidia avec sa génération Vera Rubin.
- ✓Le calendrier effectif des livraisons Helios (H2 2026)
- ✓L’adoption de ROCm face à l’écosystème CUDA
- ✓La riposte de Nvidia sur ses propres systèmes rack-scale
