Microsoft a annoncé le 20 juillet qu’elle déploierait des solutions d’IA à l’échelle rack AMD Helios sur sa plateforme cloud Azure afin de prendre en charge des charges avancées d’inférence de modèles. Le système Helios est proposé entre 5 millions de dollars et 5,5 millions de dollars, soit environ 40 % de plus que le prix estimé par Nvidia pour son architecture Vera Rubin (3,5 millions de dollars à 4 millions de dollars). Pourtant, Microsoft a choisi la solution full-stack d’AMD, signalant un changement dans la manière dont les fournisseurs cloud évaluent l’infrastructure IA — en donnant la priorité au coût total de possession et à l’efficacité de l’inférence plutôt qu’au prix unitaire.
Les revenus du segment data center d’AMD ont progressé de 57 % pour atteindre 5,8 milliards de dollars au T1 2026, et la société compte désormais huit des dix meilleures entreprises d’IA au monde parmi les utilisateurs de Helios, dont Meta, OpenAI et Oracle. Toutefois, l’écosystème CUDA de Nvidia et ses cadres d’inférence distribuée optimisés restent des avantages concurrentiels ; la maturité de l’écosystème logiciel d’AMD sera cruciale pour maintenir son pouvoir de fixation des prix à long terme.