Amazon Web Services (AWS) et NVIDIA annoncent la livraison de 2 millions de GPU supplémentaires pour l’IA agentique et physique
Amazon Web Services (AWS) et NVIDIA renforcent leur partenariat stratégique avec l’annonce d’une livraison massive de 2 millions de GPU supplémentaires. Cette expansion vise à répondre à la croissance exponentielle des besoins en calcul haute performance pour les applications d’intelligence artificielle, notamment celles liées à l’IA agentique et physique. Ces investissements témoignent d’une volonté commune d’innover sur une technologie de nouvelle génération, intégrant non seulement les GPU mais également des CPUs NVIDIA Vera, des avancées en networking et des modèles ouverts destinés à accélérer le déploiement de solutions IA à large échelle.
Alors que les charges de travail en intelligence artificielle se multiplient dans des secteurs variés tels que l’automatisation d’entreprise, la robotique avancée ou la découverte scientifique, cette collaboration stratégique s’appuie sur plus de 16 ans d’innovation conjointe. Le déploiement de cette infrastructure as aux clients une capacité scalable et sécurisée pour faire face à la complexité croissante des applications IA, tout en garantissant une interopérabilité fluide entre les différentes technologies co-optimisées. Les initiatives concernent également les laboratoires de pointe et les entités gouvernementales nécessitant un accès à des GPU sécurisés pour des opérations critiques.
Le déploiement de ces 2 millions de GPU supplémentaires par AWS, prévu entre 2027 et 2028, illustre la montée en puissance des exigences en calcul pour l’intelligence artificielle. Cette décision fait suite à une précédente annonce de plus d’un million de GPU, dont l’adoption par les clients a dépassé les attentes. Les GPU concernés incluent les modèles NVIDIA Blackwell Ultra, Rubin et Rubin Ultra, reconnus pour leurs performances optimales dans les environnements de calcul haute performance et d’inférence IA.
À travers cet accroissement, AWS confirme sa position de leader offrant la plus large gamme d’instances GPU adaptées aux besoins complexes des entreprises. Par exemple, les instances EC2 G7, intégrant des GPU RTX PRO 4500 Blackwell Server Edition, délivrent une performance d’inférence AI quatre fois supérieure à la génération précédente, tout en améliorant les capacités graphiques. Cette avancée technologique permet de booster la vitesse de traitement d’algorithmes complexes tout en réduisant la latence.
Cette montée en charge ne concerne pas uniquement les ressources GPU, mais inclut également une optimisation complète des réseaux, avec une collaboration sur la technologie NVIDIA Spectrum, essentielle pour les workflows d’entraînement distribué et les scénarios multi-GPU, cruciaux pour les modèles d’intelligence artificielle de grande échelle.
Parallèlement, AWS et NVIDIA étendent leur collaboration en intégrant les CPUs basés sur l’architecture Vera, conçus pour répondre aux besoins des applications IA exigeantes. Cette infrastructure CPU complète les offres GPU, formant une plateforme hétérogène de calcul optimisée pour les charges agents et physiques.
Cette évolution de l’écosystème AWS-NVIDIA repose également sur des innovations en matière de sécurité et de réseau, indispensables pour accompagner la montée en charge des applications IA dans des environnements sensibles. Le système AWS Nitro et l’adaptateur Elastic Fabric Adapter (EFA) asnt une connexion haute performance tout en garantissant la sécurité des workloads mission-critical, notamment dans les secteurs fédéraux et gouvernementaux.
Les technologies réseau avancées NVIDIA NVLink Fusion, couplées à la mémoire haute bande passante NVHBM, apportent une amélioration significative du débit entre GPU et CPU dans les racks. Ce lien rapide est crucial pour favoriser l’exécution fluide des workflows IA hybrides.
Cette collaboration s’inscrit dans une philosophie d’ouverture et d’accès simplifié aux outils IA, favorisant une adoption plus large dans des environnements nécessitant la personnalisation des modèles d’IA agentique.
En intégrant des modèles ouverts NVIDIA Nemotron à Amazon Bedrock et Amazon SageMaker, la plateforme offre aux utilisateurs la liberté de déployer, ajuster ou créer des modèles adaptés à leurs besoins spécifiques.
Cette stratégie démontre que le partenariat entre AWS et NVIDIA ne se limite pas à un simple déploiement de puissance brute, mais vise également à optimiser l’ensemble de la chaîne technologique IA, incluant infrastructures, logiciels et modèles, afin d’accompagner efficacement les acteurs de l’industrie dans leurs processus de transformation digitale.
Source : Intelligence-Artificielle.com

