Résumé :
La coopération entre Amazon et Nvidia s'approfondit encore. Les deux sociétés ont annoncé le 26 août qu'elles allaient élargir leur partenariat. Amazon déploiera 2 millions de GPU Nvidia supplémentaires dans ses centres de données au cours des deux prochaines années pour faire face à la demande croissante de puissance de calcul sur le marché de l'intelligence artificielle.

Les produits nouvellement achetés incluent les GPU NVIDIA Blackwell Ultra, Rubin et Rubin Ultra, qui sont principalement utilisés pour répondre aux besoins de calcul haute performance pour la formation et l'inférence de grands modèles. Les puces concernées seront déployées dans les centres de données Amazon Cloud Technology (AWS) en 2027 et 2028.
La nouvelle a été annoncée lors de la conférence téléphonique sur les résultats trimestriels de Nvidia. Il y a à peine cinq mois, Amazon s'est engagé à déployer plus d'un million de GPU Nvidia dans l'infrastructure AWS à partir de cette année. Nvidia a déclaré que la demande du marché avait depuis augmenté plus rapidement que prévu.
Les deux parties n'ont pas divulgué le montant précis de la transaction. Cependant, compte tenu du prix unitaire et de l’échelle d’achat des GPU IA haut de gamme, la valeur potentielle de cette nouvelle commande devrait atteindre des dizaines de milliards de dollars.
Il convient de noter que l’expansion de cette coopération ne se limite pas à l’achat supplémentaire de GPU par Amazon. Nvidia a déclaré que l'ensemble de ses capacités techniques, y compris le matériel réseau à haut débit, les modèles ouverts, les processeurs, les logiciels de traitement de données et les plates-formes robotiques, seront également plus largement intégrés dans le système de services d'AWS. La technologie réseau de NVIDIA peut interconnecter des milliers de GPU dans un système informatique unifié et constitue un élément important de la construction d'une infrastructure d'IA à grande échelle.
Les deux sociétés ont déclaré que la « demande croissante » de la part des start-ups, des grandes entreprises, des laboratoires d'IA et même des agences gouvernementales a poussé les deux parties à approfondir leur coopération. Alors que l’IA générative passe du stade expérimental au déploiement en production, les fournisseurs de services cloud accélèrent l’expansion des ressources informatiques des centres de données.
Cette mise à niveau de la coopération intervient dans le contexte où Amazon accélère la mise en place de puces d'IA auto-développées. Amazon espère réduire sa dépendance à l'égard de Nvidia en développant ses propres processeurs et concurrencer ces derniers dans certains domaines. Peter DeSantis, responsable de l'activité intelligence artificielle d'AWS, a précédemment déclaré qu'AWS envisageait de vendre des puces Trainium à des sociétés externes ; ce produit est destiné aux charges de travail d'apprentissage en profondeur et est considéré comme une alternative aux puces des séries H100 et Blackwell de Nvidia.
Dans le même temps, le processeur Graviton d'Amazon basé sur l'architecture Arm est également considéré comme un défi aux positions d'Intel et d'AMD sur le marché traditionnel des processeurs pour serveurs. Amazon a précédemment déclaré que son activité de puces personnalisées s'était développée rapidement, avec un chiffre d'affaires annuel supérieur à 25 milliards de dollars, soutenu par un engagement cumulé de 225 milliards de dollars de la part de laboratoires d'IA tels qu'Anthropic et OpenAI.
Cependant, à en juger par cette commande supplémentaire à grande échelle, NVIDIA conserve toujours une nette domination sur le marché des puces IA. En plus des 2 millions de GPU, Nvidia prévoit également de fournir un nombre non divulgué de processeurs Vera à Amazon, dont certains seront intégrés aux GPU Rubin et d'autres seront livrés en tant que processeurs autonomes. Colette Kress, directrice financière de Nvidia, a déclaré que les déploiements associés commenceraient au troisième trimestre.
Le PDG de Nvidia, Jensen Huang, a précédemment déclaré que le processeur Vera devrait ouvrir un nouveau marché d'environ 200 milliards de dollars à l'entreprise. Kress a déclaré lors de la dernière conférence téléphonique sur les résultats que Vera devrait être adoptée par les principaux fournisseurs de cloud hyperscale, les nouveaux fournisseurs de services cloud, les laboratoires d'IA et les fabricants de systèmes, et a maintenant commencé à la livrer à des partenaires majeurs, notamment Oracle et SpaceXAI.
La coopération entre les deux parties s'étendra également à l'automatisation des entrepôts d'Amazon et aux services cloud au niveau de l'entreprise. Amazon prévoit d'utiliser toute la pile technologique « IA physique » de Nvidia pour prendre en charge sa flotte de robots, notamment Omniverse pour la simulation et les jumeaux numériques, la plate-forme de modèles mondiaux Cosmos, la plate-forme de développement de robots Isaac et le matériel informatique Jetson pour les robots et l'IA de pointe. Nvidia a également lancé cette semaine une nouvelle version de Jetson Orin Nano, visant à réduire les obstacles au développement d'IA et de robotique de pointe d'entrée de gamme.
En termes de services d'entreprise, AWS fournira des modèles ouverts de la série NVIDIA Nemotron via Amazon Bedrock et SageMaker. La première est la plate-forme de modèle de base hébergée d'AWS et la seconde est son service d'apprentissage automatique dans le cloud.
Le rapport financier de Nvidia publié le même jour montre que le chiffre d'affaires de la société au deuxième trimestre a atteint 96,2 milliards de dollars, dépassant les attentes du marché. Parmi eux, le chiffre d'affaires des centres de données s'est élevé à 89 milliards de dollars, soit une augmentation de 117 % sur un an, représentant la majorité du chiffre d'affaires de l'entreprise au cours du trimestre. Nvidia s'attend à ce que le chiffre d'affaires du troisième trimestre atteigne 108 milliards de dollars, une partie de la croissance provenant d'une nouvelle génération de GPU Rubin ; la société a déclaré que Rubin avait commencé la production de masse ce trimestre.
Afin de répondre à la demande d'infrastructures d'IA au cours des prochaines années, Nvidia s'est également engagé à investir 279 milliards de dollars pour sécuriser la capacité d'approvisionnement et de fabrication requise pour les projets de centres de données, une augmentation significative par rapport aux 119 milliards de dollars du trimestre précédent. Sur ce montant, 92 milliards de dollars devraient être dépensés pendant le reste de cet exercice, et 87 milliards de dollars supplémentaires seront investis au cours de l'exercice 2028.
Huang Renxun a déclaré lors de la conférence téléphonique que l'IA avait commencé à entreprendre un travail réel avec une valeur de production et à générer une production « symbolique » rentable. Il estime qu’une plus grande puissance de calcul peut créer des services d’IA plus précieux et se traduire par des bénéfices pour les fournisseurs de services. C’est pourquoi toutes les parties prenantes de l’industrie continuent d’augmenter leurs investissements dans les infrastructures.
Cependant, le marché restera attentif à une question centrale : après que les entreprises d'IA auront investi des centaines de milliards de dollars dans la puissance de calcul et les centres de données, les nouvelles ressources informatiques pourront-elles être converties de manière stable en nouveaux bénéfices comme prévu.
Commentaires