La forte demande a stimulé le GPU de Nvidia, ce qui en a fait l'entreprise la plus valorisée au monde. Le GPU est également la puce principale pour créer et exécuter l’intelligence artificielle. Maintenant que le géant des puces a commencé à fournir des unités centrales de traitement (CPU) auto-développées à des parties externes, les fournisseurs de services cloud peuvent choisir ce produit pour remplacer les solutions d'AMD et d'Intel, et le marché des serveurs d'IA a entamé un nouveau cycle de concurrence.

Le 16 mars 2026, lors de la conférence NVIDIA GTC à San Jose, Californie, États-Unis, le PDG de NVIDIA, Jensen Huang, a prononcé un discours d'ouverture avec à côté de lui un plateau informatique Vera Rubin Ultra Kyber et un fond de panier d'interconnexion Vera Rubin Ultra Kyber NVLink. NVIDIA, une entreprise clé dans la vague de construction de puissance de calcul de l'IA, prévoit que d'ici fin 2027, les revenus de ses deux principales gammes de puces, Blackwell et Rubin, atteindront au moins 1 000 milliards de dollars.
Mardi, Nvidia a officiellement publié des informations détaillées sur son processeur de centre de données Vera, notamment les spécifications de la puce, les données de référence et les informations sur l'architecture, permettant aux clients potentiels de l'évaluer pleinement. Les représentants de Nvidia ont révélé que les puces Vera avaient été livrées aux clients en juin et que les acheteurs incluent OpenAI, Anthropic et SpaceX.
NVIDIA a longtemps dirigé l'industrie mondiale des technologies de l'information. Mais dans le domaine des processeurs, Nvidia est un challenger tardif. Ses adversaires Intel et AMD ont des racines profondes et entretiennent des relations de coopération stables et à long terme avec les principaux fabricants de cloud à très grande échelle.
La disposition des processeurs est une autre étape dans la stratégie d’intégration verticale de Nvidia : développer davantage de puces et de technologies de base dans le système d’année en année. L'objectif de NVIDIA n'est plus simplement de vendre des puces, mais de fournir aux clients des systèmes informatiques intégrés dans toute l'armoire.
NVIDIA a déclaré que cette stratégie peut aider les ingénieurs à libérer pleinement les performances du GPU ; Alors que la concurrence entre les puces développées par AMD et les diverses solutions de puissance de calcul personnalisées s'intensifie, cette décision consolidera le premier choix des systèmes NVIDIA dans les principaux laboratoires d'IA.
Avant le boom de l’IA, le processeur était le composant le plus important et le plus coûteux d’un serveur. Lorsque ChatGPT a été lancé en 2022, la première génération de serveurs IA utilisait généralement 1 processeur avec jusqu'à 8 GPU, et le centre de la puissance de calcul a commencé à s'orienter vers les GPU NVIDIA.
Cependant, l’Agent AI (Agentic AI) émerge rapidement. Ce type de système peut fonctionner de manière autonome en arrière-plan avec une petite quantité d'intervention manuelle. Le marché a réaffirmé la valeur du CPU. Le processeur est responsable de la planification de l'agent et de la transmission continue des données à la carte graphique. Le marché des capitaux a également saisi ce changement : depuis 2026, les cours des actions des fabricants de processeurs établis AMD et Intel se classent parmi les premiers du secteur des puces, avec des hausses respectives de 128 % et 149 % au cours de l'année, supérieures à la hausse de 8 % de Nvidia.
Ian Buck, vice-président de l'activité hyperscale de NVIDIA, a déclaré lors d'une session de partage la semaine dernière que les agents rendent le processeur « critique », « notamment en fonction de la rapidité avec laquelle le processeur traite une seule requête ».
NVIDIA estime qu'à long terme, la taille globale du marché des processeurs pour serveurs devrait atteindre 200 milliards de dollars ; Bernstein a estimé plus tôt cette année que la taille globale du marché mature des processeurs pour serveurs en 2025 atteindrait environ 37 milliards de dollars.
Wolf Research a prédit en mai que le prix moyen d'une seule puce Vera était d'environ 5 000 dollars, et Nvidia devrait en expédier 1,3 million d'unités cette année. Nvidia n'a pas commenté les rumeurs sur les prix.
L'analyste de Gartner, Kevin Knox, a déclaré qu'AMD est actuellement le principal concurrent dans le domaine des processeurs pour serveurs d'IA d'entreprise. Les données du marché montrent que la part de marché des processeurs pour serveurs d'AMD est d'environ 33 %, tandis que celle d'Intel est de 66,8 % ; cependant, la part d'AMD continue d'augmenter et est profondément liée aux grands géants du cloud.
"AMD a construit un écosystème complet autour de ses propres puces et présente des avantages significatifs." dit Knox.

Performances monocœur : un changement de cap majeur
NVIDIA a annoncé la semaine dernière que Vera était le premier processeur de serveur de la société conçu entièrement à partir du noyau. Elle est différente de la solution précédente qui utilisait la version publique du noyau d'ARM, et l'investissement en R&D est plus élevé.
Vera est spécialement conçue pour résoudre le goulot d'étranglement des scénarios d'IA intelligents ; NVIDIA affirme que face aux charges d'agents intelligents, les performances de cette puce sont 50 % supérieures à celles des puces à architecture x86 utilisées par Intel et AMD.
NVIDIA a expliqué que dans le passé, les processeurs orientés cloud d'Intel et d'AMD recherchaient généralement le nombre de cœurs, tandis que Vera est équipée de cœurs Olympus auto-développés, donnant la priorité à l'amélioration de la vitesse de calcul d'un seul cœur.
Hannah Kutander, responsable du marketing produit chez Nvidia pour Vera, a déclaré dans la présentation que la conception de la puce se concentre sur la puissance de calcul monocœur, une bande passante mémoire élevée et une faible latence, "permettant à l'agent de renvoyer les tâches au GPU le plus rapidement possible. Le GPU est une ressource extrêmement coûteuse et précieuse dans l'usine d'IA, et cette solution peut maximiser le fonctionnement à forte charge du GPU".
Nvidia peut vendre des puces Vera individuellement ou sous forme de packages complets avec ses propres GPU. Les formes de produits comprennent : une armoire complète refroidie par liquide équipée de 256 puces Vera, configuration double Vera à machine unique ; il peut également être combiné avec le GPU NVIDIA pour former la plate-forme informatique intégrée Vera Rubin pour une livraison externe.
La consommation électrique de ce processeur varie de 250 watts à 450 watts ; la puce est équipée d'une mémoire basse consommation de grande capacité (le même type de mémoire utilisé dans les téléphones mobiles et les ordinateurs portables), et une seule puce prend en charge une capacité de mémoire maximale de 1,5 To.
Certains analystes estiment que Nvidia a ouvert une nouvelle catégorie de processeurs et qu'Intel et AMD n'ont actuellement pas de concurrents équivalents. Karl Freund, fondateur de Cambrian AI Research, a déclaré que le nouveau processeur de Nvidia ne sera pas utilisé pour héberger des services de serveur traditionnels tels que les services de sites Web, mais se concentrera sur les charges de travail d'IA à haute intensité.
Mais même pour Nvidia, il reste encore du mal à convaincre les fournisseurs de cloud d’acheter de nouveaux produits.
Kutande a admis que Vera en est encore aux premiers stades de commercialisation. Dans la liste des partenaires officiels, le seul fournisseur de services de cloud public est Oracle ; parallèlement, Nvidia a révélé qu'OpenAI prévoyait de déployer les puces Vera à grande échelle à partir de ce trimestre.
Analyse de Freund : "Le processeur développé par Nvidia est destiné à briser la dépendance des clients à l'égard des processeurs Intel et AMD et à rivaliser pour ces revenus de marché. Ils ont choisi de trouver un autre moyen de créer un processeur dédié unique actuellement sur le marché."