Résumé :
OpenAI affirme que sa nouvelle puce « Jalapeno » a obtenu de meilleurs résultats lors des tests que la gamme de produits actuelle de Nvidia, soulignant les progrès réalisés par l'entreprise dans le développement de ses propres processeurs d'IA. Richard, responsable de l'activité puces OpenAI Ho a déclaré dans une interview que la puce avait été comparée au Nvidia GB300, un test considérant le GB300 comme le produit le plus avancé disponible. Lors du test, Jalapeno avait l'avantage sur deux indicateurs : la quantité de charge de travail d'IA qu'il peut gérer par unité de consommation d'énergie et la vitesse de réponse.
Lorsque OpenAI a testé publiquement Jalapeno cette fois-ci, il a utilisé son propre modèle open source plus petit, le GPT‑OSS 120B, ainsi que des modèles tiers de DeepSeek et Moonshot AI. Sur le modèle Kimi K2.5 1T de Moonshot, les avantages du Jalapeno sont encore plus évidents.

OpenAI a déclaré que lors des tests internes, Jalapeno a également obtenu de bons résultats lors de l'exécution de certains modèles avancés à grande échelle qui n'ont pas encore été publiés. Cela suggère que la conception de la puce « augmentera encore en valeur » à mesure que les charges de travail deviendront plus importantes et plus complexes.
OpenAI a collaboré avec Broadcom pour développer Jalapeno. La société prévoit d’utiliser la puce pour prendre en charge ses modèles d’IA à partir de la fin de cette année. Cela fait partie de son projet visant à construire sa propre infrastructure d’IA et à promouvoir l’auto-recherche de puces à plus grande échelle.
Broadcom produit des puces personnalisées pour de nombreux clients. Les deux sociétés ont annoncé leur coopération l'année dernière et ont vigoureusement promu la vitesse de développement de ce processeur en juin de cette année, affirmant qu'il avait été développé à une vitesse record.
Actuellement, de plus en plus d'entreprises développent des puces d'IA auto-développées, et NVIDIA domine toujours ce domaine.
Normalement, certaines puces ont plus de puissance de traitement lors de l'exécution de tâches d'IA, tandis que d'autres réagissent mieux rapidement, mais Jalapeno a le meilleur des deux mondes, a déclaré Ho.
OpenAI décidera quels modèles d'IA s'exécuteront sur Jalapeno, permettant ainsi aux clients de choisir des solutions moins coûteuses ou plus performantes en fonction de leurs besoins.
Ho a déclaré : « Lors des tests en laboratoire, Jalapeno a montré de solides performances dans le domaine du haut débit, ce qui signifie qu'il peut servir un grand nombre de clients à moindre coût ; en même temps, il a également obtenu de bons résultats dans le domaine de la faible latence, ce qui signifie que pour les clients qui apprécient la vitesse de réponse, son temps de réponse sera très, très rapide. » Pour les centres de données, l’électricité constitue l’un des coûts les plus importants.

Il convient de noter que Jalapeno n'a pas été testé avec les puces Vera Rubin de dernière génération de Nvidia, qui viennent tout juste de commencer à être expédiées. De plus, Jalapeno n'est pas conçu pour la formation de modèles d'IA, et la formation est exactement l'un des domaines dans lesquels la technologie NVIDIA est la meilleure.
Jalapeno est principalement orienté vers l'étape d'inférence de l'IA, c'est-à-dire qu'une fois la formation terminée, le modèle génère des réponses et exécute des tâches basées sur les invites de l'utilisateur. L'avantage en termes de vitesse signifie qu'OpenAI peut l'utiliser pour obtenir des effets qui, dans le passé, ne pouvaient être obtenus que par des processeurs utilisant différents types de mémoire et architectures de puces.
OpenAI s'appuie toujours sur la technologie Cerebras pour exécuter certains modèles, et ce type de puce est plus adapté aux modèles plus petits. En comparaison, Jalapeno est capable de gérer des modèles beaucoup plus grands. Ho a déclaré que la technologie d'OpenAI ne remplacerait pas des fournisseurs tels que Cerebras à court terme.
Ho a déclaré : "Notre demande en puissance de calcul est très énorme, c'est pourquoi nous avons signé des contrats avec autant de fournisseurs différents. Cette situation va perdurer pendant un certain temps." Il a déclaré qu'OpenAI espère afficher publiquement ses résultats de recherche et développement afin de promouvoir l'innovation dans le domaine des puces IA.
D'autres startups explorent des directions similaires. Etched a déclaré la semaine dernière avoir obtenu une valorisation d'environ 21 milliards de dollars lors d'un cycle de financement et avoir commencé à expédier une puce basse tension. MatX, fondée par deux anciens employés de Google Chip, développe actuellement un produit semi-conducteur avec le même objectif : combiner haut débit et faible latence.
OpenAI a également déclaré que la société utilisait son propre modèle d'IA pour accélérer le processus de développement des puces. La puce de deuxième génération est également entrée dans une phase de recherche et développement plus approfondie. Ho a déclaré que la société prévoit d'achever l'enregistrement de la puce "dans les mois à venir", date à laquelle la conception de la puce entrera dans la phase de finalisation.
Dans le même temps, OpenAI a commencé à concevoir ses puces de troisième génération, dans l'espoir de réduire davantage le coût de l'infrastructure d'IA qu'elle construit à grande échelle dans le monde. Ho a déclaré : "Nous avons maintenant atteint un niveau de coût et un niveau de consommation d'énergie qui peuvent réduire les coûts d'infrastructure. Ce n'est que la première étape."
Bien qu'OpenAI promeuve activement les puces auto-développées et compare leurs performances avec les produits NVIDIA, Ho a tout de même souligné qu'OpenAI considère toujours NVIDIA comme un fournisseur clé de puces.
"NVIDIA est un très bon partenaire, et nous devons encore utiliser beaucoup de puces NVIDIA."
Commentaires