DERNIÈRES NOUVELLES
SÉLECTIONNÉ POUR VOUS

OpenAI lance la puce Jalapeño et revendique une importante performance avec la Nvidia GB300

ParHannah CollymoreHannah Collymore 2 minutes de lecture
OpenAI lance la puce Jalapeño et revendique une importante performance avec la Nvidia GB300
  • OpenAI a publié mardi les premiers résultats de référence pour Jalapeño, sa puce d'inférence construite par Broadcom.
  • L'entreprise affirme que la puce offre jusqu'à 1,9 fois plus de rendement par watt et une latence jusqu'à 3,6 fois inférieure à celle des systèmes GB200 et GB300 de Nvidia sur trois modèles ouverts.
  • Cette puce est destinée à l'usage interne d'OpenAI et sera déployée en petites quantités d'ici fin 2026.

OpenAI a publié ses premiers résultats de référence pour Jalapeño, sa puce d'inférence interne construite avec Broadcom.

L'entreprise affirme que la puce effectue plus de tâches d'IA par watt et fournit des réponses plus rapidement que les systèmes rack Nvidia GB200 et GB300 avec lesquels elle a été comparée.

Quelles sont les performances de la nouvelle puce d'OpenAI ?

OpenAI a publié les résultats de tests de performance de sa nouvelle puce d'IA interne, Jalapeño. La puce a été testée avec InferenceX, un outil de test public de SemiAnalysis qui mesure l'ensemble du processus de traitement d'une requête d'IA, et sur les architectures GPT-OSS 120B d'OpenAI, R1 670B de DeepSeek et Kimi K2.5 1T de Moonshot AI.

OpenAI a déclaré que sa nouvelle puce effectuait 1,5 à 1,9 fois plus de travail par unité d'électricité que les autres systèmes testés. Elle répondait également aux requêtes 1,7 à 3,6 fois plus rapidement.

Pour les tâches les plus pratiques qui nécessitent de nombreux allers-retours, l'écart s'est creusé, atteignant entre 2,1 et 4,1 fois mieux.

Richard Ho, vice-présidentdentdu matériel chez OpenAI, a déclaré aux journalistes que la puce traite plus de travail simultanément et répond également plus rapidement, ce que la plupart des puces ne peuvent pas faire en même temps.

Les points de comparaison étaient les superpuces GB200 et GB300 de Nvidia, qui représentaient alors les meilleurs résultats enregistrés par InferenceX. Sur le modèle le plus imposant testé, Kimi K2.5, OpenAI a indiqué que Jalapeño atteignait environ 1,5 fois les performances de pointe par watt et une latence 3,4 fois inférieure.

Il n'y a pas de marché de location, pas de type d'instance et aucun projet de commercialisation de Jalapeno. Interrogé sur la possibilité pour OpenAI de proposer la puce à d'autres, Ho a déclaré que l'entreprise « peinait à disposer de suffisamment » de puissance de calcul pour ses propres besoins.

OpenAI dispose du budget et de l'espace nécessaires, mais sa limitation actuelle réside dans la puissance des centres de données plutôt que dans le budget ou l'espace disponible, ce qui fait du nombre de jetons par mégawatt l'indicateur déterminant.

L'inférence s'exécute en continu sur ChatGPT et l'API ; par conséquent, la réduction de la consommation d'énergie par jeton a un impact considérable à l'échelle d'OpenAI. La puce est conçue pour une consommation de 700 watts, mais elle a été maintenue à 550 watts ou moins lors des tests de charge de travail.

Cette puce s'inscrit dans le cadre de l'accord conclu en octobre 2025 entre OpenAI et Broadcom pour déployer 10 gigawatts d'accélérateurs conçus par OpenAI d'ici 2029. Cryptopolitan avait rapporté les premières esquisses de ce partenariat.

OpenAI va-t-elle passer à l'utilisation exclusive de ses propres puces ?

Lors du salon Hot Chips, Ho a indiqué qu'OpenAI déploierait la puce par grappes de 128, chaque grappe complète pouvant exécuter 2 048 ASIC. Un déploiement de 128 puces offre une puissance de calcul de 1,7 exaflops sur 4 bits et 27,5 téraoctets de mémoire HBM4, chaque module disposant d'une bande passante mémoire de 15,4 téraoctets par seconde.

OpenAI a déclaré avoir utilisé ses propres modèles pour accélérer le développement de Jalapeno, passant de la conception à la fabrication en seulement neuf mois. Ho a ajouté qu'une version de deuxième génération est « en développement avancé » et qu'une troisième est en cours d'élaboration.

Malgré ces performances annoncées, OpenAI ne remplace pas son parc de GPU. Ho a décrit Jalapeño comme un élément d'une stratégie de calcul qui s'appuie toujours sur d'excellents partenaires comme Nvidia et Cerebras. Le déploiement de la puce devrait débuter en petites quantités d'ici fin 2026, avant une montée en puissance progressive tout au long de 2027.

Il est à noter que tous les chiffres proviennent d'OpenAI ; SemiAnalysis a vérifié en personne les exécutions d'InferenceX, mais n'a pas exécuté la suite complète ni vu les résultats d'AgentX.

Ne vous contentez pas de lire les actualités crypto. Comprenez-les. Abonnez-vous à notre newsletter. C'est gratuit.

FAQ

Qu'est-ce que la puce Jalapeño d'OpenAI ?

Jalapeño est la première puce personnalisée d'OpenAI, un ASIC dédié à l'inférence, conçu en partenariat avec Broadcom et destiné à exécuter des modèles entraînés plutôt qu'à les entraîner.

Comment Jalapeño se compare-t-il aux puces Nvidia ?

Sur le benchmark InferenceX, OpenAI a déclaré que Jalapeño fournissait 1,5 à 1,9 fois plus de travail d'IA par watt et une latence 1,7 à 3,6 fois inférieure à celle des systèmes GB200 et GB300 de Nvidia sur GPT-OSS 120B, DeepSeek R1 et Kimi K2.5.

D'autres entreprises peuvent-elles acheter ou louer Jalapeño ?

Non. OpenAI ne vend pas la puce et n'a pas de marché de location pour celle-ci ; le vice-président Richard Ho a déclaré que l'entreprise a besoin de toute la puissance de calcul pour elle-même, donc Jalapeño ne sert que le trafic propre à OpenAI.

Partagez cet article
Hannah Collymore

Hannah Collymore

Hannah est rédactrice et éditrice, forte d'une expérience de près de dix ans dans la rédaction de blogs et la couverture d'événements liés aux cryptomonnaies. Chez Cryptopolitan, elle contribue à la page d'actualités en rédigeant des articles et en analysant les dernières évolutions de la finance décentralisée DeFi, des comptes gérés par les utilisateurs (RWA), de la réglementation des cryptomonnaies, de l'intelligence artificielle (IA) et des technologies de pointe. Elle est diplômée en administration des affaires de l'université Arcadia.

PLUS D'ACTUALITÉS