OpenAI dévoile son propre processeur Jalapeño : un accélérateur 1,5 à 2 fois plus efficace que Nvidia

cryptonews.ruPublié le 2026-08-30Dernière mise à jour le 2026-08-30

Résumé

OpenAI a dévoilé les premiers résultats de test de son accélérateur d'inférence maison, Jalapeño. Sur le benchmark InferenceX, il surpasse les systèmes Nvidia GB200/GB300, offrant 1,5 à 1,9 fois plus de calcul par watt et réduisant la latence de 1,7 à 3,6 fois. Conçu pour sa charge de travail spécifique (ChatGPT, API...), ce chip de 700W vise à réduire drastiquement le coût par requête. Développé en neuf mois avec Broadcom et Celestica, Jalapeño s'inscrit dans un accord de déploiement de 10 GW d'ici fin 2029. OpenAI conserve sa chaîne d'approvisionnement externe pour l'entraînement et une partie de l'inférence, mais reprend le contrôle architectural sur son flux de calcul principal. Cette stratégie économique permet d'éviter la marge commerciale des GPU universels, comme ceux de Nvidia (71,1% de marge brute en 2026), transformant ces coûts en économies et capacité interne. Cependant, elle comporte des risques : la spécialisation pourrait limiter la flexibilité face aux évolutions futures des modèles d'IA, et la dépendance à des partenaires de fabrication crée un point de vulnérabilité.

OpenAI a publié le 25 août 2026 les premiers résultats des tests de son propre accélérateur d'inférence Jalapeño. Sur le benchmark public InferenceX de SemiAnalysis, les systèmes équipés de la nouvelle puce ont montré 1,5 à 1,9 fois plus de calculs par watt en débit de pointe et ont réduit la latence de réponse de 1,7 à 3,6 fois par rapport aux systèmes basés sur Nvidia GB200 et GB300. Les tests ont été effectués sur les modèles GPT-OSS-120B, DeepSeek R1 et Kimi K2.5. Pour une entreprise qui sert quotidiennement un énorme flux de requêtes via ChatGPT, Codex et sa propre API, de telles performances sont directement liées au coût unitaire de chaque réponse.

La puce est conçue pour une puissance nominale de 700 W, mais la consommation soutenue sous les charges testées est restée à un niveau allant jusqu'à 550 W. Un rack de 128 Jalapeño annonce 1,7 exaflops de calcul en format 4 bits.

Où s'arrête l'indépendance vis-à-vis de Nvidia

Jalapeño a été développé en partenariat : Broadcom était responsable de la réalisation du silicium et de la partie réseau, Celestica des cartes et des racks. Neuf mois se sont écoulés entre le début de la conception et le transfert du design à la production. Le déploiement de la puce dans l'infrastructure d'OpenAI est prévu pour fin 2026, et Jalapeño constituera la première génération d'une plateforme pluriannuelle appelée à s'étendre.

L'accélérateur universel de Nvidia doit servir un large éventail de clients et de types de tâches. Jalapeño, quant à lui, est conçu pour la charge de travail spécifique qu'OpenAI génère elle-même, mesure et peut modifier en même temps que sa pile logicielle – autour de ses propres modèles de langage, cœurs de calcul, mouvement des données, mémoire et échange réseau.

Une échelle fixée à 10 GW

La base de tout le programme est l'accord entre OpenAI et Broadcom, par lequel les parties se sont engagées au déploiement de 10 GW d'accélérateurs de conception propre d'OpenAI. L'installation des racks débutera dans la seconde moitié de 2026 et se prolongera jusqu'à fin 2029. À une telle puissance, la différence en watts et en millisecondes cesse d'être une caractéristique de laboratoire pour devenir un poste de dépenses en électricité, refroidissement, mémoire, réseau, racks et surface de centres de données.

OpenAI ne renonce pas pour autant complètement aux fournisseurs externes :

  • l'entraînement des modèles de pointe nécessite toujours des accélérateurs externes ;
  • la production en série de Jalapeño dépend de partenaires pour la fabrication, la mémoire, l'encapsulation et l'assemblage ;
  • l'entreprise continuera d'utiliser largement les puces de Nvidia et d'autres fournisseurs – tant pour l'entraînement que pour une partie de l'inférence.

La limite du projet est donc claire : OpenAI conserve une chaîne d'approvisionnement externe, mais s'approprie l'architecture matérielle pour son plus grand flux quotidien de calculs.

L'économie de l'inférence

La différence entre une puce propriétaire et l'achat de GPU va au-delà de la consommation énergétique. Nvidia a clôturé l'exercice 2026 avec un chiffre d'affaires de 215,9 milliards de dollars et une marge brute de 71,1 %, et son segment 'datacenter' a cru de 68 % en glissement annuel – ces données sont reflétées dans ses déclarations auprès de la SEC (Securities and Exchange Commission). L'acheteur de GPU paie non seulement l'équipement, mais aussi la marge commerciale du fournisseur par-dessus.

OpenAI conçoit la puce comme un composant interne de son propre service et bénéficie de la réduction du coût total de traitement d'une requête, même sans marge commerciale distincte sur le processeur lui-même. Une partie du coût qui revenait auparavant au fournisseur d'accélérateurs universels, l'entreprise tente de la transformer en économie propre et en capacité de calcul supplémentaire.

Une inférence moins chère et plus rapide permet d'exécuter plus longtemps des tâches d'agents, de servir plus de requêtes parallèles et de réduire le coût des produits sans croissance proportionnelle du nombre de centres de données. L'augmentation de l'utilisation du service, à son tour, accroît la charge de la plateforme propriétaire et rend la génération suivante de puces spécialisées plus économiquement justifiée.

Jalapeño change la position d'OpenAI dans la chaîne d'infrastructure de l'IA : l'entreprise contrôlait déjà le modèle, la pile logicielle et le produit, et acquiert désormais le contrôle sur l'architecture du processeur, dont dépend le prix de la réponse. Nvidia conserve le marché de l'entraînement des modèles et des accélérateurs universels, mais le segment de travail le plus massif d'OpenAI cesse d'être une vente garantie pour elle.

L'avis de l'IA

D'un point de vue d'analyse de données automatisée, le cas Jalapeño répète la trajectoire qu'ont déjà suivie d'autres leaders du secteur avant OpenAI. Anthropic s'est engagée sur un million de TPU auprès de Google dès octobre 2025, et Midjourney a transféré la génération d'images sur les TPU de Google Cloud pour des raisons d'économie. La logique générale est la même : les hyperscalers s'éloignent des GPU universels vers des puces adaptées à leur propre charge dès que le volume d'inférence devient suffisamment prévisible et massif.

Cette stratégie comporte aussi un revers. La spécialisation pour un modèle et une pile spécifiques réduit la flexibilité en cas de changement d'architectures d'IA, et la dépendance envers Broadcom et Celestica pour la production crée un point de risque unique sur tout le cycle de développement de neuf mois. Jalapeño restera-t-il compétitif après deux ou trois générations de modèles, ou l'optimisation étroite pour l'inférence d'aujourd'hui deviendra-t-elle une limitation demain ?

Cryptos en tendance

Questions liées

QQuels sont les principaux avantages du nouveau chip d'inférence d'OpenAI, Jalapeño, par rapport aux solutions Nvidia (GB200/GB300) d'après les tests ?

AD'après les tests publics InferenceX de SemiAnalysis, les systèmes équipés du nouveau chip Jalapeño ont montré une efficacité de 1,5 à 1,9 fois supérieure en termes de calculs par watt à débit de pointe et ont réduit la latence de réponse de 1,7 à 3,6 fois par rapport aux systèmes basés sur Nvidia GB200 et GB300.

QQuelle est la puissance nominale du chip Jalapeño et quelle est la puissance de calcul déclarée pour un bloc de 128 unités ?

ALe chip Jalapeño est conçu pour une puissance nominale de 700 watts. Un bloc composé de 128 unités Jalapeño est annoncé pour fournir 1,7 exaflops de calculs au format 4 bits.

QQuels partenaires d'OpenAI ont participé au développement de Jalapeño et quel était leur rôle ?

ALe développement de Jalapeño a été une collaboration avec Broadcom, chargée de la réalisation du cristal et de la partie réseau, et Celestica, responsable des cartes et des baies.

QQuel est l'enjeu financier majeur pour OpenAI derrière le développement de son propre chip d'inférence ?

AL'enjeu financier majeur est de réduire le coût complet de traitement de chaque requête. En ayant son propre chip optimisé pour sa charge de travail spécifique, OpenAI évite de payer la marge commerciale importante de fournisseurs comme Nvidia (dont la marge brute était de 71,1% en 2026), transformant cette partie du coût en économie interne et en capacité de calcul supplémentaire.

QSelon l'analyse de l'article, quels sont les principaux risques et limites associés à la stratégie de chip propriétaire d'OpenAI ?

ALes principaux risques et limites sont : 1) Une perte de flexibilité en cas de changement d'architecture d'IA, car le chip est spécialisé pour une charge de travail et un stack logiciel spécifiques. 2) Une dépendance vis-à-vis de partenaires comme Broadcom et Celestica pour la production, créant un point de risque unique sur le cycle de développement de neuf mois. 3) La question de savoir si l'optimisation étroite pour l'inférence actuelle deviendra une limitation dans 2-3 générations de modèles.

Lectures associées

La Schnabel de la BCE déclare que l'argent des banques centrales « doit migrer vers la blockchain »

Isabel Schnabel de la BCE a déclaré que la monnaie des banques centrales "doit migrer vers la blockchain", marquant un changement notable dans le discours de l'institution. Elle a souligné que les stablecoins privés manquent d'une capacité indépendante à fournir des liquidités en période de stress, un rôle que seule une banque centrale peut remplir. La solution réside dans la tokenisation, qui pourrait rendre les transactions plus rapides, sécurisées et programmables, à condition que la monnaie de banque centrale circule sur les mêmes "rails" que les autres actifs tokenisés. La BCE lance le projet Pontes en septembre comme première étape. Il synchronisera initialement son infrastructure de paiement TARGET avec les plates-formes DLT du marché, avant d'évoluer vers des règlements définitifs sur une DLT gérée par l'Eurosystème, avec des contrats intelligents et un fonctionnement 24h/24. Le projet à long terme, nommé Appia, vise à établir d'ici 2028 l'architecture, les normes et le cadre juridique pour un véritable marché européen d'actifs tokenisés. Des tests ont déjà traité 1,6 milliard d'euros, et la BCE accepte désormais certains actifs basés sur la DLT comme collatéral. Cette évolution dépasse l'Europe. Elle légitime l'infrastructure blockchain et montre que les discussions sur l'avenir de la finance, suivies par les marchés cryptos, sont maintenant au cœur des réflexions des banques centrales, soucieuses de ne pas être contournées par la tokenisation privée.

cryptonews.ruIl y a 1 h

La Schnabel de la BCE déclare que l'argent des banques centrales « doit migrer vers la blockchain »

cryptonews.ruIl y a 1 h

Trading

Spot

Articles tendance

Comment acheter CHIP

Bienvenue sur HTX.com ! Nous vous permettons d'acheter USD.AI (CHIP) de manière simple et pratique. Suivez notre guide étape par étape pour commencer votre parcours crypto.Étape 1 : Création de votre compte HTXUtilisez votre adresse e-mail ou votre numéro de téléphone pour ouvrir un compte sur HTX gratuitement. L'inscription se fait en toute simplicité et débloque toutes les fonctionnalités.Créer mon compteÉtape 2 : Choix du mode de paiement (rubrique Acheter des cryptosCarte de crédit/débit : utilisez votre carte Visa ou Mastercard pour acheter instantanément USD.AI (CHIP).Solde :utilisez les fonds du solde de votre compte HTX pour trader en toute simplicité.Prestataire tiers :pour accroître la commodité d'utilisation, nous avons ajouté des modes de paiement populaires tels que Google Pay et Apple Pay.P2P :tradez directement avec d'autres utilisateurs sur HTX.OTC (de gré à gré) : nous offrons des services personnalisés et des taux de change compétitifs aux traders.Étape 3 : stockage de vos USD.AI (CHIP)Après avoir acheté vos USD.AI (CHIP), stockez-les sur votre compte HTX. Vous pouvez également les envoyer ailleurs via un transfert sur la blockchain ou les utiliser pour trader d'autres cryptos.Étape 4 : tradez des USD.AI (CHIP)Tradez facilement USD.AI (CHIP) sur le marché Spot de HTX. Il vous suffit d'accéder à votre compte, de sélectionner la paire de trading, d'exécuter vos trades et de les suivre en temps réel. Nous offrons une expérience conviviale aux débutants comme aux traders chevronnés.

1.2k vues totalesPublié le 2026.04.21Mis à jour le 2026.06.02

Comment acheter CHIP

Discussions

Bienvenue dans la Communauté HTX. Ici, vous pouvez vous tenir informé(e) des derniers développements de la plateforme et accéder à des analyses de marché professionnelles. Les opinions des utilisateurs sur le prix de CHIP (CHIP) sont présentées ci-dessous.

活动图片