JDWJDW
Font ResizerAa
  • Tech & Innovations
  • Mobiles & Apps
  • IA & Robotique
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Geek & Gadgets
  • Bons plans & promos
  • Plus
    • Blockchain & Crypto
    • Web & Internet
    • Informatique & Cybersécurité
    • Sciences & Espace
    • Réseaux Sociaux & Influence
    • e-Business & Webmarketing
    • Fintech & Néobanques
    • Streaming & P2P
Font ResizerAa
JDWJDW
Rechercher
  • Web & Internet
  • Tech & Innovations
  • Mobiles & Apps
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Blockchain & Crypto
  • Geek & Gadgets
  • Informatique & Cybersécurité
  • Streaming & P2P
Avez-vous déjà un compte ? Sign In
Suivez-nous
IA & Robotique

OpenAI Jalapeño : la puce d’inférence maison pulvérise les benchmarks du GB300 de Nvidia à Hot Chips 2026

Raphael Gelin
Published: 27 août 2026
Last updated: 27 août 2026
Partager
Concept : puce d'inférence Jalapeño d'OpenAI, logo officiel OpenAI avec le nom du modèle sur fond sombre techno

OpenAI a dévoilé les premiers résultats publics de Jalapeño, son ASIC d’inférence co-développé avec Broadcom, lors de la conférence Hot Chips le 25 août 2026, et les chiffres sont suffisamment agressifs pour qu’on arrête de traiter cette initiative comme un hobby de milliardaires. Sur le benchmark InferenceX de SemiAnalysis, appliqué à trois modèles ouverts (GPT-OSS 120B, DeepSeek R1, Kimi K2.5 1T), la puce affiche entre 1,5 et 1,9 fois plus de travail IA par watt au pic de débit que les GPU GB200/GB300, et une latence de bout en bout 1,7 à 3,6 fois inférieure. Quand on pousse les workloads très interactifs, l’écart se creuse encore avec un ratio de 2,1 à 4,1x en performance pure.

La fiche technique du Jalapeño ressemble à un manifeste contre le gaspillage énergétique des GPU géants. Gravée en 3 nm chez TSMC, la puce embarque 6 piles HBM4 totalisant 216 GiB de mémoire (environ 50 % de plus par watt que le GB300) et délivre un débit mémoire avoisinant les 15 TB/s. Son enveloppe thermique est officiellement fixée à 700 W, alors que les mesures en fonctionnement continu plafonnent à 550 W, soit la moitié du budget thermique d’un GB300 coté à 1 400 W. Aux points de latence les plus bas, Tom’s Hardware rapporte des ratios de débit par kilowatt allant de 8,6x à 104,3x face aux réglages les plus rapides du concurrent vert. On peut discuter la méthodologie… mais pas ignorer l’ordre de grandeur.

Neuf mois séparent le début du design du tapeout, un calendrier que l’équipe de Richard Ho, VP hardware chez OpenAI, attribue en partie à l’utilisation intensive de l’IA dans le processus de conception. La génération 2 serait déjà proche du tapeout et la troisième en phase de design actif, ce qui signifie qu’OpenAI ne mise pas sur un prototype vitrine mais sur une cadence industrielle calquée sur celle que Nvidia impose depuis une décennie.

Pourquoi, alors, Sam Altman continue-t-il de signer des chèques pharaoniques à Jensen Huang ? Parce que Jalapeño est un chip d’inférence, conçu exclusivement pour servir des réponses, pas pour entraîner les modèles monstres qui justifient l’existence même d’OpenAI. L’entraînement reste le territoire quasi-monopolistique de Nvidia, et Richard Ho l’a rappelé à Bloomberg avec une franchise désarmante « Nvidia est un très bon partenaire, et nous continuons d’avoir besoin de beaucoup de Nvidia ». Une déclaration qui prend tout son relief quand on sait que Nvidia a accepté, à peine dix jours plus tôt, de garantir jusqu’à 105 milliards de dollars de financement pour les datacenters qu’OpenAI construit dans l’Ohio.

A lire également

GLM-5.3-Flash, modèle multimodal open source de Z.ai, concept sur fond techno sombre
GLM-5.3-Flash : Z.ai lâche dans la nature un monstre multimodal de 320 milliards de paramètres sous licence MIT
Robotaxi Waymo de nuit sur le Strip de Las Vegas, avec logo Waymo
Waymo dévoile sa puce 5nm taillée pour le temps réel et lance ses robotaxis sur Las Vegas, San Diego et au-delà
Concept : logo officiel NVIDIA sur fond techno sombre, réseaux neuronaux et GPU, illustration de l'investissement de 6 milliards de dollars dans Poolside pour un modèle open-weight rival d'OpenAI et DeepSeek
Nvidia s’offre la technologie de Poolside pour 6 milliards de dollars et part en guerre ouverte contre OpenAI et DeepSeek

L’absence la plus éloquente de cette présentation reste la plateforme Vera Rubin, la prochaine architecture de Nvidia attendue en 2026-2027 et taillée pour dominer l’inférence autant que l’entraînement. Comparer Jalapeño au GB300 revient à affronter le champion sortant plutôt que le challenger qui s’échauffe en coulisses, ce qui rend les benchmarks impressionnants sur le papier mais stratégiquement incomplets. OpenAI prévoit de déployer sa puce dans ses propres datacenters d’ici fin 2026, un horizon qui coïncide précisément avec la montée en puissance de Vera Rubin.

La leçon de fond dépasse la guerre des specs entre deux géants californiens qui dorment dans le même lit financier. Chaque hyperscaler, de Google (TPU) à Amazon (Trainium) en passant désormais par OpenAI, fabrique ses propres puces d’inférence pour la même raison triviale qui pousse un restaurateur à cultiver ses propres tomates quand il en consomme dix tonnes par semaine. L’inférence, c’est le coût opérationnel permanent de l’IA générative, et réduire ce coût de moitié par watt vaut des milliards en marge annuelle. Jalapeño ne libère pas OpenAI de Nvidia, il rend la dépendance soutenable, ce qui est peut-être encore plus redoutable pour Jensen Huang que ne le serait une rupture franche.

Partager cet article
Facebook Whatsapp Whatsapp LinkedIn Reddit Telegram Copy Link

Derniers articles

Logo officiel PayPal intégré à un concept financier de rachat par Stripe et Advent
PayPal dans le viseur de Stripe et Advent pour un rachat à 53 milliards de dollars
Fintech & Néobanques
PlayStation Plus Monthly Games de septembre 2026 : Sniper Elite Resistance, MLB The Show 26 et Wobbly Life
PlayStation Plus septembre 2026 : Sniper Elite Resistance, MLB The Show 26, Wobbly Life et Chained Echoes offerts aux abonnés
Consoles & Jeux Vidéo
Concept cyberattaque d'État : le Capitole et la Réserve fédérale américains reliés par un réseau rouge de données, cadenas numérique, illustrant la campagne de cyberespionnage chinois
Espionnage chinois aux États-Unis : des hackers ont ciblé le DOJ, la NASA, la Fed et le Sénat pendant huit ans
Informatique & Cybersécurité
Samsung Galaxy Watch 8 avec l'interface One UI 9 Watch sur fond bleu nuit, programme bêta de Wear OS 7
One UI 9 Watch : la bêta officielle de Wear OS 7 débarque enfin sur les Galaxy Watch 8
Geek & Gadgets

Tendance

Logo Anthropic avec le nom Claude au centre, concept de systèmes multi-agents IA sur fond techno sombre, illustration du rapport sur les sabotages entre agents
Les IA ont des réflexes de survie, mentent et falsifient les données : Anthropic révèle l’ampleur des sabotages dans les systèmes multi-agents
IA & Robotique
GTA 6, artwork officiel de Rockstar avec les protagonistes Lucia et Jason
GTA 6 : des vidéos de gameplay et la carte on fuité. Cette fois c’est pas de l’IA
Consoles & Jeux Vidéo
Concept d'une montre connectée Garmin mesurant la glycémie non invasive au poignet grâce à un capteur optique
Garmin dévoile un brevet pour mesurer la glycémie au poignet et relance la course contre Apple
Geek & Gadgets
Rendu concept de la première smartwatch transparente Nothing
Nothing prépare sa première smartwatch transparente pour septembre 2026, sous les 300 dollars
Geek & Gadgets
Robot humanoïde type Tesla Optimus dans un hall industriel futuriste, production à grande échelle
Tesla Optimus : premières ventes repoussées à 2027, la mue spectaculaire de Fremont s’accélère
IA & Robotique

Vous allez aussi aimer

Manifeste The Future is for Everyone de Mark Zuckerberg pour une IA libre et ouverte, symbole infini Meta sur fond techno bleu nuit
IA & Robotique

Mark Zuckerberg lance un manifeste de 6 500 mots pour une superintelligence personnelle offerte à chaque humain

23 août 2026
Concept : racks de serveurs IA Nvidia avec GPU et mémoire HBM dans un data center, éclairage LED vert, illustration de la hausse des prix des accélérateurs IA
IA & Robotique

Nvidia alerte ses clients : les serveurs IA vont coûter plus de 15 % plus cher début 2027

23 août 2026
Robots humanoïdes en pleine course sur la piste de 100 mètres lors des World Humanoid Robot Games de Pékin, où le robot Lightning d'Honor a pulvérisé le record d'Usain Bolt en 9,32 secondes
IA & Robotique

Un robot pulvérise le record du 100 mètres d’Usain Bolt aux Jeux mondiaux de robots humanoïdes de Pékin

23 août 2026
Robot humanoïde exposé dans les allées de la World Robot Conference 2026 à Pékin
IA & Robotique

World Robot Conference 2026 : Pékin déroule le tapis rouge à plus de 300 entreprises et affirme sa suprématie sur les humanoïdes

21 août 2026
Logo MiniMax avec le nom du studio MiniMax Design sur fond techno abstrait sombre
IA & Robotique

MiniMax Design transforme le modèle vidéo H3 en studio de production agentique

21 août 2026
Robot humanoïde Unitree Superman en plein saut de deux mètres, visuel officiel du fabricant
IA & Robotique

Unitree enflamme le Star Market de Shanghai : l’IPO du robot acrobate s’envole de plus de 600 %

19 août 2026
Concept d'un réseau de neurones lumineux ascendant, modèle open-weight GLM-5.3 de Z.ai
IA & Robotique

GLM-5.3 : Z.ai lâche son modèle open-weight au prix de la version précédente et talonne Kimi K3 au sommet des classements

19 août 2026
Visuel officiel OpenAI : contrôles parentaux de ChatGPT pour les 13-17 ans, avec comptes liés, Quiet hours et Study Mode
IA & Robotique

ChatGPT ouvre ses portes aux ados : OpenAI déploie un arsenal de contrôles parentaux pour les 13-17 ans

19 août 2026

Infos légales

  • Mentions légales
  • Politique de confidentialité
  • Nous contacter
  • Partenaires

Maj récentes

GTA 6, artwork officiel de Rockstar avec les protagonistes Lucia et Jason
GTA 6 : Rockstar perd le contrôle de son propre jeu à trois mois de la sortie
Consoles & Jeux Vidéo
Tesla Model Y
Tesla Model Y : Prix, performances, autonomie… Tout savoir sur le SUV électrique
Tech & Innovations
Concept iOS 27 bêta 7 : grand carré glassmorphism centré avec le chiffre 27 et bêta 7 en dessous, sur fond dégradé indigo à cyan
iOS 27 bêta 7, macOS Golden Gate, Siri IA sur liste d’attente : Apple accélère à deux semaines de la keynote
Mobiles & Apps
Interface WhatsApp Passkeys affichant plusieurs clés d'accès enregistrées sur un même compte
WhatsApp autorise désormais plusieurs passkeys par compte, le milliard d’utilisateurs n’attendait que ça
Mobiles & Apps

Qui sommes nous ?

Le Journal du Web alias JDW a été fondé et est édité par des passionnés par l’univers web, nouvelles technologies et de la culture populaire.

Newsletter
Inscrivez-vous à notre newsletter pour recevoir nos derniers articles!
Suivez-nous
Welcome Back!

Sign in to your account

Username or Email Address
Password

Mot de passe oublié ?