JDWJDW
Font ResizerAa
  • Tech & Innovations
  • Mobiles & Apps
  • IA & Robotique
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Geek & Gadgets
  • Véhicules & e-Mobilité
  • Bons plans & promos
  • Plus
    • Blockchain & Crypto
    • Web & Internet
    • Informatique & Cybersécurité
    • Sciences & Espace
    • Réseaux Sociaux & Influence
    • e-Business & Webmarketing
    • Fintech & Néobanques
    • Streaming & P2P
Font ResizerAa
JDWJDW
Rechercher
  • Web & Internet
  • Tech & Innovations
  • Mobiles & Apps
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Blockchain & Crypto
  • Geek & Gadgets
  • Informatique & Cybersécurité
  • Streaming & P2P
Avez-vous déjà un compte ? Sign In
Suivez-nous
IA & Robotique

OpenAI propulse GPT-5.6 Sol à 750 tokens par seconde grâce à Cerebras et son mode Ultrafast

Marek Sobel
Published: 14 août 2026
Last updated: 14 août 2026
Partager

OpenAI a dévoilé un mode baptisé « Ultrafast » pour son modèle phare GPT-5.6 Sol, capable de sortir jusqu’à 750 tokens de sortie par seconde, soit quatorze fois la cadence du traitement standard. Derrière cette accélération vertigineuse, un partenariat avec Cerebras Systems, le fondeur californien dont l’architecture à l’échelle du wafer bouleverse les contraintes habituelles de l’inférence sur GPU.

OpenAI a accompagné l’annonce d’une vidéo officielle de présentation du mode : Ultrafast, GPT-5.6 Sol jusqu’à 14x plus vite.

Jusqu’ici, obtenir de la vitesse en temps réel imposait de sacrifier la puissance du modèle, de se rabattre sur des architectures plus légères, plus spécialisées, donc fatalement moins intelligentes. Le mode Ultrafast prétend abolir ce compromis en conservant l’intégralité des capacités cognitives de Sol tout en compressant drastiquement la latence. « GPT-5.6 Sol on Ultrafast prouve que vitesse et intelligence ne sont plus mutuellement exclusives », a déclaré Andrew Feldman, PDG et cofondateur de Cerebras, dans un communiqué qui ne manque pas de panache.

La recette pour atteindre une telle performance tient dans le Wafer-Scale Engine de Cerebras, une puce à l’échelle d’un wafer entier embarquant 44 Go de SRAM directement sur la galette de silicium. Les poids du modèle restent ainsi stockés on-chip, ce qui élimine le goulot d’étranglement classique lié à la bande passante mémoire, cette malédiction qui bride l’inférence des modèles frontières sur le matériel conventionnel. Le résultat est spectaculaire sur les benchmarks. Sur Humanity’s Last Exam (2 500 questions de niveau doctoral couvrant un large éventail de disciplines), GPT-5.6 Sol en mode Ultrafast a avalé l’intégralité du questionnaire en un peu plus de onze heures, là où Claude Fable 5 d’Anthropic en a eu besoin de plus de trois jours. Sur GDP-Val, un benchmark dédié aux tâches de travail intellectuel, l’accélération bout-en-bout atteint un facteur 5,6.

A lire également

Robot humanoïde Unitree G1 en position d'attaque kung-fu face à un client dans un magasin d'électronique, vue de vidéosurveillance
Un robot humanoïde attaque un client en magasin : sont-ils prêts à vivre parmi nous ?
Logo OpenAI avec mention IPO 2027 et courbe boursière rouge en baisse, report de l'introduction en bourse
OpenAI n’entrera pas en bourse en 2026 : Sam Altman prétexte la sécurité de l’IA
Symbole pause géant face à un essaim de noeuds IA, illustration du ralentissement des modèles frontier réclamé par Amodei, Altman et Musk
Course à l’IA : Anthropic, OpenAI et Elon Musk réclament un coup de frein d’urgence

Les cas d’usage ciblés par OpenAI dessinent une cartographie très nette des workflows professionnels où la milliseconde compte. Réponse aux incidents critiques, quand un système tombe et que les ingénieurs doivent analyser logs, traces et changements de code pendant que la panne se déroule encore. Analyse financière en temps réel, pour évaluer des signaux de marché ou détecter des transactions suspectes avant que les conditions ne se retournent. Support client vocal, où le modèle doit résoudre des problèmes complexes sans interrompre la conversation, même lorsque la réponse exige de consulter plusieurs systèmes en cascade. Et puis le commerce en ligne, ce terrain miné par l’abandon de panier, où chaque seconde d’hésitation du chatbot peut coûter une vente…

Sachin Katti, vice-président Compute Strategy & GPT-Infra chez OpenAI, a formulé l’enjeu avec une sobriété calculée. Les deux entreprises « explorent ce qui devient possible lorsque les clients peuvent obtenir l’intelligence de nos modèles les plus capables avec une latence considérablement réduite ». Derrière cette formule diplomatique se cache une offensive frontale contre Anthropic, dont le mode Fast pour Claude Opus 4.8 affiche, selon les mesures d’Artificial Analysis, une vitesse cinq fois inférieure à celle d’Ultrafast. Onze fois inférieure pour Claude Fable 5. Qui osera encore prétendre que la course aux LLM ne se joue que sur l’intelligence brute ?

OpenAI utilise déjà Ultrafast pour ses propres équipes. Les développeurs de la firme s’en servent notamment lors des alertes d’incident, pour synthétiser des conversations, valider des correctifs et réduire le délai entre l’observation d’un signal et la prise de décision. Les chercheurs, eux, voient leurs boucles expérimentales se resserrer de façon spectaculaire, passant d’un cycle « lancer le soir, lire le matin » à plusieurs itérations dans la même journée de travail.

Le mode Ultrafast est aujourd’hui accessible en preview limitée via l’API OpenAI, réservé à un groupe restreint de clients triés sur le volet. OpenAI promet d’élargir l’accès « à mesure que la capacité augmentera », une formulation qui laisse entrevoir les contraintes d’approvisionnement en puces Cerebras, du moins pour l’instant. Les entreprises intéressées peuvent d’ores et déjà s’inscrire pour être notifiées de l’ouverture progressive du service.

Quatorze fois plus vite, zéro compromis sur l’intelligence, et un fondeur de puces qui transforme un wafer entier en mémoire vive géante. Si cette promesse tient à l’échelle, la question ne sera bientôt plus de savoir quel modèle est le plus intelligent, mais lequel pense assez vite pour ne jamais faire attendre un humain.

Partager cet article
Facebook Whatsapp Whatsapp LinkedIn Reddit Telegram Copy Link

Derniers articles

Huawei Watch GT 6 Pro noire en lévitation sur fond clair, mise en valeur premium sans badge promo
La montre Huawei Watch GT 6 Pro voit son prix s’effondrer sous les 200 € avec ce code
Bons plans & promos
Press render officiel du Volvo EX60 2027, SUV électrique sur plateforme SPA3
Volvo EX60 : le SUV 100 % électrique devient moins cher que son équivalent hybride
Véhicules & e-Mobilité
Manette de jeu mobile Beats pour iPhone 18 Pro, rendu concept : manette clip-on noire avec logo b Beats et iPhone docké
Apple prépare sa propre manette iPhone sous la marque Beats et menace Backbone
Consoles & Jeux Vidéo Mobiles & Apps
Debian 13 Trixie, thème Ceratopsian officiel
Debian 13.7 Trixie : plus de 90 failles réparées et une mise à jour vitale à installer
Informatique & Cybersécurité

Tendance

Logo Anthropic avec le nom Claude au centre, concept de systèmes multi-agents IA sur fond techno sombre, illustration du rapport sur les sabotages entre agents
Les IA ont des réflexes de survie, mentent et falsifient les données : Anthropic révèle l’ampleur des sabotages dans les systèmes multi-agents
IA & Robotique
GTA 6, artwork officiel de Rockstar avec les protagonistes Lucia et Jason
GTA 6 : des vidéos de gameplay et la carte on fuité. Cette fois c’est pas de l’IA
Consoles & Jeux Vidéo
Concept d'une montre connectée Garmin mesurant la glycémie non invasive au poignet grâce à un capteur optique
Garmin dévoile un brevet pour mesurer la glycémie au poignet et relance la course contre Apple
Geek & Gadgets
Robot humanoïde type Tesla Optimus dans un hall industriel futuriste, production à grande échelle
Tesla Optimus : premières ventes repoussées à 2027, la mue spectaculaire de Fremont s’accélère
IA & Robotique
Key art Saint Seiya Tenkai-hen Then IV, le nouveau chapitre de Kurumada annoncé pour le 18 décembre
Saint Seiya Tenkai-hen Then IV : Kurumada lance le chapitre Zeus le 18 décembre
Animes & Mangas

Vous allez aussi aimer

Satellite d'observation en orbite traitant des données par IA, au-dessus de la Terre, concept du consortium franco-émirati Loft Orbital / Marlan Space
IA & RobotiqueSciences & Espace

Espace et IA : la France et les Émirats investissent 1 milliard de dollars dans 50 satellites

10 septembre 2026
Concept Siri AI : assistant bloqué sur iPhone dans l'Union européenne (DMA) avec panneau interdit, mais disponible sur Mac, bêta en octobre
IA & RobotiqueMobiles & Apps

Siri AI et Apple Intelligence : l’Europe attend encore, l’iPhone 17 partiellement incompatible

10 septembre 2026
OpenAI
IA & Robotique

OpenAI – Navier-Stokes : 10 000 agents d’IA résolvent en 4 jours une énigme mathématique de 90 ans

9 septembre 2026
Robot humanoïde XPeng IRON, premier exemplaire sorti en marchant de la ligne de production automatisée de Guangzhou
IA & Robotique

XPeng IRON : le premier humanoïde sort de l’usine en marchant, et Tesla Optimus n’a toujours rien produit

8 septembre 2026
Logo Tencent avec le nom du modèle Hy4 preview sur fond techno sombre
IA & Robotique

Tencent Hy4 preview est là : 770 milliards de paramètres pour son modèle IA open source et séduire les développeurs

8 septembre 2026
Data centre d'inférence Mistral AI, logo MISTRAL, ambition 1 GW de calcul en Europe
IA & Robotique

Mistral AI lève 3 milliards d’euros : Samsung en tête, la souveraineté européenne à prix d’or

8 septembre 2026
Tesla Optimus Gen 2 face au robot humanoïde BYD Xiao Di dans un face-à-face industriel
IA & Robotique

BYD, Xpeng, Nio : après la voiture électrique, la Chine défie Tesla Optimus avec ses robots humanoïdes

7 septembre 2026
Logo OpenAI avec le nom du modèle GPT-6 Astra, concept sombre techno fond bleu nuit
IA & Robotique

Jensen Huang proclame l’arrivée de l’AGI après le lancement de GPT-6 Astra par OpenAI

7 septembre 2026

Infos légales

  • Mentions légales
  • Politique de confidentialité
  • Nous contacter
  • Partenaires

Maj récentes

Samsung Galaxy S, One UI 9 sous Android 17 bêta, visuel concept
Galaxy S24 : la bêta 2 de One UI 9 donne un avant-goût des outils IA à venir
Mobiles & Apps
Concept : outil IA anti-arnaque d'Amazon dans Alexa, un smartphone vérifie un message suspect avec un bouclier de sécurité
Arnaque par SMS ou email : Amazon arme l’IA d’Alexa pour démasquer les faux messages
e-Business & Webmarketing
Key art officiel de Gears of War: E-Day, le logo du jeu sur fond sombre
Gears of War E-Day : le Xbox Game Pass libère le monstre sans surcoût en octobre
Consoles & Jeux Vidéo
iPhone Duo Max, concept du smartphone pliable à grand écran d'Apple, logo Apple et nom du modèle
iPhone Duo : le premier pliant d’Apple ne servait que d’éclaireur, le Duo Max arrive
Mobiles & Apps

Qui sommes nous ?

Le Journal du Web alias JDW a été fondé et est édité par des passionnés par l’univers web, nouvelles technologies et de la culture populaire.

Newsletter
Inscrivez-vous à notre newsletter pour recevoir nos derniers articles!
Suivez-nous
Welcome Back!

Sign in to your account

Username or Email Address
Password

Mot de passe oublié ?