JDWJDW
Font ResizerAa
  • Tech & Innovations
  • Mobiles & Apps
  • IA & Robotique
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Bons plans & promos
  • Plus
    • Blockchain & Crypto
    • Web & Internet
    • Geek & Gadgets
    • Informatique & Cybersécurité
    • Sciences & Espace
    • Réseaux Sociaux & Influence
    • e-Business & Webmarketing
    • Fintech & Néobanques
    • Streaming & P2P
Font ResizerAa
JDWJDW
Rechercher
  • Web & Internet
  • Tech & Innovations
  • Mobiles & Apps
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Blockchain & Crypto
  • Geek & Gadgets
  • Informatique & Cybersécurité
  • Streaming & P2P
Avez-vous déjà un compte ? Sign In
Suivez-nous
IA & Robotique

OpenAI propulse GPT-5.6 Sol à 750 tokens par seconde grâce à Cerebras et son mode Ultrafast

Marek Sobel
Published: 14 août 2026
Last updated: 14 août 2026
Partager

OpenAI a dévoilé un mode baptisé « Ultrafast » pour son modèle phare GPT-5.6 Sol, capable de sortir jusqu’à 750 tokens de sortie par seconde, soit quatorze fois la cadence du traitement standard. Derrière cette accélération vertigineuse, un partenariat avec Cerebras Systems, le fondeur californien dont l’architecture à l’échelle du wafer bouleverse les contraintes habituelles de l’inférence sur GPU.

OpenAI a accompagné l’annonce d’une vidéo officielle de présentation du mode : Ultrafast, GPT-5.6 Sol jusqu’à 14x plus vite.

Jusqu’ici, obtenir de la vitesse en temps réel imposait de sacrifier la puissance du modèle, de se rabattre sur des architectures plus légères, plus spécialisées, donc fatalement moins intelligentes. Le mode Ultrafast prétend abolir ce compromis en conservant l’intégralité des capacités cognitives de Sol tout en compressant drastiquement la latence. « GPT-5.6 Sol on Ultrafast prouve que vitesse et intelligence ne sont plus mutuellement exclusives », a déclaré Andrew Feldman, PDG et cofondateur de Cerebras, dans un communiqué qui ne manque pas de panache.

La recette pour atteindre une telle performance tient dans le Wafer-Scale Engine de Cerebras, une puce à l’échelle d’un wafer entier embarquant 44 Go de SRAM directement sur la galette de silicium. Les poids du modèle restent ainsi stockés on-chip, ce qui élimine le goulot d’étranglement classique lié à la bande passante mémoire, cette malédiction qui bride l’inférence des modèles frontières sur le matériel conventionnel. Le résultat est spectaculaire sur les benchmarks. Sur Humanity’s Last Exam (2 500 questions de niveau doctoral couvrant un large éventail de disciplines), GPT-5.6 Sol en mode Ultrafast a avalé l’intégralité du questionnaire en un peu plus de onze heures, là où Claude Fable 5 d’Anthropic en a eu besoin de plus de trois jours. Sur GDP-Val, un benchmark dédié aux tâches de travail intellectuel, l’accélération bout-en-bout atteint un facteur 5,6.

Les cas d’usage ciblés par OpenAI dessinent une cartographie très nette des workflows professionnels où la milliseconde compte. Réponse aux incidents critiques, quand un système tombe et que les ingénieurs doivent analyser logs, traces et changements de code pendant que la panne se déroule encore. Analyse financière en temps réel, pour évaluer des signaux de marché ou détecter des transactions suspectes avant que les conditions ne se retournent. Support client vocal, où le modèle doit résoudre des problèmes complexes sans interrompre la conversation, même lorsque la réponse exige de consulter plusieurs systèmes en cascade. Et puis le commerce en ligne, ce terrain miné par l’abandon de panier, où chaque seconde d’hésitation du chatbot peut coûter une vente…

A lire également

Concept : logo officiel OpenAI avec une courbe de croissance boursière ascendante et un signe dollar, évoquant l'IPO
OpenAI franchit les 40 milliards de dollars de revenus annualisés et fonce vers une IPO à mille milliards
Logo Google Gemini avec le nom du modèle Gemini 3.7 Flash, fond techno sombre
Google lance Gemini 3.7 Flash et baisse son tarif par rapport à son prédécesseur
Robot humanoïde Samsung, rendu concept sur fond bleu aux couleurs de la marque
Samsung mise sur ses moteurs de lave-linge pour fabriquer un robot humanoïde à prix cassé

Sachin Katti, vice-président Compute Strategy & GPT-Infra chez OpenAI, a formulé l’enjeu avec une sobriété calculée. Les deux entreprises « explorent ce qui devient possible lorsque les clients peuvent obtenir l’intelligence de nos modèles les plus capables avec une latence considérablement réduite ». Derrière cette formule diplomatique se cache une offensive frontale contre Anthropic, dont le mode Fast pour Claude Opus 4.8 affiche, selon les mesures d’Artificial Analysis, une vitesse cinq fois inférieure à celle d’Ultrafast. Onze fois inférieure pour Claude Fable 5. Qui osera encore prétendre que la course aux LLM ne se joue que sur l’intelligence brute ?

OpenAI utilise déjà Ultrafast pour ses propres équipes. Les développeurs de la firme s’en servent notamment lors des alertes d’incident, pour synthétiser des conversations, valider des correctifs et réduire le délai entre l’observation d’un signal et la prise de décision. Les chercheurs, eux, voient leurs boucles expérimentales se resserrer de façon spectaculaire, passant d’un cycle « lancer le soir, lire le matin » à plusieurs itérations dans la même journée de travail.

Le mode Ultrafast est aujourd’hui accessible en preview limitée via l’API OpenAI, réservé à un groupe restreint de clients triés sur le volet. OpenAI promet d’élargir l’accès « à mesure que la capacité augmentera », une formulation qui laisse entrevoir les contraintes d’approvisionnement en puces Cerebras, du moins pour l’instant. Les entreprises intéressées peuvent d’ores et déjà s’inscrire pour être notifiées de l’ouverture progressive du service.

Quatorze fois plus vite, zéro compromis sur l’intelligence, et un fondeur de puces qui transforme un wafer entier en mémoire vive géante. Si cette promesse tient à l’échelle, la question ne sera bientôt plus de savoir quel modèle est le plus intelligent, mais lequel pense assez vite pour ne jamais faire attendre un humain.

Partager cet article
Facebook Whatsapp Whatsapp LinkedIn Reddit Telegram Copy Link

Derniers articles

One UI 9.5, interface glass sur Galaxy S26 Samsung - captures d'écran fuitées
One UI 9.5 : les premières captures fuitées sur Galaxy S26 dévoilent un redesign « glass » spectaculaire et une app Phone dopée à l’IA
Mobiles & Apps
Concept illustrant le malware macOS AmnesiaStealer qui détourne les sessions Chromium
AmnesiaStealer : le malware macOS qui vole vos sessions Chromium en temps réel grâce au protocole CDP
Informatique & Cybersécurité
Rendu concept de l'iPhone Air 2 avec sa deuxième caméra exilée de l'autre côté de l'îlot photo
iPhone Air 2 : une deuxième caméra exilée de l’autre côté de l’îlot, le design ultra-fin d’Apple dans l’impasse
Mobiles & Apps
Key art officiel de Call of Duty Black Ops 7 Season 05 Reloaded, avec Rex Infernus et les créatures Zombies
Call of Duty Black Ops 7 Season 05 Reloaded : Rex Infernus signe la fin apocalyptique de l’arc Zombies le 20 août
Consoles & Jeux Vidéo

Tendance

iphone 18 pro concept
Foxconn lance son recrutement massif pour produire l’iPhone 18 Pro avant septembre
Mobiles & Apps
ssor invexaro
Avis sur Essor Invexaro : une énième arnaque au trading IA ?
Blockchain & Crypto IA & Robotique Informatique & Cybersécurité
google ai overview
AI Mode et Overview : quand Google légitime une arnaque financière
IA & Robotique Web & Internet
Rendu concept de la première smartwatch transparente Nothing
Nothing prépare sa première smartwatch transparente pour septembre 2026, sous les 300 dollars
Geek & Gadgets
XGIMI MemoMind One, lunettes connectées sans caméra, rendu concept
XGIMI MemoMind One : les lunettes sans caméra franchissent le million de dollars sur Kickstarter et parient tout sur la vie privée
Geek & Gadgets

Vous allez aussi aimer

Concept de l'enceinte connectée donut d'OpenAI, conçue avec Jony Ive (LoveFrom)
IA & Robotique

OpenAI et Jony Ive dévoilent un donut connecté : ChatGPT prend corps dans une enceinte à 300 dollars

7 août 2026
ia vole propriété intellectuelle
IA & RobotiqueTech & Innovations

L’intelligence artificielle a-t-elle volé les créateurs ? Le procès du copyright s’enflamme

16 juin 2026
Logo LTX avec le nom du modèle 2.5, world model vidéo open weights
IA & Robotique

LTX-2.5 est là ! Le modèle open source vidéo génère des clips de dix secondes en moins de sept secondes

12 août 2026
Concept robots humanoïdes alignés dans une usine futuriste, guerre des robots US-Chine
IA & Robotique

Robots humanoïdes chinois bannis des États-Unis : Washington déclenche la guerre des machines

4 août 2026
interdire chatgpt aux mineurs
IA & Robotique

Faut-il interdire ChatGPT et les chatbots IA aux mineurs ?

16 juin 2026
gpt-5.6
IA & Robotique

GPT-5.6 sous tutelle fédérale : OpenAI contraint de différer le lancement de son modèle phare

26 juin 2026
Logo officiel Mistral AI
IA & Robotique

Mistral AI présente Shieldstral, le modèle de sécurité à 3 milliards de paramètres

5 août 2026
claude fable 5
IA & Robotique

Claude Fable 5 et Mythos 5 c’est fini ! Anthropic débranche ses deux modèles sur ordre de Washington

13 juin 2026

Infos légales

  • Mentions légales
  • Politique de confidentialité
  • Nous contacter
  • Partenaires

Maj récentes

Garmin CIRQA Smart Ring, anneau connecté concept sur fond techno bleu
Garmin CIRQA Smart Ring : la bague connectée du roi des montres GPS surgit dans une certification indonésienne
Geek & Gadgets
Logo Windows 11 avec indicateur +10% et flèche rouge montante, illustrant la hausse des frais de licence
Microsoft augmente ses frais de licence Windows 11 de 10 % : les PC vont encore coûter plus cher
Informatique & Cybersécurité
Microsoft cybersécurité
Patch Tuesday d’août 2026 : Microsoft colmate 400 failles, dont un zero-day exploité par le groupe Lazarus
Informatique & Cybersécurité
Photo officielle des montres Garmin Forerunner 570 et 970
Wearables au T2 2026 : les ventes mondiales reculent de 2%, Garmin et Huawei cartonnent
Geek & Gadgets

Qui sommes nous ?

Le Journal du Web alias JDW a été fondé et est édité par des passionnés par l’univers web, nouvelles technologies et de la culture populaire.

Newsletter
Inscrivez-vous à notre newsletter pour recevoir nos derniers articles!
Suivez-nous
Welcome Back!

Sign in to your account

Username or Email Address
Password

Mot de passe oublié ?