JDWJDW
Font ResizerAa
  • Tech & Innovations
  • Mobiles & Apps
  • IA & Robotique
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Bons plans & promos
  • Plus
    • Blockchain & Crypto
    • Web & Internet
    • Geek & Gadgets
    • Informatique & Cybersécurité
    • Sciences & Espace
    • Réseaux Sociaux & Influence
    • e-Business & Webmarketing
    • Fintech & Néobanques
    • Streaming & P2P
Font ResizerAa
JDWJDW
Rechercher
  • Web & Internet
  • Tech & Innovations
  • Mobiles & Apps
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Blockchain & Crypto
  • Geek & Gadgets
  • Informatique & Cybersécurité
  • Streaming & P2P
Avez-vous déjà un compte ? Sign In
Suivez-nous
IA & Robotique

Google lance Gemini 3.7 Flash et baisse son tarif par rapport à son prédécesseur

Raphael Gelin
Published: 14 août 2026
Last updated: 14 août 2026
Partager
Logo Google Gemini avec le nom du modèle Gemini 3.7 Flash, fond techno sombre

Trois semaines, pas un jour de plus, auront suffi à Google pour empiler une nouvelle itération de son modèle Flash au-dessus de la précédente, dans une cadence de publication qui ressemble désormais à un sprint permanent. Gemini 3.7 Flash, annoncé ce jeudi et déjà disponible via l’API Gemini, Google AI Studio et Android Studio, se présente comme le modèle « workhorse » le plus intelligent de la gamme, taillé pour le code de production, la compréhension de documents denses et l’orchestration d’agents autonomes, le tout facturé à 0,75 dollar par million de tokens en entrée et 3,75 dollars en sortie jusqu’à fin 2026, soit exactement la moitié du tarif standard de son prédécesseur.

Les benchmarks que Google met en avant ont de quoi faire vibrer les équipes d’ingénierie logicielle. Sur FrontierCode 1.1 Main, qui évalue la qualité du code prêt pour la production, le nouveau modèle grimpe à 43,6 % contre 34,4 % pour la 3.6 Flash, dépassant au passage les 42,7 % attribués à Claude Sonnet 5 d’Anthropic et les 41,3 % de GPT-5.6 Terra d’OpenAI dans le propre tableau comparatif de Google. Sur DeepSWE v1.1, un test d’ingénierie logicielle à horizon long, le bond est encore plus spectaculaire avec 65,3 % contre 49 % pour la version précédente (GPT-5.6 Terra conserve toutefois l’avantage à 69,6 %). En développement web, le score Elo sur Code Arena atteint 1588, devant Claude Sonnet 5 (1541) et GPT-5.6 Terra (1523). Et puis il y a AutomationBench, ce benchmark d’automatisation de workflows métier où 3.7 Flash bondit à 30,4 % depuis les 17 % de la 3.6, écrasant les 10,7 % de Claude Sonnet 5 et les 23,6 % de GPT-5.6 Terra.

Mais pourquoi une telle frénésie de publication ? La réponse tient peut-être dans l’enthousiasme algorithmique et un contexte organisationnel agité. Google n’a toujours pas livré Gemini 3.5 Pro, le modèle phare annoncé en mai et censé arriver le mois suivant, qui reste englué dans une phase de tests partenaires sans calendrier public. Le dernier modèle Pro en circulation demeure Gemini 3.1 Pro, introduit en février. Des désaccords internes, des ressources de calcul contraintes et une bureaucratie pesante auraient, selon plusieurs sources, ralenti les sorties et fragilisé les performances en codage. Demis Hassabis, cofondateur de DeepMind et prix Nobel, a récemment cédé la direction opérationnelle de la division pour en devenir président et occuper simultanément le poste de directeur scientifique d’Alphabet, tandis que l’ancien CTO Koray Kavukcuoglu pilote désormais l’ensemble de la chaîne Gemini, du développement des modèles à l’application grand public, en rendant compte directement à Sundar Pichai. Plusieurs figures emblématiques, dont les co-responsables de Gemini Oriol Vinyals et Noam Shazeer (parti chez OpenAI), ainsi que le scientifique d’AlphaFold John Jumper (parti chez Anthropic), ont quitté le navire pour fonder ou rejoindre d’autres structures. Dans ce paysage… la Flash line devient le véhicule d’exécution rapide par excellence, celui qui permet à Google de montrer qu’il itère vite là où le Pro patine.

La proposition de valeur pour les développeurs et les équipes produit repose sur un argument économique qui mérite d’être disséqué avec soin. Le tarif d’appel à 0,75 dollar par million de tokens en entrée place 3.7 Flash bien en dessous des 2 dollars de Claude Sonnet 5 et des 2 dollars de GPT-5.6 Terra, selon les chiffres compilés par Google. Sauf que cette générosité a une date d’expiration au 31 décembre 2026, après quoi les prix doublent pour rejoindre le barème standard de la 3.6 Flash (1,50 dollar en entrée, 7,50 en sortie). Pour un agent autonome qui enchaîne des dizaines d’appels au modèle, des tokens de raisonnement et des interactions avec des outils externes sur une seule requête utilisateur, le coût par tâche accomplie avec succès importe bien davantage que le prix brut par million de tokens. Google affirme que 3.7 Flash « pense avec plus de rigueur », investit davantage d’effort dans la planification multi-étapes et les appels d’outils, et génère un code correct dès le premier passage plus souvent que son prédécesseur, ce qui réduit les boucles de correction et la supervision humaine. Si ces gains de fiabilité se confirment en production, le tarif réduit devient un levier redoutable pour verrouiller les usages avant le retour aux prix pleins.

L’intégration immédiate dans Gemini Spark, l’agent personnel 24h/24 accessible aux abonnés Google AI Pro et Ultra dans plus de 160 pays, illustre bien la stratégie de distribution massive de Google. Spark peut désormais consolider des fichiers, rédiger des e-mails et mettre à jour des documents de suivi à travers les applications Google Workspace avec une précision améliorée grâce au nouveau modèle. Avec 950 millions d’utilisateurs mensuels revendiqués pour l’application Gemini, Google dispose d’un canal de diffusion qu’aucun concurrent ne peut répliquer à cette échelle, et qui ne dépend pas entièrement de la suprématie sur les classements de benchmarks.

A lire également

Concept : logo officiel OpenAI avec une courbe de croissance boursière ascendante et un signe dollar, évoquant l'IPO
OpenAI franchit les 40 milliards de dollars de revenus annualisés et fonce vers une IPO à mille milliards
Logo OpenAI avec le nom du modèle GPT-5.6 Sol et son mode Ultrafast, concept sombre sur fond techno
OpenAI propulse GPT-5.6 Sol à 750 tokens par seconde grâce à Cerebras et son mode Ultrafast
Robot humanoïde Samsung, rendu concept sur fond bleu aux couleurs de la marque
Samsung mise sur ses moteurs de lave-linge pour fabriquer un robot humanoïde à prix cassé

Faut-il pour autant considérer 3.7 Flash comme le meilleur modèle du marché ? Les propres données de Google répondent avec une honnêteté inhabituelle. Sur Terminal-bench 2.1, GPT-5.6 Terra mène à 87,4 % contre 85,8 %. Sur Agent’s Last Exam, Claude Sonnet 5 domine avec 33,3 % contre 26,3 %. L’indice d’intelligence globale d’Artificial Analysis place Claude Opus 5 à 63, contre 56 pour 3.7 Flash (en progression depuis les 52 de la 3.6). Le modèle de Google ne prétend donc pas régner partout, il prétend offrir le meilleur rapport performance-prix dans les workflows de code et d’automatisation, un positionnement de « cheval de trait » assumé qui laisse la couronne du pur-sang au futur Gemini 4, dont le développement serait déjà bien engagé.

La vraie question que pose cette sortie éclair dépasse le périmètre d’un seul modèle. Google est en train d’installer un rythme d’itération où des améliorations algorithmiques peuvent atteindre la production sans attendre une nouvelle génération phare, transformant la Flash line en laboratoire vivant. Pour les équipes qui déploient des agents en production, cette cadence crée une tension permanente entre l’envie de profiter des gains et la nécessité de re-benchmarker chaque version contre leurs propres dépôts, schémas d’outils et modes de défaillance. Le pari de Google tient en une phrase implicite, du moins pour les mois qui viennent : un modèle suffisamment compétitif face aux systèmes plus chers, et suffisamment bon marché pour tourner en boucle à l’intérieur d’agents, vaut mieux qu’un modèle de pointe qu’on hésite à appeler trop souvent.

Partager cet article
Facebook Whatsapp Whatsapp LinkedIn Reddit Telegram Copy Link

Derniers articles

One UI 9.5, interface glass sur Galaxy S26 Samsung - captures d'écran fuitées
One UI 9.5 : les premières captures fuitées sur Galaxy S26 dévoilent un redesign « glass » spectaculaire et une app Phone dopée à l’IA
Mobiles & Apps
Concept illustrant le malware macOS AmnesiaStealer qui détourne les sessions Chromium
AmnesiaStealer : le malware macOS qui vole vos sessions Chromium en temps réel grâce au protocole CDP
Informatique & Cybersécurité
Rendu concept de l'iPhone Air 2 avec sa deuxième caméra exilée de l'autre côté de l'îlot photo
iPhone Air 2 : une deuxième caméra exilée de l’autre côté de l’îlot, le design ultra-fin d’Apple dans l’impasse
Mobiles & Apps
Key art officiel de Call of Duty Black Ops 7 Season 05 Reloaded, avec Rex Infernus et les créatures Zombies
Call of Duty Black Ops 7 Season 05 Reloaded : Rex Infernus signe la fin apocalyptique de l’arc Zombies le 20 août
Consoles & Jeux Vidéo

Tendance

iphone 18 pro concept
Foxconn lance son recrutement massif pour produire l’iPhone 18 Pro avant septembre
Mobiles & Apps
ssor invexaro
Avis sur Essor Invexaro : une énième arnaque au trading IA ?
Blockchain & Crypto IA & Robotique Informatique & Cybersécurité
google ai overview
AI Mode et Overview : quand Google légitime une arnaque financière
IA & Robotique Web & Internet
Rendu concept de la première smartwatch transparente Nothing
Nothing prépare sa première smartwatch transparente pour septembre 2026, sous les 300 dollars
Geek & Gadgets
XGIMI MemoMind One, lunettes connectées sans caméra, rendu concept
XGIMI MemoMind One : les lunettes sans caméra franchissent le million de dollars sur Kickstarter et parient tout sur la vie privée
Geek & Gadgets

Vous allez aussi aimer

Tesla Optimus Gen-2 servant du popcorn au Tesla Diner d'Hollywood, scène réelle
IA & Robotique

Le robot humanoïde Optimus de Tesla se fait pranker et retourne la blague

13 août 2026
ia vole propriété intellectuelle
IA & RobotiqueTech & Innovations

L’intelligence artificielle a-t-elle volé les créateurs ? Le procès du copyright s’enflamme

16 juin 2026
apple M7 Ultra
IA & RobotiqueInformatique & Cybersécurité

Apple M7 Ultra : jusqu’à 1,5 To de mémoire unifiée et une ambition « classe Nvidia Blackwell » pour 2028

14 juillet 2026
space x
IA & Robotique

SpaceX rachète Cursor pour 60 milliards de dollars et fait du code assisté par IA une infrastructure stratégique

18 juin 2026
Le robot humanoïde Digit v5 d'Agility Robotics en environnement industriel
IA & Robotique

Digit v5 : Agility Robotics libère son humanoïde des cages pour l’envoyer travailler aux côtés des humains dès décembre

12 août 2026
DeepSeek V4 Flash - logo blanc et nom du modèle sur fond tech abstrait
IA & Robotique

DeepSeek V4-Flash : le modèle d’IA le moins cher au monde coûte cent fois moins que Claude Fable 5

5 août 2026
Concept de l'enceinte connectée donut d'OpenAI, conçue avec Jony Ive (LoveFrom)
IA & Robotique

OpenAI et Jony Ive dévoilent un donut connecté : ChatGPT prend corps dans une enceinte à 300 dollars

7 août 2026
ollama
IA & Robotique

Qu’est-ce qu’Ollama ? Tout savoir sur ce moteur d’IA locale

19 juillet 2026

Infos légales

  • Mentions légales
  • Politique de confidentialité
  • Nous contacter
  • Partenaires

Maj récentes

Garmin CIRQA Smart Ring, anneau connecté concept sur fond techno bleu
Garmin CIRQA Smart Ring : la bague connectée du roi des montres GPS surgit dans une certification indonésienne
Geek & Gadgets
Logo Windows 11 avec indicateur +10% et flèche rouge montante, illustrant la hausse des frais de licence
Microsoft augmente ses frais de licence Windows 11 de 10 % : les PC vont encore coûter plus cher
Informatique & Cybersécurité
Microsoft cybersécurité
Patch Tuesday d’août 2026 : Microsoft colmate 400 failles, dont un zero-day exploité par le groupe Lazarus
Informatique & Cybersécurité
Photo officielle des montres Garmin Forerunner 570 et 970
Wearables au T2 2026 : les ventes mondiales reculent de 2%, Garmin et Huawei cartonnent
Geek & Gadgets

Qui sommes nous ?

Le Journal du Web alias JDW a été fondé et est édité par des passionnés par l’univers web, nouvelles technologies et de la culture populaire.

Newsletter
Inscrivez-vous à notre newsletter pour recevoir nos derniers articles!
Suivez-nous
Welcome Back!

Sign in to your account

Username or Email Address
Password

Mot de passe oublié ?