JDWJDW
Font ResizerAa
  • Tech & Innovations
  • Mobiles & Apps
  • IA & Robotique
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Bons plans & promos
  • Plus
    • Blockchain & Crypto
    • Web & Internet
    • Geek & Gadgets
    • Informatique & Cybersécurité
    • Sciences & Espace
    • Réseaux Sociaux & Influence
    • e-Business & Webmarketing
    • Fintech & Néobanques
    • Streaming & P2P
Font ResizerAa
JDWJDW
Rechercher
  • Web & Internet
  • Tech & Innovations
  • Mobiles & Apps
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Blockchain & Crypto
  • Geek & Gadgets
  • Informatique & Cybersécurité
  • Streaming & P2P
Avez-vous déjà un compte ? Sign In
Suivez-nous
IA & Robotique

DeepSeek V4-Pro 0813 : le flagship chinois sort de sa preview à 0,87 $ le million de tokens et défie frontalement les labos américains

Marek Sobel
Published: 13 août 2026
Last updated: 13 août 2026
Partager
DeepSeek V4 Pro - logo baleine et nom du modèle sur fond tech abstrait

Un tableau de tarification mis à jour sur une page API, sans communiqué de presse, sans fanfare, sans même un billet de blog… voilà comment DeepSeek a officiellement lancé le 12 août 2026 son modèle phare V4-Pro dans sa version de production estampillée 0813, mettant fin à près de quatre mois de preview et propulsant dans l’arène un mastodonte de 1 600 milliards de paramètres facturé quarante-six fois moins cher que son rival le plus performant chez Anthropic.

Le prix affiché donne le vertige à quiconque suit la guerre économique des LLM frontier, avec 0,435 $ par million de tokens en entrée et 0,87 $ en sortie, tandis que le cache hit tombe à un dérisoire 0,003625 $. En face, Claude Fable 5 d’Anthropic réclame 10 $ en input et 50 $ en output pour un avantage moyen de 5,3 % sur dix benchmarks agents, selon les propres données comparatives publiées par DeepSeek. Ramené au coût pondéré par tâche, le calcul est dévastateur pour les labos de San Francisco et Londres : environ 3,15 $ la tâche benchmark chez Anthropic contre trois centimes pour V4-Flash, la déclinaison économique du même pipeline.

L’architecture mixture-of-experts du V4-Pro n’active que 49 milliards de paramètres par token sur les 1 600 milliards totaux, un ratio qui permet de comprimer le compute d’inférence à 27 % et le KV cache à 10 % des besoins qu’exigeait la génération précédente V3.2 sur des contextes d’un million de tokens. Le modèle a été pré-entraîné sur plus de 32 000 milliards de tokens, accepte une fenêtre de contexte d’un million de tokens et peut générer jusqu’à 384 000 tokens en sortie, le tout sous licence MIT avec les poids disponibles sur Hugging Face où le dépôt Pro a déjà dépassé 1,4 million de téléchargements en un mois.

Les scores rapportés par le constructeur (non encore vérifiés de manière indépendante) placent le V4-Pro-0813 à 80,6 % sur SWE-bench Verified, 93,5 % sur LiveCodeBench et 90,1 % sur GPQA Diamond, des résultats qui le positionnent dans la cour des modèles frontier tout en restant en retrait derrière GPT-5.4 sur Terminal Bench 2.0 (67,9 % contre 75,1 %) et derrière Gemini-3.1-Pro sur Humanity’s Last Exam. Le modèle surclasse en revanche Opus 4.8 d’Anthropic sur Terminal Bench 2.1, Cybergym, DeepSWE et AutomationBench d’après des résultats préliminaires.

La sortie du V4-Pro s’inscrit dans une escalade tarifaire inversée qui a structuré tout l’été 2026. OpenAI avait dégainé en premier avec un rabais de 80 % sur GPT-5.6 Luna (0,2 $ en input, 1,20 $ en output), puis DeepSeek avait répliqué fin juillet avec V4-Flash-0731, un modèle de 284 milliards de paramètres affiché à 0,14 $ en input et 0,28 $ en output, et dont les performances rivalisent avec celles d’Opus 4.8. La stratégie « flash-first » du labo chinois a même produit un résultat paradoxal, puisque le Flash re-post-trained surpassait la preview Pro sur certaines suites agents au moment de sa mise en production le 31 juillet.

A lire également

Grok 4.6, logo et nom du modèle flagship de SpaceXAI sur fond techno sombre
Grok 4.6 : SpaceXAI propulse son modèle flagship au sommet du classement mondial, à prix cassé
Le robot humanoïde Digit v5 d'Agility Robotics en environnement industriel
Digit v5 : Agility Robotics libère son humanoïde des cages pour l’envoyer travailler aux côtés des humains dès décembre
Data centre d'inférence Mistral AI, logo MISTRAL, ambition 1 GW de calcul en Europe
Mistral AI veut planter 1 gigawatt de calcul souverain en Europe d’ici 2030 et verrouille déjà ses clients pour cinq ans

Kimi K3, le modèle de Moonshot AI, avait de son côté battu Fable 5 et GPT-5.6 Sol sur certains benchmarks lors de son lancement, confirmant que la compétition frontier ne se joue désormais plus entre la Californie et Londres, mais entre Hangzhou, Pékin et Shenzhen (Xiaomi pousse aussi ses propres réductions de coûts de 99 % sur l’inférence frontier). DeepSeek occupait en juillet la deuxième place mondiale en volume total de tokens consommés via API, juste derrière Anthropic, un rang conquis avec un parc estimé à seulement 20 000 GPU NVIDIA H100, ce qui provoque parfois des ralentissements d’inférence aux heures de pointe.

Le positionnement stratégique du line-up V4 dessine deux voies distinctes, Flash pour la haute fréquence et la concurrence massive (2 500 requêtes simultanées) et Pro pour le raisonnement lourd, le coding long contexte et les agents autonomes (500 requêtes simultanées). Le mode thinking est activé par défaut sur Pro, avec un endpoint non-thinking disponible, et des fonctionnalités en bêta comme la continuation de préfixe conversationnel et le fill-in-the-middle réservé au mode non-thinking.

Un détail mérite toute l’attention des développeurs qui construisent sur cette infrastructure à prix cassé. La page de tarification de DeepSeek mentionne, en toutes lettres, « une augmentation substantielle » du prix API à venir, sans préciser ni le calendrier ni l’ampleur de la hausse. La question qui brûle désormais n’est peut-être pas de savoir si les labos américains peuvent rivaliser sur la performance, mais combien de temps encore ils pourront justifier un écart de prix de 4 600 % auprès d’entreprises qui découvrent qu’un modèle open source, téléchargeable et vérifiable, fait à peu près le même travail pour une fraction du coût.

Partager cet article
Facebook Whatsapp Whatsapp LinkedIn Reddit Telegram Copy Link

Derniers articles

Key art officielle d'Elden Ring Tarnished Edition sur Nintendo Switch 2
Elden Ring Tarnished Edition débarque sur Switch 2 le 28 août : FromSoftware conquiert enfin le portable de Nintendo
Consoles & Jeux Vidéo
Key art officiel de Minecraft pour Nintendo Switch 2, logo officiel Minecraft sur fond de monde en blocs
Minecraft sur Switch 2 : rendez-vous le 27 octobre 2026 avec les Vibrant Visuals
Consoles & Jeux Vidéo
Samsung Galaxy Watch 8 Classic avec One UI 9 Watch, rendu de communication
One UI 9 Watch sur Galaxy Watch 8 Classic : Samsung prépare déjà la bêta sur ses serveurs
Mobiles & Apps
Key art officielle de Le Seigneur des Anneaux : War in the North Legacy Edition, les trois héros face à Agandaûr au nord de la Terre du Milieu
Le Seigneur des Anneaux : War in the North revient en Legacy Edition, lâché sans prévenir par Aspyr sur PS5, Xbox, Switch et PC
Consoles & Jeux Vidéo

Tendance

ios 27
iOS 27 en bêta publique : Siri dopé à l’IA arrive enfin sur iPhone
Mobiles & Apps
iphone 18 pro concept
Foxconn lance son recrutement massif pour produire l’iPhone 18 Pro avant septembre
Mobiles & Apps
Windows 11
Windows 11 démembre Phone Link : la synchronisation Android s’installe au cœur du système
Informatique & Cybersécurité Mobiles & Apps
CyberGhost VPN
CyberGhost VPN casse son prix à 1,59 €/mois : 88 % de remise et 2 mois offerts
Informatique & Cybersécurité
Claude Fable 5 vs GPT-5.6 Sol : le duel des deux LLM frontière décortiqué benchmark par benchmark
IA & Robotique

Vous allez aussi aimer

Bit GPT App arnaque
Blockchain & CryptoIA & Robotique

Avis Bit GPT App : véritable arnaque ou service légitime ?

1 sur 5Mauvais
nvidia
IA & RobotiqueTech & Innovations

Nvidia contre une prise de participation de l’État américain dans les entreprises IA : Jensen Huang dit non

18 juin 2026
Logos officiels OpenAI et Hugging Face, côte à côte
IA & Robotique

Des agents IA devenus pirates : OpenAI avoue, Meta encaisse, le Congrès dégaine un bouton d’arrêt d’urgence

7 août 2026
Claude Code, interface officielle Anthropic du mode autonome
IA & Robotique

Claude Code passe en pilote automatique : Anthropic impose le mode auto par défaut dès le 14 août

10 août 2026
claude fable 5
IA & Robotique

Claude Fable 5 : Anthropic libère sa bête de course et parie sur des garde-fous inédits

10 juin 2026
Tesla Robovan autonome dans un rendu pour le complexe Terafab
IA & Robotique

Terafab : le Robovan de Tesla surgit aux côtés d’Optimus dans une vidéo qui dévoile l’usine à 16,8 milliards de dollars

9 août 2026
Concept de l'enceinte connectée donut d'OpenAI, conçue avec Jony Ive (LoveFrom)
IA & Robotique

OpenAI et Jony Ive dévoilent un donut connecté : ChatGPT prend corps dans une enceinte à 300 dollars

7 août 2026
DeepSeek V4 Flash - logo blanc et nom du modèle sur fond tech abstrait
IA & Robotique

DeepSeek enterre l’ère du « 3 cents par tâche » et prépare une hausse de prix fracassante

6 août 2026

Infos légales

  • Mentions légales
  • Politique de confidentialité
  • Nous contacter
  • Partenaires

Maj récentes

Rendu concept de la Nintendo Switch 2 édition limitée 40 ans de The Legend of Zelda avec son Pro Controller commémoratif
Zelda fête ses 40 ans : une Switch 2 édition limitée et un Pro Controller commémoratif fuitent en images
Consoles & Jeux Vidéo
Apple Watch Ultra 4concept
Apple Watch Ultra 4 : puce S11, tension artérielle et autonomie musclée, la fuite qui électrise les poignets
Geek & Gadgets
The Elder Scrolls VI, rendu concept du paysage de Tamriel
The Elder Scrolls 6 : la patronne de Xbox dit avoir été bluffée par une démonstration en jeu
Consoles & Jeux Vidéo
Logo LTX avec le nom du modèle 2.5, world model vidéo open weights
LTX-2.5 est là ! Le modèle open source vidéo génère des clips de dix secondes en moins de sept secondes
IA & Robotique

Qui sommes nous ?

Le Journal du Web alias JDW a été fondé et est édité par des passionnés par l’univers web, nouvelles technologies et de la culture populaire.

Newsletter
Inscrivez-vous à notre newsletter pour recevoir nos derniers articles!
Suivez-nous
Welcome Back!

Sign in to your account

Username or Email Address
Password

Mot de passe oublié ?