JDWJDW
Font ResizerAa
  • Tech & Innovations
  • Mobiles & Apps
  • IA & Robotique
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Geek & Gadgets
  • Véhicules & e-Mobilité
  • Bons plans & promos
  • Plus
    • Blockchain & Crypto
    • Web & Internet
    • Informatique & Cybersécurité
    • Sciences & Espace
    • Réseaux Sociaux & Influence
    • e-Business & Webmarketing
    • Fintech & Néobanques
    • Streaming & P2P
Font ResizerAa
JDWJDW
Rechercher
  • Web & Internet
  • Tech & Innovations
  • Mobiles & Apps
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Blockchain & Crypto
  • Geek & Gadgets
  • Informatique & Cybersécurité
  • Streaming & P2P
Avez-vous déjà un compte ? Se connecter
Suivez-nous
IA & Robotique

MiniMax H3 : le modèle vidéo IA qui rivalise avec Sora et Veo tourne désormais sur un GPU de salon

Robin Prigent
Published: 10 août 2026
Last updated: 10 août 2026
Partager
MiniMax H3, rendu concept blanc sur fond techno abstrait sombre

MiniMax a lâché dans la nature les poids de H3, son modèle multimodal de génération vidéo, et l’événement ressemble furieusement à ce qu’a provoqué DeepSeek dans le monde des grands modèles de langage. Sauf qu’ici, on parle de vidéo 2K avec audio stéréo natif, générée en une seule passe, sur une carte graphique que l’on peut acheter chez n’importe quel revendeur gaming.

Le modèle digère simultanément du texte, des images, des clips vidéo et des pistes audio (jusqu’à 9 images, 3 vidéos et 3 bandes-son dans une même requête) pour recracher une séquence cohérente de 5 à 15 secondes à 24 images par seconde, son compris. Voix, bruitages, musique d’ambiance, tout est modélisé conjointement, pas collé après coup par un pipeline séparé. Les prompts peuvent atteindre 7 000 caractères, de quoi loger un découpage technique complet dans une seule génération. Et la résolution grimpe à 2K, soit environ 3,7 mégapixels en format 21:9, avec des ratios allant du cinémascope au portrait vertical.

Artificial Analysis, la plateforme de benchmarks qui fait référence, place déjà H3 au premier rang mondial en montage vidéo assisté par IA. Le modèle se retrouve toutefois derrière le Gemini Omni Flash de Google en text-to-video et cède aussi du terrain face au Seedance 2.0 de ByteDance en image-to-video. Mais voilà le paradoxe qui donne le vertige… Seedance 2.0 reste verrouillé derrière une API propriétaire, tandis que H3, lui, s’exécute en local, poids ouverts, personnalisable, fine-tunable.

La firme chinoise a explicitement conçu son architecture pour fonctionner sur du matériel grand public, citant la compatibilité hardware comme « une considération déterminante dans la conception de H3 ». Quatre briques technologiques rendent la chose possible. Le H3-VAE, d’abord, compresse les séquences avec un ratio si agressif qu’il quadruple la longueur effective de séquence traitée, rendant la génération native en 2K économiquement viable. Le H3-Omni Transformer, ensuite, sépare les charges de compréhension et de génération pour optimiser l’utilisation du GPU, avec un gain de débit d’entraînement de près de 30 %. La régénération en contexte, enfin, permet au modèle de ré-upscaler sa propre sortie basse résolution en relisant le contexte multimodal d’origine, récupérant ainsi typographies fines et détails que les upscalers classiques ne font que deviner.

A lire également

Concept : OpenAI accuse Moonshot AI (Kimi) de distillation massive du raisonnement de ses modèles pour nourrir Kimi
OpenAI accuse Moonshot AI d’avoir aspiré le raisonnement de ses modèles pour nourrir Kimi
Tesla Optimus Gen 3
Optimus Gen 3 : une fuite dans l’application Tesla révèle le rendu du futur robot
Logo PixVerse avec le nom du modèle R2, world model temps réel
PixVerse R2 : la vidéo générative par IA s’ouvre à l’interaction en temps réel

Le profil matériel réel mérite qu’on s’y attarde, parce que « tourner sur un GPU domestique » peut vouloir dire beaucoup de choses. En version safetensors complète (diffusion de 21 Go, encodeur texte Qwen3-VL 32B de 15,7 Go, VAE vidéo de 5,2 Go, VAE audio de 0,6 Go, soit environ 42,5 Go au total), H3 exige une carte dotée de 32 Go de VRAM, typiquement une RTX 5090. Un testeur rapporte environ 2 minutes 30 pour générer 7 secondes de vidéo text-to-video en 736×416, et 7 minutes pour 5 secondes d’image-to-video en 768×1344 sur cette même carte. Les composants non actifs se déchargent vers la RAM système entre les phases.

Pour les possesseurs de cartes à 24 Go de VRAM (RTX 4090, RTX 3090), des versions quantifiées au format GGUF existent déjà. La variante Q4_K_M du modèle de diffusion pèse 19,86 Go, celle de l’encodeur texte 14,58 Go, et le tout tient dans l’enveloppe mémoire d’une 4090 avec un compromis qualité-performance que la communauté juge très acceptable. Une quantification Q3_K_M descend même à 15,58 Go pour le diffuseur, offrant une marge confortable.

ComfyUI intègre nativement les nœuds H3 depuis sa version 0.30.0, avec trois workflows prêts à l’emploi (text-to-video, image-to-video, reference-to-video) que l’on peut glisser-déposer dans l’interface. L’écosystème a réagi en quelques heures, fal.ai se positionnant comme partenaire « Day 0 » avec une API serverless pour ceux qui préfèrent ne pas gérer de GPU.

La licence MiniMax Community autorise gratuitement l’usage non commercial et l’usage commercial pour les organisations générant moins de 20 millions de dollars de revenus annuels, avec obligation d’attribution. « Les modèles propriétaires ont longtemps dominé la génération vidéo, avec des cycles d’itération plus lents et un écosystème moins ouvert que celui des grands modèles de langage », a déclaré MiniMax dans son billet d’annonce, justifiant ainsi l’ouverture des poids pour « soutenir la communauté open source ».

Qu’un modèle capable de générer des films de marque, de l’animation stylisée, du gameplay et du montage vidéo avec remplacement d’arrière-plan, clonage vocal et typographie lisible puisse désormais être fine-tuné par n’importe quel studio indépendant sur une machine à 2 000 euros, voilà qui redistribue les cartes d’une manière que ni OpenAI avec Sora, ni Google avec Veo, ni ByteDance avec Seedance n’avaient anticipée. La vidéo générative vient de vivre son « moment LLaMA », et la suite appartient aux bidouilleurs.

Partager cet article
Facebook Whatsapp Whatsapp LinkedIn Reddit Telegram Copy Link

Derniers articles

Samsung Galaxy Buds On, écouteurs clip-on open-ear noirs, visuel de présentation
Samsung lance les Galaxy Buds On et s’attaque enfin aux écouteurs ouverts
Geek & Gadgets
Apple A20, puce N2 2 nm du futur iPhone 18 non-Pro, rendu concept avec carte de billes visible
iPhone 18 standard : le schéma de la puce A20 vend la mèche sur les sacrifices d’Apple
Mobiles & Apps
Nintendo Switch 2 et Switch, mise à jour système 23.0.1 corrigeant les lenteurs au démarrage, à la pause et à la fermeture
Switch 2 : la mise à jour 23.0.1 corrige les lenteurs au lancement, à la pause et à la fermeture des jeux
Consoles & Jeux Vidéo
Samsung Galaxy S27 Ultra, rendu concept avec protège-écran en verre interchangeable, fond bleu nuit Samsung
Samsung Galaxy S27 Ultra : cinq protège-écrans suggèrent une face avant héritée du S26 Ultra
Mobiles & Apps

Tendance

noTube
noTube Avis : risque de virus, qualité de sortie MP3/MP4… ce convertisseur est-il vraiment fiable ?
One Piece
One Piece : où voir l’anime en streaming légalement et tous les épisodes en VF et VOSTFR ?
Animes & Mangas
Dark Web
Dark Web : ce que cache réellement la face obscure d’Internet au-delà des mythes
Informatique & Cybersécurité Web & Internet
WhatsApp Web
WhatsApp Web : comment tchatter avec ses contacts sans application ?
Mobiles & Apps Web & Internet
Key art Saint Seiya Tenkai-hen Then IV, le nouveau chapitre de Kurumada annoncé pour le 18 décembre
Saint Seiya Tenkai-hen Then IV : Kurumada lance le chapitre Zeus le 18 décembre
Animes & Mangas

Vous allez aussi aimer

Logo officiel Anthropic Claude avec le nom du modèle Opus 5.5 au centre, concept sur fond techno sombre
IA & Robotique

Anthropic lance Claude Opus 5.5 et baisse enfin le prix de son API

24 septembre 2026
Grok 4.7, logo et nom du modèle flagship de xAI sur fond techno sombre
IA & Robotique

Grok 4.7 : xAI lance son nouveau modèle de raisonnement taillé pour le code

22 septembre 2026
Concept Anthropic : noyau neural orange (nouveau modèle IA) + courbe de croissance boursière et chandeliers, à la veille de son IPO
IA & Robotique

Anthropic pourrait sortir un nouveau modèle IA avant son IPO pour contrer OpenAI

19 septembre 2026
Robot humanoïde Figure 03 piloté par Helix 2.5 pliant du linge dans une cuisine réelle
IA & Robotique

Figure AI lâche son robot humanoïde Figure 03 dans 30 foyers avec l’objectif qu’il s’adapte seul à son environnement

19 septembre 2026
Robot humanoïde Unitree G1 en position d'attaque kung-fu face à un client dans un magasin d'électronique, vue de vidéosurveillance
IA & Robotique

Un robot humanoïde attaque un client en magasin : sont-ils prêts à vivre parmi nous ?

13 septembre 2026
Logo OpenAI avec mention IPO 2027 et courbe boursière rouge en baisse, report de l'introduction en bourse
IA & Robotique

OpenAI n’entrera pas en bourse en 2026 : Sam Altman prétexte la sécurité de l’IA

13 septembre 2026
Symbole pause géant face à un essaim de noeuds IA, illustration du ralentissement des modèles frontier réclamé par Amodei, Altman et Musk
IA & Robotique

Course à l’IA : Anthropic, OpenAI et Elon Musk réclament un coup de frein d’urgence

13 septembre 2026
Satellite d'observation en orbite traitant des données par IA, au-dessus de la Terre, concept du consortium franco-émirati Loft Orbital / Marlan Space
IA & RobotiqueSciences & Espace

Espace et IA : la France et les Émirats investissent 1 milliard de dollars dans 50 satellites

10 septembre 2026

Qui sommes nous ?

Média numérique indépendant, Le Journal du Web (JDW) analyse les évolutions technologiques, les nouveautés mobiles et la pop-culture. Entre tests de produits, avis impartiaux et sélection rigoureuse de bons plans vérifiés, nos rédacteurs décryptent chaque jour l’actualité tech, le jeu vidéo et la culture web pour accompagner votre quotidien connecté

Maj récentes

Concept The Last of Us : ville abandonnée envahie par la végétation et le Cordyceps, deux traînées de lucioles divergent vers deux chemins, symbolisant les deux nouveaux projets Naughty Dog
The Last of Us prépare son futur : Naughty Dog confirme deux projets inédits
Consoles & Jeux Vidéo
Samsung Galaxy S26 avec l'écran de mise à jour One UI 9 sous Android 17, déploiement OTA vers l'Europe, le Canada et l'Inde, visuel concept
Samsung déploie enfin One UI 9 sur les Galaxy S26 : qu’en est-il des autres modèles ?
Mobiles & Apps
Anime Sama, site de streaming d'animes en ligne
Anime Sama : changement d’adresse, risque de virus… la vérité sur le site de streaming pirate
Animes & Mangas Informatique & Cybersécurité Streaming & P2P
Alan Ritchson dans l'affiche officielle de Reacher saison 4 sur Prime Video
Reacher renouvelé pour une saison 6 : Prime Video verrouille sa série phare
Films & Séries

Infos légales

  • Charte éthique et éditoriale
  • Mentions légales
  • Politique de confidentialité
  • Nous contacter
  • Partenaires
Suivez-nous
© 2019- Le Journal du Web (JDW). Tous droits réservés.
  • Charte éthique et éditoriale
  • Mentions légales
  • Politique de confidentialité
  • Nous contacter
  • Partenaires
Welcome Back!

Sign in to your account

Username or Email Address
Password

Mot de passe oublié ?