JDWJDW
Font ResizerAa
  • Tech & Innovations
  • Mobiles & Apps
  • IA & Robotique
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Bons plans & promos
  • Plus
    • Blockchain & Crypto
    • Web & Internet
    • Geek & Gadgets
    • Informatique & Cybersécurité
    • Sciences & Espace
    • Réseaux Sociaux & Influence
    • e-Business & Webmarketing
    • Fintech & Néobanques
    • Streaming & P2P
Font ResizerAa
JDWJDW
Rechercher
  • Web & Internet
  • Tech & Innovations
  • Mobiles & Apps
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Blockchain & Crypto
  • Geek & Gadgets
  • Informatique & Cybersécurité
  • Streaming & P2P
Avez-vous déjà un compte ? Sign In
Suivez-nous
IA & Robotique

MiniMax H3 : le modèle vidéo IA qui rivalise avec Sora et Veo tourne désormais sur un GPU de salon

Robin Prigent
Published: 10 août 2026
Last updated: 10 août 2026
Partager
MiniMax H3, rendu concept blanc sur fond techno abstrait sombre

MiniMax a lâché dans la nature les poids de H3, son modèle multimodal de génération vidéo, et l’événement ressemble furieusement à ce qu’a provoqué DeepSeek dans le monde des grands modèles de langage. Sauf qu’ici, on parle de vidéo 2K avec audio stéréo natif, générée en une seule passe, sur une carte graphique que l’on peut acheter chez n’importe quel revendeur gaming.

Le modèle digère simultanément du texte, des images, des clips vidéo et des pistes audio (jusqu’à 9 images, 3 vidéos et 3 bandes-son dans une même requête) pour recracher une séquence cohérente de 5 à 15 secondes à 24 images par seconde, son compris. Voix, bruitages, musique d’ambiance, tout est modélisé conjointement, pas collé après coup par un pipeline séparé. Les prompts peuvent atteindre 7 000 caractères, de quoi loger un découpage technique complet dans une seule génération. Et la résolution grimpe à 2K, soit environ 3,7 mégapixels en format 21:9, avec des ratios allant du cinémascope au portrait vertical.

Artificial Analysis, la plateforme de benchmarks qui fait référence, place déjà H3 au premier rang mondial en montage vidéo assisté par IA. Le modèle se retrouve toutefois derrière le Gemini Omni Flash de Google en text-to-video et cède aussi du terrain face au Seedance 2.0 de ByteDance en image-to-video. Mais voilà le paradoxe qui donne le vertige… Seedance 2.0 reste verrouillé derrière une API propriétaire, tandis que H3, lui, s’exécute en local, poids ouverts, personnalisable, fine-tunable.

La firme chinoise a explicitement conçu son architecture pour fonctionner sur du matériel grand public, citant la compatibilité hardware comme « une considération déterminante dans la conception de H3 ». Quatre briques technologiques rendent la chose possible. Le H3-VAE, d’abord, compresse les séquences avec un ratio si agressif qu’il quadruple la longueur effective de séquence traitée, rendant la génération native en 2K économiquement viable. Le H3-Omni Transformer, ensuite, sépare les charges de compréhension et de génération pour optimiser l’utilisation du GPU, avec un gain de débit d’entraînement de près de 30 %. La régénération en contexte, enfin, permet au modèle de ré-upscaler sa propre sortie basse résolution en relisant le contexte multimodal d’origine, récupérant ainsi typographies fines et détails que les upscalers classiques ne font que deviner.

Le profil matériel réel mérite qu’on s’y attarde, parce que « tourner sur un GPU domestique » peut vouloir dire beaucoup de choses. En version safetensors complète (diffusion de 21 Go, encodeur texte Qwen3-VL 32B de 15,7 Go, VAE vidéo de 5,2 Go, VAE audio de 0,6 Go, soit environ 42,5 Go au total), H3 exige une carte dotée de 32 Go de VRAM, typiquement une RTX 5090. Un testeur rapporte environ 2 minutes 30 pour générer 7 secondes de vidéo text-to-video en 736×416, et 7 minutes pour 5 secondes d’image-to-video en 768×1344 sur cette même carte. Les composants non actifs se déchargent vers la RAM système entre les phases.

A lire également

Première école de robots humanoïdes en Chine — robots alignés en salle de classe
La Chine ouvre sa première école de robots humanoïdes pour muscler les cerveaux des machines
Seedance 2.5, le modèle vidéo IA de ByteDance intégré à TikTok Symphony pour générer des spots publicitaires
TikTok arme sa régie publicitaire avec Seedance 2.5, le modèle vidéo IA de ByteDance capable de générer des spots de 30 secondes
atlas boston dynamics
Atlas change sa propre batterie en moins de trois minutes : Boston Dynamics pousse l’autonomie industrielle à un cran inédit

Pour les possesseurs de cartes à 24 Go de VRAM (RTX 4090, RTX 3090), des versions quantifiées au format GGUF existent déjà. La variante Q4_K_M du modèle de diffusion pèse 19,86 Go, celle de l’encodeur texte 14,58 Go, et le tout tient dans l’enveloppe mémoire d’une 4090 avec un compromis qualité-performance que la communauté juge très acceptable. Une quantification Q3_K_M descend même à 15,58 Go pour le diffuseur, offrant une marge confortable.

ComfyUI intègre nativement les nœuds H3 depuis sa version 0.30.0, avec trois workflows prêts à l’emploi (text-to-video, image-to-video, reference-to-video) que l’on peut glisser-déposer dans l’interface. L’écosystème a réagi en quelques heures, fal.ai se positionnant comme partenaire « Day 0 » avec une API serverless pour ceux qui préfèrent ne pas gérer de GPU.

La licence MiniMax Community autorise gratuitement l’usage non commercial et l’usage commercial pour les organisations générant moins de 20 millions de dollars de revenus annuels, avec obligation d’attribution. « Les modèles propriétaires ont longtemps dominé la génération vidéo, avec des cycles d’itération plus lents et un écosystème moins ouvert que celui des grands modèles de langage », a déclaré MiniMax dans son billet d’annonce, justifiant ainsi l’ouverture des poids pour « soutenir la communauté open source ».

Qu’un modèle capable de générer des films de marque, de l’animation stylisée, du gameplay et du montage vidéo avec remplacement d’arrière-plan, clonage vocal et typographie lisible puisse désormais être fine-tuné par n’importe quel studio indépendant sur une machine à 2 000 euros, voilà qui redistribue les cartes d’une manière que ni OpenAI avec Sora, ni Google avec Veo, ni ByteDance avec Seedance n’avaient anticipée. La vidéo générative vient de vivre son « moment LLaMA », et la suite appartient aux bidouilleurs.

Partager cet article
Facebook Whatsapp Whatsapp LinkedIn Reddit Telegram Copy Link

Derniers articles

Carte graphique NVIDIA GeForce RTX 5090, visuel officiel de l annonce de DLSS 5 reserve aux RTX 50
DLSS 5 : NVIDIA réserve sa révolution neurale aux RTX 50 et abandonne les RTX 40 sur le bas-côté
Informatique & Cybersécurité
oppo find x10
Oppo prépare l’abandon des capteurs Sony au profit de Samsung et ses 200 mégapixels
Mobiles & Apps
GTA 6, artwork officiel de Rockstar avec les protagonistes Lucia et Jason et le logo du jeu
GTA 6 : des précommandes « sans précédent » et un aperçu élargi sur Netflix le 27 août
Consoles & Jeux Vidéo
Nothing Phone, smartphone officiel au dos transparent et interface Glyph
Nothing vise six smartphones en 2027 : la marque londonienne accélère et lorgne le marché américain
Mobiles & Apps

Tendance

ios 27
iOS 27 en bêta publique : Siri dopé à l’IA arrive enfin sur iPhone
Mobiles & Apps
iphone 18 pro concept
Foxconn lance son recrutement massif pour produire l’iPhone 18 Pro avant septembre
Mobiles & Apps
Windows 11
Windows 11 démembre Phone Link : la synchronisation Android s’installe au cœur du système
Informatique & Cybersécurité Mobiles & Apps
ps6 concept
PlayStation abandonne les jeux physiques : le vrai visage de la PS6 se dessine
Consoles & Jeux Vidéo
CyberGhost VPN
CyberGhost VPN casse son prix à 1,59 €/mois : 88 % de remise et 2 mois offerts
Informatique & Cybersécurité

Vous allez aussi aimer

gpt-5.6
IA & Robotique

GPT-5.6 arrive la semaine prochaine : OpenAI pousse le curseur à 1,5 million de tokens

19 juin 2026
DeepSeek V4 Flash - logo blanc et nom du modèle sur fond tech abstrait
IA & Robotique

DeepSeek V4-Flash : le modèle d’IA le moins cher au monde coûte cent fois moins que Claude Fable 5

5 août 2026
interdire chatgpt aux mineurs
IA & Robotique

Faut-il interdire ChatGPT et les chatbots IA aux mineurs ?

16 juin 2026
qwen
IA & Robotique

Alibaba lance Qwen 3.6 Max, son dernier modèle IA spécialement taillé pour l’agentique

23 avril 2026
claude fable 5
IA & Robotique

Claude Fable 5 de retour dès mercredi : Anthropic arrache la levée des restrictions américaines

1 juillet 2026
ia vole propriété intellectuelle
IA & RobotiqueTech & Innovations

L’intelligence artificielle a-t-elle volé les créateurs ? Le procès du copyright s’enflamme

16 juin 2026
bmw robots usines
IA & Robotique

BMW veut déployer des robots humanoïdes dans ses usines européennes

14 juin 2026
Concept de l'enceinte connectée donut d'OpenAI, conçue avec Jony Ive (LoveFrom)
IA & Robotique

OpenAI et Jony Ive dévoilent un donut connecté : ChatGPT prend corps dans une enceinte à 300 dollars

7 août 2026

Infos légales

  • Mentions légales
  • Politique de confidentialité
  • Nous contacter
  • Partenaires

Maj récentes

Logo officiel Roblox, le logo noir sur fond vert
Roblox s’effondre en Bourse : l’action perd 70 % tandis que les joueurs désertent la plateforme au deuxième trimestre 2026
Consoles & Jeux Vidéo
Visuel officiel Apple Upgrade : iPhone, Mac, iPad et Apple Watch, programme de location mensuelle via Klarna
Apple Upgrade : la location mensuelle d’iPhone, iPad, Mac et Apple Watch débarque aux États-Unis via Klarna
Mobiles & Apps
Symbole Bitcoin protégé par un bouclier numérique contre des attaques IA, concept illustrant le Bitcoin Red Team
Bitcoin Red Team : quand l’IA débusque des failles critiques au cœur de l’écosystème Bitcoin
Blockchain & Crypto
Concept du générateur d'images IA Imagine Image 2.0 de xAI pour Grok
xAI déploie Imagine Image 2.0 : Grok passe au Quality Mode pour la génération d’images
IA & Robotique

Qui sommes nous ?

Le Journal du Web alias JDW a été fondé et est édité par des passionnés par l’univers web, nouvelles technologies et de la culture populaire.

Newsletter
Inscrivez-vous à notre newsletter pour recevoir nos derniers articles!
Suivez-nous
Welcome Back!

Sign in to your account

Username or Email Address
Password

Mot de passe oublié ?