JDWJDW
Font ResizerAa
  • Tech & Innovations
  • Mobiles & Apps
  • IA & Robotique
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Blockchain & Crypto
  • Plus
    • Web & Internet
    • Geek & Gadgets
    • Informatique & Cybersécurité
    • Sciences & Espace
    • Réseaux Sociaux & Influence
    • e-Business & Webmarketing
    • Fintech & Néobanques
    • Streaming & P2P
Font ResizerAa
JDWJDW
Rechercher
  • Web & Internet
  • Tech & Innovations
  • Mobiles & Apps
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Blockchain & Crypto
  • Geek & Gadgets
  • Informatique & Cybersécurité
  • Streaming & P2P
Avez-vous déjà un compte ? Sign In
Suivez-nous
IA & Robotique

Mistral AI présente Shieldstral, le modèle de sécurité à 3 milliards de paramètres

Emmanuelle Grossuet
Published: 5 août 2026
Last updated: 5 août 2026
Partager
Logo officiel Mistral AI

Mistral a publié le 4 août 2026 un classifieur de sécurité multimodal de 3 milliards de paramètres, baptisé Shieldstral, distribué sous licence Apache 2.0 et capable de tourner sur un seul GPU NVIDIA de 16 Go, qui égale ou surpasse des modèles pesant jusqu’à sept fois sa taille sur les benchmarks de modération textuelle et établit un nouvel état de l’art en modération multimodale.

Là où la plupart des garde-fous embarquent dans leurs poids une taxonomie figée de catégories de risques (violence, contenu sexuel, discours haineux…), Shieldstral déplace la politique de sécurité dans le prompt lui-même. L’opérateur formule une question en langage naturel, « Ce contenu incite-t-il à la violence physique ? » par exemple, accompagnée d’un champ d’instruction précisant le contexte et le degré de sévérité, puis du document à évaluer, qu’il s’agisse d’un texte, d’une image ou d’un couple prompt-réponse. Le modèle ne produit alors qu’un seul token, dont les logits « oui » et « non » sont normalisés par softmax pour obtenir un score continu de sécurité, seuillable à 0,5 pour un verdict binaire.

Cette architecture transforme en une seule opération ce qui nécessitait auparavant quatre pipelines distincts, à savoir la classification de prompts, la modération de réponses, la détection de refus et le repérage de toxicité. Un même checkpoint peut ainsi protéger un outil de recherche en cybersécurité le matin et une plateforme de santé mentale l’après-midi, sans le moindre réentraînement. Qui d’autre peut en dire autant à 3 milliards de paramètres ?

Les chiffres rapportés par Mistral dans son rapport technique (mis en ligne le 28 juillet 2026) montrent un profil étonnamment compétitif. Shieldstral atteint 84,9 % de F1 moyen sur les benchmarks de sécurité textuelle, à parité avec GPT-OSS-Safeguard-20B, et 83,8 % de F1 moyen en modération multimodale, devant OmniGuard-7B (77,6 %). Sur l’évaluation d’adaptabilité aux politiques, conçue avec une taxonomie délibérément absente des données d’entraînement, le score grimpe à 91,3 %, contre 94,1 % pour le modèle vingt milliards de paramètres de GPT-OSS qui, lui, génère une longue chaîne de raisonnement avant de répondre. Ces résultats restent bien sûr auto-déclarés, et l’annexe du rapport reconnaît elle-même des faiblesses en arabe et en indonésien, langues sur lesquelles plusieurs modèles concurrents font mieux.

La recette d’entraînement explique en partie comment un modèle aussi compact rivalise avec des architectures bien plus lourdes. Environ 54,1 millions d’échantillons ont été assemblés, dont 45,2 millions de textes issus de jeux de données publics aux taxonomies hétérogènes, 4,4 millions de paires contrastives synthétiques et 4,5 millions d’échantillons multimodaux. Les paires contrastives constituent le cœur du dispositif didactique. Un LLM réécrit un texte inoffensif pour qu’il enfreigne une politique donnée tout en épargnant une politique voisine, forçant ainsi le modèle à discriminer finement entre règles proches plutôt qu’à mémoriser des catégories. Trois fine-tunings LoRA, l’un calibré sur les données publiques, l’autre enrichi par les paires contrastives, le troisième issu du modèle de base Ministral-3-3B avec son encodeur visuel Pixtral, sont ensuite fusionnés par interpolation sphérique (SLERP) en un unique checkpoint.

A lire également

OpenAI
OpenAI Astra : dix problèmes de mathématiques ouverts depuis des décennies résolus par un modèle qui n’existe pas encore pour le public
Qwen3.8-Max - logo blanc et nom du modèle sur fond tech abstrait
Alibaba dégaine Qwen 3.8 Max, monstre de 2 400 milliards de paramètres bientôt livré en open source
DeepSeek V4 Flash - logo blanc et nom du modèle sur fond tech abstrait
DeepSeek V4-Flash : le modèle d’IA le moins cher au monde coûte cent fois moins que Claude Fable 5

Mistral a dévoilé Shieldstral en tant que membre inaugural de l’Open Secure AI Alliance, une coalition qui rassemble désormais plus de 120 organisations, dont NVIDIA, Cisco, CrowdStrike et Hugging Face, et qui présentait le même jour à la conférence Black Hat de Las Vegas un projet de directives baptisé SAFE (Shared AI Findings Exchange), destiné à mutualiser le renseignement sur les incidents de cybersécurité liés à l’IA agentique. Dans cet écosystème où chaque membre contribue une brique spécialisée (scanner de vulnérabilités, runtime sandboxé, couche d’identité), Shieldstral occupe la case « modèle de sécurité ouvert » et couvre douze langues, du moins sur le papier.

La feuille de route annoncée vise l’élargissement de la couverture multilingue, la robustesse sur les documents longs et l’extension du périmètre multimodal. Reste à savoir si la communauté open source s’emparera effectivement d’un garde-fou dont la politique voyage avec la requête plutôt que d’être scellée dans les poids, un renversement de paradigme qui pourrait rendre obsolète l’idée même d’un jeu unique de catégories de risques.

Partager cet article
Facebook Whatsapp Whatsapp LinkedIn Reddit Telegram Copy Link

Derniers articles

Art cinématique officiel d'Attack on Titan 3, Eren Yeager avec l'équipement tridimensionnel face au Titan Colossal, fumée et braises, Koei Tecmo
L’Attaque des titans 3 débarque le 10 décembre 2026 sur Nintendo Switch 2 avec un trailer qui promet la guerre totale
Consoles & Jeux Vidéo
Robot humanoïde BYD Xiao Di en démonstration, fond avec logo BYD
BYD dévoile Xiao Di, son robot humanoïde IA pour rivaliser avec le Tesla Optimus
IA & Robotique
Concept robots humanoïdes alignés dans une usine futuriste, guerre des robots US-Chine
Robots humanoïdes chinois bannis des États-Unis : Washington déclenche la guerre des machines
IA & Robotique
Key art officiel du DLC Pokémon Pokopia Bubbly Basin, personnage en plongée avec Popplio et Sobble, logo Pokémon Pokopia Expansion Pass, Nintendo Switch 2
Pokémon Pokopia : le DLC Bubbly Basin plonge les joueurs dans les abysses dès le 5 août sur Switch 2
Consoles & Jeux Vidéo

Tendance

ios 27
iOS 27 en bêta publique : Siri dopé à l’IA arrive enfin sur iPhone
Mobiles & Apps
iphone 18 pro concept
Foxconn lance son recrutement massif pour produire l’iPhone 18 Pro avant septembre
Mobiles & Apps
Windows 11
Windows 11 démembre Phone Link : la synchronisation Android s’installe au cœur du système
Informatique & Cybersécurité Mobiles & Apps
CyberGhost VPN
CyberGhost VPN casse son prix à 1,59 €/mois : 88 % de remise et 2 mois offerts
Informatique & Cybersécurité
ps6 concept
PlayStation abandonne les jeux physiques : le vrai visage de la PS6 se dessine
Consoles & Jeux Vidéo

Vous allez aussi aimer

interdire chatgpt aux mineurs
IA & Robotique

Faut-il interdire ChatGPT et les chatbots IA aux mineurs ?

16 juin 2026
nvidia
IA & RobotiqueTech & Innovations

Nvidia contre une prise de participation de l’État américain dans les entreprises IA : Jensen Huang dit non

18 juin 2026
claude fable 5
IA & Robotique

Claude Fable 5 de retour dès mercredi : Anthropic arrache la levée des restrictions américaines

1 juillet 2026
figure 03
IA & Robotique

Figure AI accélère la production de son robot humanoïde Figure 03 jusqu’à un robot par heure

14 juin 2026
Navigateur Google Chrome
IA & Robotique

Chrome transformé en collègue IA : Google passe à la vitesse supérieure avec Gemini et l’auto browse

24 avril 2026
google ai
IA & Robotique

Google Cloud dévoile deux nouvelles puces IA pour concurrencer Nvidia

24 avril 2026
google ai
IA & Robotique

Google prêt à injecter jusqu’à 40 milliards de dollars dans Anthropic : le pari le plus cher de la course à l’IA

26 avril 2026
siri ai
IA & RobotiqueMobiles & Apps

Siri AI absente de l’UE : Apple accuse Bruxelles, qui renvoie la balle

12 juin 2026

Infos légales

  • Mentions légales
  • Politique de confidentialité
  • Nous contacter
  • Partenaires

Maj récentes

Key art concept Apex Legends, équipe de légendes en action
Apex Legends sur Nintendo Switch : EA débranche les serveurs le 4 août 2026
Consoles & Jeux Vidéo
Concept anime Genshin style, personnages affrontant un monde enneigé fantastique avec château de glace
Genshin Impact 7.0 : Snezhnaya, trains blindés et fusils à la troisième personne débarquent le 12 août
Consoles & Jeux Vidéo
Robot humanoïde type Tesla Optimus dans un hall industriel futuriste, production à grande échelle
Tesla Optimus : la feuille de route industrielle prévoit jusqu’à 10 millions de robots humanoïdes par an
IA & Robotique
Personnage vu de dos avec pioche au dos, plane vers une île flottante au coucher du soleil, Fortnite Chapter 7 Season 4
Fortnite Chapitre 7 Saison 4 : une saison Gaming Legends se profile avec Pac-Man, Persona et Sonic dans les starting-blocks
Consoles & Jeux Vidéo

Qui sommes nous ?

Le Journal du Web alias JDW a été fondé et est édité par des passionnés par l’univers web, nouvelles technologies et de la culture populaire.

Newsletter
Inscrivez-vous à notre newsletter pour recevoir nos derniers articles!
Suivez-nous
Welcome Back!

Sign in to your account

Username or Email Address
Password

Mot de passe oublié ?