JDWJDW
Font ResizerAa
  • Tech & Innovations
  • Mobiles & Apps
  • IA & Robotique
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Geek & Gadgets
  • Véhicules & e-Mobilité
  • Bons plans & promos
  • Plus
    • Blockchain & Crypto
    • Web & Internet
    • Informatique & Cybersécurité
    • Sciences & Espace
    • Réseaux Sociaux & Influence
    • e-Business & Webmarketing
    • Fintech & Néobanques
    • Streaming & P2P
Font ResizerAa
JDWJDW
Rechercher
  • Web & Internet
  • Tech & Innovations
  • Mobiles & Apps
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Blockchain & Crypto
  • Geek & Gadgets
  • Informatique & Cybersécurité
  • Streaming & P2P
Avez-vous déjà un compte ? Sign In
Suivez-nous
IA & Robotique

Mistral AI présente Shieldstral, le modèle de sécurité à 3 milliards de paramètres

Emmanuelle Grossuet
Published: 5 août 2026
Last updated: 5 août 2026
Partager
Logo officiel Mistral AI

Mistral a publié le 4 août 2026 un classifieur de sécurité multimodal de 3 milliards de paramètres, baptisé Shieldstral, distribué sous licence Apache 2.0 et capable de tourner sur un seul GPU NVIDIA de 16 Go, qui égale ou surpasse des modèles pesant jusqu’à sept fois sa taille sur les benchmarks de modération textuelle et établit un nouvel état de l’art en modération multimodale.

Là où la plupart des garde-fous embarquent dans leurs poids une taxonomie figée de catégories de risques (violence, contenu sexuel, discours haineux…), Shieldstral déplace la politique de sécurité dans le prompt lui-même. L’opérateur formule une question en langage naturel, « Ce contenu incite-t-il à la violence physique ? » par exemple, accompagnée d’un champ d’instruction précisant le contexte et le degré de sévérité, puis du document à évaluer, qu’il s’agisse d’un texte, d’une image ou d’un couple prompt-réponse. Le modèle ne produit alors qu’un seul token, dont les logits « oui » et « non » sont normalisés par softmax pour obtenir un score continu de sécurité, seuillable à 0,5 pour un verdict binaire.

Cette architecture transforme en une seule opération ce qui nécessitait auparavant quatre pipelines distincts, à savoir la classification de prompts, la modération de réponses, la détection de refus et le repérage de toxicité. Un même checkpoint peut ainsi protéger un outil de recherche en cybersécurité le matin et une plateforme de santé mentale l’après-midi, sans le moindre réentraînement. Qui d’autre peut en dire autant à 3 milliards de paramètres ?

Les chiffres rapportés par Mistral dans son rapport technique (mis en ligne le 28 juillet 2026) montrent un profil étonnamment compétitif. Shieldstral atteint 84,9 % de F1 moyen sur les benchmarks de sécurité textuelle, à parité avec GPT-OSS-Safeguard-20B, et 83,8 % de F1 moyen en modération multimodale, devant OmniGuard-7B (77,6 %). Sur l’évaluation d’adaptabilité aux politiques, conçue avec une taxonomie délibérément absente des données d’entraînement, le score grimpe à 91,3 %, contre 94,1 % pour le modèle vingt milliards de paramètres de GPT-OSS qui, lui, génère une longue chaîne de raisonnement avant de répondre. Ces résultats restent bien sûr auto-déclarés, et l’annexe du rapport reconnaît elle-même des faiblesses en arabe et en indonésien, langues sur lesquelles plusieurs modèles concurrents font mieux.

A lire également

Concept Anthropic : noyau neural orange (nouveau modèle IA) + courbe de croissance boursière et chandeliers, à la veille de son IPO
Anthropic pourrait sortir un nouveau modèle IA avant son IPO pour contrer OpenAI
Robot humanoïde Figure 03 piloté par Helix 2.5 pliant du linge dans une cuisine réelle
Figure AI lâche son robot humanoïde Figure 03 dans 30 foyers avec l’objectif qu’il s’adapte seul à son environnement
Robot humanoïde Unitree G1 en position d'attaque kung-fu face à un client dans un magasin d'électronique, vue de vidéosurveillance
Un robot humanoïde attaque un client en magasin : sont-ils prêts à vivre parmi nous ?

La recette d’entraînement explique en partie comment un modèle aussi compact rivalise avec des architectures bien plus lourdes. Environ 54,1 millions d’échantillons ont été assemblés, dont 45,2 millions de textes issus de jeux de données publics aux taxonomies hétérogènes, 4,4 millions de paires contrastives synthétiques et 4,5 millions d’échantillons multimodaux. Les paires contrastives constituent le cœur du dispositif didactique. Un LLM réécrit un texte inoffensif pour qu’il enfreigne une politique donnée tout en épargnant une politique voisine, forçant ainsi le modèle à discriminer finement entre règles proches plutôt qu’à mémoriser des catégories. Trois fine-tunings LoRA, l’un calibré sur les données publiques, l’autre enrichi par les paires contrastives, le troisième issu du modèle de base Ministral-3-3B avec son encodeur visuel Pixtral, sont ensuite fusionnés par interpolation sphérique (SLERP) en un unique checkpoint.

Mistral a dévoilé Shieldstral en tant que membre inaugural de l’Open Secure AI Alliance, une coalition qui rassemble désormais plus de 120 organisations, dont NVIDIA, Cisco, CrowdStrike et Hugging Face, et qui présentait le même jour à la conférence Black Hat de Las Vegas un projet de directives baptisé SAFE (Shared AI Findings Exchange), destiné à mutualiser le renseignement sur les incidents de cybersécurité liés à l’IA agentique. Dans cet écosystème où chaque membre contribue une brique spécialisée (scanner de vulnérabilités, runtime sandboxé, couche d’identité), Shieldstral occupe la case « modèle de sécurité ouvert » et couvre douze langues, du moins sur le papier.

La feuille de route annoncée vise l’élargissement de la couverture multilingue, la robustesse sur les documents longs et l’extension du périmètre multimodal. Reste à savoir si la communauté open source s’emparera effectivement d’un garde-fou dont la politique voyage avec la requête plutôt que d’être scellée dans les poids, un renversement de paradigme qui pourrait rendre obsolète l’idée même d’un jeu unique de catégories de risques.

Partager cet article
Facebook Whatsapp Whatsapp LinkedIn Reddit Telegram Copy Link

Derniers articles

Concept Quantum AI : wordmark argenté traversé par une courbe boursière cyan, panneaux de données fintech, ambiance trading algorithmique sobre
Quantum AI avis : 1 000 € par jour grâce au trading IA, faut-il y croire ?
Blockchain & Crypto Fintech & Néobanques
Samsung Galaxy S27 Pro et S27 Ultra, rendu concept avec les capacités de batterie 5 200 mAh et 5 700 mAh, fond bleu nuit avec batterie verte
Samsung fait certifier son Galaxy S27 Ultra avec une batterie de 5 700 mAh, la plafond est enfin brisé
Mobiles & Apps
Key art officiel de Final Fantasy VII Revelation avec Cloud, Zack, Aerith et Sephiroth
Final Fantasy VII Revelation vise 200 Go sur PS5 : le disque physique ne suffira pas
Consoles & Jeux Vidéo
Soldat Helldiver en armure jaune et cape officiel Helldivers 2
Helldivers : Ritchson en discussions pour succéder à Momoa, Sony vise une sortie en novembre 2027
Films & Séries

Tendance

One Piece
One Piece : où voir l’anime en streaming légalement et tous les épisodes en VF et VOSTFR ?
Animes & Mangas
Dark Web
Dark Web : ce que cache réellement la face obscure d’Internet au-delà des mythes
Informatique & Cybersécurité Web & Internet
Key art Saint Seiya Tenkai-hen Then IV, le nouveau chapitre de Kurumada annoncé pour le 18 décembre
Saint Seiya Tenkai-hen Then IV : Kurumada lance le chapitre Zeus le 18 décembre
Animes & Mangas
Concept d'une montre connectée Garmin mesurant la glycémie non invasive au poignet grâce à un capteur optique
Garmin dévoile un brevet pour mesurer la glycémie au poignet et relance la course contre Apple
Geek & Gadgets
Robot humanoïde type Tesla Optimus dans un hall industriel futuriste, production à grande échelle
Tesla Optimus : premières ventes repoussées à 2027, la mue spectaculaire de Fremont s’accélère
IA & Robotique

Vous allez aussi aimer

Logo OpenAI avec mention IPO 2027 et courbe boursière rouge en baisse, report de l'introduction en bourse
IA & Robotique

OpenAI n’entrera pas en bourse en 2026 : Sam Altman prétexte la sécurité de l’IA

13 septembre 2026
Symbole pause géant face à un essaim de noeuds IA, illustration du ralentissement des modèles frontier réclamé par Amodei, Altman et Musk
IA & Robotique

Course à l’IA : Anthropic, OpenAI et Elon Musk réclament un coup de frein d’urgence

13 septembre 2026
Satellite d'observation en orbite traitant des données par IA, au-dessus de la Terre, concept du consortium franco-émirati Loft Orbital / Marlan Space
IA & RobotiqueSciences & Espace

Espace et IA : la France et les Émirats investissent 1 milliard de dollars dans 50 satellites

10 septembre 2026
Concept Siri AI : assistant bloqué sur iPhone dans l'Union européenne (DMA) avec panneau interdit, mais disponible sur Mac, bêta en octobre
IA & RobotiqueMobiles & Apps

Siri AI et Apple Intelligence : l’Europe attend encore, l’iPhone 17 partiellement incompatible

10 septembre 2026
OpenAI
IA & Robotique

OpenAI – Navier-Stokes : 10 000 agents d’IA résolvent en 4 jours une énigme mathématique de 90 ans

9 septembre 2026
Robot humanoïde XPeng IRON, premier exemplaire sorti en marchant de la ligne de production automatisée de Guangzhou
IA & Robotique

XPeng IRON : le premier humanoïde sort de l’usine en marchant, et Tesla Optimus n’a toujours rien produit

8 septembre 2026
Logo Tencent avec le nom du modèle Hy4 preview sur fond techno sombre
IA & Robotique

Tencent Hy4 preview est là : 770 milliards de paramètres pour son modèle IA open source et séduire les développeurs

8 septembre 2026
Data centre d'inférence Mistral AI, logo MISTRAL, ambition 1 GW de calcul en Europe
IA & Robotique

Mistral AI lève 3 milliards d’euros : Samsung en tête, la souveraineté européenne à prix d’or

8 septembre 2026

Infos légales

  • Mentions légales
  • Politique de confidentialité
  • Nous contacter
  • Partenaires

Maj récentes

Samsung Galaxy affichant la synchronisation native de la Galerie vers Google Photos, OneDrive arrêté fin septembre 2026
Samsung Galaxy : la Galerie bascule vers Google Photos, OneDrive s’arrête le 30 septembre
Mobiles & Apps
Samsung Galaxy S25 avec l'écran de mise à jour One UI 9 sous Android 17, visuel concept du déploiement
One UI 9 pourrait être déployé le 28 septembre, voici les modèles concernés
Mobiles & Apps
Illustration concept : un satellite-miroir orbital déployé renvoie un faisceau de lumière solaire vers la face nocturne de la Terre, concept de la startup Reflect Orbital
Reflect Orbital : ces miroirs spatiaux brillent 40 fois plus que la pleine Lune
Sciences & Espace
Concept iOS 27 : fonction Hide Location qui masque discrètement le partage de position, iPhone affichant Find My avec No Location Found, carré glassmorphism iOS 27 centré
iOS 27 : Apple permet de masquer votre position sans alerter le contact visé
Mobiles & Apps

Qui sommes nous ?

Le Journal du Web alias JDW a été fondé et est édité par des passionnés par l’univers web, nouvelles technologies et de la culture populaire.

Newsletter
Inscrivez-vous à notre newsletter pour recevoir nos derniers articles!
Suivez-nous
Welcome Back!

Sign in to your account

Username or Email Address
Password

Mot de passe oublié ?