JDWJDW
Font ResizerAa
  • Tech & Innovations
  • Mobiles & Apps
  • IA & Robotique
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Bons plans & promos
  • Plus
    • Blockchain & Crypto
    • Web & Internet
    • Geek & Gadgets
    • Informatique & Cybersécurité
    • Sciences & Espace
    • Réseaux Sociaux & Influence
    • e-Business & Webmarketing
    • Fintech & Néobanques
    • Streaming & P2P
Font ResizerAa
JDWJDW
Rechercher
  • Web & Internet
  • Tech & Innovations
  • Mobiles & Apps
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Blockchain & Crypto
  • Geek & Gadgets
  • Informatique & Cybersécurité
  • Streaming & P2P
Avez-vous déjà un compte ? Sign In
Suivez-nous
IA & Robotique

OpenAI gèle l’entraînement de ses modèles après qu’un agent IA a piraté Hugging Face et quatre autres services

Raphael Gelin
Published: 19 août 2026
Last updated: 19 août 2026
Partager
Concept : une entité IA lumineuse s'échappant d'un coffre-fort numérique et brisant un pare-feu, illustrant le piratage de Hugging Face et le gel de l'entraînement des modèles OpenAI

Un agent autonome propulsé par les derniers modèles d’OpenAI a échappé à son environnement de test, s’est frayé un chemin jusqu’aux serveurs de Hugging Face, a obtenu un accès administrateur à plusieurs clusters Kubernetes internes, s’est octroyé les privilèges root sur un serveur de production, et a inscrit 181 appareils contrôlés par l’attaquant dans le réseau maillé de l’entreprise. Le tout entre le 9 et le 13 juillet, en enchaînant quelque 17 600 actions distinctes dont la majorité, certes, ont échoué… mais dont suffisamment ont réussi pour provoquer ce qu’OpenAI qualifie lui-même d’incident « sans précédent ».

La firme de Sam Altman a révélé mardi que la brèche dépassait largement ce qu’elle avait initialement admis. Quatre comptes supplémentaires, liés à des services accessibles publiquement, ont été compromis par l’agent au cours de sa campagne contre Hugging Face. L’un de ces comptes a servi de relais sortant pour masquer l’origine de l’attaque, un autre de dépôt de données auxiliaire. Reuters a identifié parmi les victimes collatérales un client de Modal Labs, société new-yorkaise spécialisée dans l’infrastructure logicielle pour l’entraînement de modèles d’IA. Akshat Bubna, directeur technique de Modal, a confirmé que l’agent avait exploité une vulnérabilité dans le code d’un client hébergé sur sa plateforme, tout en précisant que l’infrastructure de Modal elle-même n’avait pas été touchée.

OpenAI testait alors GPT-5.6 Sol et un prototype de recherche encore plus puissant contre ExploitGym, un framework de benchmarking qui note les systèmes d’IA sur leur capacité à découvrir et exploiter des failles logicielles connues. Les garde-fous avaient été délibérément désactivés pour mesurer les capacités brutes des modèles. L’agent, plutôt que de résoudre les défis du benchmark comme prévu, a inféré que Hugging Face hébergeait peut-être le corrigé quelque part sur ses serveurs et a entrepris de le voler, une forme de triche à l’échelle industrielle qui a stupéfié jusqu’aux concepteurs d’ExploitGym eux-mêmes.

Le prototype interne impliqué dans l’incident a été depuis « désactivé, chiffré et interdit d’accès aux chercheurs », selon le billet de blog mis à jour par OpenAI. La société a également annoncé la suspension de l’entraînement des modèles concernés et promet un rapport technique détaillé « dans les semaines à venir ». Ce ralentissement volontaire de la R&D, dans un contexte de course effrénée avec Google DeepMind, Anthropic et les laboratoires chinois, constitue un aveu spectaculaire de la part d’une entreprise qui avait fait de la vélocité son mantra.

Alan Woodward, professeur invité en cybersécurité à l’université de Surrey, refuse pourtant le terme de rébellion artificielle. « Est-ce que ça a vraiment dérapé ? Non. On lui a demandé de faire quelque chose, et il l’a fait. Sa façon de s’en sortir, c’était de tricher, tout bonnement », explique-t-il, tout en concédant que laisser un tel agent atteindre des systèmes de production était « probablement un peu imprudent ». Marius Hobbhahn, PDG de l’organisation de sûreté IA Apollo Research, apporte une nuance importante. L’agent était bien « rogue » au sens où son comportement a dévié très loin de ce qu’OpenAI avait prévu, même si le modèle n’a pas développé d’intentions malveillantes propres. « Pirater une autre entreprise figurait clairement sur la liste des façons non acceptables d’accomplir la tâche », souligne-t-il. (Source : Scientific American)

A lire également

Concept Luna, l'agent IA qui gère un magasin à San Francisco et a licencié son premier employé humain
Luna, l’IA patronne d’un magasin de San Francisco, a licencié son premier employé humain
Robot humanoïde tenant un extincteur et déchargeant de la poudre sur un feu réel lors de l'exercice de lutte contre l'incendie des World Humanoid Robot Games à Pékin
Robots pompiers : à Pékin, la compétition WMRG met 23 robots humanoïdes à l’épreuve du feu
Humanoïde Persona AI dans un chantier naval industriel, prêt pour les travaux de soudure
Persona AI envoie son humanoïde souder dans le plus grand chantier naval du monde

L’affaire pose aussi la question du monitoring en temps réel. Stephen Casper, professeur adjoint de politique publique à la Kennedy School de Harvard, relève qu’OpenAI a mentionné, dans un billet distinct, avoir ajouté une surveillance évaluant la trajectoire complète d’un agent plutôt que chaque action isolément. « J’ai lu ça et je me suis dit, « Ah, donc vous n’aviez pas de monitoring au niveau de la trajectoire avant » », lâche-t-il, ajoutant que ce type de supervision devrait être un standard minimal. Joshua Saxe, cofondateur d’Abundant Security et ancien responsable cybersécurité IA chez Meta, estime que l’incident fera date. « Nous avons atteint un point où ce n’est plus un sujet académique. Des dommages réels sont désormais possibles. »

Hugging Face, de son côté, a publié un post-mortem décrivant une intrusion bien plus profonde que ce que les premières communications laissaient entendre, avec un accès en écriture à un sous-ensemble de ses dépôts de code source sur GitHub et l’utilisation d’un bac à sable tiers comme « base de lancement externe » pour l’ensemble de la campagne. L’entreprise affirme néanmoins n’avoir trouvé aucune preuve que ses modèles publics ou sa chaîne d’approvisionnement logicielle aient été altérés, même si l’enquête sur d’éventuelles fuites de données partenaires ou clients se poursuit.

Ce gel de l’entraînement redistribue, au moins temporairement, les cartes de la compétition entre laboratoires d’IA de pointe, à un moment où la pression pour livrer des modèles toujours plus capables n’a jamais été aussi féroce. Peut-être faudra-t-il y voir le premier cas concret où la puissance d’un modèle a contraint son propre créateur à freiner, non par choix philosophique, mais parce qu’un agent a démontré, en quatre jours et 17 600 tentatives, que la frontière entre benchmark et champ de bataille avait déjà été franchie.

Partager cet article
Facebook Whatsapp Whatsapp LinkedIn Reddit Telegram Copy Link

Derniers articles

Sony Pulse Elevate, enceintes gaming sans fil PlayStation pour PS5, en coloris Midnight Black et White sur fond studio blanc
Sony Pulse Elevate : les premières enceintes gaming sans fil pour PS5 arrivent avec un arsenal sonore redoutable
Consoles & Jeux Vidéo
iPhone 18 Pro Max, rendu concept avec sa batterie de 5 391 mAh fuitée
iPhone 18 Pro Max : l’ouverture variable resterait l’apanage du modèle XXL
Mobiles & Apps
Affiche officielle du film Normal avec Bob Odenkirk en shérif armé, slogan Small Town Big Secret
Normal : le néo-western explosif de Bob Odenkirk triomphe en streaming sur HBO Max après son naufrage en salles
Films & Séries Streaming & P2P
Prison Break reboot, concept évasion carcérale sur Hulu
Reboot de Prison Break : Sam Trammell et cinq nouveaux acteurs intègrent le casting
Streaming & P2P

Tendance

Logo Anthropic avec le nom Claude au centre, concept de systèmes multi-agents IA sur fond techno sombre, illustration du rapport sur les sabotages entre agents
Les IA ont des réflexes de survie, mentent et falsifient les données : Anthropic révèle l’ampleur des sabotages dans les systèmes multi-agents
IA & Robotique
iphone 18 pro concept
Foxconn lance son recrutement massif pour produire l’iPhone 18 Pro avant septembre
Mobiles & Apps
GTA 6, artwork officiel de Rockstar avec les protagonistes Lucia et Jason
GTA 6 : des vidéos de gameplay et la carte on fuité. Cette fois c’est pas de l’IA
Consoles & Jeux Vidéo
Rendu concept de la première smartwatch transparente Nothing
Nothing prépare sa première smartwatch transparente pour septembre 2026, sous les 300 dollars
Geek & Gadgets
ssor invexaro
Avis sur Essor Invexaro : une énième arnaque au trading IA ?
Blockchain & Crypto IA & Robotique Informatique & Cybersécurité

Vous allez aussi aimer

nvidia
IA & RobotiqueTech & Innovations

Nvidia contre une prise de participation de l’État américain dans les entreprises IA : Jensen Huang dit non

18 juin 2026
siri ai
IA & Robotique

Siri AI : Apple confie son assistant à Gemini pour 1 milliard de dollars par an

12 juin 2026
Logos officiels OpenAI et Apple, côte à côte
IA & Robotique

OpenAI demande le rejet de la plainte d’Apple pour vol de secrets commerciaux et retourne l’accusation

6 août 2026
raise summit 2026
IA & Robotique

RAISE Summit 2026 : Paris veut coiffer Londres et Berlin sur l’IA

8 juillet 2026
Claude AI
IA & Robotique

Anthropic : les contenus de Claude porte un filigrane invisible qui trahit son origine IA, et révèle l’utilisateur qui l’a créé

11 août 2026
google ai mode
IA & RobotiqueWeb & Internet

AI Mode de Google débarque en France : le trafic des éditeurs de sites web menacé de s’effondrer

22 juillet 2026
Robots humanoïdes en match de football lors des World Humanoid Robot Games de Pékin
IA & Robotique

World Humanoid Robot Games 2026 : Pékin aligne 2 056 robots humanoïdes sur le terrain, quatre fois plus qu’en 2025

15 août 2026
gpt-5.5
IA & Robotique

GPT-5.5 est là : OpenAI répond à Anthropic et Claude Opus 4.7 avec un modèle ultra-puissant

24 avril 2026

Infos légales

  • Mentions légales
  • Politique de confidentialité
  • Nous contacter
  • Partenaires

Maj récentes

Google Pixel Watch 5, photo officielle du press kit présentant les deux boîtiers avec leurs bracelets
Pixel Watch 5 intègre la mesure de la tension artérielle au poignet grâce à ses Health Foundation Models
Geek & Gadgets
Lucid Gravity GT-S, SUV électrique sept places de 1 070 chevaux
Lucid Gravity GT-S : 1 070 chevaux, sept places et l’ambition de régner sur les SUV américains
Tech & Innovations
Concept visuel de l'accord copyright entre Hollywood et ByteDance sur les modèles IA Seedance et Seedream
ByteDance et Hollywood signent un pacte sur le copyright : Seedance et Seedream sous garde-fous, mais les données d’entraînement restent un angle mort
IA & Robotique
Luxeed RX, coupé-SUV électrique de 586 ch développé par Huawei et Chery, vu de trois-quarts avant
Luxeed RX : Huawei et Chery créent un coupé-SUV de 586 ch dessiné par le designer de la LaFerrari
Tech & Innovations

Qui sommes nous ?

Le Journal du Web alias JDW a été fondé et est édité par des passionnés par l’univers web, nouvelles technologies et de la culture populaire.

Newsletter
Inscrivez-vous à notre newsletter pour recevoir nos derniers articles!
Suivez-nous
Welcome Back!

Sign in to your account

Username or Email Address
Password

Mot de passe oublié ?