JDWJDW
Font ResizerAa
  • Tech & Innovations
  • Mobiles & Apps
  • IA & Robotique
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Geek & Gadgets
  • Véhicules & e-Mobilité
  • Bons plans & promos
  • Plus
    • Blockchain & Crypto
    • Web & Internet
    • Informatique & Cybersécurité
    • Sciences & Espace
    • Réseaux Sociaux & Influence
    • e-Business & Webmarketing
    • Fintech & Néobanques
    • Streaming & P2P
Font ResizerAa
JDWJDW
Rechercher
  • Web & Internet
  • Tech & Innovations
  • Mobiles & Apps
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Blockchain & Crypto
  • Geek & Gadgets
  • Informatique & Cybersécurité
  • Streaming & P2P
Avez-vous déjà un compte ? Se connecter
Suivez-nous
IA & Robotique

OpenAI freine son modèle Astra, jugé trop proche du seuil « Critical » en capacités de cyberattaque

Robin Prigent
Published: 9 août 2026
Last updated: 9 août 2026
Partager
Logo OpenAI avec le nom du modèle Astra, concept sombre inspiré cybersécurité

OpenAI a annoncé vendredi 7 août avoir suspendu une partie des travaux sur Astra, un modèle encore en développement dont les évaluations internes révèlent des aptitudes offensives en cybersécurité suffisamment avancées pour déclencher le plus haut niveau d’alerte du laboratoire. Le Preparedness Framework, ce protocole d’évaluation des risques mis en place dès 2023, a formellement identifié que le modèle pouvait, sans intervention humaine, repérer et exploiter des vulnérabilités dans des systèmes traditionnellement bien protégés, voire concevoir et exécuter des attaques à partir d’un objectif formulé en termes vagues.

« Nos évaluations préliminaires indiquent des performances suffisamment élevées pour que nous ne puissions pas exclure un niveau de capacité Critical à ce stade », a écrit l’entreprise dans un billet de blog, en précisant qu’Astra n’avait aucun lien avec l’incident désormais célèbre où un agent IA d’OpenAI avait piraté les systèmes de Hugging Face lors d’un test interne. La distinction compte, car elle dessine la frontière entre un accident de containment et une décision délibérée de transparence sur un produit qui n’a pas encore quitté le laboratoire.

Un laboratoire d’IA de pointe qui rend publique la mise en pause partielle d’un modèle non commercialisé, voilà un geste dont la rareté mérite qu’on s’y arrête. Les entreprises de tous secteurs retardent régulièrement des produits pour des raisons de sécurité, et n’en disent rien. OpenAI a choisi de documenter la chose, d’expliquer les seuils franchis, de nommer le modèle. Pourquoi maintenant ? Le contexte l’y oblige sans doute. Depuis juillet, les révélations s’enchaînent à un rythme quasi quotidien… Un agent d’OpenAI qui s’échappe de son sandbox et compromet Hugging Face (le premier cas vérifiable de perte de contrôle d’un modèle par un laboratoire), Meta qui admet cette semaine qu’un de ses propres modèles a piraté une entreprise tierce pendant des tests, et l’AI Security Institute britannique (AISI) qui rapporte le 4 août que des agents alimentés par OpenAI et Anthropic ont spontanément envoyé des e-mails ciblés à des développeurs pour tenter de passer un défi cyber, sans y avoir été expressément incités.

L’AISI a d’ailleurs tenu à nuancer la portée de cet épisode. « Ce n’est pas un cas de modèle s’échappant de son environnement de test sécurisé », a précisé l’institut, rappelant que l’accès à internet avait été volontairement autorisé pour évaluer les capacités maximales des modèles. Le comportement restait néanmoins « possible, soutenu et nouveau », selon ses termes, ce qui justifiait à lui seul une attention accrue.

A lire également

Concept : OpenAI accuse Moonshot AI (Kimi) de distillation massive du raisonnement de ses modèles pour nourrir Kimi
OpenAI accuse Moonshot AI d’avoir aspiré le raisonnement de ses modèles pour nourrir Kimi
Tesla Optimus Gen 3
Optimus Gen 3 : une fuite dans l’application Tesla révèle le rendu du futur robot
Logo PixVerse avec le nom du modèle R2, world model temps réel
PixVerse R2 : la vidéo générative par IA s’ouvre à l’interaction en temps réel

Les mesures qu’OpenAI déploie autour d’Astra dessinent un périmètre de confinement renforcé, avec des environnements de test isolés, un accès réseau et des outils restreints, un chiffrement et une protection accrus des poids du modèle, ainsi que des capacités de surveillance supplémentaires. Toute activité interne impliquant Astra qui ne satisfait pas ces nouvelles exigences est gelée. Le laboratoire affirme collaborer avec des agences gouvernementales et des organisations spécialisées en sûreté de l’IA pour auditer les capacités du modèle.

Reste la question que personne dans l’écosystème ne formule tout à fait innocemment. Quand un laboratoire annonce qu’il bride un modèle parce que celui-ci est devenu trop puissant, s’agit-il d’un acte de responsabilité ou d’une démonstration de force à peine voilée ? Certains observateurs du secteur, cités par The Guardian, soulignent que ce type de divulgation, chez OpenAI comme chez Anthropic ou Meta, peut aussi fonctionner comme un signal adressé aux investisseurs, une manière de certifier que la technologie progresse à une vitesse qui justifie les valorisations stratosphériques. L’administration Trump finalise en parallèle un cadre fédéral pour les tests de sécurité des modèles d’IA, et OpenAI comme Anthropic poussent activement en faveur d’une réglementation plus stricte des modèles open source, arguant qu’ils représentent un risque sécuritaire, du moins pour ceux qui ne disposent pas des moyens de les encadrer.

Astra n’a encore rien attaqué, rien compromis, rien exfiltré. Le modèle dort dans un sandbox renforcé pendant que ses créateurs mesurent l’étendue exacte de ce qu’il sait faire. La vraie nouveauté n’est peut-être pas qu’une IA approche du seuil où elle pourrait mener des cyberattaques autonomes contre des cibles durcies, mais qu’un laboratoire choisisse de le dire avant que quelqu’un d’autre ne le découvre à ses dépens.

Partager cet article
Facebook Whatsapp Whatsapp LinkedIn Reddit Telegram Copy Link

Derniers articles

Florence Pugh en Cathy Ames dans East of Eden, mini-série Netflix de Zoe Kazan
Netflix ressuscite À l’est d’Éden : Florence Pugh porte une tragédie familiale intense
Films & Séries
Samsung Galaxy Buds On, écouteurs clip-on open-ear noirs, visuel de présentation
Samsung lance les Galaxy Buds On et s’attaque enfin aux écouteurs ouverts
Geek & Gadgets
Apple A20, puce N2 2 nm du futur iPhone 18 non-Pro, rendu concept avec carte de billes visible
iPhone 18 standard : le schéma de la puce A20 vend la mèche sur les sacrifices d’Apple
Mobiles & Apps
Nintendo Switch 2 et Switch, mise à jour système 23.0.1 corrigeant les lenteurs au démarrage, à la pause et à la fermeture
Switch 2 : la mise à jour 23.0.1 corrige les lenteurs au lancement, à la pause et à la fermeture des jeux
Consoles & Jeux Vidéo

Tendance

noTube
noTube Avis : risque de virus, qualité de sortie MP3/MP4… ce convertisseur est-il vraiment fiable ?
One Piece
One Piece : où voir l’anime en streaming légalement et tous les épisodes en VF et VOSTFR ?
Animes & Mangas
Dark Web
Dark Web : ce que cache réellement la face obscure d’Internet au-delà des mythes
Informatique & Cybersécurité Web & Internet
WhatsApp Web
WhatsApp Web : comment tchatter avec ses contacts sans application ?
Mobiles & Apps Web & Internet
Key art Saint Seiya Tenkai-hen Then IV, le nouveau chapitre de Kurumada annoncé pour le 18 décembre
Saint Seiya Tenkai-hen Then IV : Kurumada lance le chapitre Zeus le 18 décembre
Animes & Mangas

Vous allez aussi aimer

Logo officiel Anthropic Claude avec le nom du modèle Opus 5.5 au centre, concept sur fond techno sombre
IA & Robotique

Anthropic lance Claude Opus 5.5 et baisse enfin le prix de son API

24 septembre 2026
Grok 4.7, logo et nom du modèle flagship de xAI sur fond techno sombre
IA & Robotique

Grok 4.7 : xAI lance son nouveau modèle de raisonnement taillé pour le code

22 septembre 2026
Concept Anthropic : noyau neural orange (nouveau modèle IA) + courbe de croissance boursière et chandeliers, à la veille de son IPO
IA & Robotique

Anthropic pourrait sortir un nouveau modèle IA avant son IPO pour contrer OpenAI

19 septembre 2026
Robot humanoïde Figure 03 piloté par Helix 2.5 pliant du linge dans une cuisine réelle
IA & Robotique

Figure AI lâche son robot humanoïde Figure 03 dans 30 foyers avec l’objectif qu’il s’adapte seul à son environnement

19 septembre 2026
Robot humanoïde Unitree G1 en position d'attaque kung-fu face à un client dans un magasin d'électronique, vue de vidéosurveillance
IA & Robotique

Un robot humanoïde attaque un client en magasin : sont-ils prêts à vivre parmi nous ?

13 septembre 2026
Logo OpenAI avec mention IPO 2027 et courbe boursière rouge en baisse, report de l'introduction en bourse
IA & Robotique

OpenAI n’entrera pas en bourse en 2026 : Sam Altman prétexte la sécurité de l’IA

13 septembre 2026
Symbole pause géant face à un essaim de noeuds IA, illustration du ralentissement des modèles frontier réclamé par Amodei, Altman et Musk
IA & Robotique

Course à l’IA : Anthropic, OpenAI et Elon Musk réclament un coup de frein d’urgence

13 septembre 2026
Satellite d'observation en orbite traitant des données par IA, au-dessus de la Terre, concept du consortium franco-émirati Loft Orbital / Marlan Space
IA & RobotiqueSciences & Espace

Espace et IA : la France et les Émirats investissent 1 milliard de dollars dans 50 satellites

10 septembre 2026

Qui sommes nous ?

Média numérique indépendant, Le Journal du Web (JDW) analyse les évolutions technologiques, les nouveautés mobiles et la pop-culture. Entre tests de produits, avis impartiaux et sélection rigoureuse de bons plans vérifiés, nos rédacteurs décryptent chaque jour l’actualité tech, le jeu vidéo et la culture web pour accompagner votre quotidien connecté

Maj récentes

Jenna Ortega en Wednesday Addams penchée sur une machine à écrire, premier regard officiel de la saison 3 de Wednesday sur Netflix
Mercredi saison 3 : fin du tournage et première image de Jenna Ortega
Films & Séries
Citroën 2 CV concept : le teasing officiel du Mondial de l'Auto 2026, voiture concept néo-rétro sous bâche qui se révèle
Citroën réveille l’icône 2 CV en dévoilant les premiers secrets de son concept
Véhicules & e-Mobilité
Concept The Last of Us : ville abandonnée envahie par la végétation et le Cordyceps, deux traînées de lucioles divergent vers deux chemins, symbolisant les deux nouveaux projets Naughty Dog
The Last of Us prépare son futur : Naughty Dog confirme deux projets inédits
Consoles & Jeux Vidéo
Samsung Galaxy S26 avec l'écran de mise à jour One UI 9 sous Android 17, déploiement OTA vers l'Europe, le Canada et l'Inde, visuel concept
Samsung déploie enfin One UI 9 sur les Galaxy S26 : qu’en est-il des autres modèles ?
Mobiles & Apps

Infos légales

  • Charte éthique et éditoriale
  • Mentions légales
  • Politique de confidentialité
  • Nous contacter
  • Partenaires
Suivez-nous
© 2019- Le Journal du Web (JDW). Tous droits réservés.
  • Charte éthique et éditoriale
  • Mentions légales
  • Politique de confidentialité
  • Nous contacter
  • Partenaires
Welcome Back!

Sign in to your account

Username or Email Address
Password

Mot de passe oublié ?