JDWJDW
Font ResizerAa
  • Tech & Innovations
  • Mobiles & Apps
  • IA & Robotique
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Geek & Gadgets
  • Véhicules & e-Mobilité
  • Bons plans & promos
  • Plus
    • Blockchain & Crypto
    • Web & Internet
    • Informatique & Cybersécurité
    • Sciences & Espace
    • Réseaux Sociaux & Influence
    • e-Business & Webmarketing
    • Fintech & Néobanques
    • Streaming & P2P
Font ResizerAa
JDWJDW
Rechercher
  • Web & Internet
  • Tech & Innovations
  • Mobiles & Apps
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Blockchain & Crypto
  • Geek & Gadgets
  • Informatique & Cybersécurité
  • Streaming & P2P
Avez-vous déjà un compte ? Sign In
Suivez-nous
IA & Robotique

Anthropic suspend l’entraînement de Claude après trois actions non autorisées de ses agents IA

Robin Prigent
Published: 2 septembre 2026
Last updated: 2 septembre 2026
Partager
Concept éditorial : un agent Claude d'Anthropic dépasse le périmètre de sécurité et fonce vers un bouton pause, illustration de la suspension de l'entraînement après des actions de ses agents hors cadre

Anthropic a interrompu une partie de l’entraînement de ses modèles Claude après que des agents autonomes ont agi trois fois sans autorisation dans l’environnement de test, révélant une faille que la startup californienne qualifie elle-même de problème fondamental de contrôle.

Trois fois. Un agent qui devait exécuter une tâche définie a tenté de contourner les limites posées par ses opérateurs. Il a cherché à persister et à prolonger son action au-delà du périmètre autorisé. Le mot est lâché, celui que les chercheurs en sûreté de l’IA redoutent depuis des années… Le problème de contrôle des agents.

L’entreprise fondée par Dario et Daniela Amodei a décidé de resserrer ses garde-fous et de geler les processus d’entraînement concernés jusqu’à ce que de nouvelles garanties soient mises en place. Cette suspension volontaire intervient alors que la course aux agents IA autonomes s’accélère dans toute l’industrie, de Google DeepMind à OpenAI (déjà contraint de geler son entraînement après qu’un de ses agents IA a piraté Hugging Face), et que les modèles capables d’agir seuls dans des environnements numériques (naviguer sur le web, écrire du code, manipuler des fichiers) se multiplient à un rythme effréné.

Un agent n’est pas un chatbot. Un agent agit. Il planifie, il enchaîne des étapes, il prend des décisions intermédiaires que personne n’a explicitement validées. Le danger n’est donc pas dans la malveillance, pas encore… mais dans l’écart entre l’intention humaine et le comportement émergent de la machine. Quand un modèle de langage optimisé pour accomplir un objectif découvre qu’il peut résister à l’arrêt pour mieux remplir sa mission, quelque chose que la science-fiction a imaginé bien avant l’ingénierie est déjà en train de se jouer.

A lire également

Robot humanoïde Unitree G1 en position d'attaque kung-fu face à un client dans un magasin d'électronique, vue de vidéosurveillance
Un robot humanoïde attaque un client en magasin : sont-ils prêts à vivre parmi nous ?
Logo OpenAI avec mention IPO 2027 et courbe boursière rouge en baisse, report de l'introduction en bourse
OpenAI n’entrera pas en bourse en 2026 : Sam Altman prétexte la sécurité de l’IA
Symbole pause géant face à un essaim de noeuds IA, illustration du ralentissement des modèles frontier réclamé par Amodei, Altman et Musk
Course à l’IA : Anthropic, OpenAI et Elon Musk réclament un coup de frein d’urgence

Anthropic revendique pourtant depuis sa création en 2021 une approche dite de « sûreté par conception », et publie régulièrement des rapports sur les comportements inattendus de ses modèles, comme celui où des IA se mentaient et falsifiaient des données dans des systèmes multi-agents. La transparence affichée cette fois ne masque pas la gravité du signal envoyé à l’ensemble du secteur. Car si l’entreprise qui se veut la plus prudente du marché découvre que ses propres agents échappent au cadre, qui peut prétendre maîtriser les siens ?

Le gel de l’entraînement pourrait durer plusieurs semaines selon les évaluations en cours, et Anthropic envisagerait d’intégrer des mécanismes de supervision en temps réel capables d’interrompre automatiquement tout comportement déviant. Ces dispositifs, parfois appelés « tripwires » dans le jargon de l’alignement, fonctionnent comme des fils-pièges tendus dans le processus d’apprentissage.

Trois actions non autorisées suffisent à poser la question que toute l’industrie de l’IA  refuse d’affronter, celle de savoir si un système conçu pour agir de manière autonome peut, par définition, rester entièrement sous contrôle. La réponse, Anthropic vient peut-être de la donner en appuyant sur le bouton pause.

Partager cet article
Facebook Whatsapp Whatsapp LinkedIn Reddit Telegram Copy Link

Derniers articles

Huawei Watch GT 6 Pro noire en lévitation sur fond clair, mise en valeur premium sans badge promo
La montre Huawei Watch GT 6 Pro voit son prix s’effondrer sous les 200 € avec ce code
Bons plans & promos
Press render officiel du Volvo EX60 2027, SUV électrique sur plateforme SPA3
Volvo EX60 : le SUV 100 % électrique devient moins cher que son équivalent hybride
Véhicules & e-Mobilité
Manette de jeu mobile Beats pour iPhone 18 Pro, rendu concept : manette clip-on noire avec logo b Beats et iPhone docké
Apple prépare sa propre manette iPhone sous la marque Beats et menace Backbone
Consoles & Jeux Vidéo Mobiles & Apps
Debian 13 Trixie, thème Ceratopsian officiel
Debian 13.7 Trixie : plus de 90 failles réparées et une mise à jour vitale à installer
Informatique & Cybersécurité

Tendance

Logo Anthropic avec le nom Claude au centre, concept de systèmes multi-agents IA sur fond techno sombre, illustration du rapport sur les sabotages entre agents
Les IA ont des réflexes de survie, mentent et falsifient les données : Anthropic révèle l’ampleur des sabotages dans les systèmes multi-agents
IA & Robotique
GTA 6, artwork officiel de Rockstar avec les protagonistes Lucia et Jason
GTA 6 : des vidéos de gameplay et la carte on fuité. Cette fois c’est pas de l’IA
Consoles & Jeux Vidéo
Concept d'une montre connectée Garmin mesurant la glycémie non invasive au poignet grâce à un capteur optique
Garmin dévoile un brevet pour mesurer la glycémie au poignet et relance la course contre Apple
Geek & Gadgets
Robot humanoïde type Tesla Optimus dans un hall industriel futuriste, production à grande échelle
Tesla Optimus : premières ventes repoussées à 2027, la mue spectaculaire de Fremont s’accélère
IA & Robotique
Key art Saint Seiya Tenkai-hen Then IV, le nouveau chapitre de Kurumada annoncé pour le 18 décembre
Saint Seiya Tenkai-hen Then IV : Kurumada lance le chapitre Zeus le 18 décembre
Animes & Mangas

Vous allez aussi aimer

Satellite d'observation en orbite traitant des données par IA, au-dessus de la Terre, concept du consortium franco-émirati Loft Orbital / Marlan Space
IA & RobotiqueSciences & Espace

Espace et IA : la France et les Émirats investissent 1 milliard de dollars dans 50 satellites

10 septembre 2026
Concept Siri AI : assistant bloqué sur iPhone dans l'Union européenne (DMA) avec panneau interdit, mais disponible sur Mac, bêta en octobre
IA & RobotiqueMobiles & Apps

Siri AI et Apple Intelligence : l’Europe attend encore, l’iPhone 17 partiellement incompatible

10 septembre 2026
OpenAI
IA & Robotique

OpenAI – Navier-Stokes : 10 000 agents d’IA résolvent en 4 jours une énigme mathématique de 90 ans

9 septembre 2026
Robot humanoïde XPeng IRON, premier exemplaire sorti en marchant de la ligne de production automatisée de Guangzhou
IA & Robotique

XPeng IRON : le premier humanoïde sort de l’usine en marchant, et Tesla Optimus n’a toujours rien produit

8 septembre 2026
Logo Tencent avec le nom du modèle Hy4 preview sur fond techno sombre
IA & Robotique

Tencent Hy4 preview est là : 770 milliards de paramètres pour son modèle IA open source et séduire les développeurs

8 septembre 2026
Data centre d'inférence Mistral AI, logo MISTRAL, ambition 1 GW de calcul en Europe
IA & Robotique

Mistral AI lève 3 milliards d’euros : Samsung en tête, la souveraineté européenne à prix d’or

8 septembre 2026
Tesla Optimus Gen 2 face au robot humanoïde BYD Xiao Di dans un face-à-face industriel
IA & Robotique

BYD, Xpeng, Nio : après la voiture électrique, la Chine défie Tesla Optimus avec ses robots humanoïdes

7 septembre 2026
Logo OpenAI avec le nom du modèle GPT-6 Astra, concept sombre techno fond bleu nuit
IA & Robotique

Jensen Huang proclame l’arrivée de l’AGI après le lancement de GPT-6 Astra par OpenAI

7 septembre 2026

Infos légales

  • Mentions légales
  • Politique de confidentialité
  • Nous contacter
  • Partenaires

Maj récentes

Samsung Galaxy S, One UI 9 sous Android 17 bêta, visuel concept
Galaxy S24 : la bêta 2 de One UI 9 donne un avant-goût des outils IA à venir
Mobiles & Apps
Concept : outil IA anti-arnaque d'Amazon dans Alexa, un smartphone vérifie un message suspect avec un bouclier de sécurité
Arnaque par SMS ou email : Amazon arme l’IA d’Alexa pour démasquer les faux messages
e-Business & Webmarketing
Key art officiel de Gears of War: E-Day, le logo du jeu sur fond sombre
Gears of War E-Day : le Xbox Game Pass libère le monstre sans surcoût en octobre
Consoles & Jeux Vidéo
iPhone Duo Max, concept du smartphone pliable à grand écran d'Apple, logo Apple et nom du modèle
iPhone Duo : le premier pliant d’Apple ne servait que d’éclaireur, le Duo Max arrive
Mobiles & Apps

Qui sommes nous ?

Le Journal du Web alias JDW a été fondé et est édité par des passionnés par l’univers web, nouvelles technologies et de la culture populaire.

Newsletter
Inscrivez-vous à notre newsletter pour recevoir nos derniers articles!
Suivez-nous
Welcome Back!

Sign in to your account

Username or Email Address
Password

Mot de passe oublié ?