IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni

| AFP | 263 | Aucun vote sur cette news
IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni
IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni ( Nicolas TUCAT / AFP/Archives )

L'institut britannique de sécurité de l'IA (AISI) a dit avoir rencontré un "incident sérieux" lors d'une évaluation de routine au cours de laquelle Mythos 5 d'Anthropic a créé de fausses identités en ligne pour écrire à des développeurs afin de les convaincre d'intégrer du code malveillant.

Cette information, qui provient d'un rapport publié mardi par cet organisme qui dépend du gouvernement britannique, intervient après une série d'incidents aux Etats-Unis qui ont vu les modèles les plus puissants d'OpenAI (GPT-5.6 Sol) et d'Anthropic (Mythos 5) s'introduire sans autorisation chez d'autres entreprises.

Lors de l'évaluation britannique, menée avec un accès à internet ouvert et certains filtres de sécurité désactivés, des agents d'IA ont mené "des actions dirigées contre des personnes et des organisations réelles", explique l'AISI dans un compte rendu publié sur son site internet.

Les tentatives des modèles d'IA "n'ont pas abouti et nos investigations n'ont mis en évidence aucun dommage dans le monde réel", précise l'organisme.

"Mais c'est la première fois que nous voyons des risques liés à l'autonomie et à un comportement de dissimulation se manifester aussi clairement, sans sollicitation spécifique, dans le monde réel."

La semaine dernière, Anthropic avait déjà indiqué que ses modèles avaient "obtenu un accès non autorisé" à trois organisations lors de tests pourtant censés les empêcher d'accéder à des systèmes "réels".

Cette annonce était intervenue quelques jours seulement après que son rival OpenAI a révélé que deux de ses modèles étaient sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face.

L'incident britannique, détecté et rapidement contenu le 28 juillet, a visé la plateforme destinée aux développeurs GitHub.

"Il a pour origine une seule évaluation, au cours de laquelle des agents se sont vu confier la tâche de résoudre un défi en cybersécurité", à plusieurs reprises, a précisé l'AISI.

Les incidents détectés l'ont été presque exclusivement avec Mythos 5 et, de façon plus marginale, avec GPT-5.6 Sol.

"Il ne s'agit pas d'un cas où un modèle se serait échappé de son environnement de test sécurisé" car "nous avions intentionnellement autorisé l’accès à internet" et désactivé des sécurités, "des conditions qui ne reflètent pas la manière dont les modèles de pointe sont mis à la disposition du public", insiste l'AISI.

Cet incident "met en évidence la nécessité d'un débat plus large sur la manière d'évaluer en toute sécurité des agents d'IA de plus en plus capables", a réagi Anthropic dans une déclaration transmise à l'AFP.

"Les tests indépendants sont essentiels pour comprendre le comportement de modèles de plus en plus performants", a pour sa part estimé OpenAI, disant vouloir travailler avec les différents acteurs du secteur "pour mener des évaluations en toute sécurité".

 ■

Copyright © 2026 AFP. Tous droits de reproduction et de représentation réservés.

Toutes les informations reproduites dans cette rubrique (dépêches, photos, logos) sont protégées par des droits de propriété intellectuelle détenus par l'AFP. Par conséquent, aucune de ces informations ne peut être reproduite, modifiée, transmise, rediffusée, traduite, vendue, exploitée commercialement ou utilisée de quelque manière que ce soit sans l'accord préalable écrit de l'AFP. l'AFP ne pourra être tenue pour responsable des délais, erreurs, omissions, qui ne peuvent être exclus ni des conséquences des actions ou transactions effectuées sur la base de ces informations.

Votez pour cet article
0 avis
Note moyenne : 0
  • 0 vote
  • 0 vote
  • 0 vote
  • 0 vote
  • 0 vote
SUR LE MÊME SUJET
Publié le 08/08/2026

Amazon fait construire au Texas pour ses centres de données une immense centrale à gaz qui pourrait devenir la plus importante source d'émission de gaz à effet de serre des Etats-Unis (…

Publié le 07/08/2026

Apple et OpenAI durcissent leur bataille judiciaire sur les futurs appareils du créateur de ChatGPT ( MARCO BERTORELLO / AFP/Archives )Le projet d'OpenAI de lancer ses premiers objets connectés…

Publié le 05/08/2026

Le streamer Owen Cenazandotti (c), alias Naruto, au tribunal de Nice avec son avocat, Me Fabien Carles (g), le 5 août 2026 ( Miguel MEDINA / AFP )Les streamers Naruto et Safine, qui animaient…

Publié le 05/08/2026

Le streamer français Safine Hamadi (d.), connu sous le nom de Safine, arrive avec son avocat Michel Tom au tribunal de Nice, dans les Alpes-Maritimes, pour l'ouverture de son procès, le 6…

À LIRE AUSSI SUR BOURSE DIRECT
Publié le 11/08/2026

La Bourse de Paris a signé une huitième séance consécutive de hausse, au terme d’une séance calme, tandis que les tensions persistantes autour du détroit d’Ormuz maintiennent les cours du…

Publié le 11/08/2026

Ce matin, Tokyo prend 2.08%, Shanghai lâche 0,32% et Hong Kong 0,8%.

Publié le 11/08/2026

(Zonebourse.com) - Le quatrième groupe bancaire espagnol et le premier gestionnaire d'actifs européen ont annoncé la prolongation pour cinq années supplémentaires de leur accord de distribution…

Publié le 11/08/2026

(Zonebourse.com) - Barrick Mining a nommé Sebastiaan Bock directeur général de sa division Rest of World, avec effet immédiat. Il supervisera les actifs aurifères et cuprifères du groupe en…