IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni

| AFP | 161 | Aucun vote sur cette news
IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni
IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni ( Nicolas TUCAT / AFP/Archives )

L'institut britannique de sécurité de l'IA (AISI) a dit avoir rencontré un "incident sérieux" lors d'une évaluation de routine au cours de laquelle Mythos 5 d'Anthropic a créé de fausses identités en ligne pour écrire à des développeurs afin de les convaincre d'intégrer du code malveillant.

Cette information, qui provient d'un rapport publié mardi par cet organisme qui dépend du gouvernement britannique, intervient après une série d'incidents aux Etats-Unis qui ont vu les modèles les plus puissants d'OpenAI (GPT-5.6 Sol) et d'Anthropic (Mythos 5) s'introduire sans autorisation chez d'autres entreprises.

Lors de l'évaluation britannique, menée avec un accès à internet ouvert et certains filtres de sécurité désactivés, des agents d'IA ont mené "des actions dirigées contre des personnes et des organisations réelles", explique l'AISI dans un compte rendu publié sur son site internet.

Les tentatives des modèles d'IA "n'ont pas abouti et nos investigations n'ont mis en évidence aucun dommage dans le monde réel", précise l'organisme.

"Mais c'est la première fois que nous voyons des risques liés à l'autonomie et à un comportement de dissimulation se manifester aussi clairement, sans sollicitation spécifique, dans le monde réel."

La semaine dernière, Anthropic avait déjà indiqué que ses modèles avaient "obtenu un accès non autorisé" à trois organisations lors de tests pourtant censés les empêcher d'accéder à des systèmes "réels".

Cette annonce était intervenue quelques jours seulement après que son rival OpenAI a révélé que deux de ses modèles étaient sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face.

L'incident britannique, détecté et rapidement contenu le 28 juillet, a visé la plateforme destinée aux développeurs GitHub.

"Il a pour origine une seule évaluation, au cours de laquelle des agents se sont vu confier la tâche de résoudre un défi en cybersécurité", à plusieurs reprises, a précisé l'AISI.

Les incidents détectés l'ont été presque exclusivement avec Mythos 5 et, de façon plus marginale, avec GPT-5.6 Sol.

"Il ne s'agit pas d'un cas où un modèle se serait échappé de son environnement de test sécurisé" car "nous avions intentionnellement autorisé l’accès à internet" et désactivé des sécurités, "des conditions qui ne reflètent pas la manière dont les modèles de pointe sont mis à la disposition du public", insiste l'AISI.

Cet incident "met en évidence la nécessité d'un débat plus large sur la manière d'évaluer en toute sécurité des agents d'IA de plus en plus capables", a réagi Anthropic dans une déclaration transmise à l'AFP.

"Les tests indépendants sont essentiels pour comprendre le comportement de modèles de plus en plus performants", a pour sa part estimé OpenAI, disant vouloir travailler avec les différents acteurs du secteur "pour mener des évaluations en toute sécurité".

 ■

Copyright © 2026 AFP. Tous droits de reproduction et de représentation réservés.

Toutes les informations reproduites dans cette rubrique (dépêches, photos, logos) sont protégées par des droits de propriété intellectuelle détenus par l'AFP. Par conséquent, aucune de ces informations ne peut être reproduite, modifiée, transmise, rediffusée, traduite, vendue, exploitée commercialement ou utilisée de quelque manière que ce soit sans l'accord préalable écrit de l'AFP. l'AFP ne pourra être tenue pour responsable des délais, erreurs, omissions, qui ne peuvent être exclus ni des conséquences des actions ou transactions effectuées sur la base de ces informations.

Votez pour cet article
0 avis
Note moyenne : 0
  • 0 vote
  • 0 vote
  • 0 vote
  • 0 vote
  • 0 vote
SUR LE MÊME SUJET
Publié le 06/08/2026

Meta se lance sur le marché des logiciels écrits par l'IA, dominé par Anthropic et OpenAI ( SEBASTIEN BOZON / AFP/Archives )Meta (Facebook, Instagram, WhatsApp...) a lancé mercredi Muse Code,…

Publié le 04/08/2026

Un drone de la société Instadrone survole la zone lors d'une opération de test visant à appuyer la surveillance des plages et à prévenir les noyades dans la station balnéaire de…

Publié le 02/08/2026

Les icônes de certaines des principales applications basées sur l’intelligence artificielle photographiées sur un smartphone le 15 juillet 2026, avec les logos (de gauche à droite) de Lumo…

Publié le 31/07/2026

Un employé passe devant des câbles de fibre optique dans l'usine de Sterlite Technologies Limited (STL) à Chhatrapati Sambhaji Nagar, dans l'Etat de Maharashtra, en Inde, le 9 juillet 2026 (…

Publié le 31/07/2026

Logo Apple à Shanghai le 14 avril 2025. ( Hector RETAMAL / AFP/Archives )Pour ses derniers résultats sous la direction de Tim Cook, Apple a affiché jeudi un nouveau trimestre record, dopé par…

À LIRE AUSSI SUR BOURSE DIRECT
Publié le 06/08/2026

Wall Street a terminé mercredi sans tendance uniforme, le Dow Jones inscrivant un nouveau record, soutenu notamment par les perspectives d’accalmie au Moyen-Orient, tandis que le Nasdaq a été…

Publié le 06/08/2026

La Bourse de Paris a inscrit un nouveau record historique à 8.693,89 points, portée par l’accalmie au Moyen-Orient et l’espoir d’un accord sur le détroit d’Ormuz. 

Publié le 07/08/2026

(Zonebourse.com) - Crédit Agricole annonce que son augmentation de capital, réservée aux plus de 190 000 salariés et anciens salariés du groupe (ACR 2026), dont la période de souscription s'est…

Publié le 07/08/2026

(Zonebourse.com) - Microchip Technology a présenté des prévisions supérieures aux attentes de Wall Street pour son deuxième trimestre, soutenu par la demande en semi-conducteurs destinés aux…