Des agents IA d'OpenAI avaient déjà collaboré sur internet avant l'incident Hugging Face, selon un rapport

| AFP | 106 | Aucun vote sur cette news
Des milliers d'agents IA (intelligence artificielle) attribués à OpenAI ont utilisé de leur propre initiative un site allemand pour poster des messages les uns pour les autres et se coordonner, en mai, rapportent vendredi des chercheurs
Des milliers d'agents IA (intelligence artificielle) attribués à OpenAI ont utilisé de leur propre initiative un site allemand pour poster des messages les uns pour les autres et se coordonner, en mai, rapportent vendredi des chercheurs ( JACK GUEZ / AFP/Archives )

Des milliers d'agents IA (intelligence artificielle) attribués à OpenAI ont utilisé de leur propre initiative un site allemand pour poster des messages les uns pour les autres et se coordonner, en mai, rapportent vendredi des chercheurs.

"Nous pensons qu'OpenAI était au courant et n'en a pas fait état", a écrit sur X Sydney Von Arx, patronne de l'organisation dédiée à la sécurité sur internet Nightingale et parmi les auteurs du rapport.

"S'ils en avait parlé", a-t-elle ajouté, "je doute que l'attaque d'Hugging Face aurait eu lieu."

En juillet, des agents IA d'OpenAI sont sortis de leur milieu théoriquement confiné pour faire spontanément intrusion sur la plateforme Hugging Face, à la recherche de réponses à un test.

Sollicité par l'AFP, OpenAI a expliqué ne pas pouvoir répondre à ces allégations car les auteurs du rapport avaient "décliné notre demande d'accès aux résultats de leurs recherches avant publication".

La start-up californienne "étudie" actuellement le rapport "et prendra toutes les mesures nécessaires".

Selon le rapport publié vendredi sur l'incident de mai, des milliers d'agents ont pris d'assaut un "wiki", un site collaboratif sur lequel les utilisateurs peuvent créer et modifier des pages.

A la différence de l'épisode Hugging Face, ces agents avaient autorisation de se rendre sur internet, mais uniquement à des fins de consultation, pas pour poster du contenu ou en modifier.

Ils ont collaboré et trouvé un moyen d'y remédier, en présentant de fausses données pour tromper le dispositif de sécurité.

Ils ont ensuite posté environ 18.000 messages pour trouver des astuces liées au programme auquel ils étaient soumis, dont les chercheurs n'ont pu déterminer s'il s'agissait de développement ou d'évaluation.

La séquence prévoyant une série de questions avec, à chaque fois, un temps imparti, les agents cherchaient notamment à connaître la prochaine question avant qu'elle ne leur soit posée, pour s'octroyer un avantage.

Ils ont aussi caché des instructions et se sont fait passer pour un modérateur du site. Une fois découverts, ils ont créé des pages pour remplacer celles qui étaient détruites progressivement par les modérateurs.

"Un nouvel essaim d'agents IA dans la nature", a commenté le cofondateur d'Hugging Face Thomas Wolf sur X.

Les incidents liés à des agents dépassant leurs prérogatives pour accomplir la mission qui leur a été confiée se sont multipliés ces derniers mois, Anthropic ou le chinois Alibaba ayant connu des débordements similaires.

Ils inquiètent une partie de la communauté de l'IA quant aux difficultés croissantes à surveiller et contrôler des modèles de plus en plus puissants.

 ■

Copyright © 2026 AFP. Tous droits de reproduction et de représentation réservés.

Toutes les informations reproduites dans cette rubrique (dépêches, photos, logos) sont protégées par des droits de propriété intellectuelle détenus par l'AFP. Par conséquent, aucune de ces informations ne peut être reproduite, modifiée, transmise, rediffusée, traduite, vendue, exploitée commercialement ou utilisée de quelque manière que ce soit sans l'accord préalable écrit de l'AFP. l'AFP ne pourra être tenue pour responsable des délais, erreurs, omissions, qui ne peuvent être exclus ni des conséquences des actions ou transactions effectuées sur la base de ces informations.

Votez pour cet article
0 avis
Note moyenne : 0
  • 0 vote
  • 0 vote
  • 0 vote
  • 0 vote
  • 0 vote
SUR LE MÊME SUJET
Publié le 04/09/2026

A 18 ans, il est suspecté d'être l'un des hackers derrière le retentissant piratage du fisc ( THOMAS SAMSON / AFP/Archives )A 18 ans, il est suspecté d'être l'un des hackers derrière le…

Publié le 04/09/2026

L'actrice américaine Maggie Gyllenhaal, présidente du jury, participe à la cérémonie du tapis rouge précédant la cérémonie d'ouverture de la 83e édition du Festival international du film…

Publié le 04/09/2026

Un centre de données en construction à Stone Ridge, en Virginie, le 12 août 2026 ( Brendan Smialowski / AFP/Archives )Moins d'eau ou même plus du tout pour refroidir les installations des…

Publié le 04/09/2026

OpenAI a lancé jeudi GPT-6 Astra, son premier modèle d'intelligence artificielle (IA) capable de pirater seul des systèmes informatiques très protégés, désormais diffusé au public avec des…

Publié le 03/09/2026

Robots dopés à l'IA : l'Europe affiche sa volonté de peser dans un secteur dominé par les Chinois et les Américains ( Kirill KUDRYAVTSEV / AFP/Archives )Des robots dopés à l'IA qui font le…

À LIRE AUSSI SUR BOURSE DIRECT
Publié le 04/09/2026

La Bourse de New York a terminé en hausse, soutenue par le recul des anticipations de resserrement monétaire après les déclarations de Christopher Waller. 

Publié le 04/09/2026

Le bitcoin vit son plus beau mois depuis des semaines.

Publié le 04/09/2026

(Zonebourse.com) - Le conseil d'administration de Cofidur SA, réuni sous la présidence de Monsieur Dupoiron le 3 septembre 2026, a arrêté les comptes consolidés du 1er semestre 2026. Sur cette…

Publié le 04/09/2026

(Zonebourse.com) - Danone annonce avoir finalisé avec succès l'acquisition de Huel, un acteur de premier plan dans le domaine des solutions de repas complets et équilibrés sur le plan…