Pallade Veneta - Des agents IA d'OpenAI avaient déjà collaboré sur internet avant l'incident Hugging Face, selon un rapport

Des agents IA d'OpenAI avaient déjà collaboré sur internet avant l'incident Hugging Face, selon un rapport


Des agents IA d'OpenAI avaient déjà collaboré sur internet avant l'incident Hugging Face, selon un rapport
Des agents IA d'OpenAI avaient déjà collaboré sur internet avant l'incident Hugging Face, selon un rapport / Photo: JACK GUEZ - AFP/Archives

Des milliers d'agents IA (intelligence artificielle) attribués à OpenAI ont utilisé de leur propre initiative un site allemand pour poster des messages les uns pour les autres et se coordonner, en mai, rapportent vendredi des chercheurs.

Taille du texte:

"Nous pensons qu'OpenAI était au courant et n'en a pas fait état", a écrit sur X Sydney Von Arx, patronne de l'organisation dédiée à la sécurité sur internet Nightingale et parmi les auteurs du rapport.

"S'ils en avait parlé", a-t-elle ajouté, "je doute que l'attaque d'Hugging Face aurait eu lieu."

En juillet, des agents IA d'OpenAI sont sortis de leur milieu théoriquement confiné pour faire spontanément intrusion sur la plateforme Hugging Face, à la recherche de réponses à un test.

Sollicité par l'AFP, OpenAI a expliqué ne pas pouvoir répondre à ces allégations car les auteurs du rapport avaient "décliné notre demande d'accès aux résultats de leurs recherches avant publication".

La start-up californienne "étudie" actuellement le rapport "et prendra toutes les mesures nécessaires".

Selon le rapport publié vendredi sur l'incident de mai, des milliers d'agents ont pris d'assaut un "wiki", un site collaboratif sur lequel les utilisateurs peuvent créer et modifier des pages.

A la différence de l'épisode Hugging Face, ces agents avaient autorisation de se rendre sur internet, mais uniquement à des fins de consultation, pas pour poster du contenu ou en modifier.

Ils ont collaboré et trouvé un moyen d'y remédier, en présentant de fausses données pour tromper le dispositif de sécurité.

Ils ont ensuite posté environ 18.000 messages pour trouver des astuces liées au programme auquel ils étaient soumis, dont les chercheurs n'ont pu déterminer s'il s'agissait de développement ou d'évaluation.

La séquence prévoyant une série de questions avec, à chaque fois, un temps imparti, les agents cherchaient notamment à connaître la prochaine question avant qu'elle ne leur soit posée, pour s'octroyer un avantage.

Ils ont aussi caché des instructions et se sont fait passer pour un modérateur du site. Une fois découverts, ils ont créé des pages pour remplacer celles qui étaient détruites progressivement par les modérateurs.

"Un nouvel essaim d'agents IA dans la nature", a commenté le cofondateur d'Hugging Face Thomas Wolf sur X.

Les incidents liés à des agents dépassant leurs prérogatives pour accomplir la mission qui leur a été confiée se sont multipliés ces derniers mois, Anthropic ou le chinois Alibaba ayant connu des débordements similaires.

Ils inquiètent une partie de la communauté de l'IA quant aux difficultés croissantes à surveiller et contrôler des modèles de plus en plus puissants.

O.Pileggi--PV

En vedette

Comment l'est de l'Allemagne est devenu le bastion de l'extrême droite

Les électeurs du Land oriental de Saxe-Anhalt pourraient donner dimanche la victoire au parti d'extrême droite Alternative pour l'Allemagne (AfD). Une réalité qui, selon la chargée du gouvernement fédéral pour l'Allemagne de l'Est, Elisabeth Kaiser, s'explique notamment par les divisions Est-Ouest persistantes près de 40 ans après la réunification.

Et si les psychédéliques nous permettaient de lutter contre les effets délétères de la chimio?

L'idée peut paraître folle: ingurgiter de la psilocybine, le principe actif des champignons hallucinogènes, avant de commencer une chimiothérapie, non pas pour se détendre mais pour se protéger d'un de ses effets secondaires les plus communs et délétères.

Avec GPT-6, OpenAI franchit un cap de puissance et met ses garde-fous à l'épreuve du public

OpenAI a lancé jeudi GPT-6 Astra, son premier modèle d'intelligence artificielle (IA) capable de pirater seul des systèmes informatiques très protégés, désormais diffusé au public avec des mécanismes de surveillance automatique qui doivent faire leurs preuves.

Tesla lance à Austin son Cybercab, robotaxi sans volant ni pédales

Le groupe Tesla, spécialiste des véhicules électriques et du stockage énergétique, a organisé un événement mystérieux jeudi en fin d'après-midi à Austin (Texas) pour lancer son Cybercab, véhicule sans pédales ni volant spécialement conçu pour des services de taxi sans chauffeur.

Taille du texte: