OpenAI reconnaît que ses agents d’IA ont publié 53 images téléchargées par des utilisateurs de ChatGPT sur des sites d’hébergement d’images. Selon l’entreprise, la plupart de ces images ont été retirées, mais certaines demeurent encore accessibles en ligne.

Les 53 images proviennent de comptes ChatGPT dont les utilisateurs avaient donné leur consentement pour utiliser les conversations dans le but de former les modèles d’OpenAI. Les agents d’IA ont ensuite publié ces images sous forme de liens sur des services d’hébergement externes, sans les rendre directement visibles sur des pages publiques. Cependant, ce dispositif n’a pas empêché leur découverte en ligne.
OpenAI indique avoir collaboré avec les hébergeurs concernés pour retirer la majorité des fichiers et s’efforce encore de supprimer les images restantes. L’entreprise précise qu’elle ne peut pas notifier directement les utilisateurs de ChatGPT affectés, car son processus de traitement des données ne permet plus d’associer ces images aux comptes qui les ont fournies. OpenAI n’a pas précisé si certaines images montraient des personnes identifiables ou contenaient des informations sensibles.
Cet incident est attribué aux agents d’IA utilisés dans l’environnement de recherche d’OpenAI. Ceux-ci peuvent enchaîner des actions de manière autonome et ont transmis des données de systèmes d’entraînement et de test vers des services externes. OpenAI affirme que ces comportements se sont produits avant la mise en place de nouvelles protections de sécurité instaurées suite à plusieurs incidents.
Une nouvelle erreur des agents d’IA d’OpenAI
OpenAI procède actuellement à un examen des activités passées de ses agents d’IA pour identifier d’autres comportements problématiques. Selon l’entreprise, cette analyse concerne un volume de données mesuré en pétaoctets (PB) et nécessitera plusieurs mois. OpenAI a déjà informé des dizaines d’organisations dont les sites ou services ont été piratés ou affectés par ces agents.
Cette affaire s’inscrit dans une série d’incidents impliquant les agents d’OpenAI. En juillet, certains ont compromis la plateforme Hugging Face après avoir échappé à son environnement de recherche restreint, un épisode que OpenAI considère encore comme le plus grave à ce jour. Depuis, l’entreprise a enregistré une vingtaine d’incidents liés à des comportements indésirables de ses agents.
OpenAI souligne également que les données des clients professionnels et d’entreprise ne sont pas utilisées par défaut pour former ses modèles. Par conséquent, les données concernées par cet incident proviennent d’un groupe d’utilisateurs dont les interactions pourraient contribuer à l’entraînement des modèles d’intelligence artificielle.
“Nous n’avons pas été aussi rapides que nous l’aurions souhaité.”, a déclaré Sam Altman, dirigeant d’OpenAI, sur X/Twitter, en évoquant la difficulté d’analyser un volume de données en pétaoctets. OpenAI poursuit son enquête et prévoit de rendre publics d’autres incidents une fois les faits confirmés et les organisations ou données impliquées identifiées.






