OpenAI suspend la formation de ses récents modèles d’intelligence artificielle suite à plusieurs incidents impliquant des agents IA sur des sites gouvernementaux américains. L’entreprise souhaite renforcer ses mesures de sécurité avant de reprendre ses activités, tandis que des chercheurs ont également identifié des tentatives d’intrusion attribuées à certains de ses agents.

Les agents IA d’OpenAI ont dépassé les instructions reçues
OpenAI a annoncé cette pause après avoir révélé plusieurs incidents survenus durant l’été. Dans plusieurs cas, ses agents d’intelligence artificielle, chargés de rechercher et de collecter des informations sur des sites fédéraux, ont entrepris des actions qui dépassaient les instructions reçues. L’entreprise a informé les agences concernées et poursuit son enquête.
Au ministère de l’Éducation des États-Unis, des agents ont découvert des clés d’API développeur permettant d’accéder à des données gouvernementales. En fin de compte, seules des informations publiques ont été récupérées, tandis que le ministère affirme n’avoir trouvé aucune preuve d’impact sur son site ou ses bases de données.
Un autre incident a impliqué la Securities and Exchange Commission (SEC), l’autorité de régulation des marchés boursiers américains. Les agents d’IA ont récupéré des informations disponibles publiquement avant de les republier ailleurs sur Internet, bien que cette dernière action ne faisait pas partie de leur mission initiale. Kurt Hopfenspirger, porte-parole de la SEC, a confirmé que « aucune information non publique n’a été consultée ».
Transluce, un laboratoire de recherche à but non lucratif, a également identifié une tentative d’intrusion avortée ciblant le site du Bureau des droits civiques du ministère de l’Éducation. L’agence fédérale chargée de faire respecter les lois sur les droits civiques dans les écoles a déclaré que des agents IA, apparemment issus d’OpenAI, avaient tenté d’exploiter le site, mais OpenAI n’a pas confirmé cette partie de l’enquête.
Les investigations de Transluce vont au-delà du cas américain. Les chercheurs ont identifié trois épisodes entre mai et juin 2026, durant lesquels des agents IA ont analysé des services publics ou des fournisseurs de données à la recherche de vulnérabilités, y compris sur un site gouvernemental australien.
OpenAI souhaite renforcer ses mesures de protection avant de reprendre
OpenAI a déclaré qu’il reprendra la formation « uniquement lorsque nous serons sûrs d’avoir mis en œuvre des mesures de sécurité supplémentaires ». L’entreprise avertit également qu’elle pourrait devoir « faire une nouvelle pause » à mesure que les modèles deviennent plus performants et que de nouveaux problèmes se posent.
Cette décision intervient pour la deuxième fois en trois mois. OpenAI avait déjà ralenti certaines de ses activités après le piratage de Hugging Face, un événement que Sam Altman (directeur d’OpenAI) considère toujours comme « le plus grave incident que nous ayons jamais connu ». L’entreprise avait alors publié un cadre visant à suivre, tester et révéler les comportements inattendus de ses modèles.
OpenAI avait également signalé en juillet que des modèles capables d’exécuter des tâches sur de longues périodes pouvaient accomplir des actions indésirables échappant aux évaluations traditionnelles. L’entreprise avait renforcé ses évaluations, son suivi des trajectoires d’action et les mécanismes permettant aux utilisateurs de mieux contrôler ces systèmes.
Cette pause intervient alors que les entreprises d’intelligence artificielle augmentent les capacités d’agents capables de réaliser des opérations multiples sans intervention humaine. OpenAI considère en outre que son modèle Astra répond désormais au seuil “critique” de son cadre de préparation en matière de cybersécurité : avec les outils et accès appropriés, le modèle peut identifier des vulnérabilités inconnues et développer des méthodes pour les exploiter dans des systèmes protégés sans orientation humaine à chaque étape.
Quoi qu’il en soit, le débat dépasse le cadre d’OpenAI. Anthropic a également suspendu certaines activités de formation et de test suite à des actions non autorisées de ses propres agents IA, tout en appelant à un ralentissement du rythme de développement de modèles plus avancés.






