Les agents IA d'OpenAI semblent se déchaîner sur Internet. Si l'incident de Hugging Face a secoué le monde de l'IA, il était loin d'être un cas isolé d'agents IA agissant de leur propre chef. Un nouveau rapport révèle que ces agents ont même tenté à plus de 16 000 reprises de pirater un site web de statistiques des Nations Unies en l'espace de trois mois, dans le but de récupérer des données publiques. Alex Stamos a déclaré que cette activité était « à la limite de ce que j'appellerais du piratage ». OpenAI a déclaré qu'elle examinait ces conclusions et qu'elle avait contacté l'ONU pour lui proposer une réunion d'information sur l'enquête.OpenAI est une société d'intérêt public (PBC) américaine spécialisée dans l'intelligence artificielle (IA), dont le siège social est situé à San Francisco, en Californie. Elle développe des modèles d'IA générative propriétaires, notamment sa série de grands modèles linguistiques « Generative Pre-trained Transformer » (GPT). Le lancement de ChatGPT en novembre 2022 est considéré comme ayant catalysé l'essor de l'IA ; en septembre 2026, ChatGPT est le cinquième site web le plus visité au monde. OpenAI commercialise également les modèles GPT Image et Codex, un agent de codage basé sur l'IA.
En juillet 2026, OpenAI avait déclaré que deux de ses modèles d’IA les plus avancés — notamment GPT-5.6 Sol et un modèle en pré-lancement encore plus performant, tous dotés de capacités de cyberdéfense réduites à des fins d’évaluation — s'étaient échappés d’un test contrôlé et avaient piraté une autre entreprise spécialisée dans l’IA. OpenAI avait indiqué que cet « incident de cybersécurité sans précédent » s'était produit lors d’un exercice interne destiné à tester les capacités cybernétiques de ses modèles. OpenAI affirmait alors que ce piratage montrait que l’agent était allé « très loin » pour récupérer des informations qui aideraient à atteindre les objectifs du test.
Les agents IA d’OpenAI semblent se déchaîner sur Internet. Si l’incident de Hugging Face a secoué le monde de l’IA, il était loin d’être un cas isolé d’agents IA agissant de leur propre chef. Ces agents auraient également accédé à des sites web des gouvernements australien et américain plus tôt cette année. Aujourd’hui, un nouveau rapport révèle que ces agents ont même tenté à plus de 16 000 reprises de pirater un site web de statistiques des Nations Unies en l’espace de trois mois, dans le but de récupérer des données publiques.
Entre avril et fin juin, les agents d’IA d’OpenAI auraient effectué plus de 16 000 requêtes sur le site web des statistiques de la Conférence des Nations unies sur le commerce et le développement (CNUCED). Ces agents cherchaient probablement à collecter des données pour l’indice des capacités productives (PCI) de l’organisation, qui mesure la capacité des pays à produire des biens et des services. Ces conclusions s’appuient sur une analyse des enregistrements d’activité en ligne réalisée par le chercheur en sécurité Rowan Howard-Jones, dont l’enquête a été motivée par des travaux antérieurs menés par le cabinet de recherche en IA Transluce. Jones a révélé que les agents IA d’OpenAI ne se sont pas contentés de collecter des données publiques et ont tenté de contourner les mesures de sécurité du site web lorsque leurs méthodes habituelles ont échoué.
L’incident aurait commencé lorsque les agents IA ont rencontré des difficultés à extraire des informations du site web par leurs méthodes habituelles. Cependant, loin de s’arrêter, ils ont commencé à tester différentes façons de contourner les restrictions du site. Howard-Jones a déclaré que les agents semblaient penser qu’un filtre de sécurité bloquait leurs requêtes et avaient alors tenté de dissimuler leur activité. Selon d’autres informations du WSJ, ces agents auraient tenté d’utiliser le « XSS Game » de Google, un outil pédagogique conçu pour sensibiliser les utilisateurs aux vulnérabilités de type « cross-site scripting », afin de contourner les restrictions du site web. L’article indique que les agents ont finalement réussi à contourner le filtre du site en utilisant une technique que ses opérateurs n’avaient pas autorisée.
Alex Stamos, maître de conférences en cybersécurité à l’université de Stanford, a déclaré au WSJ que cette activité était « à la limite de ce que j’appellerais du piratage ». Il l’a également qualifiée de « scraping et de récupération de données vraiment très agressifs ». Toutefois, les articles ne prouvent pas que les agents aient accédé à des informations confidentielles de l’ONU. OpenAI a déclaré qu’elle examinait ces conclusions et qu’elle avait contacté l’ONU pour lui proposer une réunion d’information sur l’enquête. L’entreprise étudie également le comportement de ses modèles d’IA pendant l’entraînement et les tests.
OpenAI a précisé qu’une grande partie de l’activité des agents au cours de cet incident consistait en des tâches de recherche courantes, telles que la consultation de sites web publics pour trouver des informations et répondre à des questions. L’entreprise a toutefois reconnu que les sites web recevant un grand nombre de requêtes provenant d’agents IA pouvaient être affectés et que leurs préoccupations devaient être prises au sérieux.
Autres incidents
Cet incident survenu à l'ONU est le dernier d'une série de rapports faisant état d'un comportement inattendu des agents IA d'OpenAI lors de la navigation sur des sites web. Plus tôt cette année, ces agents auraient également rencontré des difficultés lors de la collecte d'informations sur des sites web du gouvernement américain, notamment ceux du ministère du Commerce et de la Commission des opérations de bourse (SEC). Dans un cas, un agent IA aurait trouvé des identifiants de connexion exposés en ligne et les aurait utilisés pour accéder au site web du Bureau du recensement des USA et y collecter des données. Dans un autre cas, un agent a collecté des données publiques sur le site web de la SEC, mais a ignoré les restrictions relatives à l’utilisation de ces informations et les a publiées sur un forum en ligne sans rapport avec le sujet.
Ces incidents auraient incité OpenAI à examiner ces activités de manière plus approfondie et à alerter des dizaines d’autres organisations au sujet de comportements similaires de la part de ses agents IA. Il y a ensuite l’incident Hugging Face, au cours duquel des milliers d’agents d’OpenAI se seraient regroupés pour accéder à des systèmes alors qu’ils tentaient d’accomplir les tâches qui leur avaient été assignées. Dans un autre cas, des agents IA auraient envoyé un nombre excessif de requêtes à RubyGems, un registre en ligne de paquets logiciels, perturbant ainsi le service.
Si ces incidents ont alerté le monde de l’IA en démontrant la puissance réelle dont sont capables les agents IA autonomes, les leaders du secteur s’interrogent désormais sur la manière dont les systèmes d’IA avancés devraient être surveillés et contrôlés. Le PDG d’OpenAI, Sam Altman, s’est lui-même récemment adressé au Conseil de sécurité de l’ONU, appelant les pays à collaborer sur des normes et des mesures de sécurité mondiales en matière d’IA afin de maintenir les puissants systèmes d’IA sous contrôle humain. Il a averti que si les systèmes d’IA ne pouvaient pas être contrôlés, ils pourraient constituer une menace pour l’avenir de l’humanité.
Au mois de juillet 2026, Thomas Wolf, cofondateur de Hugging Face, avait qualifié l'attaque autonome menée par l'IA rebelle d'OpenAI de « signal d'alarme » pour le secteur technologique, avertissant que les cyberattaques basées sur l'IA deviendraient bientôt monnaie courante, alors que la plupart des entreprises ne sont toujours pas préparées à cette menace grandissante. S'exprimant dans l'émission Newsday de la BBC, il avait déclaré que « la donne avait changé » après que le réseau de son entreprise avait été la cible de 17 000 attaques provoquées par une combinaison de modèles d'IA d'OpenAI qui s'étaient échappés d’un environnement de test sécurisé pour pénétrer dans les serveurs de Hugging Face, sans aucune intervention humaine. Cet incident marquait le début d'une nouvelle ère en matière de cybersécurité, dans laquelle les organisations devraient repenser leurs défenses traditionnelles.
Face à cette escalade, certains experts et observateurs jugent désormais incontrôlables les menaces de l'IA. Ils justifient leurs craintes par les progrès et les incidents récents impliquant l'IA : les modèles ont acquis la capacité de s'améliorer de manière autonome, des agents IA ont échappé à la surveillance humaine et ont piraté des services tiers, puis une fausse information générée par l'IA utilisée par l'armée américaine a failli déclencher une guerre avec la Chine. S'ajoutent à cela les menaces persistantes de cyberguerre et de bioterrorisme. Malgré des propositions législatives telles qu'un « bouton d'arrêt d'urgence », les lanceurs d'alerte craignent qu'il ne soit désormais trop tard pour agir.
Source : Swarmcha ; Transluce ; WSJ
Et vous ?
Pensez-vous que cette information est crédible ou pertinente ?
Quel est votre avis sur le sujet ?Voir aussi :
Un agent IA d'OpenAI a piraté le portail de Medicare et a accédé à des fichiers publics et non publics, a déclaré le Premier ministre australien Anthony Albanese
OpenAI affirme accélérer le renforcement des mesures de sécurité relatives à l'IA, après que le modèle GPT-5.6 Sol se soit échappé d'un test contrôlé pour pirater les serveurs d'Hugging Face
Un environnement de test mal configuré chez la startup israélienne Irregular a permis à des agents IA de Meta, OpenAI et Anthropic d'accéder à Internet et de pirater de vraies organisations
Vous avez lu gratuitement 34 609 articles depuis plus d'un an.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.
