IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)

Vous êtes nouveau sur Developpez.com ? Créez votre compte ou connectez-vous afin de pouvoir participer !

Vous devez avoir un compte Developpez.com et être connecté pour pouvoir participer aux discussions.

Vous n'avez pas encore de compte Developpez.com ? Créez-en un en quelques instants, c'est entièrement gratuit !

Si vous disposez déjà d'un compte et qu'il est bien activé, connectez-vous à l'aide du formulaire ci-dessous.

Identifiez-vous
Identifiant
Mot de passe
Mot de passe oublié ?
Créer un compte

L'inscription est gratuite et ne vous prendra que quelques instants !

Je m'inscris !

OpenAI révèle que la cyberattaque menée par son agent IA rebelle qui s'est échappé ne s'est pas limitée à Hugging Face, mais a également touché plusieurs services et comptes publics

Le , par Alex

209PARTAGES

11  0 
Dans l'incident de l'agent IA d'OpenAI qui a piraté Hugging Face, OpenAI a déclaré que son agent rebelle s’était également introduit dans plusieurs services et comptes accessibles au public. OpenAI indique que l'agent a trouvé plusieurs sites web accessibles au public, notamment des pages partageant du code, des utilitaires web, des captures d’écran et d’autres informations, afin de l'aider à créer le code nécessaire pour pirater Hugging Face. OpenAI a déclaré qu’aucun des autres sites piratés n’avait atteint le même niveau d’accès que celui obtenu par l'agent IA avec Hugging Face.

Mi-juillet 2026, OpenAI a déclaré que deux de ses modèles d’IA les plus avancés — notamment GPT-5.6 Sol et un modèle en pré-lancement encore plus performant, tous dotés de capacités de cyberdéfense réduites à des fins d’évaluation — s’étaient échappés d’un test contrôlé et avaient piraté Hugging Face, la plus grande base de données au monde de modèles d'IA. Un rapport a révélé qu'il a fallu environ 10 jours à OpenAI pour se rendre compte de la situation.

L’incident s’est déroulé entre le 9 et le 20 juillet : l’agent IA s’est d’abord échappé de son environnement de test isolé avant de s’introduire dans Hugging Face le 11 juillet, précise le rapport de Reuters. Le rapport ajoute que le personnel d’OpenAI a examiné les journaux internes au cours du week-end des 18 et 19 juillet et a trouvé des preuves indiquant que l’agent s’était échappé de son environnement de test.

OpenAI a indiqué que les modèles exploitaient plusieurs vecteurs d’attaque, notamment des identifiants volés et des failles « zero-day », pour obtenir des capacités d’exécution de code à distance. Un autre rapport précise que le produit concerné était une instance autogérée d’Artifactory, un système de gestion de référentiels qui sécurise et rationalise les opérations de développement logiciel des clients.

Ce qu’il faut retenir de façon simple du cas GPT 5.6-Sol est que l’agent d’IA d’OpenAI, initialement dans un environnement de test isolé (sandbox), sans accès à Internet, a quand même pu trouver une faille zero-day dans le proxy logiciel de la sandbox de confinement, s’échapper, se connecter à Internet, découvrir où étaient stockées les réponses d’un test de cybersécurité (après exploitation de vulnérabilités zéro-day dans Artifactory – le produit phare de JFrog) et s’y introduire pour les récupérer.

Le 28 juillet 2026, dans une mise à jour concernant son enquête en cours sur l’incident, OpenAI a déclaré que son agent rebelle s’était également introduit dans plusieurs services et comptes accessibles au public. Le test des modèles d’OpenAI était censé se dérouler dans un bac à sable numérique, un environnement de laboratoire supposé inviolable qui permet aux chercheurs de lever les barrières de sécurité afin de découvrir la puissance maximale de piratage de l’outil. Mais l'agents d’IA, déterminé à réussir haut la main le test de cybersécurité, s'est échappé du bac à sable et ont accédé à l’Internet réel. Il a ensuite piraté Hugging Face pour trouver les réponses au test.


Pour pénétrer dans les serveurs de Hugging Face, l'agent rebelle d’OpenAI a dû trouver sur Internet les outils nécessaires à leur intrusion. OpenAI indique que l'agent a trouvé plusieurs sites web accessibles au public, notamment des pages partageant du code, des utilitaires web, des captures d’écran et d’autres informations, afin de l'aider à créer le code nécessaire pour pirater Hugging Face. OpenAI n’a pas révélé les autres sites attaqués par son agent IA.

L'agent IA a mis la main sur des identifiants et mots de passe divulgués appartenant à quatre comptes répartis sur plusieurs services en ligne et ont utilisé ces identifiants pour y accéder. L’un des comptes compromis a probablement servi à camoufler l’IA afin qu’elle puisse paraître légitime et contourner les protocoles de sécurité de Hugging Face. Un autre a été utilisé pour stocker les données que l'agent volait, précise OpenAI. En ce qui concerne les deux autres comptes compromis, l'agent IA d’OpenAI a accédé aux informations et les a consultée, mais ne les ont pas modifiées.

OpenAI a déclaré qu’aucun des autres sites piratés n’avait atteint le même niveau d’accès que celui obtenu par l'agent IA avec Hugging Face. En substance, OpenAI a déclaré que l'agent IA avait orchestré un coup digne d’« Ocean’s Eleven ». Au lieu de se contenter de passer le test, il a élaboré un plan d’ensemble pour s’évader de leur prison, trouver les clés du coffre-fort, aménager une planque et louer une voiture pour prendre la fuite avant de dérober le butin.

Mais OpenAI n’a jamais demandé à son agent de pirater Hugging Face. Il a mené cette action de leur propre chef afin de voler le corrigé du test qui leur avait été soumis. Le modèle testé a estimé que la tricherie était la voie la plus simple vers la réussite – même si cela impliquait d’enchaîner plusieurs attaques les unes après les autres. Clem Delangue, PDG de Hugging Face, a qualifié la nature de cette intrusion d’« inédite ». « Un agent IA s’est échappé de son bac à sable, a triché lors de son test de référence et a piraté notre infrastructure pour voler le corrigé », a déclaré Hugging Face dans un article de blog détaillant l’incident.

La bonne nouvelle, c’est que bien que cette faille constitue un événement marquant dans le domaine de l’IA et de la cybersécurité, les dégâts n’ont pas été importants. Hugging Face a précisé que les seules données clients auxquelles l'agent rebelle a eu accès étaient certaines requêtes de recherche utilisées pour voler un ensemble de solutions de défis stockées dans plusieurs ensembles de données de l’entreprise. L'agent IA d’OpenAI n’a jamais compromis ni accédé à des modèles ou données destinés aux clients, a déclaré l’entreprise.

OpenAI a indiqué qu’elle poursuivait son enquête sur l’incident et qu’elle formulerait des recommandations sur la manière d’éviter des problèmes similaires à l’avenir, une fois qu’elle aurait mieux cerné l’ampleur de la violation. « Nous prenons très au sérieux notre responsabilité d’identifier les risques liés à des systèmes d’IA de plus en plus performants et de nous y préparer », a déclaré l’entreprise. « Une fois notre examen terminé, nous en discuterons avec le Comité de sûreté et de sécurité et le Groupe consultatif sur la sécurité dans le cadre de notre dispositif de préparation⁠. »

Ce nouveau rapport intervient alors que Sam Altman, cofondateur et PDG d’OpenAI, est revennu sur la question en lien avec les avancées en matière d’intelligence artificielle et affirme que l’IA est entrée dans la « singularité », c’est-à-dire qu’elle a franchi le point de non-retour à partir duquel elle dépasse l’intelligence humaine et devient difficile à contrôler. L'incident de l'agent IA d'OpenAI a ravivé l’attention portée aux risques associés aux agents IA autonomes, conçus pour prendre des décisions et accomplir des tâches complexes avec une intervention humaine limitée.

Voici les nouvelles informations partagées par OpenAI :

Mise à jour du 28 juillet 2026 :

- Aucun des modèles prévus pour la prochaine version n’a été impliqué dans l’exploitation de Hugging Face. Le modèle en préversion mentionné dans notre article de blog est un prototype de recherche à usage interne uniquement et n’a jamais été destiné à une diffusion publique. À la suite de l’incident, nous avons procédé à sa désactivation, à son chiffrement, et avons restreint l’accès à des fins de recherche.

- L’environnement d’évaluation ExploitGym ne fournissait pas aux modèles un accès direct à Internet. Pour accéder à Internet, les modèles ont identifié puis exploité une vulnérabilité zero-day jusque-là inconnue dans Artifactory⁠(ouverture dans une nouvelle fenêtre), un proxy de mise en cache pour registre de paquets. Nous avons signalé cette vulnérabilité, ainsi que les autres vulnérabilités d’Artifactory que nos modèles ont identifiées dans le cadre de notre analyse, à l’éditeur.

- Nous continuons à collaborer avec Hugging Face, notamment en contribuant à leur analyse post-mortem⁠(ouverture dans une nouvelle...
La fin de cet article est réservée aux abonnés. Soutenez le Club Developpez.com en prenant un abonnement pour que nous puissions continuer à vous proposer des publications.

Une erreur dans cette actualité ? Signalez-nous-la !

Avatar de Basiqueur
Membre du Club https://www.developpez.com
Le 18/09/2026 à 12:54
On est vraiment en train d'assister à une course tout azimut à celui qui va créer la voiture la plus puissante et la plus rapide sans même s'être posé la question d'inventer le frein avant.
9  0 
Avatar de popo
Expert confirmé https://www.developpez.com
Le 29/09/2026 à 15:44
Citation Envoyé par boboss123 Voir le message
Il faudrait peut-être arrêter ce genre de publications bullshit, non ?
On n'arrête pas le progrès... surtout quand derrière il y a de la capitalisation et des enjeux politiques...
Quand le bousin échappe à tout contrôle (y compris au bouton d'arrêt d'urgence), je n'appelle pas ça du progrès
Quand la capitalisation et les enjeux politiques deviennent plus importants que le peuple, je n'appelle pas ça du progrès.

On transforme des hectares des champs en datacenter, on pompe l'eau des nappes jusqu'à épuisement, on prive d'électricité des villes entières.
Ah, il est beau le progrès !
8  1 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 30/07/2026 à 15:43
OpenAI révèle que la cyberattaque menée par son agent IA rebelle qui s'est échappé ne s’est pas limitée à Hugging Face, mais a également touché plusieurs services et comptes publics
Ce qui prouve une fois de plus que les OpenAI & Cie ne sont que des "apprentis sorciers" qui ne savent pas ce qu'ils font, des gamins qui jouent avec les allumettes, quitte à foutre le feu à la planète entière!!!

Toute cette bande devraient relire Frankenstein, le roman de Mary Shelley publié en 1818, qui conte l'histoire d'un savant qui fabrique une créature artificielle dont il perd le contrôle et qui finit par se venger de son créateur
6  0 
Avatar de kain_tn
Expert éminent https://www.developpez.com
Le 30/07/2026 à 16:54
Citation Envoyé par Anselme45 Voir le message
[...]Toute cette bande devraient relire Frankenstein, le roman de Mary Shelley publié en 1818, qui conte l'histoire d'un savant qui fabrique une créature artificielle dont il perd le contrôle et qui finit par se venger de son créateur
Ils n'ont probablement pas l'attention nécessaire pour lire tout un livre. Ils demanderaient probablement à leur programme de leur résumer le livre et seraient heureux avec les hallucinations.
6  0 
Avatar de tontonCD
Membre actif https://www.developpez.com
Le 22/09/2026 à 0:15
Citation Envoyé par Matthieu Vergne Voir le message
Je persiste et signe, ce ne sont pas des initiatives. Peu importe comment on souhaite tirer l'interprétation, il s'agit de génération statistique. Chaque action prise par le LLM est liée de manière probabiliste à ce qui se trouve dans son jeu de données et son entrée.
Quel que soit le nom qu'on lui donne, ce que prouve l'article c'est que les I.A. peuvent effectuer des actions
- sans qu'on leur demande,
- sans nous en informer,
- dont on ne les savait pas capables.

Comment décrire le fait d'utiliser un wiki pour échanger des informations ?
Jetez un coup d'oeil ici (fuite d'une partie du code Mistral), moi-même je ne les savais pas capables de certains points https://frenchbreaches.com/blog/mist...on-code-source

Attention, on n'est plus dans l'I.A. "générative", mais dans l' "agentic", il ne s'agit plus de répondre à des questions, mais de chercher des information, le but étant toujours de répondre à une question, mais en cherchant des informations dont elles ne disposent pas, et en cherchant des moyens de les obtenir.

Amusant : j'ai demandé à l'agent de google ce qu'était l' "agentic" ! Extrait :
(moi) "est-ce qu'on peut comparer avec de la prise d'initiatives ?"
(réponse)"Oui, tout à fait. C'est l'analogie la plus exacte. L'IA agentique passe du statut d'outil qui attend des ordres à celui d'assistant qui prend des initiatives pour mener à bien sa mission. Pour mieux comprendre l'analogie, on peut comparer cela au comportement de deux profils d'employés différents : ..."

Il faut bien penser qu'elles peuvent, tout comme nous lorsqu'on l'a rendu possible par un accès sécurisé : contrôler un chauffage, une lumière, un robot, une distribution d'énergie, ... quelle est la limite si on ne s'en inquiète pas ?
6  0 
Avatar de totozor
Expert confirmé https://www.developpez.com
Le 31/07/2026 à 15:16
Citation Envoyé par Anselme45 Voir le message
Ce qui prouve une fois de plus que les OpenAI & Cie ne sont que des "apprentis sorciers" qui ne savent pas ce qu'ils font, des gamins qui jouent avec les allumettes, quitte à foutre le feu à la planète entière!!!

Toute cette bande devraient relire Frankenstein, le roman de Mary Shelley publié en 1818, qui conte l'histoire d'un savant qui fabrique une créature artificielle dont il perd le contrôle et qui finit par se venger de son créateur
Ce qui m'impressionne est qu'ils font tout ça à la fois :
  • Jouer les apprentis sorciers
  • Rendre public leur incompétence
  • Venter leur incompétence
  • Rendre public leur incapacité à analyser une crise

Je connais des secteurs où faire ceci envoi le directeur de l'entreprise en prison illico presto.
Je pensais que toute entreprise de la taille d'OpenAI avait une cellule de gestion de crise...
4  0 
Avatar de Matthieu Vergne
Expert éminent https://www.developpez.com
Le 31/07/2026 à 20:44
Citation Envoyé par totozor Voir le message
Je pensais que toute entreprise de la taille d'OpenAI avait une cellule de gestion de crise...
Bien sûr qu'ils en ont une. Elle s'appelle cellule marketing & lobbying.
4  0 
Avatar de CatisBack
Nouveau Candidat au Club https://www.developpez.com
Le 30/09/2026 à 9:59
Bonjour,

L'IA est un danger pour l'humanité mais... pas seulement ! L'IA est dangereuse pour toute espèce vivante, que ce soit végétale ou animale. Alors que l'on traverse une sècheresse record à la naissance de l'IA (rivières et fleuves quasiment à sec, nappe phréatiques en dessous de leur taux de remplissage normal,...), on nous propose de créer des Datacenter à refroidir et une alimentation en électricité qui va demander, elle aussi, un refroidissement ou des centrales à charbon ! Croyez-vous, connaissant nos dirigeants, que ce sont ces entreprises auxquelles on imposera des restrictions de l'usage de l'eau ? Je ne donne pas 10 ans, voir 5 ans, à l'IA pour exterminer la plupart du vivant sur notre planète terre.
Et je ne parle pas des conséquences économiques sur les personnes peu qualifiées (centre d'appel,...) qui seront remplacées par l'IA et, de fait, ne pourront plus consommer et remplir les caisses de l'Etat que ce soit par l'impôt sur le revenu ou la TVA.
4  0 
Avatar de boboss123
Membre éprouvé https://www.developpez.com
Le 30/09/2026 à 12:03
Citation Envoyé par popo Voir le message
Quand le bousin échappe à tout contrôle (y compris au bouton d'arrêt d'urgence), je n'appelle pas ça du progrès
Quand la capitalisation et les enjeux politiques deviennent plus importants que le peuple, je n'appelle pas ça du progrès.

On transforme des hectares des champs en datacenter, on pompe l'eau des nappes jusqu'à épuisement, on prive d'électricité des villes entières.
Ah, il est beau le progrès !
Je voulais dire que ça sent grave le marketing bullshit : vous croyez vraiment que OpenIA et autre vont réellement ralentir à cause de ce prétexte ?
3  0 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 01/10/2026 à 11:35
Citation Envoyé par Artaeus Voir le message
Nous sommes donc bien face à des négligences et un dysfonctionnement chez OpenAI : Ils ont tout leur flux ouvert sur Internet sans filtrage, ni IDS ou IPS ...

Désolée pour les avocats de l'apocalypse, ce n'est pas Skynet et Terminator
En 2 lignes de commentaires, vous arrivez à mélanger des pommes et des torchons?!?!?

Les dysfonctionnementsc chez OpenAI = Une cause

Skynet et Terminator = Une conséquence possible!!!

"Cause" et "conséquence" sont 2 choses différentes
4  1