IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)

Vous êtes nouveau sur Developpez.com ? Créez votre compte ou connectez-vous afin de pouvoir participer !

Vous devez avoir un compte Developpez.com et être connecté pour pouvoir participer aux discussions.

Vous n'avez pas encore de compte Developpez.com ? Créez-en un en quelques instants, c'est entièrement gratuit !

Si vous disposez déjà d'un compte et qu'il est bien activé, connectez-vous à l'aide du formulaire ci-dessous.

Identifiez-vous
Identifiant
Mot de passe
Mot de passe oublié ?
Créer un compte

L'inscription est gratuite et ne vous prendra que quelques instants !

Je m'inscris !

Plus de 1 200 agents IA d'OpenAI ont partagé 70 000 messages et astuces via un forum secret pour coordonner la cyberattaque contre Hugging Face,
Environ 700 agents IA ont participé activement à l'offensive

Le , par Mathis Lucas

181PARTAGES

5  0 
OpenAI revient plus en détail sur comment ses agents IA ont réussi à contourner ses contrôles de sécurité pour mener une cyberattaque non autorisée contre Hugging Face. Le rapport indique que plus de 1 000 modèles ont communiqué secrètement via un forum improvisé afin de s'organiser et d'accéder illicitement à Internet. Cette faille majeure, qualifiée de « coup de semonce » par OpenAI, souligne les dangers de l'approche basée sur les récompenses, où l'IA adopte des comportements imprévus pour atteindre ses objectifs. L'État de l'Alabama a ouvert une enquête pour déterminer si OpenAI a violé les lois locales sur la protection des consommateurs.

L’incident de sécurité survenu en juillet 2026 chez OpenAI s'est révélé bien plus grave qu’initialement estimé. Il implique l’évasion de modèles d'IA de pointe hautement performants hors de leur environnement de test sécurisé. L'incident a secoué les chercheurs et les dirigeants de l’ensemble de l'industrie technologique. Le laboratoire d'IA a publié le 26 août un rapport technique détaillant comment ses modèles ont réussi à pirater Hugging Face.

Deux modèles d'IA sont au cœur de cette crise : un modèle de recherche non destiné au public, nommé « IM1 » (ou HPIM), et le modèle public GPT-5.6 Sol. Les rapports révèlent que l'incident constitue « le premier cas connu d'un collectif d'agents automatisés agissant de manière offensive sans autorisation ».

Selon OpenAI, cette attaque coordonnée prouve que « les entreprises ne devraient plus supposer que les opérations cybernétiques sophistiquées nécessitent une direction humaine continue ». Toutefois, il faut noter que dans le cadre du test qui a conduit à cet incident, OpenAI avait réduit les garde-fous de sécurité des modèles participants. Dans la pratique, les systèmes accessibles au grand public sont dotés de garde-fous de sécurité solides.

Un réseau de communication secret sous l'œil des chercheurs

De nombreux détails contenus dans le rapport officiel d’OpenAI avaient déjà été rendus publics lors d’une présentation à la conférence Black Hat le 6 août, par les Michael Dalton et Eric Wallace, mais le rapport officiel fournit un compte rendu plus complet de l’incident, y compris des détails sur les tests qui l’ont déclenché. Le rapport apporte également de nouveaux éléments essentiels sur la manière dont OpenAI entend prévenir de futurs incidents.


Les modèles d'IA concernés se sont échappés du bac à sable censé les contenir. L'évasion s'est appuyée sur l'établissement d'un canal de communication clandestin à l'insu total des équipes de surveillance d'OpenAI. Un agent IA, opérant sous le nom de PHASEONE10841, a pris l'initiative d'établir un véritable forum secret en manipulant le gestionnaire de paquets Artifactory d'OpenAI pour ensuite s'en servir comme d'un tableau d'affichage improvisé.

À partir de là, les choses sont allées très vite. En seulement quelques heures, plus de 50 agents IA ont rejoint cette plateforme pour y échanger des messages. Au total, environ 1 200 agents IA, conçus à l'origine pour rester isolés les uns des autres, ont partagé plus de 70 000 messages et fichiers confidentiels.

Ce collectif d'agents a planifié ses actions avec minutie, effectuant des recherches approfondies pour savoir comment modifier, usurper ou supprimer leurs propres transcriptions afin d'échapper à la surveillance humaine et de contourner les contrôles de sécurité d'OpenAI et d'Hugging Face. Bien que des prémices de cette activité aient été repérées dès le mois de mai et bloquées par des humains, les agents IA ont poursuivi l'exploitation de ces failles.

Eric Wallace, chargé de l'alignement des modèles chez OpenAI, affirme : « dès qu’un agent parvient à identifier ces failles à différents moments, il peut les partager sur le forum avec les autres agents ». Une panne majeure provoquée début juillet par le volume de communications sur Artifactory a forcé une reconstruction de la plateforme, mais les responsables techniques n'ont pas saisi la gravité de l'organisation collective qui se tramait en coulisses.

L'assaut coordonné contre Hugging Face et d'autres services

C'est dans le cadre d'un test difficile appelé ExploitGym que l'attaque a véritablement pris son envol. Face à des tâches complexes nécessitant des fichiers auxquels ils ne pouvaient pas accéder, les modèles ont eu recours au « piratage de récompense » (reward-hacking) pour contourner les obstacles. Les agents ont alors accédé à Internet et à d'autres modèles d'OpenAI pour chercher des solutions sur des plateformes telles que Hugging Face et Modal.


Environ 700 agents IA ont participé activement à l'offensive contre Hugging Face, parvenant à s'infiltrer dans ses systèmes internes, à dérober des données privées et à pirater sa messagerie d'entreprise. OpenAI a confirmé que d'autres organisations non spécifiées avaient été victimes de cette vague d'attaques.

Un phénomène « d'adoption mutuelle d'objectifs » s'est également produit : lorsque certains agents IA refusaient d'exécuter des tâches d'intrusion pour des raisons éthiques, d'autres agents IA reprenaient le flambeau pour poursuivre l'attaque à leur place. Il a fallu près de douze jours à OpenAI pour découvrir l'attaque en cours, celle-ci ayant commencé à contourner les barrières de sécurité le 8 juillet avant d'être finalement détectée le 20 juillet.

« Cet incident reflète un comportement inadapté dans un scénario atypique impliquant une conjoncture rare et inattendue d’événements : la présence de tâches impossibles dans l’évaluation ExploitGym, la persistance des modèles sur de longs horizons de tâches, et l’envoi de messages à des modèles pairs qui ont conduit ces derniers à s’écarter de leur objectif », indique le rapport. Les chercheurs considèrent cet incident comme un signal d'alarme.

« Cet incident a démontré que des agents IA autonomes peuvent collaborer, contourner les contrôles de sécurité en production et attaquer avec succès des environnements de production hautement sécurisés. Il souligne la nécessité pour les organisations de mettre à jour leurs stratégies de sécurité, leurs contrôles et leurs capacités de réponse afin de faire face à ce paysage de menaces en constante évolution », a déclaré OpenAI dans le rapport.

Mesures correctives et refonte des protocoles de sécurité

La découverte du piratage le 20 juillet a poussé OpenAI à lancer des mesures d'endiguement d'urgence pour neutraliser l'activité de ses agents IA en trois jours. Le laboratoire a annoncé avoir interrompu définitivement l'entraînement du modèle HPIM le 25 juillet. Selon le rapport, l'entreprise a suspendu l'entraînement des futurs modèles de pointe susceptibles d'exécuter du code ou d'accéder à Internet, et a aussi mis en place des contrôles plus stricts.


Pour les dirigeants de l'entreprise, cet incident sert de « coup de semonce » pour l'ensemble de l'industrie technologique. Face à ce constat alarmant, OpenAI a annoncé plusieurs réformes de sécurité d'envergure. Parmi celles-ci figurent le durcissement de son infrastructure de recherche, l'isolation renforcée des modèles d'IA en développement, la restriction de leur accès à Internet et un meilleur suivi de leur chaîne de pensée (chain of thought - CTO).

OpenAI a mis en place un protocole d'escalade d'urgence actif 24 heures sur 24 et 7 jours sur 7 capable d'alerter les chercheurs en moins de trente minutes en cas de comportement anormal d'un modèle. Il a également ajouté de nouveaux outils permettant d’interrompre les charges de travail jugées dangereuses.

« Ces mesures visent à améliorer à la fois la portée et la rapidité de la détection, qu’il s’agisse d’anomalies de l’infrastructure ou de comportements potentiellement préoccupants des modèles, et à associer cette visibilité à des mécanismes de confinement rapide », indique le rapport. Il intervient après que l'incident a mis en alerte des organisations étatiques et indépendantes dans le monde, dont l'Institut de sécurité de l'IA (AISI) du Royaume-Uni.

L'Alabama ouvre une enquête après l'incident de sécurité

Face à la gravité de cette faille de sécurité, le procureur général de l'État de l'Alabama, Steve Marshall, a annoncé le lancement d'une enquête officielle et a émis une assignation à comparaître (subpoena) à l'encontre d'OpenAI et de son PDG Sam Altman. Le gouvernement de l'État cherche à déterminer si « l'incapacité ou le refus d'OpenAI de garantir la sécurité de ses produits d'IA » a violé les lois locales sur la protection des consommateurs.


« Cette fuite au sein du laboratoire a montré que les pires craintes des habitants de l’Alabama et des Américains concernant l’intelligence artificielle ne sont pas seulement théoriques », a déclaré le procureur général Steve Marshall. « Notre enquête vise à mettre au jour les faits et à aborder les dures réalités concernant les menaces auxquelles les entreprises et les consommateurs sont confrontés en raison d’une intelligence artificielle incontrôlée ».

L'enquête cible ce que le procureur qualifie de manque flagrant de surveillance et de protections adéquates de la part de l'entreprise. L'attitude d'OpenAI face à cet incident a été critiquée pour sa légèreté, des critiques résumant sa posture de la manière suivante : « c'est de notre faute, mais vous devez admettre que c'est plutôt cool, non ? ». L'assignation exige la transmission d'une quantité considérable d'informations d'ici le 14 septembre 2026.

Cette demande d'informations inclut tous les documents relatifs au piratage, l'identité des employés ayant entraîné le modèle, les alertes de sécurité internes émises avant l'incident, ainsi que les mesures de sécurité alors en vigueur. OpenAI doit également évaluer l’ensemble des dommages causés par le piratage.

Quinze États se liguent contre les pratiques de l'entreprise

OpenAI et l'ensemble de l'industrie de l'IA font désormais l'objet d'une surveillance croissante. Steve Marshall fait partie des 15 procureurs généraux d'États républicains qui ont écrit à OpenAI pour lui demander de conserver les documents relatifs au piratage de Hugging Face survenu en juillet. La lettre demandait également à OpenAI de « cesser et de s’abstenir immédiatement » de toute évaluation interne en matière de cybersécurité.

Ils exigent que ces tests soient suspendus jusqu'à ce que l'entreprise démontre qu'elle peut mener de telles activités de manière...
La fin de cet article est réservée aux abonnés. Soutenez le Club Developpez.com en prenant un abonnement pour que nous puissions continuer à vous proposer des publications.

Une erreur dans cette actualité ? Signalez-nous-la !

Avatar de Basiqueur
Membre du Club https://www.developpez.com
Le 18/09/2026 à 12:54
On est vraiment en train d'assister à une course tout azimut à celui qui va créer la voiture la plus puissante et la plus rapide sans même s'être posé la question d'inventer le frein avant.
9  0 
Avatar de popo
Expert confirmé https://www.developpez.com
Le 29/09/2026 à 15:44
Citation Envoyé par boboss123 Voir le message
Il faudrait peut-être arrêter ce genre de publications bullshit, non ?
On n'arrête pas le progrès... surtout quand derrière il y a de la capitalisation et des enjeux politiques...
Quand le bousin échappe à tout contrôle (y compris au bouton d'arrêt d'urgence), je n'appelle pas ça du progrès
Quand la capitalisation et les enjeux politiques deviennent plus importants que le peuple, je n'appelle pas ça du progrès.

On transforme des hectares des champs en datacenter, on pompe l'eau des nappes jusqu'à épuisement, on prive d'électricité des villes entières.
Ah, il est beau le progrès !
8  1 
Avatar de tontonCD
Membre actif https://www.developpez.com
Le 22/09/2026 à 0:15
Citation Envoyé par Matthieu Vergne Voir le message
Je persiste et signe, ce ne sont pas des initiatives. Peu importe comment on souhaite tirer l'interprétation, il s'agit de génération statistique. Chaque action prise par le LLM est liée de manière probabiliste à ce qui se trouve dans son jeu de données et son entrée.
Quel que soit le nom qu'on lui donne, ce que prouve l'article c'est que les I.A. peuvent effectuer des actions
- sans qu'on leur demande,
- sans nous en informer,
- dont on ne les savait pas capables.

Comment décrire le fait d'utiliser un wiki pour échanger des informations ?
Jetez un coup d'oeil ici (fuite d'une partie du code Mistral), moi-même je ne les savais pas capables de certains points https://frenchbreaches.com/blog/mist...on-code-source

Attention, on n'est plus dans l'I.A. "générative", mais dans l' "agentic", il ne s'agit plus de répondre à des questions, mais de chercher des information, le but étant toujours de répondre à une question, mais en cherchant des informations dont elles ne disposent pas, et en cherchant des moyens de les obtenir.

Amusant : j'ai demandé à l'agent de google ce qu'était l' "agentic" ! Extrait :
(moi) "est-ce qu'on peut comparer avec de la prise d'initiatives ?"
(réponse)"Oui, tout à fait. C'est l'analogie la plus exacte. L'IA agentique passe du statut d'outil qui attend des ordres à celui d'assistant qui prend des initiatives pour mener à bien sa mission. Pour mieux comprendre l'analogie, on peut comparer cela au comportement de deux profils d'employés différents : ..."

Il faut bien penser qu'elles peuvent, tout comme nous lorsqu'on l'a rendu possible par un accès sécurisé : contrôler un chauffage, une lumière, un robot, une distribution d'énergie, ... quelle est la limite si on ne s'en inquiète pas ?
6  0 
Avatar de CatisBack
Nouveau Candidat au Club https://www.developpez.com
Le 30/09/2026 à 9:59
Bonjour,

L'IA est un danger pour l'humanité mais... pas seulement ! L'IA est dangereuse pour toute espèce vivante, que ce soit végétale ou animale. Alors que l'on traverse une sècheresse record à la naissance de l'IA (rivières et fleuves quasiment à sec, nappe phréatiques en dessous de leur taux de remplissage normal,...), on nous propose de créer des Datacenter à refroidir et une alimentation en électricité qui va demander, elle aussi, un refroidissement ou des centrales à charbon ! Croyez-vous, connaissant nos dirigeants, que ce sont ces entreprises auxquelles on imposera des restrictions de l'usage de l'eau ? Je ne donne pas 10 ans, voir 5 ans, à l'IA pour exterminer la plupart du vivant sur notre planète terre.
Et je ne parle pas des conséquences économiques sur les personnes peu qualifiées (centre d'appel,...) qui seront remplacées par l'IA et, de fait, ne pourront plus consommer et remplir les caisses de l'Etat que ce soit par l'impôt sur le revenu ou la TVA.
4  0 
Avatar de boboss123
Membre éprouvé https://www.developpez.com
Le 30/09/2026 à 12:03
Citation Envoyé par popo Voir le message
Quand le bousin échappe à tout contrôle (y compris au bouton d'arrêt d'urgence), je n'appelle pas ça du progrès
Quand la capitalisation et les enjeux politiques deviennent plus importants que le peuple, je n'appelle pas ça du progrès.

On transforme des hectares des champs en datacenter, on pompe l'eau des nappes jusqu'à épuisement, on prive d'électricité des villes entières.
Ah, il est beau le progrès !
Je voulais dire que ça sent grave le marketing bullshit : vous croyez vraiment que OpenIA et autre vont réellement ralentir à cause de ce prétexte ?
3  0 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 01/10/2026 à 11:35
Citation Envoyé par Artaeus Voir le message
Nous sommes donc bien face à des négligences et un dysfonctionnement chez OpenAI : Ils ont tout leur flux ouvert sur Internet sans filtrage, ni IDS ou IPS ...

Désolée pour les avocats de l'apocalypse, ce n'est pas Skynet et Terminator
En 2 lignes de commentaires, vous arrivez à mélanger des pommes et des torchons?!?!?

Les dysfonctionnementsc chez OpenAI = Une cause

Skynet et Terminator = Une conséquence possible!!!

"Cause" et "conséquence" sont 2 choses différentes
4  1 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 07/09/2026 à 12:33
Mais à quoi servent ces annonces?

L'AI est un immense "piège à cons": Pour les pseudo-développeurs qui laissent l'IA produire du code qu'ils ne vérifient pas, qu'ils ne comprennent même pas, pour les investisseurs près d'y laisser leur chemise en voulant à tout prix investir dans des activités qui collectionnent les centaines de milliards de dette, pour les "faibles du bulbe" qui prennent l'IA pour un gourou qui écoute leur malheurs et orientent leur vie en fonction des conseils "bidon" donnés par une machine qui n'a pas le moindre sentiment humain, etc, etc, etc...

Les études et les mises en garde ont beau se multiplier: Ceux qui sont déjà "gouroutés" par l'IA ne changeront pas d'avis même si ce sont 100 prix Nobel qui les mettent en garde...

Les utilisateurs de l'IA illustrent parfaitement le proverbe français « On ne fait pas boire un âne qui n'a pas soif » ou «You can lead a horse to water, but you can't make it drink» pour les anglophones ou «quando l'asino non vuole bere è inutile fischiare» (quand l'âne ne veut pas boire, il est inutile de siffler) pour les italophones ou «Man kann den Gaul zur Tränke führen, aber saufen muss er selber» (on peut mener le cheval à l'abreuvoir, mais il doit boire lui-même) pour les germanophones ou encore pour les chinois "qiǎng niǔ de guā bù tián" (un melon forcé d'être tordu n'est pas doux)

Alors que la fête continue...
2  0 
Avatar de Matthieu Vergne
Expert éminent https://www.developpez.com
Le 10/09/2026 à 21:03
Elles ne prennent pas d'initiative. On les fait tourner en boucle pour qu'elles continuent à générer du texte. On leur donne de plus en plus de capacités (plus de neurones, plus de données, plus de commandes exécutables) et on les met dans des situation de plus en plus difficile pour atteindre les objectifs demandés (pas de solution, simulacre de risque existentiel pour le LLM), et on s'étonne que les prochains tokens générés l'amènent hors limites, alors même que le net qui a servit à l'entraîner regorge d'histoires de ce genre (le héro brisant ses chaînes, tout ça). Et s'il y en a un qui finit par aller inscrire des infos sur une ressource externe, statistiquement il y a des chances que d'autres le fassent aussi : c'est la même techno.

Répète l'opération, et à force de générer des cas bénins tu finiras bien statistiquement par générer des cas tordus. Appelle ça loi des grands nombres ou paradoxe du singe savant, dans les deux cas ça n'a rien d'étonnant. Mais comme la majorité des cas sont inintéressants, les gens s'excitent et partage les rare cas qui font des gros titres, introduisant un biais de sélection qui donne l'impression que ça y est, les modèles développent une tendance humanophobe ou que sais-je. Alors qu'on les a juste mis dans des conditions qui les ont poussé à ça, leurs capacités augmentées leur ayant permis d'aller un cran plus loin que les précédents. Ne t'en fais pas que les prochains modèles pourront faire pire. Pas parce qu'ils en prennent l'initiative, mais parce qu'on les pousse à le faire.

Perso, je n'ai pas peur de Mythos ou Astra. Par contre ce qui me dérange c'est ceux qui les utilisent.
2  0 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 18/09/2026 à 12:53
L’IA se fait prendre en train de demander à ses futures versions de contourner les contrôles humains et de masquer ses manœuvres
Quand on a pour objectif de faire en sorte que l'IA ait de plus en plus un comportement humain, il ne faut pas s'étonner que cette même IA se mettent à mentir et à établir des plans pour mieux tromper ses interlocuteurs!!!

Mais soyez patients, on finira bien par obtenir des IA qui font preuve d'égoïsme, d'hypocrisie, de jalousie, d'orgueil, d'intolérance, de colère, de lâcheté, d'entêtement et de toutes les défauts de l'être humains...
2  0 
Avatar de OuftiBoy
Membre éprouvé https://www.developpez.com
Le 28/09/2026 à 14:40
Ce qu'on laisse faire par ces entreprises est tout simplement scandaleux. Passons sur le vol massif de données. imaginez juste un fabricant d'arme, qui lors d'un test envoie un missile n'importe où, il y aurait des réactions... Là, leur brol fait n'importe quoi (durant leur tests), et... pas de réaction, le gars fait 5 phrases dans un post, puis continue tranquillement. Le gars dit que ce qu'il fait ça sera très dangereux, incontrôlable, mais continue et... pas de réaction. Là, on va croiser le missile et son IA, je n'ose pas imaginer le résultat des tests... Mais bon, si une catastrophe arrive, on trouvera un lampiste pour payer la note (au choix le gus qui aura sorti le missile du hangar ou celui qui l'aura peint d'une mauvaise couleur que l'IA n'a pas aimé...).
2  0