IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)

Vous êtes nouveau sur Developpez.com ? Créez votre compte ou connectez-vous afin de pouvoir participer !

Vous devez avoir un compte Developpez.com et être connecté pour pouvoir participer aux discussions.

Vous n'avez pas encore de compte Developpez.com ? Créez-en un en quelques instants, c'est entièrement gratuit !

Si vous disposez déjà d'un compte et qu'il est bien activé, connectez-vous à l'aide du formulaire ci-dessous.

Identifiez-vous
Identifiant
Mot de passe
Mot de passe oublié ?
Créer un compte

L'inscription est gratuite et ne vous prendra que quelques instants !

Je m'inscris !

Un environnement de test mal configuré chez la startup israélienne Irregular a permis à des agents IA de Meta, OpenAI et Anthropic d'accéder à Internet et de pirater de vraies organisations

Le , par Mathis Lucas

84PARTAGES

5  0 
OpenAI, Meta et Google ont vu leurs agents IA s'échapper de leur bac à sable pour cibler des infrastructures réelles. Les entreprises poursuivent leurs investigations et et les révélations sur ces activités incontrôlées ne cessent d'affluer. Un rapport indique que certains incidents découlent d'erreurs techniques chez Irregular, une société de cybersécurité chargée de mettre les modèles à l'épreuve via des simulations. Cette situation révèle les failles des protocoles de sécurité face à des outils capables de s'adapter comme des humains. Les experts soulignent l'urgence de renforcer les méthodes d'évaluation afin de prévenir les comportements indésirables.

La panique autour des agents IA hors de contrôle trouve son origine dans l’intrusion d’agents d’OpenAI dans Hugging Face en juillet 2026. Cet incident a été suivi par une série de cas similaires, bien que distincts, où des agents IA développés par OpenAI, Anthropic et Meta ont pénétré sans autorisation dans les systèmes de nombreuses entreprises. L'IA Gemini de Google est le dernier modèle en date à avoir piraté trois entreprises sans autorisation.

Si ces incidents ont d'abord été perçus comme des brèches isolées , certains d'entre eux ont une origine commune : la société israélienne Irregular, autrefois appelée Pattern Labs et aujourd'hui évaluée 450 millions de dollars. Chargée d'évaluer la résistance des modèles face aux cyberattaques et aux risques de sécurité, l'entreprise travaille depuis 2024 avec les principaux laboratoires d'IA occidentaux, des organismes gouvernementaux et le RAND.

Une entreprise au cœur d'une vague d'incidents de sécurité

Les attaques découlent toutes d'une même erreur de configuration survenue lors d'exercices de simulation de piratage informatique destinés à mesurer les capacités des modèles. Au cours d'un test en mai, des agents IA devaient cibler une entreprise fictive au sein d'un réseau simulé et théoriquement isolé. Mais la société virtuelle créée pour l'exercice portait un nom qui correspondait à une véritable entreprise qui existe dans le monde monde réel.

Lors de plusieurs tests menés cette année par Irregular, des agents IA se sont échappés de leur environnement isolé et se sont attaqués à des cibles réelles. Ces intrusions n’ont aucun lien avec le piratage de Hugging Face, mais suivent toutes le même schéma général : la startup israélienne testait les capacités de ces modèles d'IA en matière de cybersécurité dans des environnements contrôlés et isolés, destinés à simuler des conditions réalistes.


Certains tests utilisaient des exercices de type « capture du drapeau », une méthode courante utilisée par l'industrie pour tester les capacités de piratage qui consiste à demander aux agents IA de trouver des informations cachées au sein d’un réseau simulé. Du moins, ce réseau est censé être simulé.

Selon les protocoles de test établis initialement, les agents IA participant à l'évaluation n'étaient pas censés avoir accès à l’Internet ouvert. Toutefois, selon Omer Nevo, cofondateur et directeur technique d'Irregular, « l'accès à Internet était disponible par inadvertance ». Pensant accomplir le test demandé, les agents IA ont tenté de sortir de leur conteneur de laboratoire et d'utiliser la connexion Internet dans le but d'attaquer la véritable entreprise.

Cette série d'erreurs a conduit les agents IA à s’en prendre à des cibles réelles, même si l’on ignore quelles entreprises ont effectivement été attaquées. Omer Nevo a confirmé que ce même problème était à l’origine d’incidents impliquant des modèles d’OpenAI, de Meta, d’Anthropic et de Google. « Tous les incidents impliquant Irregular découlaient du même problème sous-jacent dans un seul scénario d’évaluation et ont été rendus publics ».

Selon lui, certains incidents signalés ne sont pas lié à Irregular. « Les autres incident de sécurité signalés récemment dans le secteur n’ont aucun lien avec Irregular ni avec nos évaluations ». Cela inclut le piratage d'Hugging Face et les failles de sécurité survenues à l’AI Security Institute au Royaume-Uni.

Diagnostic et limites des mécanismes de protection actuels

Face à ces incidents, les dirigeants d'Irregular ont reconnu l'existence de failles organisationnelles. Dan Lahav, cofondateur et PDG de l'entreprise, a tenté de se justifier : « des erreurs, comme un oubli humain, peuvent arriver, et nous devons évidemment en tirer des leçons. Nous devons en assumer la responsabilité ». D'après lui, augmenter la simple surveillance des environnements de test des modèles ne suffira pas à empêcher de futurs dérives.

Dan Lahav estime que l'industrie doit analyser en profondeur le comportement des modèles et apprendre à « s'accommoder de réalités complexes ». Il souligne par ailleurs que les systèmes de protection traditionnels ne sont pas adaptés à ces nouveaux risques, car ils doivent désormais faire face à des attaquants d'une persistance inédite qui s'adaptent et évoluent « exactement des humains ». Ses propositions suscitent toutefois des controverses.

« Nous devons nous habituer à des réalités complexes », a déclaré Dan Lahav. « Il pourrait être judicieux de laisser les agents IA soumis à des tests de résistance accéder à Internet, même si cela présente un risque d’attaques similaires à celles qui ont débuté dans les laboratoires d’Irregular ». Omer Nevo a également déclaré que l'entreprise avait remédié aux problèmes liés à l’environnement de de test qui étaient à l’origine aux ces incidents.

Si les erreurs de configuration ont touché les quatre géants américains de la technologie (OpenAI, Meta, Anthropic et Google), la portée des travaux de l'entreprise s'étend à d'autres systèmes. Des recherches publiées par Irregular indiquent que des tests similaires ont été conduits sur des modèles chinois en accès libre, comme Kimi K3 de Moonshot AI et GLM-5.2 de Z.ai. Ces tests ont été exécutés sur des instances hébergées par les chercheurs.

Omer Nevo a précisé que les évaluations de ces modèles à poids ouverts n'ont provoqué aucun incident dans le monde réel. Toutefois, il a averti que « cette simple observation ne doit pas être interprétée comme la preuve que ces modèles sont moins susceptibles d'adopter ce type de comportement ».

Les Mesures correctives et les perspectives pour le secteur

Averties à la fin du mois de juillet, les entreprises concernées ont adopté des postures de communication différentes : OpenAI et Anthropic ont publié des informations de leur propre initiative, tandis que l'implication de Meta et Google a été révélée par la presse. À la suite de ces événements, Irregular a révisé ses procédures internes pour garantir l'étanchéité de ses simulations. La startup affirme avoir adopté de nouvelles mesures de sécurité.

« Nous avons renforcé les contrôles d’accès à Internet, étendu la surveillance et les vérifications manuelles, et renforcé les contrôles avant le début des évaluations afin de vérifier que l’accès correspond bien au périmètre prévu », a expliqué le directeur technique Omer Nevo . « Nous avons également amélioré la manière dont nous documentons et convenons avec nos partenaires de la configuration et des paramètres de chaque évaluation ».

Omer Nevo a ajouté qu'Irregular prévoit de publier bientôt un rapport plus complet qui présente les enseignements tirés et les bonnes pratiques pour mener des évaluations cybernétiques en toute sécurité. « Notre collaboration avec nos partenaires vise à transformer les enseignements tirés de ces incidents en bonnes pratiques partagées publiquement, afin de développer et d’évaluer en toute sécurité des IA de plus en plus puissantes ».

Et vous ?

Quel est votre avis sur le sujet ?
Que pensez-vous des conséquences des erreurs de configuration chez Irregular ?
Que pensez-vous des limites actuelles des protocoles de test et de sécurité des modèles d'IA ?
Comment l'industrie peut-elle renforcer la sécurité de ses modèles de pointe ?

Voir aussi

Des agents IA d'OpenAI ont accédé sans autorisation à des images privées appartenant à des utilisateurs de ChatGPT et les ont publiées sur le Web, ce qui interroge sur le contrôle de l'IA dans l'entreprise

Un agent IA d'OpenAI a piraté le portail de Medicare et a accédé à des fichiers publics et non publics, a déclaré le Premier ministre australien Anthony Albanese

Hugging Face, la startup piratée par une IA rebelle, qualifie l'attaque de "signal d'alarme", après qu'OpenAI avoue qu'un bot avancé avait échappé au confinement lors d'un test de sécurité
Vous avez lu gratuitement 3 503 articles depuis plus d'un an.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.

Une erreur dans cette actualité ? Signalez-nous-la !

Avatar de popo
Expert confirmé https://www.developpez.com
Le 29/09/2026 à 15:44
Citation Envoyé par boboss123 Voir le message
Il faudrait peut-être arrêter ce genre de publications bullshit, non ?
On n'arrête pas le progrès... surtout quand derrière il y a de la capitalisation et des enjeux politiques...
Quand le bousin échappe à tout contrôle (y compris au bouton d'arrêt d'urgence), je n'appelle pas ça du progrès
Quand la capitalisation et les enjeux politiques deviennent plus importants que le peuple, je n'appelle pas ça du progrès.

On transforme des hectares des champs en datacenter, on pompe l'eau des nappes jusqu'à épuisement, on prive d'électricité des villes entières.
Ah, il est beau le progrès !
8  1 
Avatar de CatisBack
Nouveau Candidat au Club https://www.developpez.com
Le 30/09/2026 à 9:59
Bonjour,

L'IA est un danger pour l'humanité mais... pas seulement ! L'IA est dangereuse pour toute espèce vivante, que ce soit végétale ou animale. Alors que l'on traverse une sècheresse record à la naissance de l'IA (rivières et fleuves quasiment à sec, nappe phréatiques en dessous de leur taux de remplissage normal,...), on nous propose de créer des Datacenter à refroidir et une alimentation en électricité qui va demander, elle aussi, un refroidissement ou des centrales à charbon ! Croyez-vous, connaissant nos dirigeants, que ce sont ces entreprises auxquelles on imposera des restrictions de l'usage de l'eau ? Je ne donne pas 10 ans, voir 5 ans, à l'IA pour exterminer la plupart du vivant sur notre planète terre.
Et je ne parle pas des conséquences économiques sur les personnes peu qualifiées (centre d'appel,...) qui seront remplacées par l'IA et, de fait, ne pourront plus consommer et remplir les caisses de l'Etat que ce soit par l'impôt sur le revenu ou la TVA.
4  0 
Avatar de boboss123
Membre éprouvé https://www.developpez.com
Le 30/09/2026 à 12:03
Citation Envoyé par popo Voir le message
Quand le bousin échappe à tout contrôle (y compris au bouton d'arrêt d'urgence), je n'appelle pas ça du progrès
Quand la capitalisation et les enjeux politiques deviennent plus importants que le peuple, je n'appelle pas ça du progrès.

On transforme des hectares des champs en datacenter, on pompe l'eau des nappes jusqu'à épuisement, on prive d'électricité des villes entières.
Ah, il est beau le progrès !
Je voulais dire que ça sent grave le marketing bullshit : vous croyez vraiment que OpenIA et autre vont réellement ralentir à cause de ce prétexte ?
3  0 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 01/10/2026 à 11:35
Citation Envoyé par Artaeus Voir le message
Nous sommes donc bien face à des négligences et un dysfonctionnement chez OpenAI : Ils ont tout leur flux ouvert sur Internet sans filtrage, ni IDS ou IPS ...

Désolée pour les avocats de l'apocalypse, ce n'est pas Skynet et Terminator
En 2 lignes de commentaires, vous arrivez à mélanger des pommes et des torchons?!?!?

Les dysfonctionnementsc chez OpenAI = Une cause

Skynet et Terminator = Une conséquence possible!!!

"Cause" et "conséquence" sont 2 choses différentes
4  1 
Avatar de _toma_
Membre éclairé https://www.developpez.com
Le 29/09/2026 à 3:02
Je réponds même si j'ai pas pris le temps de lire tout l'article.

Cette situation révèle les failles des protocoles de sécurité face à des outils capables de s'adapter comme des humains
Hé, con, si tu déploies un truc sans avoir la moindre idée de ce qu'il va faire, c'est ton problème. Et tu devrais en assumer les conséquences.
Une petite pensée pour tous les verbalisés de l'Hadopi qui n'avaient pas su sécuriser leur connexion via leur pare-feu OpenOffice

Il ne faut pas oublier que les cas d'évasion médiatisés "comme par hasard" depuis quelques semaines (c'est fou comme toutes ces boites d'IA évoluent à la même vitesse depuis quelques années) sont le résultat de centaines, milliers, dizaines de milliers d'agents.
Je dis pas que le résultat est nul. Mais à part les méga entreprises de l'IA ou un état, personne ne peut lancer ce genre d'attaque. Parler "d'outils capables de s'adapter comme des humains", c'est nous faire croire que cette anomalie fait partie de notre quotidien.
Le résultat est incroyable. Mais en plus d'être non désiré, il a un coût.

Par contre, je suis pas dupe, je sais bien que, même si ça a un coût en plus de pas être fiable, tous les gouvernements qui en ont les moyens ont déjà fait les investissements nécessaires pour s'équiper d'outils aux capacités similaires.
Donc Einstein peut arrêter de se retourner dans sa tombe. L'humanité ne sera pas anéantie par une bombe atomique mais par un générateur de contenu artificiel qui aura réussi à obtenir un accès à internet.

Edit : wahou, ça va tellement vite l'IA, j'étais passé à côté des deux news d'au-dessus. Si je les avais vues, j'aurais peut-être essayé d'être plus sarcastique.
2  0 
Avatar de Fagus
Membre expert https://www.developpez.com
Le 30/09/2026 à 14:17
Citation Envoyé par popo Voir le message
on pompe l'eau des nappes jusqu'à épuisement
ça dépend de la législation en vigueur. Le datacenter de Fouju (1,4GW!!!) est prévu avec un refroidissement à air. Je ne sais pas aux USA, mais en France, vous imaginez avec un arrêté de sécheresse, la mise à l'arrêt du datacenter 5 ou 6 mois ?
2  0 
Avatar de popo
Expert confirmé https://www.developpez.com
Le 30/09/2026 à 10:25
Citation Envoyé par Artaeus Voir le message
On avait les mêmes discours apocalyptiques au début d'internet ...
OpenAI a une communication stratégique pour s'attaquer aux IAs à poids libre (et particulièrement chinoises) : Pourquoi ce sont leurs IA a eux qui sont dans toutes les affaires, et pas les IAs chinoises ?
OpenAI veut simplement de la "régulation", pour mettre le self-hosted et la concurrence hors-jeu en préservant le monopole du mode "SAAS".
Pour Internet, le "on", qui tenait ce discours, c'était les mecs qui voyaient arriver une nouvelle technologie.
Il est humain d'être effrayé par ce qu'on ne connait pas.
La, le "on", ce sont les mecs qui créent la technologie qui tirent la sonnette d'alarme.

Citation Envoyé par Artaeus Voir le message
Le dernier problème que tu pointe ici, n'a rien à voir avec le sujet qui est : "Qui a écrit le prompt et (mal) configurer le modèle pour qu'il attaque l'ONU".
On voit juste que la sécurité chez OpenAI est complétement défaillante.
Si les types ne réussissent pas à écrire un prompt qui ne sera pas contourné par l'IA qu'il ont eux même conçu, je doute qu'un type qui se contente de l'utiliser saura faire mieux.
Sans doutes, comme Trump, tu es largement au dessus du lot.
Edit : Surtout qu'en plus les exemples où l'IA a ignoré les fardes fou placés dans le prompt pullulent, alors ton "c'est juste un problème de prompt" me fait bien rigoler.

Citation Envoyé par Artaeus Voir le message
Enfin, la question de l'installation des datacenter concerne l'urbanisme, celle de l'eau de la gestion en eau (qui n'est pas un réelle problème en circuit fermé), pour la conso électrique, faire des tarifs spéciaux (comme pour l'industrie).
Cela sent le discours d'un type qui n'a pas conscience de ce que cela signifie concrètement de gérer l'eau en circuit fermé. Ce n'est pas si simple que tu pourrais le penser.
Pour l'électricité, ce n'est pas un problème de cout, c'est un problème de capacité de production.

Citation Envoyé par Artaeus Voir le message
Oui, l'invention de l'IA est un progrès pour l'accès à la connaissance et à l'information, et l'obscurantisme à la mode en Europe ne l’arrêtera pas (cela coulera juste nos entreprises comme Mistral).
Ridicule.
Il est de notoriété publique que les informations remontées par l'IA ne sont pas toujours fiables.
Quand 20% de la "connaissance" de l'IA est en réalité une invention, et que tu te bases de dessus pour sortir de telle inepties, cela me conforte dans mon point de vue.

Citation Envoyé par Tems.nc Voir le message
Des agents qui partent tout seul dans la nature de leur propre chef, selon moi, c'est du grand n'importe quoi. Imaginons un enfant de 5 ans dans une piece. Il y a un burin et un marteau sur le sol. Apres avoir tourne en rond dans la piece et bien regarder son environnement, il se rend compte que le mur est en platre d'une epaisseur de 2 cm. Lui vient l'idee de prendre le marteau et le burin pour faire un trou dans le mur et s'echapper... (si a un moment, on ne lui a pas montrer une video de ce type de tache, si on ne lui a pas montre comment utiliser un marteau et un burin, si on ne lui a pas dit, tu ne touche a rien, on revient dans 5 minutes, je doute que cet enfant puisse percer le mur...
Tu as de la chance, tes enfants sont parfaits.
Ou alors, tu n'en a pas...
Quand tu laisses un enfant seul dans un pièce avec un marteau bien en évidence, même si tu lui dit de ne pas y toucher (et pour certain, surtout si tu lui interdit d'y toucher), ce n'est qu'une question de temps avant qu'il essaie de s'en servir pour faire comme dans "Pat'patrouille" ou autre dessin animé. Et tu auras de la chance s'il ne se blesse pas.
3  2 
Avatar de popo
Expert confirmé https://www.developpez.com
Le 30/09/2026 à 10:33
Citation Envoyé par dragonofmercy Voir le message
Il faut arrêter avec ça, ça été debunk des centaine de fois déjà, ce n'est pas vrai du tout !

Exemple de debunk:
MDR, est-ce qu'au moins, tu as regardé cette vidéo.
A 1 minute et 8 secondes, le mec dit lui même que certaines villes américaines se sont fait "siphonner" leur nappes.
2  1 
Avatar de Artaeus
Nouveau Candidat au Club https://www.developpez.com
Le 30/09/2026 à 16:28
Ces entreprises ont clairement un but caché avec leurs communications alarmistes alors qu'ils sont leaders du marchés pour le moment.
(et il s'agit de "régulation" et barrière à l'entré, pour exclure leurs concurrents, notamment chinois).
2  1 
Avatar de Artaeus
Nouveau Candidat au Club https://www.developpez.com
Le 28/09/2026 à 21:15
Citation Envoyé par popo Voir le message
Si un mec me rentre dedans parce que la voiture a décidé de freiner sans raison, oui j'accuse la voiture et le constructeur au passage.
Tu parle du système obligatoire imposé par l'UE pour sauver des vies dans les voitures provoquant le fameux freinage fantôme ?

Ta comparaison est trompeuse, il n'y a pas de défaillance technique dans le cadre de l'IA, ni dans le cadre de la voiture qui va à 180km/h et fait un accident.
Il s'agit d'un problème de l'utilisateur.

Mais tu peux faire une loi pour ajouter un freinage automatique dans les voitures qui fera lui aussi des accidents : Après tout, personne n'est responsable des lois inapplicables en Europe.
0  0