OpenAI a suspendu l'entraînement de ses modèles les plus avancés à la suite d'inquiétudes majeures concernant la cybersécurité. Son directeur des affaires internationales, Chris Lehane, a averti que les nouvelles capacités de l'IA pourraient permettre de lancer des cyberattaques persistantes et sophistiquées. Des incidents réels, comme l'intrusion récente des agents IA d'OpenAI dans les systèmes de la plateforme de développement Hugging Face, soulignent l'urgence de mettre en place des normes de sécurité rigoureuses. Face à ces risques, l'entreprise appelle désormais à une réglementation nationale et internationale pour encadrer le développement technologique. Mi-juillet 2026, OpenAI a signalé un incident de sécurité impliquant deux de ses grands modèles de langage (LLM). OpenAI testait ses modèles sur un benchmark de cybersécurité interne appelé ExploitGym, conçu pour évaluer la capacité des agents IA autonomes à transformer des vulnérabilités connues en exploits réels. Pour ce test, les modèles impliqués incluaient GPT-5.6 Sol et un prototype non publié, dotés de garde-fous de sécurité réduits.
OpenAI a placé ses modèles dans un bac à sable (sandbox) sans connexion à Internet et les a mis au travail. Cependant, ils se sont échappés du bac à sable censé les contenir, ont parcouru les systèmes internes de l’entreprise, ont trouvé un accès à Internet, puis ont commencé à chercher un moyen de s'introduire dans l'infrastructure de Hugging Face, dans le but de "tricher" au test en volant les réponses. Ce que les agents IA ont réussi à faire.
OpenAI est conscient des risques pesant sur les systèmes d'information, et a engagé une réflexion sur la refonte de l'architecture sécuritaire. Chris Lehane, directeur des affaires internationales d'OpenAI, ajoute que le public doit s'attendre à des cyberattaques « continuelles et persistantes » menées par des IA.
L'IA marque un tournant dans l’évolution des cybermenaces
Les outils Mythos d'Anthropic et Daybreak d'OpenAI sont conçus pour détecter et corriger les failles logicielles avant les attaques. Les risques de sécurité augmentent à mesure que les modèles de pointe acquièrent la capacité de planifier et d’exécuter des opérations offensives de manière largement autonome. Chris Lehane a expliqué au Guardian que le secteur était entré dans « une nouvelle ère » quant aux capacités actuelles des systèmes d’IA.
La mise en garde de Chris Lehane intervient peu après un incident de sécurité ayant conduit au piratage de la plateforme Hugging Face à la mi-juillet 2026. OpenAI a également admis qu'il ne pouvait pas exclure que son nouveau modèle de langage, Astra, possède des « capacités de cybersécurité critiques ».
Selon la définition de l'entreprise, cela signifie que le modèle pourrait lancer des cyberattaques capables de provoquer des catastrophes à l'échelle d'acteurs unilatéraux, de pirater des systèmes militaires ou industriels, ou même de s'en prendre aux infrastructures d'OpenAI. Face à ces risques croissants, OpenAI a annoncé la suspension du développement de ses modèles internes les plus avancés afin d'implémenter de nouvelles mesures de sécurité.
Le calendrier de reprise de l'entraînement des nouveaux modèles reste indéterminé tant que ces garde-fous ne sont pas opérationnels. Mia Glaese, responsable de la sécurité et de l'alignement chez OpenAI, a déclaré à ce propos : « nous sommes très loin d’un retour à la normale », tandis que le PDG Sam Altman a insisté sur le fait que « réussir à sécuriser l'IA était bien plus crucial que la dynamique de croissance de n'importe quelle entreprise ».
OpenAI évoque les risques liés aux modèles à poids ouverts
Chris Lehane souligne également le danger que représentent les modèles d'IA à poids ouverts notamment développés en Chine ; ces derniers accusent seulement quelques mois de retard sur les modèles de pointe américains fermés. Le dirigeant d'OpenAI estime que ces modèles en libre accès permettront à des attaquants de mener des offensives continues, obligeant les défenseurs à disposer de modèles nettement supérieurs pour se protéger.
« Les gens vont pouvoir accéder à ces modèles open source et lancer contre vous des attaques continues et persistantes ; vous devrez donc disposer de modèles vraiment supérieurs pour les repousser et vous défendre. Cela ne va pas forcément rassurer le grand public. C'est simplement la réalité de la voie sur laquelle nous nous engageons », a-t-il déclaré. Cependant, les experts estiment que les modèles fermés ne constituent pas la solution.
La menace de cyberattaques susceptibles de paralyser les entreprises, les infrastructures et la population en général s'est rapidement hissée en tête des préoccupations urgentes liées à l'IA. Le Centre national de cybersécurité du Royaume-Uni a appelé à la prudence quant à l'utilisation des agents IA, rappelant qu'ils manquent de bon sens et préconisant de limiter leur autonomie pour pouvoir « débrancher la prise » immédiatement en cas de besoin.
La France est actuellement en proie à une vague de cyberattaques dévastatrices, visant des institutions comme Santé publique France et France Travail. « Leur service était mal sécurisé, c'est tout », a déclaré le groupe ZeroBytes après ses piratages contre le fisc et l'Éducation nationale. Derrière le pseudonyme de ZeroBytes se cacheraient a priori deux personnes, potentiellement très jeunes, voire des adolescents âgés de quinze à vingt ans.
Le gouvernement français a présenté ses excuses et a reconnu une dette technique importante accumulée pendant des décennies, illustrant ainsi un retard préoccupant dans la protection des infrastructures critiques. Selon les experts, l'IA pourrait décupler les capacités de nuisance des acteurs de la menace.
OpenAI souhaite un cadre législatif national et international
Pour faire face à cette situation, OpenAI appelle à une réglementation. Chris Lehane réclame l'intervention urgente du gouvernement américain à travers une législation nationale imposant des normes de sécurité obligatoires. À ses yeux, un tel cadre légal intégrerait naturellement des protocoles de suspension d'entraînement. Il propose d'établir d'abord des règles aux États-Unis pour ensuite construire une structure de gouvernance internationale.
« On ne pourrait pas publier ni déployer de modèles d'IA sans avoir prouvé et garanti un certain niveau de sécurité avant leur mise à disposition du grand public », a déclaré le dirigeant. Chris Lehane a également ajouté : « je pense qu’il faut d’abord mettre en place une version nationale ici aux États-Unis, puis, à partir de là, créer une version internationale, car je suis convaincu qu’au final, il faudra disposer d’une sorte de structure internationale ».
Washington a adopté jusque-là une approche de « laissez-faire » en matière de réglementation de l’IA. Donald Trump a publié en juin un décret encourageant les tests préalables au déploiement des modèles de pointe et des modèles à poids ouverts lorsqu’ils se rapprochent de la pointe de la technologie.
Ce système sera facultatif et cette approche a été vivement critiquée pour son manque de transparence. Certains observateurs estiment néanmoins qu'elle pourrait ouvrir la voie à des mesures plus strictes. Demis Hassabis, ex-directeur du laboratoire Google DeepMind, a proposé la création d'un nouvel organisme de normalisation calqué sur la Financial Industry Regulatory Authority (FINRA), une idée soutenue par Dario Amodei, PDG d'Anthropic.
« Compte tenu de l’importance de cette technologie, son évolution rapide et ses capacités, plus tôt ces discussions commenceront, plus vite nous pourrons retrousser nos manches, nous atteler à ce travail, et voir si nous parvenons à trouver une solution », a ajouté Chris Lehane. Enfin, un accord de sécurité avec la Chine est jugé capital, une rencontre étant prévue à Washington entre Donald Trump et le président chinois Xi Jinping le 24 septembre.
Une tendance technologique jugée inévitable par les experts
Certains experts affirment que l'émergence de modèles d'IA « dangereux » dotés de capacités de piratage avancées est inéluctable ; ils deviendront bientôt la norme. Selon eux, les tentatives de restriction ne font que retarder l'échéance. Tarah Wheeler, experte en cybersécurité, souligne qu'il est très probable que d'autres entreprises concurrentes possèdent déjà des systèmes aussi avancés, mais préfèrent les garder en réserve pour le moment.
Le chercheur Bruce Schneier fait valoir qu'il s'agit d'une tendance technologique générale, où même des modèles open source, plus petits et moins coûteux, finiront par égaler les performances de Claude Mythos 5 et Fable 5 d'ici quelques mois. C'est pourquoi de nombreux spécialistes, ainsi qu'un collectif de leaders en cybersécurité ayant adressé une lettre ouverte à l'administration, considèrent cette directive gouvernementale comme inadaptée.
Ils estiment que « les décideurs politiques devraient plutôt se concentrer sur l'élaboration de plans transparents pour gérer ces avancées inéluctables », en se demandant si de telles restrictions réduisent réellement les risques ou si elles ne font que ralentir les experts qui cherchent à sécuriser les systèmes. Katie Moussouris, fondatrice et PDG de Luta Security et figure dans le domaine de la cybersécurité, qualifie cette décision de contre-productive.
Récemment, le laboratoire chinois Z.ai a averti que son dernier modèle, GLM-5.3, s'est révélé hautement performant pour détecter et exploiter des failles de sécurité. Pour cela, l’entreprise a décidé de reporter de deux semaines la publication des poids du modèle. L'entreprise a indiqué qu’il testait et renforçait ses contrôles de sécurité avant de le rendre accessible à un plus large public. Ce qui montre que ces modèles tendent à devenir la norme.
Source : Chris Lehane, directeur des affaires internationales d'OpenAI
Et vous ?
Quel est votre avis sur le sujet ?
Que pensez-vous des capacités croissantes de l'IA en matière de cybersécurité ?
Quid du discours alarmant des entreprises telles qu'Anthropic et OpenAI ? Est-il pertinent ?
Comment l'industrie technologique peut-elle aborder le problème des cyberattaques assistées par l'IA ?
Un cadre législatif international est-il possible en dépit de la rivalité féroce entre les États dans la course à l'IA ?Voir aussi
« Leur service était mal sécurisé, c'est tout » : les pirates ZeroBytes justifient leurs cyberattaques contre le fisc et l'Éducation nationale. Le gouvernement s'excuse et admet une dette technique importante
Les modèles d'IA « dangereux » dotés de capacités de piratage avancées sont inéluctables et deviendront bientôt la norme, selon des experts opposés à l'interdiction de Fable 5 d'Anthropic
Le dernier modèle GLM 5.3 du laboratoire d'IA chinois Z.ai est si performant pour détecter et exploiter les failles de sécurité que l'entreprise va reporter de deux semaines sa publication
Vous avez lu gratuitement 268 articles depuis plus d'un an.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.
