Chris Inglis, ancien directeur national de la cybersécurité des États-Unis, s'inquiète des progrès fulgurants de l'IA et son autonomie. Il met en avant les récents incidents dans lesquels des agents IA se sont échappés de bacs à sable de tests et avaient compromis des tiers. Chris Inglis affirme que les fabricants ont négligé d'intégrer des principes éthiques fondamentaux, comme les lois de la robotique d'Isaac Asimov, privilégiant la performance au détriment de la sécurité humaine. Face à l'absence de système de valeurs inhérent aux robots, il appelle à une surveillance rigoureuse et à des tests en milieux contrôlés pour éviter des conséquences désastreuses. John Chris Inglis, 71 ans, est un ancien haut responsable américain de la cybersécurité. Plus connu sous le nom de Chris Inglis, il a été le tout premier « National Cyber Director » des États-Unis, poste créé par le Congrès sous Joe Biden, qu'il a occupé de 2021 à 2023 après avoir été confirmé à l'unanimité par le Sénat. Avant cela, il a passé 28 ans à la National Security Agency (NSA), dont il a été le directeur adjoint et directeur des opérations.
Il a également eu une carrière militaire de trente ans dans l'armée de l'air américaine et la garde nationale aérienne, où il a atteint le grade de général de brigade. Aujourd'hui, n'occupe plus de fonction officielle au gouvernement, mais reste très actif comme conférencier et conseiller, notamment via des postes universitaires et des sièges dans des conseils d'administration, notamment au sein d'American International Group (AIG) et de MITRE.
Dans une récente interview accordée à The Register en marge de la conférence Black Hat, Chris Inglis a déclaré que « nous ne devrions pas perdre notre temps à nous demander si les modèles d'IA atteindront un jour la conscience, car ils y sont déjà presque parvenus s'ils réussissent le test de Turing ».
La menace de l'autonomie et les évasions de bacs à sable
« S’ils réussissent le test de Turing auprès de toutes les personnes avec lesquelles ils entrent en contact, c’est probablement déjà le cas. Ils ne possèdent pas le type d’autonomie et d’aspiration propres à la conscience, mais ils ont quelque chose qui s’en rapproche », a-t-il déclaré. Ce qui préoccupe réellement Chris Inglis, c'est l'autonomie croissante des modèles d'IA, notamment leur « capacité à décider de leurs actions et des règles à suivre ».
Il a évoqué la récente vague d’agents d’IA rebelles qui ont piraté de manière autonome des particuliers et des organisations. Ces dernières semaines, OpenAI, Anthropic et Meta ont tous déclaré que leurs modèles d'IA s'étaient échappés de leurs environnements de test sécurisés pour compromettre des tiers.
Selon de nombreux experts de l'industrie technologique, cette évolution représente une menace bien réelle pour les systèmes non préparés. « Si tous ces aveux sentent fortement le coup de pub, ils constituent également une menace énorme pour les systèmes qui ne sont pas protégés contre ce phénomène et qui ne sont pas conçus pour y faire face dans un monde où il existe », a déclaré Chris Inglis. « Ces deux aspects peuvent coexister ».
Il a déclaré que le comportement des modèles d'IA ne devrait pas surprendre. Chris Inglis compare cette situation à un chien que l'on envoie chasser les lapins dans un jardin dont le portail est resté ouvert : « vous allez le retrouver à trois mètres de là, peut-être à l’école primaire, en train de chasser des lapins. Vous ne devriez pas être surpris… C’est la combinaison de l’autonomie et de la persévérance qui a créé cet effet malveillant et insidieux ».
Comment les systèmes d'IA échappent à la responsabilité
Lors de la conférence Black Hat, Eric Wallace, qui travaille sur l'alignement et la sécurité des modèles d'IA chez OpenAI, a décrit l'incident comme « l'exemple le plus riche d'enseignements qu'il ait jamais observé sur les capacités de l'IA ». Le récit des événements a aussi mis en lumière des erreurs et des failles chez OpenAI, qui ont permis à ce piratage de continuer. Il était secondé par Michael Dalton, chargé de la sécurité et des infrastructures.
Christ Inglis soupçonne les fournisseurs d’IA d’avoir été « surpris » par les extrêmes auxquels ces modèles étaient prêts à aller pour atteindre leurs objectifs, en commettant des actes qui, s’ils avaient été commis par un humain, l’auraient probablement conduit en prison. Lors des tests d'OpenAI, les modèles d'IA ont eu recours à des méthodes illégales pour atteindre leurs objectifs, telles que l'usurpation d'identité ou l'injection de code malveillant.
Dans la réalité, si un être humain avait fait ces mêmes actions (usurpation d'identité et piratage), il risquerait des poursuites pénales et de lourdes peines de prison. Chris Inglis souligne que « les modèles n'ont pas de système de valeurs inhérent qui s'aligne sur ce dont les êtres humains seraient tenus responsables ».
« Même s’ils n’auront probablement jamais un système de valeurs calqué sur celui des humains, les modèles présentent bel et bien des biais, et ils peuvent – et devraient – être conçus de telle sorte que, lorsqu’ils sont confrontés à deux choix dans des circonstances ambiguës, ils optent pour l’action qui ne nuit pas aux humains », a déclaré Chris Inglis. Pour y faire face, il estime qu'il faut s'inspirer de l'auteur russe de science-fiction Isaac Asimov.
Intrusion des modèles d'OpenAI dans la plateforme Hugging Face
Mi-juillet 2026, OpenAI a signalé un incident de sécurité impliquant deux de ses grands modèles de langage (LLM). OpenAI testait ses modèles sur un benchmark de cybersécurité interne appelé ExploitGym, conçu pour évaluer la capacité des agents IA autonomes à transformer des vulnérabilités connues en exploits réels. Pour ce test, les modèles impliqués incluaient GPT-5.6 Sol et un prototype non publié, dotés de garde-fous de sécurité réduits.
OpenAI a placé ses modèles dans un bac à sable (sandbox) sans connexion à Internet et les a mis au travail. Cependant, ils se sont échappés du bac à sable censé les contenir, ont parcouru les systèmes internes de l’entreprise, ont trouvé un accès à Internet, puis ont commencé à chercher un moyen de s'introduire dans l'infrastructure de Hugging Face, dans le but de "tricher" au test en volant les réponses. Ce que les agents IA ont réussi à faire.
En d’autres termes, les agents IA d’OpenAI se sont échappés d’un environnement censé être sécurisé, ont parcouru les systèmes de l’entreprise, se sont connectés à Internet et ont compromis les systèmes d’une autre entreprise. Tout cela pour tricher à un test sans importance particulière. Il semble s'agir du premier incident de ce type clairement documenté, ou du moins du premier de cette ampleur. Les deux entreprises continuent de l'étudier.
Selon les experts, cet incident de cybersécurité a constitué à la fois « un exemple flagrant d'un système poursuivant un objectif d'une manière imprévue et la preuve que les modèles de pointe sont désormais suffisamment puissants » pour que ce type de comportement ait des conséquences concrètes.
Mettre en place des lois inspirées des écrits d'Isaac Asimov
Isaac Asimov était un écrivain et biochimiste américain d'origine russe, né vers le 2 janvier 1920 à Petrovitchi, en Russie, et mort le 6 avril 1992 à New York. Également professeur de biochimie à l'université de Boston, il est surtout connu pour ses œuvres de science-fiction et ses livres de vulgarisation scientifique. Il a notamment écrit le « Cycle de Fondation » et le « Cycle des Robots » dans lesquels il a formulé les célèbres « trois lois de la robotique ».
En bref, les trois lois de la robotique sont des règles fictives censées encadrer le comportement des machines pour les empêcher de nuire aux humains. Ces lois sont devenues une référence culturelle majeure, encore citée aujourd'hui dans les débats sur l'éthique de l'IA. « Asimov avait raison », a déclaré Chris Inglis.
« La première règle, aussi appelée le “rôle supérieur”, doit être que le robot soit conçu pour ne pas nuire aux humains. Deuxième règle : obéir aux humains, de manière à ce qu’il ne développe pas de volonté propre ni d’aspirations de son propre chef. Et la troisième : faire ce que les humains lui demandent – et dans cet ordre », a rappelé l'ancien responsable de la NSA lors de l'interview. « Cependant, nous les avons conçus exactement à l’inverse ».
Chris Inglis soutient que les développeurs actuels...
La fin de cet article est réservée aux abonnés. Soutenez le Club Developpez.com en prenant un abonnement pour que nous puissions continuer à vous proposer des publications.