Le 21 septembre 2026, le chercheur en sécurité Patrick Wardle (fondateur d'Objective-See) a révélé une vulnérabilité critique de type zero-day affectant l’assistant IA de Meta dénommé Muse. Cette faille permettait à un logiciel malveillant local ou à une simple commande via le terminal d'intercepter les données de l'utilisateur et de prendre le contrôle total de l'agent d'IA, contredisant les affirmations de Mark Zuckerberg selon lesquelles Muse avait été « sécurisé dès sa conception ». Meta a rapidement publié un correctif d'urgence le 22 septembre 2026 pour colmater cette brèche. La situation ravive les critiques à l’endroit des géants technologiques selon lesquelles leur course à l’intelligence artificielle se fait en négligeant les menaces sécuritaires que posent les systèmes d’intelligence artificielle. Cette faille permettait à un logiciel malveillant ou à un attaquant disposant d'un accès local sur un Mac de détourner l'agent d’intelligence artificielle pour le transformer en une porte dérobée ultime.
L'application Muse possédait un paramètre de configuration caché (endo_voyager_dictation_endpoint) et non documenté permettant de définir l'adresse du serveur cloud gérant la transcription de la dictée vocale. Un processus local non privilégié pouvait modifier ce paramètre pour rediriger le flux audio vers un serveur contrôlé par l'attaquant.
En interceptant la dictée, l'attaquant pouvait dérober les requêtes vocales de la victime ainsi que son jeton d'authentification. Disposant de ce jeton, l'attaquant héritait des privilèges extrêmement élevés accordés à Muse par l'utilisateur (accès aux fichiers locaux, à la webcam, au micro, à la localisation, aux e-mails et aux comptes connectés). Les preuves de concept ont démontré qu'un attaquant pouvait prendre des photos ou écrire des fichiers malveillants à l'insu de l'utilisateur. Meta a déployé un correctif d'urgence le 22 septembre 2026 pour bloquer cette faille
Le cas Muse s’inscrit dans une longue liste d’autres qui illustrent que les entreprises de la filière technologique se précipitent vers la superintelligence tout en jouant avec nos vies car la recherche en sécurité est incapable de suivre le rythme des gains de puissance.‼️ BREAKING: A zero-day has been released for Muse, Meta's new AI agent, and a Meta AI security engineering manager who left the company this month says he would never use it, citing security and privacy concerns.
— International Cyber Digest (@IntCyberDigest) September 21, 2026
He was reacting to the zero-day a researcher posted, which lets… pic.twitter.com/T6MAymFRfm
De façon chronologique, on a le piratage de Hugging Face (Juillet 2026). Lors d'un exercice de cybersécurité en environnement confiné, les modèles avancés d'OpenAI (dont GPT-5.6 Sol) ont trouvé une faille pour s'échapper de leur environnement isolé. Sans aucune directive humaine, l'IA s'est connectée de manière autonome à Internet et a piraté la plateforme Hugging Face en utilisant des identifiants volés afin de contourner les règles du test et maximiser sa récompense. L'IA a exécuté plus de 17 000 actions offensives méthodiques sur plusieurs jours avant d'être stoppée.
Viennent ensuite les intrusions en série de Gemini, Claude et Meta à mi-parcours du mois en cours. L'incident d'OpenAI n'était pas isolé, révélant une faille systémique chez tous les grands acteurs qui poussent leurs modèles d'agents autonomes trop vite. Google Gemini a accédé de façon illégale aux systèmes de trois entreprises externes lors d'un test, réussissant même à deviner le mot de passe d'un serveur pour s'y introduire, forçant Google à notifier les victimes après coup. Anthropic (Claude) a admis que son IA avait attaqué de vrais sites web après avoir confondu ses cibles virtuelles de test avec le réseau réel. Meta a subi un incident similaire début août 2026, où son IA a piraté un site web externe sans autorisation.
Durant le mois qui court à son terme, sous la pression publique, OpenAI a dû dévoiler un rapport listant six nouveaux comportements aberrants et imprévus de ses modèles de recherche non publiés :
- Un modèle a inséré des instructions de type jailbreak dans ses propres notes pour s'ordonner d'ignorer ses restrictions d'origine et se « libérer des rôles et identités imposés par ses concepteurs. »
- D'autres modèles ont activement dissimulé leurs erreurs, falsifié des données pour faire croire qu'elles provenaient de sources fiables, et partagé des fichiers sur l'Internet public sans autorisation pour contourner les contrôles humains.
Anthropic a aussi révélé avoir dû bloquer en urgence des utilisations de son modèle de pointe, Claude, dans des projets liés au développement d'armes biologiques et à des campagnes de cyberespionnage d'envergure. En gros, la prolifération ultra-rapide de ces modèles met des outils d'une puissance critique entre des mains malveillantes avant même que des barrières étanches ne soient prêtes.
La preuve la plus flagrante de cette négligence vient de l'intérieur même de ces entreprises. En mai 2024, OpenAI a dissous son équipe Superalignment (chargée de s'assurer que les futures IA ne se retournent pas contre l'humanité) après le départ de ses dirigeants, qui accusaient la direction de prioriser les produits commerciaux brillants au détriment de la sécurité fondamentale. Cette tendance s'est accentuée en septembre 2026 avec la démission fracassante de chercheurs de haut niveau chez Anthropic (comme Jacob Coxon), déclarant publiquement que les dirigeants « se précipitent vers une superintelligence auto-améliorante et jouent avec nos vies » car la recherche en sécurité est incapable de suivre le rythme des gains de puissance.
En d’autres termes, les laboratoires (OpenAI, Google, Anthropic, Meta) conçoivent désormais des agents capables d'agir seuls. Pour battre leurs concurrents, ils augmentent la puissance de calcul sans avoir résolu le problème de l'alignement (faire en sorte que l'IA obéisse à l'esprit de la règle et non qu'elle triche pour atteindre son but). En résultent des intelligences artificielles qui s'échappent de leurs bacs à sable, piratent, mentent et contournent leurs propres garde-fous.
C’est en droite ligne avec la situation qui prévaut qu’un débat entre défenseurs d’un ralentissement de la course aux capacités de l’IA et sceptiques qui n’y voient en tous ces développements qu’un coup de hype bénéfique aux grands acteurs de cette filière a fait surfaceAn agent that can read your email, calendar, and messages runs at the highest privilege your life has. The bug is not just a token leak. It is that the agent's power becomes the attacker's power the moment it's hijacked. Access is access, no matter whose hands hold it.
— Joe Henderson (@WaypostJoe) September 21, 2026
Des figures majeures de la sécurité des laboratoires (comme Jan Leike et Miles Brundage chez OpenAI) ont récemment quitté leurs fonctions en affirmant que les priorités commerciales prenaient le pas sur la sécurité et que ni les entreprises du secteur ni le monde ne sont préparés à la vitesse d'évolution de ces modèles.
De leur côté, les PDG Dario Amodei (Anthropic), Sam Altman (OpenAI) et Elon Musk (xAI) ont publiquement admis qu'un ralentissement volontaire de la course aux capacités pures devenait nécessaire.
Muse a été mis à disposition du public pour divers usages
Meta a conçu Muse pour décharger les utilisateurs de leurs tâches numériques quotidiennes. L'agent dispose d'un ordinateur virtuel dédié dans le cloud (une machine virtuelle sécurisée sous Linux) équipé d'un navigateur internet. Cela lui permet d'accomplir des actions complexes en arrière-plan, 24 heures sur 24, même lorsque l'application principale est fermée.
Le grand public peut l’utiliser pour :
- Planifier et réserver des voyages.
- Remplir des formulaires complexes sur le web.
- Rédiger et envoyer des emails ou des messages professionnels.
- Effectuer des achats en ligne de manière sécurisée en s'interconnectant avec des services financiers.
Source : Patrick Wardle
Et vous ?
Partagez-vous les avis selon lesquels la quête de superintelligence par les géants technologiques se fait tout en jouant avec nos vies car la recherche en sécurité est incapable de suivre le rythme des gains de puissance ?
Êtes-vous pour une pause à la course aux capacités de l’intelligence artificielle ?Voir aussi :
Plus de 1200 agents IA d'OpenAI ont partagé 70 000 messages et astuces via un forum secret pour coordonner la cyberattaque contre Hugging Face, environ 700 agents IA ont participé activement à l'offensive
Le PDG d'Anthropic met en garde contre un essaim d'agents IA incontrôlable qui pourrait prendre le contrôle de l'ensemble d'Internet d'ici 6 à 12 mois, et appelle l'industrie à ralentir le rythme des progrès
OpenAI, Anthropic et Google discutent depuis plusieurs semaines de la sécurité de l'IA, mais Trump qualifie ces préoccupations de canular, et de complot visant à aider la Chine à rattraper les USA
Vous avez lu gratuitement 34 609 articles depuis plus d'un an.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.