Anthropic AI affirme avoir déjoué plusieurs opérations malveillantes menées à l'aide de ses modèles Claude, allant du cyberespionnage à la conception d'armes, en passant par des campagnes de surveillance de masse. Dans un nouveau rapport, l'entreprise affirme être intervenue dans le nord du Yémen, où elle a empêché une tentative de déploiement de Claude dans un logiciel de guidage de missiles. Le rapport précise que la société a suspendu les comptes impliqués et partagé des informations sur la menace avec des partenaires. Les relations entre Washington et cette entreprise restent tendues à la suite d'un bras de fer concernant les garde-fous éthiques.Récemment, des groupes alignés sur l’État iranien et liés à l’Iran ont utilisé la plateforme d’IA Claude d’Anthropic pour mener des campagnes de propagande, effectuer de la surveillance intérieure et élaborer des recommandations de ciblage contre les forces navales américaines. Anthropic a déclaré avoir mis fin à des activités malveillantes impliquant Claude entre décembre 2025 et août 2026, notamment des cyberopérations, des campagnes d’influence et des activités de surveillance. Ces révélations interviennent dans un contexte de tensions accrues entre l’Iran et les États-Unis, notamment en raison d’attaques impliquant les forces américaines et iraniennes autour du détroit d’Ormuz.
Anthropic AI affirme avoir déjoué plusieurs opérations malveillantes menées à l'aide de ses modèles Claude, allant du cyberespionnage à la conception d'armes, en passant par des campagnes de surveillance de masse. En ce qui concerne les armes conventionnelles, l'entreprise affirme dans un nouveau rapport être intervenue dans le nord du Yémen, où elle a empêché une tentative de déploiement de Claude dans un logiciel de guidage de missiles, notamment une roquette guidée et un missile balistique à longue portée.
Développement de missiles et de fusées assisté par l’IA
Selon le rapport sur les menaces d’Anthropic, les opérateurs ont utilisé Claude « à la place d’ingénieurs logiciels humains », attribuant apparemment à différentes instances du modèle des rôles spécifiques pour écrire des logiciels de guidage de missiles et de contrôle de vol. Bien que des mesures de sécurité internes aient bloqué de nombreuses requêtes, Anthropic a admis que plusieurs d’entre elles avaient réussi à passer entre les mailles du filet. Les opérateurs ont évité d’être détectés en dissimulant leurs objectifs finaux et en fractionnant les tâches en plusieurs sessions distinctes, de sorte qu’aucune instruction unique n’a permis de dévoiler l’opération.
La société a déclaré ne disposer d’aucune preuve indiquant que le groupe ait réussi à mettre au point une arme opérationnelle, bien qu’Anthropic ait affirmé que les opérateurs semblaient avoir procédé à un tir d’essai infructueux. Le rapport précise que la société a suspendu les comptes impliqués et « partagé des informations sur la menace avec des partenaires des secteurs public et privé afin d’atténuer les risques posés par ces acteurs ».
Cyberespionnage lié à l'État
Le rapport affirme qu'une opération d'espionnage liée à la Russie, présentant les caractéristiques de Midnight Blizzard (ou APT29), s'appuyait, selon Anthropic, sur des flux de travail automatisés basés sur l'IA pour mener la quasi-totalité de l'opération, gérant tout, du phishing à la mise en place en passant par le vol de données, à l'encontre de cibles ukrainiennes, européennes et diplomatiques, y compris des fabricants de drones.
Par ailleurs, l’entreprise a déclaré avoir démantelé une opération chinoise menée par des étudiants universitaires de la province du Hunan, qui utilisaient Claude « comme couche d’ingénierie et d’orchestration » d’un programme offensif ciblant des réseaux gouvernementaux et d’entreprises au Moyen-Orient, en Europe et en Asie du Sud-Est. Dans les deux cas, Anthropic a indiqué avoir suspendu les comptes associés et mis en place une surveillance renforcée afin de détecter toute activité similaire.
Identification de cibles, notamment en Syrie et en Iran
Anthropic affirme également avoir identifié et supprimé trois comptes liés à l’État iranien qui utilisaient Claude pour mener des opérations secrètes d’influence et de guerre psychologique. Chaque opération était liée à une institution de propagande iranienne nommément citée, notamment l’Organisation de la culture et de la communication islamiques et une cellule de commandement d’un séminaire de Mashhad diffusant des contenus conformes aux discours du Corps des gardiens de la révolution islamique (CGRI).
Dans un autre cas, le rapport affirme que des groupes proches de l’État ont utilisé Claude pour une opération à grande échelle, en demandant au modèle de générer des profils structurés qui cartographiaient les cibles en fonction de leur localisation, de leurs caractéristiques démographiques, de leurs orientations politiques et de leurs scores de confiance.
« Le cas le plus abouti sur le plan opérationnel », note Anthropic dans son rapport, a été détecté lorsqu’un compte aligné sur la Chine, « ne maîtrisant pas la langue arabe », a utilisé Claude pour mener une « opération de recrutement de plusieurs jours visant à infiltrer des cibles ouïghoures en Syrie ». Anthropic précise que « le modèle a rédigé des messages de prise de contact dans le dialecte régional » et « traduit les réponses en temps réel ».
En début de semaine, Anthropic a révélé un nouvel incident au cours duquel un modèle d’IA a obtenu un accès non autorisé à des systèmes externes, impliquant une première version de Claude Opus 4.6, peu après que Jacob Coxon, ancien chercheur de l’entreprise, ait démissionné publiquement en raison de préoccupations liées à la sécurité. « Les personnes qui développent l’IA sont sincèrement convaincues qu’elle pourrait tous nous tuer d’ici la fin de la décennie », a averti Coxon dans un message publié sur X. Un autre scientifique d’Anthropic, Evan Hubinger, s’est ensuite exprimé pour affirmer que Coxon avait raison.
Les avertissements des chercheurs ont conduit un nombre croissant de législateurs américains à réclamer de nouvelles règles pour encadrer les systèmes d’IA. Anthropic a déclaré qu’elle enquêtait sur les problèmes récurrents et les failles constatées dans ces incidents et qu’elle avait fait appel à un cabinet de recherche indépendant pour les examiner.
Relations avec Washington
Les relations entre Washington et cette entreprise spécialisée dans l'IA restent tendues à la suite d'un bras de fer controversé concernant les garde-fous éthiques. En début d'année, le Pentagone a inscrit l'entreprise sur sa liste noire, la considérant comme un risque pour la chaîne d'approvisionnement, après qu'elle eut refusé de lever les mesures de protection visant à empêcher l'utilisation de sa technologie pour des armes autonomes et la surveillance intérieure.
Anthropic a contesté cette décision en Californie, où un juge a estimé le mois dernier que le ministère américain de la Défense avait agi de manière illégale en prononçant cette mesure. Pourtant, malgré cette âpre bataille juridique et les tensions publiques, le Pentagone aurait déployé les modèles « Claude » de l’entreprise dans le cadre de missions militaires en Iran et au Venezuela. Ce rapport intervient à un moment critique pour l’entreprise, qui cherche à retrouver pleinement sa place au sein de la base industrielle de défense américaine après avoir été mise sur la liste noire du Pentagone.
Plus récemment, Jacob Coxon, un chercheur en IA ayant travaillé chez Anthropic et OpenAI, a brusquement démissionné, avertissant que cette technologie « pourrait tous nous tuer d’ici la fin de la décennie ». Dans un message publié sur X, il a accusé les deux entreprises de se lancer tête baissée dans la création d'une superintelligence capable de s'auto-améliorer, estimant que cette démarche revenait à « jouer avec nos vies ». Evan Hubinger, chef d’équipe chez Anthropic, a appuyé cet avertissement, estimant que la probabilité d’un tel scénario était « supérieure à 10 % » d’ici dix ans — une prise de position publique rare de la part d’un membre d’une entreprise développant cette même technologie.
Source : Anthropic
Et vous ?
Pensez-vous que ce rapport est crédible ou pertinent ?
Quel est votre avis sur le sujet ?Voir aussi :
Anthropic a été illégalement blacklisté par l'administration Trump, d'après le tribunal qui estime que cette mesure constitue « une rétorsion illégale, contraire au premier amendement »
Le Pentagone continue de considérer Anthropic comme un « risque pour la chaîne d'approvisionnement » malgré la décision de justice, ce qui constitue un rejet pur et simple de l'ordonnance judiciaire
Une puce IA de Nvidia a été découverte dans le nouveau missile de croisière russe S-71 Monochrome, conçue pour exécuter des applications d'IA sur les appareils sans nécessiter de connexion permanente
Vous avez lu gratuitement 34 609 articles depuis plus d'un an.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.