Evan Hubinger, responsable de la science de l’alignement chez Anthropic, estime qu'il y a plus de 10 % de chances que l’intelligence artificielle (IA) extermine toute l’humanité d’ici dix ans. Cette déclaration fracassante, publiée le mardi 8 septembre 2026 au soir sur X, fait suite à la démission de Jacob Coxon, chercheur en IA chez Anthropic, et à son avertissement selon lequel les dirigeants et chercheurs de haut niveau des laboratoires d'IA expriment leurs craintes en privé tout en adoucissant leur discours à l’intention de la presse. Samuel Marks, responsable de la supervision évolutive chez Anthropic, a confirmé ces propos quelques heures plus tard, ajoutant qu'au sein des laboratoires d'IA, « plus un employé occupe un poste à responsabilités, plus il se montre inquiet ». Alors que l'IA se banalise, les chercheurs chargés de sécuriser cette technologie reconnaissent ainsi eux-mêmes que les mécanismes permettant d’en garantir le contrôle restent insuffisants.Pour rappel, Jacob Coxon, chercheur en IA ayant travaillé chez Anthropic et OpenAI, a brusquement démissionné en début de semaine, affirmant que cette technologie « pourrait tous nous tuer d'ici la fin de la décennie ». Il accusait alors les deux entreprises de se précipiter vers la création d'une superintelligence capable de s'auto-améliorer, qualifiant cette démarche de véritable mise en danger de la vie de tous. « [Ils] jouent avec nos vies », a-t-il écrit sur X.
Des employés actuels d'Anthropic, l'entreprise américaine spécialisée dans l'IA fondée par d'anciens dirigeants d'OpenAI, affirment désormais que l'IA pourrait potentiellement anéantir l'humanité d'ici dix ans.
« Nous sommes sincèrement convaincus que l’IA pourrait anéantir l’humanité tout entière ! Personnellement, j’estime que la probabilité est supérieure à 10 % au cours de la prochaine décennie. Je pense qu’Anthropic fait de son mieux, mais nous n’avons pas encore de plan pour résoudre le problème de l’alignement de la superintelligence et nous ne sommes pas clairement sur la bonne voie pour y parvenir », a écrit Evan Hubinger, responsable de la science de l’alignement chez Anthropic, sur X le mardi 8 septembre 2026 au soir.
Jacob is correct here—we really do earnestly believe AI could kill all humans! I personally think it is >10% within the next decade. I believe Anthropic is trying its best, but we do not yet have a plan to solve alignment for superintelligence and are not clearly on track to. https://t.co/QAIHiFP3QZ
— Evan Hubinger (@EvanHub) September 9, 2026
Ces propos ont été tenus après que Jacob Coxon, chercheur en IA chez Anthropic, a démissionné de l'entreprise et s'est exprimé sur X pour expliquer les raisons de son départ.
« Les personnes qui développent l’IA sont sincèrement convaincues qu’elle pourrait tous nous tuer d’ici la fin de la décennie », a déclaré Jacob Coxon. « Ce n’est pas un coup de pub. Au contraire, de nombreux dirigeants et chercheurs de haut niveau veillent à modérer leurs propos dans la presse pour paraître raisonnables, mais j’entends ces mêmes personnes exprimer leurs craintes en privé. Aucune autre activité humaine ne présente un tel niveau de danger. »
Ces remarques interviennent alors que l'IA s'intègre de plus en plus dans le quotidien de millions d'Américains, alors même que les craintes concernant les dangers potentiels de cette technologie s'intensifient. Les inquiétudes quant à la possibilité que l'IA devienne incontrôlable ne datent pas d'hier : Elon Musk, ainsi que d'éminents chercheurs et universitaires, ont en effet maintes fois mis en garde contre les risques graves que des systèmes de plus en plus puissants pourraient faire peser sur l'humanité.
Le mercredi 9 septembre, vers 2 heures du matin, Samuel Marks, responsable de la supervision évolutive chez Anthropic, a également répondu au message de Jacob Coxon, précisant qu’il « écrivait ces lignes à titre personnel, et non au nom de mon employeur (Anthropic) ».
« Les développeurs d'IA estiment que leur technologie pourrait entraîner l'extinction de l'humanité (ou des conséquences tout aussi graves). Cela pourrait se produire dans les prochaines années. En général, plus un employé occupe un poste à responsabilités, plus il se montre inquiet », a ajouté Samuel Marks.
Ces mises en garde émanant des employés des laboratoires d'IA trouvent un écho institutionnel à l'échelle internationale. Volker Türk, le Haut-Commissaire des Nations unies aux droits de l'homme, a récemment mis en garde contre le risque « existentiel » que l'IA pourrait représenter pour l'humanité, et a exhorté les entreprises d'IA à réduire ces risques. Il a pointé du doigt, sans les nommer directement, des entreprises comme Meta, Anthropic, OpenAI et Google, qu'il accuse de détenir un pouvoir quasi illimité sur cette technologie.
« Je partage les préoccupations des experts du secteur selon lesquelles l’IA avancée pourrait représenter un risque existentiel pour l’humanité », a déclaré Volker Türk devant le Conseil des droits de l’homme des Nations unies à Genève, dans un discours de grande envergure prononcé avant le début de son deuxième mandat le mois prochain. « J’appelle ici, aujourd’hui, à un effort sans réserve pour mettre en place des garanties à toute épreuve concernant la sûreté et la sécurité de l’IA, avant qu’il ne soit trop tard. »
Et vous ?
Quel est votre avis sur le sujet ?
Trouvez-vous les affirmations d'Evan Hubinger, responsable chez Anthropic, crédibles ou pertinentes ?Voir aussi :
Yoshua Bengio, parrain de l'IA, met en garde contre le risque d'extinction de l'humanité d'ici dix ans, causée par des machines hyperintelligentes dotées de leur propre « désir d'autoconservation »
Anthropic appelle à une pause globale en matière de développement de l'IA face aux signes indiquant qu'ils pourraient échapper au contrôle humain. Certains comportements de l'IA suscitent en effet des craintes
Les scientifiques d'OpenAI veulent un « bunker de l'apocalypse » avant que l'AGI ne surpasse l'intelligence humaine et ne menace l'humanité, une perspective que d'autres experts en IA qualifient d'illusion
Un rapport met en garde les entreprises d'IA contre les dangers liés à la construction de systèmes de niveau humain, elles ne disposent pas de plans crédibles pour garantir la sécurité de ces systèmes
Vous avez lu gratuitement 20 157 articles depuis plus d'un an.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.


à tous et toutes,