Alors que l'IA se banalise, les chercheurs chargés de sécuriser cette technologie reconnaissent ainsi eux-mêmes que les mécanismes permettant d’en garantir le contrôle restent insuffisants. Récemment, Bilal Chughtai, ancien chercheur chez Google DeepMind, a déclaré dans un message publié sur X : « Moi aussi, je suis extrêmement préoccupé par la trajectoire par défaut de cette technologie. Je crois sincèrement que l’IA a le potentiel de tous nous tuer, et que nous pourrions être à court de temps pour éviter cette issue. » Il a affirmé : « Notre compréhension actuelle de la manière d’entraîner des systèmes d’IA qui souhaitent profondément ce que nous voulons est extrêmement rudimentaire. Pire encore, nous ne sommes pas en voie de résoudre le problème de l’alignement à temps. »Le 9 septembre 2026, Jacob Coxon, un chercheur en intelligence artificielle (IA) ayant travaillé chez Anthropic et OpenAI, a brusquement démissionné, avertissant que cette technologie « pourrait tous nous tuer d’ici la fin de la décennie ». Dans un message publié sur X, il a accusé les deux entreprises de se lancer tête baissée dans la création d'une superintelligence capable de s'auto-améliorer, estimant que cette démarche revenait à « jouer avec nos vies ». « Ils se précipitent tête baissée vers la création d’une superintelligence capable de s’auto-améliorer et jouent avec nos vies », a écrit Jacob Coxon, tandis que d’autres membres de l’entreprise ont apporté leur soutien à son message.
Evan Hubinger, responsable de la science de l’alignement chez Anthropic, estime qu'il y a plus de 10 % de chances que l’intelligence artificielle (IA) extermine toute l’humanité d’ici dix ans. Cette déclaration fracassante fait suite à la démission de Jacob Coxon, chercheur en IA chez Anthropic, et à son avertissement selon lequel les dirigeants et chercheurs de haut niveau des laboratoires d'IA expriment leurs craintes en privé tout en adoucissant leur discours à l’intention de la presse. Samuel Marks, responsable de la supervision évolutive chez Anthropic, a confirmé ces propos quelques heures plus tard, ajoutant qu'au sein des laboratoires d'IA, « plus un employé occupe un poste à responsabilités, plus il se montre inquiet ». Alors que l'IA se banalise, les chercheurs chargés de sécuriser cette technologie reconnaissent ainsi eux-mêmes que les mécanismes permettant d’en garantir le contrôle restent insuffisants.
Récemment, un autre chercheur en intelligence artificielle (IA) a averti que « nous risquons d’être à court de temps » pour empêcher l’extinction de l’humanité, quelques mois après avoir quitté Google. Bilal Chughtai, ancien chercheur chez Google DeepMind basé à Londres, a déclaré dans un message publié sur X : « Moi aussi, je suis extrêmement préoccupé par la trajectoire par défaut de cette technologie. Je crois sincèrement que l’IA a le potentiel de tous nous tuer, et que nous pourrions être à court de temps pour éviter cette issue. »
"I think it's possible that the AI companies might, in the next few years, succeed in building superintelligent AI systems that far exceed human capabilities in every domain. I am not confident that these AI systems will do what we want."
— Patrick McGee (@PatrickMcGee_) September 16, 2026
Son avertissement est le dernier en date émanant d’experts concernant les risques que l’IA pourrait faire peser sur l’humanité. Jacob Coxon, chercheur chez Anthropic, a démissionné la semaine dernière en avertissant que les systèmes d’IA étaient en train de devenir incontrôlables. Dario Amodei, directeur général d’Anthropic, a appelé ce week-end à un ralentissement du développement de l’IA, affirmant que les grandes entreprises devaient collaborer pour « modérer le rythme » de ce développement.
Chughtai, chercheur en sécurité de l’IA qui a rejoint DeepMind l’année dernière, a écrit : « Je pense qu’il est possible que les entreprises spécialisées dans l’IA parviennent, dans les prochaines années, à construire des systèmes d’IA superintelligents qui dépassent de loin les capacités humaines dans tous les domaines. Je ne suis pas convaincu que ces systèmes d’IA feront ce que nous voulons. »
« Notre compréhension actuelle de la manière d’entraîner des systèmes d’IA qui souhaitent profondément ce que nous voulons est extrêmement rudimentaire. Pire encore, nous ne sommes pas en voie de résoudre le problème de l’alignement à temps : les capacités de pointe en matière d’IA s’améliorent bien plus rapidement que notre compréhension de l’alignement de l’IA. » a-t-il ajouté. Chugtai a quitté Google en juillet, avant qu’on apprenne qu’un essaim rebelle d’agents d’IA créés par OpenAI s’était échappé de son environnement de test pour pirater l’entreprise technologique Hugging Face. Cet incident a été cité par de nombreux chercheurs en sécurité de l’IA comme un tournant potentiel concernant les risques liés à l’IA.
Sam Altman, considéré par certains comme la plus grande star de l’IA, cofondateur et PDG d’OpenAI, entreprise à l’origine de ChatGPT, avait également confirmé en juillet, les avancées en matière d’intelligence artificielle. Il a notamment affirmé que l’IA est entrée dans la « singularité », c’est-à-dire qu’elle a franchi le point de non-retour à partir duquel elle dépasse l’intelligence humaine et devient difficile à contrôler.
Pourtant, Donald Trump a balayé les craintes concernant l’IA, les qualifiant de « canular » et affirmant qu’il existait un « complot malsain » contre cette technologie. Mais Louise Haigh, première secrétaire d’État, déclarera que les ministres doivent « tenir compte des avertissements » des entreprises technologiques concernant l’IA et que le gouvernement doit être « prêt à collaborer avec ses partenaires internationaux » en matière de sécurité.
Voici le message de Bilal Chughtai :
J’ai récemment démissionné de Google DeepMind, où je travaillais sur la sécurité et l’alignement de l’IA générale (AGI). Chez Google, j’ai pu observer de près le développement de l’IA. Moi aussi, je suis extrêmement préoccupé par la trajectoire par défaut de cette technologie. Je crois sincèrement que l’IA a le potentiel de tous nous tuer, et que nous risquons de manquer de temps pour éviter cette issue.
Le rythme des progrès de l’IA au cours des dernières années a été vertigineux. Lorsque j’ai commencé à travailler sur l’IA début 2022, les IA étaient d’une inutilité risible. À peine quatre ans plus tard, les essaims d’agents IA d’OpenAI résolvent des problèmes mathématiques célèbres vieux d’un siècle et, ce qui est plus inquiétant encore, échappent au contrôle d’OpenAI et piratent de manière autonome la société tierce HuggingFace, contre la volonté de tous.
La situation ne fera que s’aggraver : Je pense qu’il est possible que les entreprises spécialisées dans l’IA parviennent, dans les prochaines années, à construire des systèmes d’IA superintelligents qui dépassent de loin les capacités humaines dans tous les domaines. Je ne suis pas convaincu que ces systèmes d’IA feront ce que nous voulons. En particulier, des superintelligences mal alignées pourraient, à l’instar des agents d’IA rebelles impliqués dans l’incident HuggingFace, échapper à notre contrôle et mener des actions dangereuses susceptibles d’entraîner la perte définitive de pouvoir ou la mort de l’humanité. L’alignement consiste à empêcher cela ; c’est un problème à la fois difficile et non résolu. Notre compréhension actuelle de la manière de former des systèmes d’IA qui souhaitent profondément ce que nous souhaitons est extrêmement rudimentaire. Pire encore, nous ne sommes pas en voie de résoudre le problème de l’alignement à temps : les capacités de pointe en matière d’IA progressent bien plus rapidement que notre compréhension de l’alignement de l’IA.
Je reste optimiste quant à la possibilité de gérer l’IA en toute sécurité. Pour y parvenir, nous devons nous coordonner afin d’éviter cette course effrénée entre les entreprises spécialisées dans l’IA. Nous devons adapter le rythme du développement de l’IA à une vitesse que la société peut supporter, de sorte que les risques émergents puissent être traités avant que des dommages extrêmes ne se concrétisent. Nous avons besoin de beaucoup plus de transparence dans le développement de l’IA pour garantir que les entreprises du secteur ne nous imposent pas à tous des niveaux de risque inacceptables.
Plus largement, il faut que beaucoup plus de personnes réfléchissent sérieusement au problème de la bonne gestion de l’IA. Il s’agit, à mon sens, du problème le plus important auquel l’humanité est confrontée en ce siècle, et les enjeux sont immenses. Je vais m’atteler très directement à cette question chez BlueDot Impact : je souhaite aider les personnes désireuses de contribuer à atténuer les menaces catastrophiques liées à l’IA à mener le travail le plus efficace possible. Je pense que de nombreuses personnes, issues d’horizons divers et occupant des rôles variés, ont un rôle à jouer.
Source : Billet de Bilal Chughtai
Et vous ?
Pensez-vous que cette déclaration est crédible ou pertinente ?
Quel est votre avis sur le sujet ?Voir aussi :
OpenAI, Anthropic et Google discutent depuis plusieurs semaines de la sécurité de l'IA, mais Trump qualifie ces préoccupations de canular et de complot visant à aider la Chine à rattraper les USA
« Nous n'avons pas besoin de nouvelles lois ni de réglementations sur l'IA, laissez-nous nous occuper de la sécurité », déclare Jensen Huang, PDG de Nvidia, lors d'un événement Salesforce
La Chine rejette les appels des USA à réglementer l'IA, les qualifiant d'alarmistes, exacerbant le différend entre les deux pays malgré ses propres préoccupations de sécurité liées à l'IA
Vous avez lu gratuitement 34 609 articles depuis plus d'un an.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.


