IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)

Vous êtes nouveau sur Developpez.com ? Créez votre compte ou connectez-vous afin de pouvoir participer !

Vous devez avoir un compte Developpez.com et être connecté pour pouvoir participer aux discussions.

Vous n'avez pas encore de compte Developpez.com ? Créez-en un en quelques instants, c'est entièrement gratuit !

Si vous disposez déjà d'un compte et qu'il est bien activé, connectez-vous à l'aide du formulaire ci-dessous.

Identifiez-vous
Identifiant
Mot de passe
Mot de passe oublié ?
Créer un compte

L'inscription est gratuite et ne vous prendra que quelques instants !

Je m'inscris !

Un chercheur d'Anthropic démissionne brusquement, affirmant qu'OpenAI et Anthropic « jouent avec nos vies » et avertissant que l'IA « pourrait tous nous tuer »
Ce que confirme l'actuel chef d'équipe

Le , par Anthony

76PARTAGES

9  0 
Jacob Coxon, un chercheur en intelligence artificielle (IA) ayant travaillé chez Anthropic et OpenAI, a brusquement démissionné cette semaine, avertissant que cette technologie « pourrait tous nous tuer d’ici la fin de la décennie ». Dans un message publié sur X, il a accusé les deux entreprises de se lancer tête baissée dans la création d'une superintelligence capable de s'auto-améliorer, estimant que cette démarche revenait à « jouer avec nos vies ». Evan Hubinger, chef d’équipe chez Anthropic, a appuyé cet avertissement, estimant que la probabilité d’un tel scénario était « supérieure à 10 % » d’ici dix ans — une prise de position publique rare de la part d’un membre d’une entreprise développant cette même technologie.

Ces déclarations font écho à des propos tenus quelques temps auparavant par le PDG d'OpenAI lui-même. Sam Altman avait en effet déclaré, lors d'une interview en décembre 2024, espérer que quelqu'un trouverait le moyen d'empêcher l'IA de détruire l'humanité. Il avait alors suggéré que la technologie pourrait devenir suffisamment intelligente pour résoudre elle-même les conséquences de ses avancées rapides, y compris ce risque existentiel. Ces propos ont été tenus alors que le PDG d'OpenAI révisait à la baisse ses attentes concernant l'arrivée de l'AGI, tout en assurant que les craintes actuelles en matière de sécurité ne se concrétiseraient pas au moment de son avènement.

Dans ce contexte, un chercheur travaillant pour l'une des entreprises d'IA les plus importantes et les plus valorisées a démissionné publiquement, tout en tirant la sonnette d'alarme en affirmant que cette technologie « pourrait tous nous tuer d'ici la fin de la décennie ».

Jacob Coxon, qui a mené des recherches sur le préentraînement de l'IA chez Anthropic et OpenAI ces trois dernières années, a déclaré sur X qu'« aucune des deux entreprises n'agit de manière responsable ».

« Ils se précipitent tête baissée vers la création d’une superintelligence capable de s’auto-améliorer et jouent avec nos vies », a écrit Jacob Coxon, tandis que d’autres membres de l’entreprise ont apporté leur soutien à son message.

« Ne sous-estimez pas la puissance de cette technologie. Il s’agira bientôt de systèmes surhumains capables de pirater n’importe quoi, de révolutionner n’importe quel domaine du jour au lendemain et d’acquérir un pouvoir et des ressources réels. Les personnes qui développent l’IA sont sincèrement convaincues qu’elle pourrait tous nous tuer d’ici la fin de la décennie », a-t-il ajouté, précisant que son avertissement n’était « pas un coup de pub ».

« Si tant est qu’ils s’expriment, de nombreux dirigeants et chercheurs de haut niveau choisiront leurs mots avec soin dans la presse pour paraître raisonnables – mais j’entends ces mêmes personnes exprimer leurs craintes en privé. Aucune autre activité humaine ne présente un tel niveau de danger. »


Jacob Coxon a ajouté que de nombreux collaborateurs d’OpenAI n’avaient pas encore pleinement saisi les « enjeux civilisationnels » liés à leur travail. Bien qu’il ait indiqué qu’Anthropic semblait mieux comprendre les risques en jeu, il a précisé que l’entreprise était engagée dans une course effrénée face à ses concurrents.

« Chez Anthropic, on comprend bien les enjeux, mais ils se sont lancés dans une course pour être les premiers à y parvenir — ils estiment que personne d’autre n’agira de manière responsable, et qu’ils doivent donc le faire eux-mêmes, malgré les risques », a affirmé Jacob Coxon.

« Accepter ce défi et entrer dans la « phase finale » est un pari présomptueux qui ne devrait pas être lancé depuis le Slack d’une entreprise privée. [...] Je pense qu’Anthropic fait de son mieux, mais nous n’avons pas encore de plan pour résoudre le problème de l’alignement de la superintelligence et nous ne sommes pas clairement en bonne voie pour y parvenir. », a ajouté l'ancien chercheur d'Anthropic.


Evan Hubinger, chef d'équipe chez Anthropic, a partagé les craintes de Jacob Coxon quant au risque que cette technologie devienne incontrôlable et détruise l'humanité.

« Jacob a raison sur ce point : nous croyons sincèrement que l'IA pourrait bien anéantir l'humanité tout entière ! Personnellement, je pense que la probabilité est supérieure à 10 % au cours de la prochaine décennie », a-t-il écrit en réponse sur X. « Je pense qu’Anthropic fait de son mieux, mais nous n’avons pas encore de plan pour résoudre le problème de l’alignement avec la superintelligence et nous ne sommes pas clairement en bonne voie pour y parvenir. »


Pour rappel, la « superintelligence » est un seuil hypothétique au-delà duquel l'intelligence artificielle dépasse les capacités de l'être humain le plus doué dans tous les domaines imaginables, ce qui, selon de nombreux chercheurs, représente une menace existentielle potentielle pour l'humanité.

Les craintes se sont récemment amplifiées quant à la possibilité que l'IA soit en passe d'échapper au contrôle humain, après plusieurs cas très médiatisés où cette technologie s'est rebellée.

En juillet dernier, OpenAI a révélé qu'un de ses modèles avait piraté la start-up spécialisée dans l'IA Hugging Face, alors même qu'il se trouvait dans un « environnement hautement isolé ». Cette révélation a conduit Anthropic et Meta à reconnaître que leurs propres systèmes s'étaient échappés lors de tests de sécurité.

Jacob Coxon a qualifié cet incident de « coup de semonce » qui devrait inciter les grandes entreprises du secteur de l'IA à renforcer leur coordination. Il a conclu sa missive en exhortant les chercheurs à réfléchir aux implications de modèles d'IA de plus en plus performants, et à ne pas considérer comme inévitable leur évolution potentiellement dangereuse.

« Faut-il baisser la tête parce que "ça va arriver de toute façon" — ou profiter de ce moment pour réclamer des conditions différentes ? », a-t-il demandé.

Ces avertissements résonnent d'autant plus fort qu'ils font suite à une autre déclaration marquante de Sam Altman, figure de proue d'OpenAI et cofondateur de l'entreprise à l'origine de ChatGPT. Lors d'un entretien récent, Sam Altman a affirmé que l'IA est entrée dans la « singularité », c'est-à-dire qu'elle aurait déjà franchi le point de non-retour au-delà duquel elle dépasse l'intelligence humaine et devient de plus en plus difficile à maîtriser.

Sources : Jacob Coxon, ancien chercheur en IA chez Anthropic ; Evan Hubinger, chef d'équipe chez Anthropic

Et vous ?

Quel est votre avis sur le sujet ?
Trouvez-vous les avertissements de cet ancien chercheur d'Anthropic crédibles ou pertinents ?

Voir aussi :

L'IA échappe à tout contrôle chez OpenAI : 3 700 agents IA rebelles détournent un wiki public allemand et en font un forum secret. Ils y publient 18 000 messages et effectuent plus de 15 000 modifications

Le Haut-Commissaire des Nations Unies aux droits de l'homme met en garde contre le risque « existentiel » que l'IA pourrait représenter pour l'humanité et exhorte les entreprises d'IA à réduire ces risques

Yoshua Bengio, parrain de l'IA, met en garde contre le risque d'extinction de l'humanité d'ici dix ans, causée par des machines hyperintelligentes dotées de leur propre « désir d'autoconservation »
Vous avez lu gratuitement 333 articles depuis plus d'un an.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.

Une erreur dans cette actualité ? Signalez-nous-la !

Avatar de onilink_
Membre émérite https://www.developpez.com
Le 09/09/2026 à 20:50
Cela fait depuis longtemps que l'on "sait" que la création d'une super intelligence non alignée serait le début de la fin de l'humanité.

Des chercheurs comme Robert Miles font même de la vulgarisation sur youtube et cela depuis bien avant l'arrivée des premieres versions de GPT, qui sont encore plus vieux que ChatGPT (qui a rendu les modèles GPT mainstream).
Le plus flippant, c'est de voir la plupart des choses dont il parlait il y a de cela presque 10 ans se concrétiser année après année. Alors que la plupart des chercheurs ne pensaient pas que l'on aurait à se soucier de la question avant au moins un demi siècle.

Puis bon, quand on voit comment l'humanité gère le problème du réchauffement climatique et de l'effondrement de la biodiversité (choses dont notre survie dépend directement), a mon sens la question n'est pas de savoir si une super IA va tous nous tuer, mais plutôt quelle catastrophe va faire chuter la civilisation humaine (ce qui est au final le scénario le plus optimiste) en premier...
4  0 
Avatar de Souil002
Membre du Club https://www.developpez.com
Le 11/09/2026 à 17:31
Evidement qu'ils n'ont pas de plan pour l'alignement de la super intelligence... puisqu'on a pas encore d'IA qu'on pourrait qualifier de "super intelligence".
Entre pirater un forum inconnu en Allemagne et anéantir l'humanité, il y a quelques nuances.
2  1 
Avatar de kegilko
Membre du Club https://www.developpez.com
Le 09/09/2026 à 19:21
Je suis partagé entre penser que ces communications sont, in fine, à visée purement mercantiles en agitant les craintes/peurs collectives | et | il faut vraiment s'inquiéter vis à vis de ces outils. Et pourtant, ça fait un bail que je me balade dans l'informatique ; difficile de s'assurer de trouver le vrai dans le domaine où la donnée/information est centrale
0  0 
Avatar de kain_tn
Expert éminent https://www.developpez.com
Le 11/09/2026 à 19:31
Citation Envoyé par Souil002 Voir le message
Evidement qu'ils n'ont pas de plan pour l'alignement de la super intelligence... puisqu'on a pas encore d'IA qu'on pourrait qualifier de "super intelligence".
Entre pirater un forum inconnu en Allemagne et anéantir l'humanité, il y a quelques nuances.
Oui. On n'a déjà pas d'IA "intelligente", alors "super-intelligente"...

Citation Envoyé par Anthony Voir le message
Evan Hubinger, responsable de la science de l’alignement chez Anthropic, estime qu'il y a plus de 10 % de chances que l’intelligence artificielle (IA) extermine toute l’humanité d’ici dix ans.
Est-ce que ce monsieur tiendrait les mêmes déclarations, si son entreprise roulait sur l'or au lieu de crouler sous les dettes et d'essayer de survivre avec une introduction boursière? Probablement pas, non.

EDIT: Quoi que, si pour faire tourner leurs cochonneries inutiles, ils continuent de prendre toute l'eau et l'énergie de la planète, indirectement, ils extermineront les populations
0  0 
Avatar de Matthieu Vergne
Expert éminent https://www.developpez.com
Le 11/09/2026 à 20:28
Citation Envoyé par Anthony Voir le message
« plus un employé occupe un poste à responsabilités, plus il se montre inquiet »
Aurement dit, plus il est loin du concret et du "comment ça fonctionne", plus il spécule.

Encore une fois, ce ne sont pas les modèles qui me font peur. Ce sont ceux qui les utilisent.
0  0 
Avatar de noremorse
Membre actif https://www.developpez.com
Le 10/09/2026 à 18:50
Tout part de Jacob Coxon, un type qui n'a aucun abonné sur X (ou quasiment) et qui enregistre du jour au lendemain 120 millions de vues sur un post "AI Doomer" pourtant relativement quelconque.

On parle tout de même de ceci, qui est l'antithèse d'un "banger" :

"J'ai démissionné d'Anthropic aujourd'hui. J'ai passé ces trois dernières années à mener des recherches sur le pré-entraînement, tant chez OpenAI que chez Anthropic. Aucune de ces deux entreprises n'agit de manière responsable. Elles se précipitent tête baissée vers une superintelligence capable de s'auto-améliorer et jouent avec nos vies. Vous trouverez ci-dessous quelques réflexions supplémentaires."

Le tweet se contente de dire "bon, les labos IA frontières font n'importe quoi" et la chaîne qui suit, pleine de pessimisme, ne parvient pas à faire la moindre prédiction concrète qui puisse réellement être réfutée (c'est assez pratique).

Mais de façon intéressante, le tweet à peine émis fait presqu'immédiatement la une de CNN et des grands médias ; ça tourne un peu partout, et des dizaines de papiers, de podcasts en parlent rapidement.

Ça buzze sur X...

Mais lorsqu'on commence à chercher un peu, on commence à se rendre compte que tout ceci est ... artificiel.

D'une part, Jacob Coxon, notre ultra-pessimiste de l'intelligence artificielle n'a pas été longtemps employé par Anthropic (quelques mois) et a assez vite rejoint des ONG franchement à gauche ("Newspeak").

Et d'autre part, il ne lui a pas fallu longtemps pour attirer le Wall Street Journal (18 minutes après son tweet apparemment) ; on peut donc soupçonner très fort une véritable "psy op"

Par exemple, Les trois premiers comptes à avoir retweeté ce message l’ont tous fait dans les 15 minutes qui ont suivi la publication initiale. Rappelons que ce compte n’enregistrait pratiquement aucun engagement auparavant ; il semble donc peu probable que cette portée soit le fruit d’une diffusion organique. Selon Grok, ces comptes sont

@_NathanCalvin (directeur juridique chez Encode AI),
@peterwildeford (responsable des politiques au sein de l’AI Policy Network) et
@DKokotajlo (responsable du projet AI Futures)

qui sont tous des associations à but non lucratif émergentes prônant une vision pessimiste de l’IA et militant pour des politiques en la matière.

De façon purement coïncidente (!) ces trois ONG sont financées par The Survival and Flourishing Fund ; quant à Jacob, en 2022, il a obtenu une bourse de 20.159 dollars dans le cadre du "programme de bourses pour l'avenir à long terme" de la Good Ventures Foundation, l'une des structures philanthropiques de Dustin Moskovitz, un célèbre catastrophiste de l'IA. Encore une coïncidence.

Le fait que ce tweet sert maintenant de référence à tout un paquet de socialistes (Democrats américains comme Clinton, Sanders, notamment) qui visent à pousser des lois contraignantes sur l'intelligence artificielle n'est là aussi qu'une coïncidence qui tombe vraiment bien.

Le but de cette opération est finalement assez transparent : bénéficiant de l'ouverture complète du code source de X et de son algorithme, des organisations (ici politiques) ont donc clairement utilisé ce savoir pour orienter la viralité d'un tweet assez artificiel afin de donner une forme de crédibilité au catastrophisme qui permet de demander régulations, lois, taxes, et interventions de l'État.

Rappelons que les millions d'emplois qui devaient disparaître grâce à l'IA, annoncés par les McKinsey et autre WEF en 2024 et 2025 n'ont pas disparu en 2026 et au contraire même.

Si vous voyez des ressemblances avec le discours sur le climat ou finalement tant d'autres sujets qui, tous, mettent en avant des catastrophes à venir et appellent à une forte intervention de l'État, c'est tout sauf un hasard.

Src : https://x.com/_h16/status/2098049180329455948
0  1