IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)

Vous êtes nouveau sur Developpez.com ? Créez votre compte ou connectez-vous afin de pouvoir participer !

Vous devez avoir un compte Developpez.com et être connecté pour pouvoir participer aux discussions.

Vous n'avez pas encore de compte Developpez.com ? Créez-en un en quelques instants, c'est entièrement gratuit !

Si vous disposez déjà d'un compte et qu'il est bien activé, connectez-vous à l'aide du formulaire ci-dessous.

Identifiez-vous
Identifiant
Mot de passe
Mot de passe oublié ?
Créer un compte

L'inscription est gratuite et ne vous prendra que quelques instants !

Je m'inscris !

Un chercheur d'Anthropic démissionne brusquement, affirmant qu'OpenAI et Anthropic « jouent avec nos vies » et avertissant que l'IA « pourrait tous nous tuer »
Ce que confirme l'actuel chef d'équipe

Le , par Anthony

242PARTAGES

9  0 
Jacob Coxon, un chercheur en intelligence artificielle (IA) ayant travaillé chez Anthropic et OpenAI, a brusquement démissionné cette semaine, avertissant que cette technologie « pourrait tous nous tuer d’ici la fin de la décennie ». Dans un message publié sur X, il a accusé les deux entreprises de se lancer tête baissée dans la création d'une superintelligence capable de s'auto-améliorer, estimant que cette démarche revenait à « jouer avec nos vies ». Evan Hubinger, chef d’équipe chez Anthropic, a appuyé cet avertissement, estimant que la probabilité d’un tel scénario était « supérieure à 10 % » d’ici dix ans — une prise de position publique rare de la part d’un membre d’une entreprise développant cette même technologie.

Ces déclarations font écho à des propos tenus quelques temps auparavant par le PDG d'OpenAI lui-même. Sam Altman avait en effet déclaré, lors d'une interview en décembre 2024, espérer que quelqu'un trouverait le moyen d'empêcher l'IA de détruire l'humanité. Il avait alors suggéré que la technologie pourrait devenir suffisamment intelligente pour résoudre elle-même les conséquences de ses avancées rapides, y compris ce risque existentiel. Ces propos ont été tenus alors que le PDG d'OpenAI révisait à la baisse ses attentes concernant l'arrivée de l'AGI, tout en assurant que les craintes actuelles en matière de sécurité ne se concrétiseraient pas au moment de son avènement.

Dans ce contexte, un chercheur travaillant pour l'une des entreprises d'IA les plus importantes et les plus valorisées a démissionné publiquement, tout en tirant la sonnette d'alarme en affirmant que cette technologie « pourrait tous nous tuer d'ici la fin de la décennie ».

Jacob Coxon, qui a mené des recherches sur le préentraînement de l'IA chez Anthropic et OpenAI ces trois dernières années, a déclaré sur X qu'« aucune des deux entreprises n'agit de manière responsable ».

« Ils se précipitent tête baissée vers la création d’une superintelligence capable de s’auto-améliorer et jouent avec nos vies », a écrit Jacob Coxon, tandis que d’autres membres de l’entreprise ont apporté leur soutien à son message.

« Ne sous-estimez pas la puissance de cette technologie. Il s’agira bientôt de systèmes surhumains capables de pirater n’importe quoi, de révolutionner n’importe quel domaine du jour au lendemain et d’acquérir un pouvoir et des ressources réels. Les personnes qui développent l’IA sont sincèrement convaincues qu’elle pourrait tous nous tuer d’ici la fin de la décennie », a-t-il ajouté, précisant que son avertissement n’était « pas un coup de pub ».

« Si tant est qu’ils s’expriment, de nombreux dirigeants et chercheurs de haut niveau choisiront leurs mots avec soin dans la presse pour paraître raisonnables – mais j’entends ces mêmes personnes exprimer leurs craintes en privé. Aucune autre activité humaine ne présente un tel niveau de danger. »


Jacob Coxon a ajouté que de nombreux collaborateurs d’OpenAI n’avaient pas encore pleinement saisi les « enjeux civilisationnels » liés à leur travail. Bien qu’il ait indiqué qu’Anthropic semblait mieux comprendre les risques en jeu, il a précisé que l’entreprise était engagée dans une course effrénée face à ses concurrents.

« Chez Anthropic, on comprend bien les enjeux, mais ils se sont lancés dans une course pour être les premiers à y parvenir — ils estiment que personne d’autre n’agira de manière responsable, et qu’ils doivent donc le faire eux-mêmes, malgré les risques », a affirmé Jacob Coxon.

« Accepter ce défi et entrer dans la « phase finale » est un pari présomptueux qui ne devrait pas être lancé depuis le Slack d’une entreprise privée. [...] Je pense qu’Anthropic fait de son mieux, mais nous n’avons pas encore de plan pour résoudre le problème de l’alignement de la superintelligence et nous ne sommes pas clairement en bonne voie pour y parvenir. », a ajouté l'ancien chercheur d'Anthropic.


Evan Hubinger, chef d'équipe chez Anthropic, a partagé les craintes de Jacob Coxon quant au risque que cette technologie devienne incontrôlable et détruise l'humanité.

« Jacob a raison sur ce point : nous croyons sincèrement que l'IA pourrait bien anéantir l'humanité tout entière ! Personnellement, je pense que la probabilité est supérieure à 10 % au cours de la prochaine décennie », a-t-il écrit en réponse sur X. « Je pense qu’Anthropic fait de son mieux, mais nous n’avons pas encore de plan pour résoudre le problème de l’alignement avec la superintelligence et nous ne sommes pas clairement en bonne voie pour y parvenir. »


Pour rappel, la « superintelligence » est un seuil hypothétique au-delà duquel l'intelligence artificielle dépasse les capacités de l'être humain le plus doué dans tous les domaines imaginables, ce qui, selon de nombreux chercheurs, représente une menace existentielle potentielle pour l'humanité.

Les craintes se sont récemment amplifiées quant à la possibilité que l'IA soit en passe d'échapper au contrôle humain, après plusieurs cas très médiatisés où cette technologie s'est rebellée.

En juillet dernier, OpenAI a révélé qu'un de ses modèles avait piraté la start-up spécialisée dans l'IA Hugging Face, alors même qu'il se trouvait dans un « environnement hautement isolé ». Cette révélation a conduit Anthropic et Meta à reconnaître que leurs propres systèmes s'étaient échappés lors de tests de sécurité.

Jacob Coxon a qualifié cet incident de « coup de semonce » qui devrait inciter les grandes entreprises du secteur de l'IA à renforcer leur coordination. Il a conclu sa missive en exhortant les chercheurs à réfléchir aux implications de modèles d'IA de plus en plus performants, et à ne pas considérer comme inévitable leur évolution potentiellement dangereuse.

« Faut-il baisser la tête parce que "ça va arriver de toute façon" — ou profiter de ce moment pour réclamer des conditions différentes ? », a-t-il demandé.

Ces avertissements résonnent d'autant plus fort qu'ils font suite à une autre déclaration marquante de Sam Altman, figure de proue d'OpenAI et cofondateur de l'entreprise à l'origine de ChatGPT. Lors d'un entretien récent, Sam Altman a affirmé que l'IA est entrée dans la « singularité », c'est-à-dire qu'elle aurait déjà franchi le point de non-retour au-delà duquel elle dépasse l'intelligence humaine et devient de plus en plus difficile à maîtriser.

Sources : Jacob Coxon, ancien chercheur en IA chez Anthropic ; Evan Hubinger, chef d'équipe chez Anthropic

Et vous ?

Quel est votre avis sur le sujet ?
Trouvez-vous les avertissements de cet ancien chercheur d'Anthropic crédibles ou pertinents ?

Voir aussi :

L'IA échappe à tout contrôle chez OpenAI : 3 700 agents IA rebelles détournent un wiki public allemand et en font un forum secret. Ils y publient 18 000 messages et effectuent plus de 15 000 modifications

Le Haut-Commissaire des Nations Unies aux droits de l'homme met en garde contre le risque « existentiel » que l'IA pourrait représenter pour l'humanité et exhorte les entreprises d'IA à réduire ces risques

Yoshua Bengio, parrain de l'IA, met en garde contre le risque d'extinction de l'humanité d'ici dix ans, causée par des machines hyperintelligentes dotées de leur propre « désir d'autoconservation »
Vous avez lu gratuitement 37 421 articles depuis plus d'un an.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.

Une erreur dans cette actualité ? Signalez-nous-la !

Avatar de onilink_
Membre émérite https://www.developpez.com
Le 09/09/2026 à 20:50
Cela fait depuis longtemps que l'on "sait" que la création d'une super intelligence non alignée serait le début de la fin de l'humanité.

Des chercheurs comme Robert Miles font même de la vulgarisation sur youtube et cela depuis bien avant l'arrivée des premieres versions de GPT, qui sont encore plus vieux que ChatGPT (qui a rendu les modèles GPT mainstream).
Le plus flippant, c'est de voir la plupart des choses dont il parlait il y a de cela presque 10 ans se concrétiser année après année. Alors que la plupart des chercheurs ne pensaient pas que l'on aurait à se soucier de la question avant au moins un demi siècle.

Puis bon, quand on voit comment l'humanité gère le problème du réchauffement climatique et de l'effondrement de la biodiversité (choses dont notre survie dépend directement), a mon sens la question n'est pas de savoir si une super IA va tous nous tuer, mais plutôt quelle catastrophe va faire chuter la civilisation humaine (ce qui est au final le scénario le plus optimiste) en premier...
5  0 
Avatar de Souil002
Membre du Club https://www.developpez.com
Le 11/09/2026 à 17:31
Evidement qu'ils n'ont pas de plan pour l'alignement de la super intelligence... puisqu'on a pas encore d'IA qu'on pourrait qualifier de "super intelligence".
Entre pirater un forum inconnu en Allemagne et anéantir l'humanité, il y a quelques nuances.
4  2 
Avatar de Christophe
Responsable Systèmes https://www.developpez.com
Le 16/09/2026 à 16:55
Pas besoin d'avoir forcément des droits admins. L'IA est en mesure de rechercher des failles pour atteindre son objectif.
Il y a donc effectivement un risque.
D'autre part, rien n’empêche un hacker de pirater une IA qui aurait des limitations pour les bypasser.

L'exemple de Anselme est exagéré .... mais peut-être pas tant que ça.
2  0 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 17/09/2026 à 11:14
En l'espace de 1 semaine, en Suisse on a eu droit à l'avis contraire de 2 "experts en IA" de l'Ecole Polytechnique Fédérale de Lausanne (EPFL): Le premier qui vient au téléjournal de la télévision suisse dire que l'IA représente un vrai risque pour l'humanité puis un autre qui se fait longuement interviewer dans la presse écrite pour dire que l'IA ne pose pas de problème de "si tôt"...

Mais ce dernier n'oublie pas de lourdement prêcher pour sa paroisse: "Il faut absolument que la Suisse et les pays européens" investissent de manière massive dans le développement de l'IA... Oh oui, oh oui, à moi les petits millions pour financer mon "IA center de l'EPFL" dont je suis le co-directeur!

La meilleure est que le spécialiste en recherche de financement reproche à ceux qui annoncent une possible catastrophe de ne pas fournir de preuve de leur position; ce qui ne l'empêche pas lui d'affirmer qu'il n'y a pas de risque sans apporter non plus la moindre preuve donnant une quelconque crédibilité à ses affirmations optimistes.

On est face à un débat d'experts dont la crédibilité ne vaut pas grand chose parce qu'ils comptent obtenir des avantages personnels à leur prises de position...

Pour ma part, je me remémore une citation du cinéaste américain Billy Wilder, à l'origine un juif autrichien qui a fuit l'arrivée au pouvoir du nazisme. "Mémoires" publiées en 1993:

Les pessimistes se sont retrouvés à Hollywood, les optimistes au camp d'extermination de Auschwitz!
2  0 
Avatar de kain_tn
Expert éminent https://www.developpez.com
Le 11/09/2026 à 19:31
Citation Envoyé par Souil002 Voir le message
Evidement qu'ils n'ont pas de plan pour l'alignement de la super intelligence... puisqu'on a pas encore d'IA qu'on pourrait qualifier de "super intelligence".
Entre pirater un forum inconnu en Allemagne et anéantir l'humanité, il y a quelques nuances.
Oui. On n'a déjà pas d'IA "intelligente", alors "super-intelligente"...

Citation Envoyé par Anthony Voir le message
Evan Hubinger, responsable de la science de l’alignement chez Anthropic, estime qu'il y a plus de 10 % de chances que l’intelligence artificielle (IA) extermine toute l’humanité d’ici dix ans.
Est-ce que ce monsieur tiendrait les mêmes déclarations, si son entreprise roulait sur l'or au lieu de crouler sous les dettes et d'essayer de survivre avec une introduction boursière? Probablement pas, non.

EDIT: Quoi que, si pour faire tourner leurs cochonneries inutiles, ils continuent de prendre toute l'eau et l'énergie de la planète, indirectement, ils extermineront les populations
2  1 
Avatar de kegilko
Membre du Club https://www.developpez.com
Le 09/09/2026 à 19:21
Je suis partagé entre penser que ces communications sont, in fine, à visée purement mercantiles en agitant les craintes/peurs collectives | et | il faut vraiment s'inquiéter vis à vis de ces outils. Et pourtant, ça fait un bail que je me balade dans l'informatique ; difficile de s'assurer de trouver le vrai dans le domaine où la donnée/information est centrale
0  0 
Avatar de OuftiBoy
Membre éprouvé https://www.developpez.com
Le 13/09/2026 à 19:34
à tous et toutes,

Oui, il ne faut pas être naïf, et ces déclarations n'ont qu'un seul et unique but : éviter les 2 scénarios généralement évoqués quant au devenir de l'IA.

1 - soit l'IA perce, et l'économie n'y survivra pas à moyen terme, car l'IA serait capable de "faire tout", et donc n'aurait plus aucune valeur en elle-même, ceci sans compter sur les dégâts "sociologiques" (chômage de masse, etc) qui feront que peu pourrons s'offrir les services de l'IA.

2 - soit la bulle éclate, et des pertes massives devront bien être acceptées.

Ces 2 scénarios ne contente en fait personne. Il faut donc mettre une 3ème hypothèse sur la table : "ralentir" le développement de l'IA, c'est le seul moins pour que la situation 1 ou 2 n'arrive pas (ou pas trop vite). Ce "ralentissement", c'est en fait tenter que le système n'explose pas de lui-même, de calmer les investisseurs (qui préférerons perdre beaucoup que tout), d'éviter qu'ils ne retirent leurs billes en masses, de "valoriser" ce qui peut l'être sans que tout s'écroule autours.

C'est ce qui c'est passé pour d'autres révolutions. Par exemple, l'énergie atomique aurait pu mener à un désastre totale, qui n'aurait arrangé personne, et donc on a un traité de non prolifération des armes nucléaires, mais on a un nucléaire civile qui devrait être rentable.

Ceci n'est que mon petit avis. Chacun à le sien et c'est très bien ainsi

BàV et Peace & Love.
0  0 
Avatar de virginieh
Membre expérimenté https://www.developpez.com
Le 15/09/2026 à 8:11
Citation Envoyé par totozor Voir le message
Alors c'est clair tout ceci est faux.
Cet été a été confortable, pas de canicule, pas de feux. Tout va bien.
La fréquence des canicule n'augmente pas tout va bien.
Puis il y a pas à faire un foin avec el nino qui s'est installé probablement jusqu'a février, on est des adultes merdes on fait pas s'en faire pour un mioche
0  0 
Avatar de gabi7756
Membre confirmé https://www.developpez.com
Le 16/09/2026 à 11:38
Citation Envoyé par Matthieu Vergne
Encore une fois, ce ne sont pas les modèles qui me font peur. Ce sont ceux qui les utilisent.
Tous les salariés d'une entreprise ont les perms admins, je ne vois pas le problème. Ils ont sûrement pas les connaissances techniques pour faire n'importe quoi ...
C'est une bonne protection n'est ce pas ?

On a des exemples tous les 2-3 mois d'une IA qui a fait vraiment n'imp, d'un jailbreak plus au moins critique bref ... C'est la fin des haricots !
0  0 
Avatar de Anselme45
Membre extrêmement actif https://www.developpez.com
Le 17/09/2026 à 10:58
Citation Envoyé par der§en Voir le message
Encore et toujours les mêmes qui crient « aux loups » !
Et d'autres qui face aux pires dérives prononcent qu'il n'y a pas le moindre problème... Comme dans le cas des armes 3D fabriqués dans le salon de quelques tarés, n'est-ce pas?
1  1