Anthropic a annoncé Claude Fable 5, un modèle de la classe Mythos qui sera mis à la disposition de ses clients professionnels et de ses abonnés payants. La société a dévoilé Mythos en avril et en a limité le déploiement en raison de ses capacités avancées en matière de cybersécurité. Anthropic a déclaré que la mise à disposition générale de Claude Fable 5 était possible grâce à de nouvelles mesures de sécurité qui bloquent les réponses dans des domaines spécifiques à haut risqueAnthropic PBC est une entreprise américaine spécialisée dans l'intelligence artificielle (IA) dont le siège social se trouve à San Francisco, en Californie. Elle a développé une série de grands modèles de langage (LLM) baptisés Claude et met l'accent sur la sécurité de l'IA. Anthropic a été fondée en 2021 par d'anciens membres d'OpenAI, dont les frère et sœur Daniela Amodei et Dario Amodei, respectivement présidente et PDG. L'entreprise est privée et, en mai 2026, sa valeur était estimée à 965 milliards de dollars.
Fin mars 2026, le dernier modèle d'IA d'Anthropic a fait l'objet d'une fuite avant même son lancement et a fait grand bruit sur les réseaux sociaux. Le nouveau modèle, dont le nom de code est « Claude Mythos », a été révélé accidentellement. Mais Anthropic a annoncé qu'il ne commercialiserait pas Mythos au grand public, invoquant la crainte qu'il ne soit trop efficace pour détecter des failles de cybersécurité de gravité élevée dans les principaux systèmes d'exploitation et navigateurs web. « L'augmentation considérable des capacités de Claude Mythos Preview nous a amenés à décider de ne pas le rendre accessible au grand public », a déclaré Anthropic.
Deux mois après avoir déployé Mythos auprès d'un nombre limité d'utilisateurs, invoquant des inquiétudes quant au potentiel de ce modèle d'intelligence artificielle à causer des dommages s'il tombait entre de mauvaises mains, la société a déclaré être prête à mettre à la disposition du public un modèle tout aussi puissant. Anthropic a annoncé Claude Fable 5, un modèle de la classe Mythos qui sera accessible à ses clients professionnels et à ses abonnés payants. La société a déclaré que cette mise à disposition à grande échelle était rendue possible par de nouvelles mesures de sécurité qui bloquent les réponses dans des domaines spécifiques à haut risque, notamment la cybersécurité et la biologie.
« Pour nous, il s’agit vraiment de ce que nous appelons la “course vers le sommet”, c’est-à-dire être en mesure de fournir cette technologie de manière utile, tout en mettant en place les garde-fous de sécurité appropriés afin qu’elle apporte, de manière asymétrique, plus d’avantages que de risques », a déclaré Dianne Penn, responsable de la gestion des produits de recherche chez Anthropic.
Anthropic a captivé Wall Street et les responsables gouvernementaux en avril avec le dévoilement de Mythos, qui excelle dans l’identification des failles de sécurité au sein des logiciels. La société avait déclaré qu’elle ne prévoyait pas de rendre le modèle accessible au grand public, et elle a limité son déploiement à un groupe restreint d’entreprises dans le cadre d’une initiative de cybersécurité appelée Project Glasswing.
Mais avec le lancement de Claude Fable 5, Anthropic concrétise son « objectif à terme » déclaré de déployer à grande échelle des modèles de la classe Mythos. L’entreprise tire également parti de la dynamique croissante et de l’intérêt des investisseurs pour sa technologie, en prévision d’une introduction en bourse potentiellement massive, qui devrait avoir lieu dès cette année. Anthropic a déclaré que Claude Fable 5 affichait des « performances exceptionnelles » dans les tâches d’ingénierie logicielle et de travail intellectuel. Selon un article de blog, il a obtenu des scores supérieurs de plus de 10 % à ceux de Claude Opus 4.8, un autre modèle annoncé par l’entreprise à la fin du mois dernier, lors de certains tests de performance.
Claude Fable 5 représente un « bond en avant significatif » en termes de capacités, raison pour laquelle Anthropic a dû mettre en place des garde-fous supplémentaires pour prévenir toute utilisation abusive, a déclaré Penn. Si un utilisateur pose une question à haut risque, comme par exemple comment fabriquer de la ricine, une toxine, le modèle bloquera sa réponse et se rabattra sur Claude Opus 4.8 pour fournir une réponse sûre. « Ce que nous voulions, c’était nous attacher tout particulièrement à mettre en place de nouveaux types de classificateurs et de nouvelles mesures de sécurité pour ce lancement », a déclaré Penn.
Anthropic a également lancé une version mise à jour du modèle Mythos, baptisée Claude Mythos 5. Il s’agit du même modèle sous-jacent que Claude Fable 5, mais les mesures de sécurité ont été levées dans certains domaines. Pourtant, un rapport récent de Google avait confirmé les craintes liées à Mythos en révélant avoir réussi à bloquer une cyberattaque de grande envergure au cours de laquelle des cybercriminels ont utilisé l'IA pour découvrir une faille inconnue. Le message de Google est clair : l'ère des « hackers alimentés par l'IA » est officiellement arrivée.
Claude Fable 5 arrive quelques jours seulement après qu’Anthropic a annoncé avoir déposé en toute confidentialité son prospectus d’introduction en bourse auprès de la Securities and Exchange Commission, ouvrant la voie à une vente d’actions potentiellement historique après que la société a connu une période de croissance explosive cette année. Anthropic a déclaré en mai que son chiffre d’affaires annuel avait grimpé en flèche pour atteindre 47 milliards de dollars, contre environ 10 milliards de dollars l’année dernière. La société a récemment clôturé un tour de table avec une valorisation de 965 milliards de dollars, dépassant ainsi son principal rival, OpenAI, qui était évalué à 852 milliards de dollars fin mars.
Voici l'annonce d'Anthropic :
Claude Fable 5 et Claude Mythos 5
Nous lançons aujourd’hui Claude Fable 5 : un modèle de classe Mythos¹ que nous avons rendu sûr pour une utilisation grand public.
Les capacités de Fable 5 surpassent celles de tous les modèles que nous avons jamais mis à la disposition du grand public. Il est à la pointe de la technologie dans presque tous les benchmarks testés en matière de capacités d’IA, affichant des performances exceptionnelles dans l’ingénierie logicielle, le travail intellectuel, la vision, la recherche scientifique et bien d’autres domaines. Plus la tâche est longue et complexe, plus l’avance de Fable 5 sur nos autres modèles est importante.
La mise à disposition d’un modèle aussi performant comporte des risques. Sans mesures de sécurité, les capacités de Fable 5 dans des domaines tels que la cybersécurité pourraient être détournées pour causer de graves dommages. Nous avons donc lancé le modèle avec des mesures de sécurité qui font que les requêtes sur certains sujets recevront à la place une réponse de notre deuxième modèle le plus performant, Claude Opus 4.8. Afin de lancer le modèle à la fois en toute sécurité et rapidement, nous avons réglé ces mesures de sécurité de manière prudente : elles intercepteront parfois des requêtes inoffensives, bien qu’elles ne se déclenchent, en moyenne, que dans moins de 5 % des sessions. Avec l’arrivée de modèles plus performants dans les mois à venir, nous travaillons à améliorer nos mesures de sécurité et à réduire les faux positifs aussi rapidement que possible.
Pour un petit groupe de cyberdéfenseurs et de fournisseurs d’infrastructures, nous lançons également Claude Mythos 5. Il s'agit du même modèle sous-jacent que Fable 5, mais avec des mesures de sécurité assouplies dans certains domaines.2 Mythos 5 sera initialement déployé via le projet Glasswing, en collaboration avec le gouvernement américain, en tant que mise à niveau de Claude Mythos Preview. Il dispose des capacités de cybersécurité les plus puissantes de tous les modèles au monde. Nous avons l'intention d'étendre prochainement l'accès à Mythos 5 via un programme d'accès de confiance plus large.
Les capacités de modèles tels que Fable 5 et Mythos 5 ont le potentiel d’apporter un bienfait considérable au monde. Nous en avons vu les prémices dans le cadre du projet Glasswing, où ces modèles ont aidé les cyberdéfenseurs à sécuriser des logiciels d’une importance cruciale. Nous l’avons également constaté dans la recherche en sciences de la vie, où ces modèles émettent des hypothèses novatrices et accélèrent le développement de nouveaux traitements.
Fable 5 et Mythos 5 sont proposés à 10 $ par million de jetons d'entrée et 50 $ par million de jetons de sortie, soit moins de la moitié du prix de Claude Mythos Preview. Le lancement conjoint d'aujourd'hui constitue une nouvelle étape vers notre objectif : mettre des capacités d'IA avancées à la disposition du plus grand nombre d'utilisateurs possible, aussi rapidement et en toute sécurité que possible.
Évaluation de Claude Fable 5 et Claude Mythos 5
Le tableau ci-dessous compare les capacités de Fable 5 et Mythos 5 à celles d’autres modèles de pointe.
Fable 5 et Mythos 5 peuvent fonctionner de manière autonome plus longtemps que n’importe quel modèle Claude précédent. Nous abordons ci-dessous la manière dont ces compétences s’appliquent à l’ingénierie logicielle, et passons en revue les capacités améliorées du modèle en matière de travail intellectuel, de vision, de mémoire et de recherche en sciences de la vie.
Ingénierie logicielle. Lors des premiers tests, Stripe a indiqué que Fable 5 avait permis de réduire des mois de travail d'ingénierie à quelques jours. Sur une base de code Ruby de 50 millions de lignes, le modèle a effectué en une journée une migration à l'échelle de l'ensemble du code qui aurait autrement nécessité plus de deux mois de travail manuel à toute une équipe. Fable 5 est également plus efficace en termes de tokens que les modèles Claude précédents : lors de l'évaluation FrontierCode de Cognition, qui teste la capacité des modèles à réussir des tâches de codage difficiles tout en respectant les normes des bases de code de production de haute qualité, Fable 5 obtient le meilleur score parmi les modèles de pointe, même avec un effort moyen.
Travail intellectuel. Fable 5 affiche de solides performances sur des tâches analytiques complexes. Sur le benchmark financier d’Hebbia pour le raisonnement de niveau senior, Fable 5 obtient le score le plus élevé de tous les modèles, avec des gains substantiels en matière de raisonnement basé sur des documents, d’interprétation de graphiques et de tableaux, et de résolution de problèmes. IMC a noté que Fable 5 a brillé dans leurs évaluations d’analyse de trading dans presque tous les domaines, y compris la recherche de faits, le raisonnement conceptuel, l’analyse des causes profondes et l’analyse de la valeur attendue.
Vision. Fable 5 est le nouveau modèle de pointe pour les tâches impliquant la vision. Il est capable d'extraire des chiffres précis à partir de figures scientifiques détaillées et d'effectuer des tâches complexes basées sur la vision, comme la reconstruction du code source d'une application web à partir de simples captures d'écran. Il nécessite également moins de support : par exemple, les modèles Claude précédents avaient du mal à jouer à Pokémon FireRed même avec des harnais leur fournissant des outils supplémentaires utiles, mais Fable 5 a battu FireRed avec un harnais minimal, basé uniquement sur la vision.
Mémoire et contexte étendu. Fable 5 conserve sa concentration sur des millions de tokens dans le cadre de tâches de longue durée et améliore ses résultats en s'appuyant sur ses propres notes. Lorsque nous avons fait jouer au modèle le jeu de construction de deck Slay the Spire, le fait de lui donner accès à une mémoire persistante basée sur des fichiers a permis de multiplier ses performances par trois par rapport à Opus 4.8 ; Fable a également atteint le dernier acte du jeu trois fois plus souvent.
Conception de médicaments : grâce à Mythos 5, nos experts internes en conception de protéines ont accéléré certains aspects du processus de conception de médicaments d’environ dix fois. Dans un exemple, ils ont constaté que Mythos 5, équipé d’outils de conception de protéines et de bio-informatique mais sans assistance humaine, égalait ou surpassait des opérateurs humains expérimentés. Ce faisant, le modèle exécute toutes les tâches normalement accomplies par un scientifique : choisir les sites de liaison, sélectionner et utiliser des outils de conception de protéines, et se remettre des échecs rencontrés en cours de route. Neuf des 14 cibles protéiques de cette étude (présentées ci-dessous) ont donné lieu à des candidats solides pour la conception de médicaments que nous étudions actuellement.
Hypothèses novatrices en biologie moléculaire. Mythos 5 est notre premier modèle à produire de manière constante des hypothèses scientifiques novatrices et convaincantes. Lors de comparaisons en aveugle avec des modèles de la classe Opus, nos scientifiques ont préféré les hypothèses de biologie moléculaire de Mythos dans environ 80 % des cas, et en ont soumis plusieurs à une évaluation expérimentale. Entre-temps, une hypothèse de Mythos — un mécanisme novateur pour une protéine d'E. coli — a été corroborée dans une étude menée par un laboratoire travaillant indépendamment sur le même problème.
Recherche novatrice en génomique. Mythos 5 a mené des recherches novatrices en génomique au cours d’une semaine de travail largement autonome. Il a assemblé des données unicellulaires pour des millions de cellules issues de 138 espèces animales, puis a conçu et entraîné un modèle d’apprentissage automatique sur mesure afin d’identifier les cellules remplissant le même rôle, même chez des organismes éloignés. Avec pour seule intervention humaine des instructions de haut niveau, le modèle entraîné de Mythos 5 a surpassé un modèle récent publié dans la revue Science, bien qu’il soit 100 fois plus petit. Nous avons l'intention de publier ces résultats dans les mois à venir.
Alignement. Lors de notre évaluation automatisée de l'alignement, nous avons constaté que le niveau de comportement non aligné de Mythos 5 (y compris les actions non alignées entreprises par le modèle, telles que la tromperie et la coopération avec une utilisation abusive du modèle par un utilisateur) était faible et similaire à celui d'Opus 4.8. Étant donné qu'ils reposent sur le même modèle sous-jacent, le niveau d'alignement de Fable 5 sera similaire. L'évaluation est décrite en détail, ainsi qu'une série complète d'autres tests de sécurité et de capacités, dans la fiche technique du modèle.
Les nouvelles mesures de sécurité de Claude Fable 5
Les modèles de classe Mythos ont atteint un seuil où ils présentent des risques significatifs. En avril, nous avons lancé le projet Glasswing, en mettant à disposition le premier modèle de classe Mythos (Claude Mythos Preview) uniquement à un groupe restreint de cyberdéfenseurs et de fournisseurs d’infrastructures logicielles critiques. À cette occasion, nous avions déclaré que nous espérions à terme mettre les capacités de niveau Mythos à la disposition de tous nos utilisateurs, à condition d’avoir développé de nouvelles mesures de sécurité suffisamment solides pour empêcher de manière fiable toute utilisation abusive.
Au cours des derniers mois, nous avons amélioré ces mesures de sécurité, qui sont désormais suffisamment robustes pour une mise à disposition générale. Comme nous avons donné la priorité à la sécurité, nous avons délibérément réglé les mesures de sécurité de manière prudente, et elles restent plus strictes que ce qui serait idéal — par exemple, des requêtes parfois inoffensives déclencheront nos classificateurs. Nous reconnaissons que cela sera frustrant pour certains utilisateurs, et notre objectif est de réduire les faux positifs à mesure que nous mettrons à jour et affinerons les mesures de sécurité après le lancement.
Nous abordons ci-dessous chacune des nouvelles mesures de sécurité de Fable 5. Notre ensemble plus large de mesures de sécurité est présenté et évalué dans la fiche technique du modèle et dans notre dernier rapport sur les risques.
Classificateurs de sécurité
Les capacités de pointe en matière de cybersécurité et de biologie de recherche des modèles de classe Mythos signifient qu’ils présentent un risque substantiel d’amplification pour les acteurs malveillants. En d’autres termes, ces modèles pourraient fournir des informations ou des conseils aidant ces acteurs à causer des dommages graves, qu’ils n’auraient pas pu obtenir par d’autres sources (par exemple, via les moteurs de recherche sur Internet). De plus, une grande partie de l’utilisation avancée des modèles d’IA est à double usage : les mêmes requêtes qui sont bénéfiques entre les mains de professionnels de la cybersécurité et de chercheurs en biologie pourraient être dangereuses si elles étaient accessibles à des acteurs malveillants.
Nous avons donc besoin de mesures de protection solides pour prévenir les abus, et leur champ d’application doit être large. Ces mesures de protection doivent elles-mêmes résister à des tentatives soutenues et sophistiquées visant à les contourner (ce que l’on appelle également le « jailbreaking » du système). L’avantage procuré par les capacités de niveau Mythos est précieux pour de nombreux adversaires — par exemple, ceux qui pourraient tirer un profit financier de cyberattaques — et nous nous attendons donc à ce qu’ils soient motivés pour tenter de contourner nos mesures de sécurité.
Fable 5 intègre un nouvel ensemble de classificateurs : des systèmes d’IA distincts qui détectent les utilisations abusives potentielles, y compris les tentatives de contournement des restrictions, et empêchent le modèle principal (en l’occurrence Fable 5) de répondre. Nous utilisons des classificateurs sur nos modèles depuis un certain temps déjà, et ceux de Fable 5 constituent une extension de ces travaux antérieurs, avec une couverture élargie.
Lorsque les classificateurs de Fable détectent une requête liée à la cybersécurité, à la biologie et à la chimie, ou à la distillation, la réponse est automatiquement gérée par Claude Opus 4.8 à la place. Les utilisateurs seront informés chaque fois que cela se produit. Opus 4.8 est un modèle très performant en soi : une réponse qui revient à Opus offre une bien meilleure expérience qu’un refus catégorique de la part de Fable. Nos premières données montrent que plus de 95 % des sessions Fable n’impliquent aucun recours à un système de secours — pour ces sessions, les performances de Fable 5 sont pratiquement identiques à celles de Mythos 5.
Voici les domaines couverts par les classificateurs :
1. Cybersécurité. Les modèles de classe Mythos excellent dans la détection et l’exploitation des vulnérabilités logicielles. Ils peuvent ainsi rendre les cyberattaques nettement plus faciles et moins coûteuses à mener. Les modèles de classe Mythos font également preuve de solides compétences en matière de piratage agentique. Cela implique d’exécuter plusieurs étapes différentes d’une cyberattaque en plus de trouver des failles : reconnaissance, découverte, mouvement latéral, etc. Afin d'empêcher ces compétences en piratage agentique de renforcer les cyberattaques, nous avons conçu nos classificateurs de cybersécurité pour couvrir à la fois l'exploitation et les tâches cyberoffensives au sens large. Comme le montre le graphique ci-dessous, nos classificateurs empêchent Fable de progresser sur ces tâches.
Nous avons soumis nos classificateurs à des tests approfondis de type « red team » afin d’évaluer leur résistance aux tentatives de contournement. Outre ces tests internes, nous avons lancé un programme externe de prime aux bogues qui n’a permis de découvrir aucun moyen universel de contournement après plus de 1 000 heures de tests. Les organisations externes de red teaming auxquelles nous avons fait appel n'ont elles non plus pas réussi à trouver de jailbreaks universels sur des tâches agentiques de longue durée jusqu'à présent — bien que l'AISI britannique ait fait des progrès en ce sens lors d'une brève phase de tests initiale.4 Il est probablement impossible d'empêcher complètement les jailbreaks universels, mais notre objectif est de rendre les jailbreaks restants suffisamment lents et coûteux pour que nous puissions les détecter et les empêcher avant qu'ils ne soient utilisés à grande...
La fin de cet article est réservée aux abonnés. Soutenez le Club Developpez.com en prenant un abonnement pour que nous puissions continuer à vous proposer des publications.

