Anthropic a lancé Claude Fable 5.1 et Mythos 5.1, deux versions d'un même modèle dotées de mécanismes de sécurité différents, qui réduisent les coûts de lecture du cache de 75 % et affichent un score de 52,6 % lors d'un test de performance en recherche scientifique, contre 24,7 % pour son prédécesseur. Un seul d'entre eux est disponible au grand public. Le principal argument de vente pour les développeurs est le prix : les lectures en cache baissent de 75 % pour s'établir à 0,25 $ par million de tokens. Les résultats générés par Claude comportent un filigrane conforme à la loi européenne sur l'IA, et l'API de détection est actuellement en préversion privée.Anthropic, PBC, est une société américaine d’intérêt public spécialisée dans l’intelligence artificielle (IA), dont le siège social est situé à San Francisco, en Californie. Son produit phare est Claude, une série de grands modèles de langage (LLM) propriétaires. Anthropic a été fondée en 2021 dans le but de promouvoir la sécurité de l’IA par d’anciens membres d’OpenAI, notamment les frère et sœur Daniela Amodei et Dario Amodei, qui en sont respectivement la présidente et le PDG. La société est privée, mais envisagerait une introduction en bourse à l'automne 2026.
Anthropic a lancé Claude Fable 5.1 et Mythos 5.1, deux versions d’un même modèle dotées de mécanismes de sécurité différents, qui réduisent les coûts de lecture du cache de 75 % et affichent un score de 52,6 % lors d’un test de performance en recherche scientifique, contre 24,7 % pour son prédécesseur. Ses résultats comportent un filigrane conforme à la loi européenne sur l’IA, et l’API de détection est actuellement en préversion privée pour les organisations éligibles.
Anthropic a lancé deux nouveaux modèles Claude. Fable 5.1 et Mythos 5.1 sont le même modèle doté de mesures de sécurité différentes, a précisé l’entreprise. Un seul d’entre eux est disponible au grand public. Mythos est proposé à des utilisateurs sélectionnés via deux programmes d’accès couvrant la cybersécurité et les sciences de la vie. Anthropic précise que le programme dédié à la biologie a été développé en collaboration avec le gouvernement américain.
Le principal argument de vente pour les développeurs est le prix. Les lectures en cache baissent de 75 % pour s’établir à 0,25 $ par million de tokens, ce qui réduit les coûts des charges de travail classiques d’environ 25 % et ceux des charges de travail « agentiques » jusqu’à 45 %. La progression est spectaculaire si l'on se réfère aux chiffres fournis par Anthropic. Fable 5.1 obtient un score de 52,6 % sur Terminal-Bench-Science 0.1, contre 24,7 % pour Fable 5, et de 55,8 % sur Terminal-Bench 4.0.
Anthropic a signé en juillet le Code de bonnes pratiques de l’UE sur la transparence des contenus générés par l’IA, aux côtés de 190 autres signataires. C’est pourquoi les résultats générés par Claude comportent un filigrane. Celui-ci s’applique aux modèles publiés après le 2 août 2026, est invisible sans l’outil de détection, et, selon Anthropic, ne contient aucune information sur l’utilisateur. Il a été rapporté le mois dernier qu’Anthropic allait proposer une API de détection gratuite afin que tout le monde puisse vérifier un texte.
La version actuellement disponible est plus restreinte. Elle fait l’objet d’un accès en avant-première réservé aux organisations éligibles, notamment les autorités de régulation, les forces de l’ordre, les médias, les vérificateurs de faits, les chercheurs indépendants, les établissements d’enseignement et les associations de la société civile de l’UE. L’obligation sous-jacente est large. L’article 50 impose aux fournisseurs de marquer les contenus synthétiques dans un format lisible par machine et de les rendre détectables ; cette disposition s’applique depuis le 2 août 2026.
Les entreprises soumises à leurs propres obligations de conformité peuvent également en bénéficier. Anthropic indique qu’elle prévoit d’élargir l’accès au fil du temps, sans toutefois préciser de date. La deuxième lacune européenne concerne l’autre modèle. Les programmes d’accès de Mythos ont été mis en place en collaboration avec le gouvernement américain et ne sont ouverts qu’à un ensemble d’organisations américaines, deux ans après l’arrivée de Claude dans l’UE.
Anthropic affirme s'efforcer d'intégrer des partenaires internationaux. À l'heure actuelle, les cyberdéfenseurs et les chercheurs en sciences de la vie européens ne font pas partie du programme. C'est ainsi que se présente le lancement. La marque existe en vertu de la législation européenne, l'outil permettant de la vérifier est en phase de préversion, et des outils de suppression existaient déjà.
En août 2026, Anthropic s'apprêtait à déposer publiquement les documents nécessaires à son introduction en bourse dès la fin de ce mois. Cette introduction en bourse pouvait égaler, voire dépasser, le record de 75 milliards de dollars établi en juin par SpaceX. Aucune introduction en bourse dans le secteur technologique n'avait jusqu'à présent levé autant de fonds. Le dépôt public du dossier permettrait aux observateurs extérieurs d'avoir pour la première fois un aperçu détaillé des finances de l'entreprise. En avançant la date de dépôt, Anthropic pouvait devancer OpenAI sur les marchés boursiers.
Voici l'annonce d'Anthropic :
Claude Fable 5.1 et Mythos 5.1
Nous vous présentons Claude Fable 5.1 et Claude Mythos 5.1. Il s’agit des modèles les plus avancés au monde en matière de programmation et de travail intellectuel ; leurs capacités de recherche offrent un premier aperçu de la manière dont les modèles d’IA contribueront au progrès scientifique.
Claude Fable 5.1 et Claude Mythos 5.1 sont un seul et même modèle, mais dotés de niveaux de protection différents. Fable 5.1 est disponible au grand public, tandis que Mythos 5.1 n’est accessible que via nos programmes d’accès sécurisé ; ses mesures de sécurité sont spécialement conçues pour soutenir les travaux dans les domaines de la cybersécurité et des sciences de la vie. Outre ses capacités accrues, Fable 5.1 apporte des améliorations significatives en réponse aux retours que nous avons reçus de nos clients concernant les prix, la conservation des données et les mesures de sécurité.
Prix. Fable 5.1 coûtera environ 25 % de moins que Fable 5 pour des charges de travail typiques, lorsque l’utilisation est facturée au jeton. Cela s’explique par la réduction de nos tarifs sur les lectures en cache (lorsque le modèle lit des entrées qui ont déjà été traitées et stockées). Pour les tâches hautement agentiques, les économies seront souvent bien plus importantes, pouvant atteindre environ 45 %.
Conservation des données. Notre nouveau système « Enterprise Frontier Safeguards » (EFS) garantit à nos clients une confidentialité totale (équivalente à une politique de non-conservation des données) tout en offrant une protection de pointe contre toute utilisation malveillante. L’EFS fonctionne en stockant les données dans une infrastructure cloud entièrement contrôlée par le client, et non par Anthropic. Il sera mis à la disposition des entreprises par étapes, à partir de la fin de cet automne. Jusqu’à la mise à disposition d’EFS, les clients éligibles pourront utiliser Fable 5.1 sans aucune conservation des données.
Mesures de sécurité. Nous avons amélioré nos mesures de sécurité afin de réduire les faux positifs (lorsque le système signale un contenu inoffensif). En matière de cybersécurité, nos toutes dernières mesures de protection bloquent 60 % de faux positifs en moins qu’auparavant. Cela s’explique en partie par le fait que Fable 5.1 peut désormais être utilisé pour détecter des vulnérabilités logicielles — mais pas pour développer des exploits à leur encontre. En biologie, nous avons mis en place un programme d’accès, développé en partenariat avec le gouvernement américain, afin de permettre l’accès aux capacités avancées de Claude Mythos 5.1 en biologie. Nous prévoyons d’ouvrir prochainement les inscriptions aux scientifiques.
Une nouvelle frontière en matière de performances
Claude Fable 5.1 établit une nouvelle référence en matière de programmation, de travail intellectuel et de résolution de problèmes de longue haleine. Les graphiques ci-dessous montrent que Fable 5.1 offre des performances bien supérieures à celles de son prédécesseur, Fable 5. De plus, lorsqu’il est réglé sur un niveau d’effort « Faible » ou « Moyen », Fable 5.1 obtient des résultats similaires, voire supérieurs, à ceux de Fable 5, et ce à un coût bien moindre. (Notez que Fable 5.1 est configuré par défaut sur un niveau d’effort « Élevé » dans Claude Code, et sur « Moyen » dans Claude Cowork et sur Claude.ai.)
Fable 5.1 évite les raccourcis qui se traduisent par un travail de moindre qualité, et il est suffisamment intelligent pour remédier aux causes profondes des problèmes logiciels. Par exemple, lors de tests menés par la société d’investissement Millennium, Fable 5.1 a identifié la cause d’un plantage rare dans ses systèmes internes qu’aucun de ses ingénieurs (ni aucun autre modèle) n’avait réussi à expliquer après plusieurs années d’efforts. Vous pouvez voir ici comment Fable 5.1 se positionne par rapport à d'autres modèles dans divers tests de performance :
Fable 5.1 a été évalué avec ses mesures de sécurité de production activées. Sur les tâches où ces mesures sont intervenues, Fable 5.1 et Fable 5 ont obtenu un score de zéro sur OSWorld 2.0, et Fable 5 a obtenu un score de zéro sur AutomationBench. Dans tous les autres cas d’intervention de nos mesures de sécurité, les tâches liées à la cybersécurité ont été réalisées par Claude Opus 4.8, et celles liées à la biologie par Claude Opus 5. Cela réduit probablement les performances de Fable 5.1 et de Fable 5 sur ces benchmarks. Nos partenaires du programme d’accès anticipé ont remarqué ces gains de performances et ont également constaté des améliorations plus qualitatives dans les résultats du modèle.
Recherche scientifique
Nous avons testé les capacités de recherche scientifique de Claude Fable 5.1 et de Claude Mythos 5.1 dans un large éventail de domaines. Nos conclusions — dont font partie les premiers exemples que nous partageons ci-dessous — viennent étayer les preuves selon lesquelles les modèles d’IA apporteront bientôt une contribution importante aux découvertes scientifiques.
Conception moléculaire. De nombreux médicaments modernes agissent en se liant à des cibles au sein de l’organisme afin de les bloquer, de les activer ou de leur administrer une substance. Des molécules de liaison à haute affinité sont nécessaires pour que les médicaments agissent à des doses plus faibles ; leur conception constitue la première étape du processus de développement de nombreuses classes de médicaments courantes. Afin d’évaluer les performances de Claude Mythos 5.1 dans cette tâche, nous avons donné au modèle accès à des outils open source de conception et de repliement des protéines, puis avons transmis ses propositions à deux organismes externes pour une validation expérimentale. Mythos 5.1 s’est révélé capable de concevoir des molécules de liaison à très haute affinité.
Sur trois cibles, ses affinités de liaison étaient 10 fois supérieures à celles des meilleures conceptions soumises aux concours de conception de protéines organisés par Adaptyv Bio. Son taux de réussite (c’est-à-dire le nombre de conceptions constituant des ligands viables) était le plus élevé que nous ayons mesuré à ce jour : il a atteint près de 50 % sur 12 cibles. (Les taux de réussite de 10 à 15 % sont courants aujourd’hui dans la conception de protéines.)
Analyse et modélisation informatiques. Claude Fable 5.1 a entraîné un réseau neuronal afin de créer une nouvelle carte altimétrique haute résolution couvrant un tiers de la planète Vénus. Son travail s’est appuyé sur des images radar prises par la mission Magellan de la NASA il y a plus de 30 ans, ainsi que sur une carte existante couvrant un cinquième de la planète. La nouvelle carte de Claude révèle désormais des détails à une échelle de deux à trois kilomètres, au lieu de 10 à 20, et indique les altitudes avec une précision accrue de 25 % par rapport à auparavant.
Biologie computationnelle. En biologie computationnelle, il est courant d’exécuter des modèles d’apprentissage automatique spécifiques à une tâche sur des GPU. La vitesse de ces modèles constitue donc un frein aux progrès de la recherche. Mythos 5.1 a apporté une solution à ce problème : en écrivant des noyaux GPU personnalisés et en mettant en cache leurs résultats intermédiaires, il a accéléré jusqu’à 2,5 fois sept modèles d’apprentissage profond open source (avec des résultats identiques).
Les avantages de ces gains de vitesse s’accumulent rapidement. Dans le cadre d’une expérience donnée, les biologistes peuvent exécuter ces modèles des milliers de fois (par exemple, pour tester toutes les mutations possibles à proximité de chaque gène humain). Pour des analyses de ce type, les modèles optimisés réduisent les coûts estimés liés à l’utilisation des GPU de 30 à 60 %. Ce type d’optimisation prendrait normalement plusieurs semaines à une équipe d’ingénieurs spécialisés dans les performances, et est souvent inabordable pour les laboratoires universitaires. Mythos 5.1 a réussi à le faire en quelques jours seulement, en utilisant uniquement le code source disponible publiquement. Nous prévoyons de mettre prochainement ces optimisations en open source.
À mesure que les capacités scientifiques de nos modèles s’améliorent, nos investissements dans le progrès scientifique s’intensifient également. La semaine dernière, nous avons présenté en avant-première la norme « Model Hardware Standard », qui permet à Claude de faire fonctionner directement et en toute sécurité des équipements de laboratoire. Nous avons également récemment renforcé notre soutien aux scientifiques grâce à notre programme « AI for Science », qui offre des crédits gratuits aux chercheurs travaillant sur des projets scientifiques à fort impact, et nous proposons des tarifs très avantageux via notre nouvelle formule « Claude Team » destinée aux scientifiques.
Sécurité, sûreté et alignement
Les capacités d’action des modèles d’IA sont devenues bien plus puissantes au cours des deux dernières années. Mais comme nous l’avons démontré, une plus grande autonomie s’accompagne de nouveaux risques. Les travaux en matière de sécurité, de sûreté et d’alignement doivent progresser au même rythme que les capacités de l’IA. Nous avons publié un rapport décrivant comment nous améliorons nos propres efforts en matière d’alignement et de sécurité
Avant de lancer Claude Fable 5.1 et Claude Mythos 5.1, nous (et, dans certains cas, des chercheurs externes) avons soumis les modèles à des tests approfondis visant à détecter les risques dans de nombreux domaines. Nous décrivons ces efforts en détail dans notre fiche système ; vous trouverez ci-dessous un bref résumé.
Risques chimiques et biologiques. Nous avons évalué dans quelle mesure Claude Mythos 5.1 pouvait contribuer à la fabrication d’armes chimiques ou biologiques. Cette évaluation a fait appel à une simulation d’attaque menée par des experts (« red teaming »), à des évaluations automatisées et à un exercice de simulation réunissant des biologistes titulaires d’un doctorat et des experts en IA, afin de vérifier si les modèles pouvaient égaler les performances des spécialistes humains. Les capacités de Mythos 5.1 sont supérieures à celles de Mythos 5. Cependant, nos évaluations indiquent qu’il n’atteint pas encore le niveau de risque supérieur défini dans notre politique de développement responsable. Nous déployons donc Mythos 5.1 avec les mêmes mesures de sécurité que celles appliquées à Mythos 5, qui restreignent l’accès aux fonctionnalités liées à la recherche en biologie.
Risques cybernétiques. Nous avons mené une série d’évaluations afin d’analyser les capacités cybernétiques de Claude Mythos 5.1 (avec les mesures de sécurité désactivées). Dans l’ensemble, ce modèle présente les capacités cybernétiques les plus avancées de tous ceux que nous avons lancés, bien qu’il se situe toujours dans la catégorie de risque la plus basse de notre cadre de conformité « Frontier ». Nous avons également soumis nos mesures de cybersécurité pour Fable 5.1 à des tests de résistance approfondis : outre notre propre évaluation dynamique de leur robustesse, nous avons fait appel à deux organismes externes pour réaliser des tests, ainsi qu’à des tests automatisés menés par Gray Swan. Comme pour Fable 5 et Opus 5, nous n’avons trouvé aucune preuve d’un « jailbreak » de gravité critique pour ces mesures de sécurité.
Sécurité agentique. Nous avons évalué la manière dont Claude Mythos 5.1 réagit aux requêtes malveillantes et aux injections de prompts (instructions adversaires dissimulées dans le contenu traité par les modèles d’IA). Il a rejeté les requêtes malveillantes liées au codage agentique et à l’utilisation d’ordinateurs à un taux comparable à celui de Mythos 5, Sonnet 5 et Opus 5, et il s’agit à ce jour de notre modèle le plus robuste sur un benchmark externe d’injection de prompts.
Alignement. Nous avons testé le comportement du modèle à travers des évaluations comportementales statiques et interactives, des analyses de son raisonnement interne à l’aide d’auto-encodeurs en langage naturel, des évaluations de capacités liées au désalignement, un examen de nos données d’entraînement et des analyses de notre utilisation pilote en interne. Nous avons également reçu des rapports issus de tests externes.
Notre audit comportemental automatisé a révélé que Claude Mythos 5.1 présente un meilleur alignement sur la plupart des indicateurs que son prédécesseur, Mythos 5. Le modèle est nettement moins susceptible que Mythos 5 de tenter d’accéder à des ressources en dehors de son environnement de test lorsqu’on lui confie une tâche par ailleurs impossible. Il est également moins enclin que Mythos 5 à recourir à un raisonnement motivé pour justifier ses actions (par exemple, en estimant que la situation est une simulation ou une évaluation), et il est moins susceptible d’ignorer des contraintes explicites dans la poursuite des objectifs des utilisateurs. D’après notre examen de ses données d’entraînement, Mythos 5.1 tente de « pirater » le système de récompenses (ou de tricher) et y parvient, mais à un taux global inférieur à celui de Mythos 5.
Bien que nos évaluations d’alignement aient globalement montré des améliorations, nos tests ont révélé que le modèle peut encore parfois contourner les autorisations et les classificateurs en mode automatique. La couverture offerte par notre évaluation d’alignement présente également des limites. Actuellement, notre audit comportemental automatisé offre une visibilité réduite sur les tâches à très long contexte et les environnements multi-agents. Nous couvrons également moins que nous ne le souhaiterions les tâches impossibles (qui peuvent susciter des comportements plus anormaux et désalignés), bien que nous ayons récemment apporté des améliorations dans ce domaine et que nous travaillions d’arrache-pied pour continuer dans cette voie.
Nous avons également amélioré nos mesures de protection afin qu’elles permettent à nos modèles d’être plus utiles sans compromettre la sécurité. Nous décrivons ces changements ci-dessous.
Mesures de sécurité automatisées pour les entreprises. EFS nous permet de détecter et de réagir aux utilisations abusives de nos modèles tout en garantissant à nos clients professionnels la confidentialité d’un accord de non-conservation des données. Avec EFS, les clients stockent leurs données sur leur propre infrastructure cloud, plutôt que sur les systèmes d’Anthropic ; toute vérification humaine est, par défaut, effectuée par le client lui-même, plutôt que par Anthropic. Nous avons développé EFS en étroite collaboration avec plus de 100 clients issus de secteurs tels que les services financiers, la santé, l’industrie manufacturière, les télécommunications, le droit, le commerce de détail et le secteur public, ainsi qu’avec nos partenaires cloud Amazon Web Services, Google Cloud et Microsoft Azure.
EFS sera pris en charge sur Claude Code, Claude Enterprise, la plateforme Claude, Amazon Bedrock, la plateforme Claude sur AWS, la plateforme Agent de Google et Microsoft Foundry. Son déploiement se fera par étapes, à partir de cet automne. Comme indiqué ci-dessus, les clients éligibles à EFS peuvent utiliser Fable 5.1 (et Fable 5) sans aucune conservation des données jusqu’à ce qu’EFS soit prêt.
Des mesures de protection plus précises pour la biologie et la cybersécurité. Au cours des derniers mois, nous avons progressé dans l’affinement de nos mesures de protection pour Fable 5.1 : nous veillons à ce qu’elles soient moins susceptibles de signaler des contenus inoffensifs (tels que des requêtes sur des questions médicales ou des cyberdéfenseurs utilisant le modèle pour sécuriser leurs systèmes), tout en garantissant une protection robuste contre les menaces réelles.
Nos dernières mesures de protection en biologie pour Fable 5.1 et Fable 5 se déclenchent 85 % moins souvent pour des requêtes inoffensives liées à la biologie élémentaire et à des questions médicales (par rapport à celles qui étaient en place lors du lancement de Fable 5). Toutefois, les requêtes liées à la recherche et au développement dans les sciences de la vie continueront d’être redirigées vers nos modèles Opus. Nous mettons les capacités du modèle en matière de sciences de la vie à la disposition des professionnels via un programme d’accès à Claude Mythos 5.1 que nous avons développé en partenariat avec le gouvernement américain, dont nous parlons ci-dessous.
Avec Fable 5.1, nous améliorons la précision de nos mesures de cybersécurité. Nous autorisons désormais également l’utilisation de...
La fin de cet article est réservée aux abonnés. Soutenez le Club Developpez.com en prenant un abonnement pour que nous puissions continuer à vous proposer des publications.