Le 7 octobre 2026, Anthropic a lancé Claude Haiku 5.5, le tout dernier modèle de sa gamme de petits modèles, disponible dès maintenant sur la plateforme Claude, Amazon Web Services, Google Cloud et Microsoft Azure à des prix inférieurs à ceux de Haiku 4.5. Anthropic a indiqué que le coût d'exploitation de ce modèle était en moyenne environ 75 % inférieur à celui de son prédécesseur. Anthropic décrit Haiku 5.5 comme le petit modèle le moins cher, le plus rapide et le plus performant qu’elle ait jamais lancé, conçu pour des tâches à haut volume et sensibles aux coûts, telles que les résumés, les compressions, les requêtes de bases de données et les demandes de classification. Anthropic est une société d'intérêt public américaine spécialisée dans l'intelligence artificielle (IA). Son produit phare est Claude, une série de grands modèles de langage (LLM) « de pointe ». En janvier 2021, dans le but de promouvoir la sécurité de l'IA, Anthropic a été fondée par d'anciens membres d'OpenAI, notamment les frère et sœur Daniela Amodei et Dario Amodei, qui en sont respectivement la présidente et le PDG. La société est privée, mais envisagerait une introduction en bourse en 2026.
Le 7 octobre 2026, Anthropic a lancé Claude Haiku 5.5, le tout dernier modèle de sa gamme de petits modèles, disponible dès maintenant sur la plateforme Claude, Amazon Web Services, Google Cloud et Microsoft Azure à des prix inférieurs à ceux de Haiku 4.5. Anthropic a indiqué que le coût d'exploitation de ce modèle était en moyenne environ 75 % inférieur à celui de son prédécesseur.
Anthropic décrit Haiku 5.5 comme le petit modèle le moins cher, le plus rapide et le plus performant qu’elle ait jamais lancé, conçu pour des tâches à haut volume et sensibles aux coûts, telles que les résumés, les compressions, les requêtes de bases de données et les demandes de classification. L’entreprise a précisé que ce modèle s’associe à Claude Opus 5.5 et Claude Sonnet 5.5 en tant que sous-agent pour les travaux de codage, et qu’il convient aux tâches où la rapidité est essentielle, comme l’assistance client en direct et l’utilisation d’un navigateur. Une note de bas de page de l’annonce nuance cette affirmation concernant la vitesse : Haiku 5.5 est le modèle le plus rapide de la société à ce jour à la vitesse standard de chaque modèle, bien qu’il fonctionne moins rapidement que les modèles Opus en mode rapide (Fast Mode).
Haiku 5.5 est le premier modèle de la classe Haiku d’Anthropic doté d’un paramètre d’effort réglable, qui permet aux utilisateurs de choisir s’ils souhaitent optimiser le coût ou l’intelligence. Les développeurs peuvent l’appeler via la chaîne de modèle « claude-haiku-5-5 », et Anthropic a publié un guide de migration pour cette version. Selon la fiche technique du modèle, Haiku 5.5 a été entraîné sur un mélange propriétaire d’informations disponibles publiquement sur Internet, de jeux de données publics et privés, de données utilisateur explicitement autorisées pour l’entraînement et de données synthétiques ; sa date limite de connaissances est fixée à juin 2026. Le modèle ne génère que du texte.
Pour les requêtes ne dépassant pas 100 000 tokens, Haiku 5.5 est facturé à 0,10 $ par million de tokens en entrée et à 0,50 $ par million de tokens en sortie, les lectures en cache étant facturées à 0,01 $ et les écritures en cache à 0,125 $ par million. Pour les requêtes de plus de 100 000 tokens, les tarifs sont de 0,50 $ pour l’entrée, 2,50 $ pour la sortie, 0,05 $ pour les lectures en cache et 0,625 $ pour les écritures en cache par million de tokens. Haiku 4.5 était facturé à 1,00 $ en entrée, 5,00 $ en sortie, 0,10 $ pour les lectures en cache et 1,25 $ pour les écritures en cache par million de jetons, tandis que Claude Sonnet 5.5 est facturé à 2,00 $ en entrée, 10,00 $ en sortie, 0,10 $ pour les lectures en cache et 2,50 $ pour les écritures en cache.
Anthropic a indiqué que le fonctionnement de Haiku 5.5 coûte en moyenne environ 75 % moins cher que celui de Haiku 4.5, et une note de bas de page explique le fondement de ce chiffre : le prix catalogue est inférieur de 90 % à celui de Haiku 4.5 pour les requêtes allant jusqu’à 100 000 tokens et de 50 % pour les requêtes dépassant ce seuil, et environ 90 % des requêtes Haiku 4.5 relevaient du niveau tarifaire inférieur. La note de bas de page précise également que le calcul tient compte d’un tokeniseur mis à jour, similaire à celui utilisé dans Sonnet 5.5 et Opus 5.5, ce qui signifie que Haiku 5.5 utilise légèrement plus de tokens pour effectuer une tâche donnée.
Cette annonce intervient alors qu'un rapport a révélé que les abonnements à Claude d'Anthropic offriraient un bien meilleur rapport qualité-prix que ChatGPT d'OpenAI. Selon une étude menée par SemiAnalysis, Claude affiche une valeur équivalente aux API d'environ cinq fois supérieures. Bien que ces abonnements individuels soient subventionnés par les entreprises d'IA, l'utilisation intensive des ressources informatiques pose des difficultés majeures pour la rentabilité. Ainsi, les grandes entreprises peinent souvent à maîtriser leur budget en raison de l'augmentation des coûts liés aux tokens utilisés et du nombre élevé d'employés. Certaines d'entre elles adoptent une stratégie hybride plus économique.
Dans le même temps, Anthropic prévoit d’avertir les investisseurs potentiels lors de son introduction en bourse que l’IA avancée pourrait présenter des « risques catastrophiques ou existentiels pour l’humanité », un avertissement extraordinaire de la part d’une entreprise cherchant à tirer profit de cette même technologie. L’entreprise, qui se positionne comme un laboratoire d’IA privilégiant la sécurité, a consacré environ 80 pages du corps principal de 261 pages de son prospectus à la présentation des facteurs de risque, soit près du double des 48 pages consacrées à la description de son activité. Anthropic vise une valorisation de 2 000 milliards de dollars, bien qu'elle fasse état de pertes croissantes, de coûts d'investissement élevés et de problèmes de sécurité.
Voici l'annonce d'Anthropic :
Présentation de Claude Haiku 5.5 : le petit modèle le moins cher, le plus rapide et le plus performant que nous ayons jamais commercialisé.
Claude Haiku 5.5 est conçu pour les tâches à haut volume et à coût maîtrisé. Il gère de manière fiable les charges de travail rapides et répétitives (telles que les résumés, les compressions, les requêtes de bases de données et les demandes de classification). Il s’associe parfaitement à Opus 5.5 et Sonnet 5.5 en tant que sous-agent pour les tâches de codage. De plus, comme il s’agit également de notre modèle le plus rapide à ce jour, il est particulièrement adapté aux tâches où la rapidité est essentielle, telles que l’assistance client en direct et l’utilisation d’un navigateur.
Haiku 5.5 est disponible à un prix bien inférieur à celui de Haiku 4.5. En moyenne, son coût d’exploitation est désormais réduit d’environ 75 %.²
Parallèlement à ce lancement, nous apportons des améliorations à la valeur de notre gamme de modèles. Nous divisons par deux le prix des lectures de cache de Claude Sonnet 5.5, ce qui signifie que Sonnet 5.5 coûte désormais environ 20 % moins cher pour la plupart des tâches liées aux agents. Et nous introduisons un nouveau crédit API mensuel pour nos abonnés Claude Max et Team, conçu pour aider nos utilisateurs à créer de nouveaux agents et applications fonctionnant sur la plateforme Claude.
Performances
Voici les performances de Claude Haiku 5.5 sur une série de tests de référence :
Haiku 5.5 est notre premier modèle de la classe Haiku à proposer un paramètre d’effort réglable. Cela signifie que, comme pour nos autres modèles, les utilisateurs peuvent choisir d’optimiser soit le coût, soit l’intelligence. Les graphiques ci-dessous montrent les performances de Haiku 5.5 sur trois tests de performance pour chaque réglage d’effort :
Lors des premiers tests, nos clients ont rapporté des résultats conformes aux améliorations de performances et de coûts indiquées ci-dessus.
Tarification
Le tableau ci-dessous compare les tarifs de Claude Haiku 5.5 à ceux de nos autres modèles. Haiku 5.5 offre un rapport qualité-prix particulièrement intéressant lorsqu’il est utilisé pour des tâches comportant des invites allant jusqu’à 100 000 tokens, ce qui représente environ 90 % des requêtes adressées à notre précédent modèle Haiku.
Sécurité
Alignement. Claude Haiku 5.5 affiche des améliorations majeures dans la quasi-totalité de nos évaluations d’alignement par rapport à Haiku 4.5. Nous avons notamment constaté beaucoup moins de cas de comportements non alignés, ainsi qu’une moindre propension à coopérer en cas d’utilisation abusive. La fiche technique du modèle décrit plus en détail notre processus d’évaluation et ses résultats.
Mesures de sécurité. Conformément à ses capacités, les mesures de sécurité de Haiku 5.5 en matière de cybersécurité sont plus restrictives que celles de Haiku 4.5, mais légèrement moins restrictives que celles que nous avons appliquées à d’autres modèles récents. En matière de cybersécurité, elles autorisent un éventail plus large de tâches défensives que nos mesures de sécurité pour Sonnet 5.5, tout en bloquant les tests d’intrusion et d’autres techniques plus susceptibles d’être utilisées par des attaquants.
Les mesures de sécurité en biologie de Haiku 5.5 sont identiques à celles de Sonnet 5, Sonnet 5.5 et Opus 5. Elles autorisent les questions de recherche en biologie mais restreignent l’accès aux requêtes que nous jugeons susceptibles de causer un préjudice. Les organisations menant des activités plus étendues en biologie et en cybersécurité peuvent postuler à notre programme de vérification des sciences de la vie et à notre programme de vérification cyber.
Disponibilité
Claude Haiku 5.5 est désormais disponible sur toutes les plateformes, notamment Amazon Web Services, Google Cloud et Microsoft Azure. Sur la plateforme Claude, les développeurs peuvent se lancer avec claude-haiku-5-5.
Source : Annonce d'Anthopic
Et vous ?
Pensez-vous que cette annonce est crédible ou pertinente ?
Quel est votre avis sur le sujet ?Voir aussi :
Anthropic lance Claude Sonnet 5.5, qui affiche un bond en avant en termes de performances, notamment en matière de codage, plus de 30 % plus rapide et jusqu'à 30 % moins cher par tâche
La start-up française Mistral AI dévoile un aperçu de Mistral Large 4, un modèle de 1 T présenté comme le système d'IA à poids ouvert le plus puissant hors de Chine
OpenAI lance GPT-6.1 Sol, un modèle moins coûteux presque aussi performant que GPT-6 Astra, en programmation, utilisation de l'ordinateur et tâches professionnelles, pour un cinquième du prix
Vous avez lu gratuitement 132 articles depuis plus d'un an.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.