Actu

La famille Claude s’agrandit avec Haiku 5.5, un petit dernier qui compresse les prix

08 octobre 2026

Par Sofian Nouira

Illustration
©Anthropic

Quinze jours après Opus 5.5 et dix après Sonnet 5.5, Anthropic boucle sa gamme Claude 5.5. Et son petit modèle arrive face au GPT-6 Luna d’OpenAI avec un argument massue, à savoir des tarifs en chute libre.

Introduction

Anthropic vient de déployer Claude Haiku 5.5, complétant ainsi la famille Claude 5.5 entamée fin septembre. Et c’est le benjamin de la gamme qui crée la surprise, moins par ses performances, pourtant en nette hausse, que par sa grille tarifaire. Rappelons que Haiku 4.5 avait débarqué 25 % plus cher que Haiku 3.5 (1 dollar en entrée et 5 dollars en sortie par million de tokens, contre 0,80 et 4 dollars), une entorse à la logique voulant que les petits modèles deviennent toujours plus abordables. Cette fois, le mouvement s’inverse, et brutalement.

Une facture divisée par quatre, un prix au token divisé par dix

Sur le papier, la baisse est assez vertigineuse. Pour les requêtes qui restent sous les 100 000 tokens, le prix au token fond de 90 % par rapport à Haiku 4.5. Au-delà de ce seuil, la remise retombe à 50 %. Un plafond moins pénalisant qu’il n’y paraît, puisque 90 % des requêtes envoyées à Haiku 4.5 restaient en dessous.

Il y a toutefois une subtilité. Haiku 5.5 adopte un nouveau tokenizer, proche de celui de Sonnet 5.5 et d’Opus 5.5, qui découpe le texte en un peu plus de tokens pour une même tâche. La facture réelle ne fond donc pas tout à fait dans les mêmes proportions que le tarif unitaire. Anthropic avance, calcul maison à l’appui, une note moyenne environ 75 % plus basse qu’avec Haiku 4.5. Quatre fois moins cher à la tâche, donc, plutôt que dix. Autant vous dire que la dégringolade reste conséquente.

GPT-6 Luna dans le viseur

Difficile de ne pas voir dans cette grille une réponse directe à OpenAI. Au lancement de GPT-6 Luna, le 22 septembre, l’éditeur avait divisé par deux le prix de son petit modèle, GPT-5.6 Luna étant jusque-là facturé 0,20 dollar en entrée et 1,20 dollar en sortie. GPT-6 Luna coûte 0,10 dollar en entrée et 0,50 dollar en sortie du million de tokens. Haiku 5.5 s’aligne exactement sur ces montants, au centime près.

Sur les benchmarks publiés par Anthropic, le duel tourne nettement à l’avantage du nouveau venu. Haiku 5.5 décroche 72,4 % sur OSWorld 2.1 (sous-ensemble hors ligne), contre 48,9 % pour GPT-6 Luna et un maigre 15,7 % pour Haiku 4.5. Sur Terminal-Bench 4.0, il affiche 39,2 % quand son concurrent plafonne à 16,4 % et que son prédécesseur n’y arrivait tout simplement pas (0 %). L’écart se resserre sur FrontierCode 1.1, avec 46,4 % contre 42,4 %. Précision qui a son importance, ces chiffres sortent des machines d’Anthropic, avec ses propres réglages, et aucune mesure indépendante n’est encore disponible. GPT-6 Luna est d’ailleurs absent de certains tableaux, dont Humanity’s Last Exam, où Haiku 5.5 bondit de 10,2 % (le score de Haiku 4.5) à 45,9 % sans outils, pas si loin des 56,9 % de Sonnet 5.5.

Le modèle inaugure par ailleurs un réglage d’effort ajustable, une première pour la gamme Haiku, et Anthropic le présente comme son modèle le plus rapide à vitesse standard. Seul Opus 5.5 en mode Fast fait mieux, jusqu’à 2,5 fois sa propre vitesse standard, mais au double du tarif.

Des premiers retours flatteurs

Comme à chaque lancement, Anthropic publie une salve de témoignages clients, sélectionnés par ses soins. Asana y rapporte une latence réduite de plus de 30 % sur les complétions de tâches et une inférence jusqu’à 2,5 fois plus rapide par tour d’agent. AlphaSense, dont l’outil de questions-réponses sur documents encaisse environ 8 millions de requêtes par semaine, a vu son score grimper de 0,76 à 0,84 sur un échantillon de 400 requêtes. HubSpot évoque de son côté 92,8 % sur sa suite d’évaluation CRM, son meilleur résultat à ce jour sur cette batterie de tests. Vous l’aurez compris, Anthropic positionne Haiku 5.5 sur les tâches courtes et répétitives, résumés, classification, requêtes en base de données, support client en direct ou navigation web, en solo ou en sous-agent au service d’Opus 5.5 et de Sonnet 5.5. L’entreprise signale aussi des progrès sur presque toutes ses évaluations d’alignement, avec moins de comportements déviants que Haiku 4.5.

Le lancement s’accompagne de quelques annonces connexes. Le prix des lectures en cache de Sonnet 5.5 est divisé par deux, de 0,20 à 0,10 dollar le million de tokens, ce qui allège d’environ 20 % la plupart des tâches d’agent. Les SDK Python et TypeScript passent en bêta avec la prise en charge de l’utilisation d’ordinateur et de navigateur. Et les abonnés Max récupèrent un crédit API mensuel, 100 dollars pour la formule 5x, 200 dollars pour la 20x, jusqu’à 500 dollars partagés pour les comptes Team.

Haiku 5.5 est disponible dès maintenant via l’API sous l’identifiant claude-haiku-5-5, ainsi que sur Amazon Web Services, Google Cloud et Microsoft Azure, facturé 0,10 dollar le million de tokens en entrée et 0,50 dollar en sortie sous les 100 000 tokens par requête (0,50 et 2,50 dollars au-delà). Haiku 4.5 bascule de son côté dans la liste des anciens modèles, avec un maintien garanti seulement jusqu’au 15 octobre 2026.

À lire aussi

Article rédigé par

Journaliste