Getty Images
Claude Haiku 5.5 : Anthropic tente de rattraper OpenAI sur le segment « low-cost »
Claude Haiku 5.5 complète la dernière collection en date d’Anthropic. Un an après Haiku 4.5, le fournisseur démontre des gains de performance notable pour son modèle au prix d’entrée le plus bas. Il peine en revanche à égaler le rapport performance-prix des concurrents chinois et GPT-6 Luna d’OpenAI.
Un an après Haiku 4.5, Anthropic lance enfin un « petit » modèle au sein de sa collection Claude 4.5. Comme son concurrent OpenAI, le fournisseur ne communique pas sur le nombre de paramètres de ses réseaux de neurones.
« Haiku 5.5 est conçu pour les tâches à haut volume et où le coût est un facteur déterminant », affirme Anthropic. « Il gère de manière fiable les tâches rapides et répétitives telles que les résumés et la classification, et s’associe parfaitement à Claude Opus 5.5 et Sonnet 5.5 en tant que sous-agent pour les travaux de programmation ».
Il ne promet rien de moins qu’une réduction du coût d’exécution de 75 % par rapport à Haiku 4.5, un grand modèle de langage désormais daté.
Évidemment, de telles affirmations sont à prendre avec des pincettes. Le prix d’entrée au million de tokens concerne les prompts de moins de 100 000 tokens. Dans ces conditions, Haiku 5.5 coûte 0,10 dollar pour 1 million de tokens et 0,5 dollar pour le même volume en sortie.
Au-dessus de 100 000 tokens par prompt, le modèle coûte 0,5 dollar pour 1 million de tokens en entrée et 2,5 dollars pour le même volume en sortie. Suivant ce seuil du contexte, la lecture en cache varie entre 0,01 et 0,05 dollar, l’écriture entre 0,125 et 0,625 dollar pour un million de tokens.
Anthropic se veut rassurant : 90 % des requêtes envoyées aux précédents modèles Haiku contenaient moins de 100 000 tokens.
À titre de comparaison, Haiku 4.5 coûte 1 dollar et 5 dollars pour 1 million de tokens en entrée et en sortie. La lecture en cache coûte 0,10 dollar, et l’écriture 1,25 dollar.
Claude Haiku 5.5 : « Petit » modèle, grosse consommation de tokens
Malgré ces changements tarifaires, Artificial Analysis n’observe pas d’économie flagrante. Le coût par tâche de son Intelligence Index avec Haiku 5.5 serait de 0,21 dollar contre 0,28 dollar pour Haiku 4.5.
Cette faible différence s’explique par une consommation de tokens en hausse. Là où Haiku 4.5 avait besoin de 78 millions de tokens pour compléter les tests de l’évaluateur, Haiku 5.5 en requiert 440 millions à son effort maximum. C’est plus que le très gourmand Sonnet 5,5 (420 millions de tokens). Cette hausse est justifiée par le changement de tokenizer, le même qui anime Opus 5.5 et Sonnet 5.5. De surcroît, le prix à la tâche évoqué par Artificial Analysis ne prend pas en compte le dépassement du seuil des 100 000 tokens.
Néanmoins à la tâche, le modèle milieu de gamme génère 197 000 tokens, contre 162 000 tokens attribuables à Claude Haiku 5.5. À noter que le nouveau modèle est doté d’une fenêtre de contexte d’un million de tokens. Haiku 4.5 n’avait le droit qu’à 200 000 tokens.
Entre les deux générations de modèles Haiku, il y a (heureusement) un écart franc. Haiku 4.5 a obtenu un score de 17 points sur l’Intelligence Index d’Artificial Analysis. Haiku 5.5 obtient 43 points, soit deux de plus que Gemini 3.8 Flash et cinq de plus que Mistral Large 4 et GPT-6 Luna. Il reste toutefois derrière les modèles chinois Kimi K3 (44 points) et GLM 5.3 (45).
Claude Haiku 5.5 se distingue surtout sur les tâches professionnelles agentiques où il dépasse Kimi K3 et GLM 5.3 en égalant Muse Spark 1.3 de Meta. Il fait également mieux sur les tâches de programmation que Gemini 3.8 Flash et GPT-6 Luna, mais perd sur les tests factuels. Cela ne veut pas dire que Claude Haiku 5.5 hallucine davantage que ses adversaires : il serait d’ailleurs plus prompt à signaler son ignorance d’un sujet, note Artificial Analysis.
Selon Anthropic cette fois-ci, il ne causerait pas de danger supplémentaire en matière de cybersécurité. En clair, il se comporte comme un LLM de sa catégorie.
Rapport performance-prix : Anthropic peine à égaler OpenAI et les fournisseurs chinois
Il n’en reste pas moins que le rapport performance/prix semble en sa défaveur. GPT-6 Luna consomme trois fois moins de tokens par tâche. À la tâche, le modèle d’OpenAI revient à 0,07 dollar. Tant que le contexte ne dépasse pas les 100 000 tokens, Haiku 5.5 coûte toutefois moins cher que GLM 5.3 Flash (0,25 dollar) et DeepSeek v4.1 (0,27 dollar). Ce n’est pas la même histoire dans les boucles agentiques, ce pour quoi le modèle a été conçu. Là, le prix risque d’être multiplié par 5. De fait, les usages des modèles et les outils qui les entourent ont évolué en un an.
Si tel était le cas, son intérêt face aux modèles chinois s’en trouverait grandement diminué. À la manière de Mistral AI et de Reflection, le fournisseur peut toujours jouer sur la préférence occidentale et sur son écosystème verrouillé, mais très cohérent.
Le fournisseur a tout de même fait l’effort de rédiger un guide de migration pour ses clients qui utiliseraient encore Haiku 4.5.
Tout à fait conscient de cet enjeu de coût, et pour s’attirer les faveurs des startups et des particuliers, Anthropic inclut davantage de crédit pour les appels API à travers les abonnements Max 5x, Max 20x et Team. « Les utilisateurs Max 5x recevront 100 dollars de crédits par mois, les utilisateurs Max 20x recevront 200 dollars, et les abonnés Team recevront jusqu’à 500 dollars, répartis entre tous leurs utilisateurs », précise le fournisseur.
Pour approfondir sur IA appliquée, GenAI, IA infusée
-
IA : Gemini 4 Argon, GPT-6.1 Sol et Claude Sonnet 5.5 sont dans un mouchoir de poche
-
Claude Opus 5.5, GPT-6 Sol et Luna : Anthropic et OpenAI jouent le coup de la baisse des prix
-
GPT-5.6 : OpenAI dégaine des modèles moins chers que ceux d’Anthropic
-
Non, Claude Sonnet 5 n’est pas forcément moins cher qu’Opus 4.8
