abimagestudio - stock.adobe.com
Claude Opus 5.5, GPT-6 Sol et Luna : Anthropic et OpenAI jouent le coup de la baisse des prix
Preuve que la course à l’IA est loin d’être en pause, Anthropic et OpenAI ont annoncé le même jour (le 22 septembre), le lancement respectif de Claude Opus 5.5, GPT-6 Sol et Luna. Les gains de performance sont incrémentaux. En revanche, les deux fournisseurs tentent de réduire leurs tarifs. Avec plus ou moins de succès.
La promesse d’Anthropic est de livrer un modèle plus performant que Claude Fable 5.1 tout en étant 40 % moins cher. Ces gains s’expliquent par le prix du modèle de raisonnement, facturé 4 dollars pour 1 million de tokens en entrée, et 20 dollars pour le même volume en sortie. Une baisse tarifaire de 20 % par rapport à Claude Opus 5 (5/25 dollars pour 1 million de tokens).
Le rabais sur la mise en cache et la lecture atteint 95 %, contre 90 % auparavant. « Les écritures en cache coûtent désormais 5 dollars par million de tokens pour une durée de vie de 5 minutes, contre 6,25 dollars auparavant », note le cabinet Artificial Analysis. « Les lectures en cache ont quant à elles bénéficié d’une réduction supplémentaire et s’élèvent désormais à 0,20 dollar par million de tokens, soit une baisse de 60 % par rapport aux 0,50 dollar d’Opus 5 ».
Claude Opus 5.5 : Anthropic baisse ses prix pour compenser la hausse de la consommation de tokens
Pour autant, l’évaluateur indépendant remarque à nouveau une hausse de la consommation de tokens. Cette fois-ci, elle est multipliée par 1,6. « À niveau d’effort maximum équivalent, Opus 5.5 utilise 119 000 tokens par tâche de notre Intelligence Index, contre environ 73 000 pour Opus 5, quand Fable 5.1 consomme 78 000 tokens et GPT-6 Astra 27 000 », illustre-t-il.
Du même coup, Opus 5.5 coûte 5,98 dollars par tâche, contre 3,26 dollars pour GPT-6 Astra.
Les parangonnages mis à jour indiquent que le coût par tâche d’Opus 5 atteint 5,86 dollars sans fallback, et plus de 8,75 dollars quand ce mode de combinaison de résultats de plusieurs modèles est activé. Vals AI observe de son côté un coût par test de 22,3 dollars avec Claude Opus 5.5, contre 19,09 dollars pour GPT-6 Astra, et 18,81 dollars pour Opus 5.
Le prix est en baisse, mais la consommation de tokens devient de plus en plus problématique. Pour compléter l’ensemble des tests d’Artificial Analysis, Opus 5.5 a consommé 260 millions de tokens, contre 120 millions de tokens pour Opus 5. Les benchmarks sont sensiblement différents, mais la différence semble trop forte pour que cela justifie un tel écart.
Claude Opus 5.5 (max, avec fallback) obtient un score de 58 sur l’Intelligence Index revue et corrigée, contre 53 pour Fable 5.1 et 51 pour Opus 5. Le cabinet attribue à Opus 5.5 les plus hauts résultats sur six des dix évaluations d’Artificial Analysis. Il serait ainsi le meilleur sur les flux agentiques de programmation et les tâches professionnelles.
Chez Vals AI, Claude Opus 5.5 obtient un score de 69,69 %, devant GPT-6 Astra (66,61 %) et Muse Spark 1.3 de Meta (64,53 %). Il gagne des points sur les tâches de programmation et scientifique, mais s’en sort moins bien sur les tests liés à la finance et au secteur légal.
Si la surconsommation de tokens est compensée par la tarification, les entreprises restent à la merci de la hausse. Oui, Anthropic baisse ses prix, mais c’est pour mieux rivaliser avec OpenAI et Google. Les deux acteurs prévoyaient de doubler le prix de certains LLM d’ici au début de l’année prochaine. Leur relative maîtrise des coûts les avantage.
GPT-6 Sol et Luna, deux modèles très compétitifs, mais pas de gains de performance notables
OpenAI a également annoncé une forte baisse des prix de ses modèles GPT-6 Sol et Luna par rapport à leurs équivalents GPT-5.6. Ainsi, le tarif en entrée de GPT-6 Sol est de 2 dollars pour un million de tokens en entrée (contre 4 dollars) et de 10 dollars (contre 20 dollars) pour le même volume en sortie.
Le prix de lecture en cache baisse également de moitié (0,2 dollar contre 0,4 dollar). L’écriture en cache est facturée 2,5 dollars.
GPT-6 Luna est facturé 0,10 centime de dollar pour un million de tokens en entrée et 0,5 centime de dollar en sortie pour le même volume de tokens (contre 0,2 dollar et 0,5 dollar avec GPT-5.6 Luna). Le prix de l’écriture en cache est affiché à 0,125 dollar et la mise en cache revient à 0,01 dollar.
Forcément, « l’exécution d’Intelligence Index avec GPT-6 Sol (max) coûte 1,06 dollar par tâche, soit environ 50 % de moins que GPT-5.6 Sol (max) à 1,99 dollar. GPT-6 Luna (max) coûte 0,07 dollar par tâche, soit environ 60 % de moins que le GPT-5.6 Luna (max), qui coûte 0,18 dollar », note Artificial Analysis. « Cette baisse s’explique par la réduction de prix, car les deux modèles utilisent légèrement plus de tokens de sortie par tâche (31 000 contre 29 000 pour Sol, et 51 000 contre 41 000 pour Luna) ».
Chez Artificial Analysis, GPT-6 Luna et Sol affichent des scores très proches de ses équivalents de la collection GPT-5.6. Chez Vals AI, GPT-6 Sol coûte 7,5 dollars par test et GPT-6 Luna revient à 0,41 dollar par tâche.
Sur son benchmark Vals Index, GPT-6 Sol obtient un score de 62,57 % et GPT-6 Luna atteint 58,45 %, contre 63,71 % pour GPT-5.6 Sol et 59,88 % pour GPT-5.6 Luna. GPT-6 Sol et Luna sont proches de leurs aînés, mais inférieurs. Les pertes principales se jouent sur les sujets académiques et légaux. Selon Vals AI, GPT-5.6 Sol et Luna demeurent plus chers (14,21 dollars et 0,76 dollar par test).
OpenAI et Anthropic tentent là de faire amende honorable, en réagissant aux plaintes des entreprises concernant les coûts de l’IA. Ils assurent tous les deux que les réductions sont imputables à l’amélioration de l’inférence. Néanmoins, OpenAI a l’avantage sur ce versant.
En revanche, OpenAI ne pipe pas mot sur la sûreté de ses LLM. Anthropic assure de son côté que les laboratoires METR et Frontier Design ont participé à la revue d’Opus 5.5. Il aurait subi les « tests plus élaborés » et afficherait les meilleurs résultats. Plus résistant qu’Opus 5, le fournisseur a tout de même renforcé ses filtres. Une déclaration à éprouver dans le monde réel.
