Rawf8 - stock.adobe.com

Fable 5.1 : Anthropic promet des économies, les tests montrent l’inverse

Du fait de sa propension à consommer plus de tokens, Fable 5.1 n’est finalement pas moins cher que Fable 5. En revanche, ses performances en hausse et les contrôles d’audit en font un candidat évident pour les applications des entreprises réglementées.

Hier, Anthropic a lancé Fable 5.1 et Mythos 5.1. Ces deux variantes d’un même modèle se différencient par les filtres de sécurité qui les encadrent. Mythos 5.1 n’est accessible qu’au travers des programmes dédiés aux « partenaires de confiance », dont le projet Glasswing.

Comme son prédécesseur, Mythos 5.1 est spécialisé dans les tâches de cybersécurité et les sciences de la vie (biologie, biologie moléculaire, biochimie, génétique, etc.). Fable 5.1 est accessible publiquement depuis l’assistant Claude, des API et les services des partenaires d’Anthropic. Les deux modèles de raisonnement disposent d’une fenêtre de contexte d’un million de tokens, peuvent générer jusqu’à 128 000 tokens en une fois et ont une date limite de connaissances fixée au mois de juin 2026.

Avec ces mises à jour, Anthropic dit répondre aux demandes de ses clients. Ils se plaignaient des prix des modèles, de la politique de rétention de données associée et des filtres trop sensibles.

Des gains de performance notables, mais des réductions de coût trop belles pour être vraies

Avant tout, le cabinet Artificial Analysis remarque un gain de performance notable. Sur son parangonnage Intelligence Index, Fable 5.1 obtient un score de 66 points, « le plus haut mesuré à ce jour ». Le modèle devance Fable 5 de 4 points (62) et Claude Opus 5 de 3 points (63). GPT-5.6 Sol affiche un score de 61 points, à l’instar de Grok 4.6. Les modèles open weight chinois GLM-5.3 et Kimi K3 ne sont pas loin (60). Les résultats de Fable 5.1 en matière d’IA agentique et d’analytique de données le placent à égalité avec Opus 5.

À noter que, tout comme Fable 5, Fable 5.1 route une partie des requêtes vers Opus 4.8 et Opus 5. Pour Anthropic, cela permet d’optimiser le rapport coût-performance de ses modèles. Lors des évaluations menées par Artificial Analysis, seuls 4 % des tokens de sortie n’ont pas été générés directement par Fable 5.1.

Les prix au volume d’entrée et de sortie de Fable 5.1 et de Mythos 5.1 ne changent pas. Les LLM sont facturés 10 dollars pour 1 million de tokens en entrée et 50 dollars pour la même quantité de tokens en sortie.

Ici, Anthropic baisse de 75 % le prix de la lecture en cache, de 1 dollar à 0,25 dollar par million de tokens. Pour rappel, le mécanisme de cache permet aux LLM de répondre à une requête en s’appuyant sur les échanges traités et stockés.

Dans le cas de Fable 5.1, ce simple ajustement devrait, selon Anthropic, faire baisser de 25 % le prix des charges de travail « typiques », tandis que les flux agentiques de longue haleine devraient coûter 45 % moins cher qu’avec Fable 5. Boris Cherny, créateur et directeur de Claude Code chez Anthropic, explique qu’une session typique avec Fable 5.1 dans l’IDE agentique peut coûter jusqu’à 38 % de moins qu’avec Fable 5.

Les tarifs relatifs à la conservation des données écrites en cache durant 5 minutes (12,5 dollars/M tokens) et 1 heure (20 dollars/M tokens) demeurent identiques.

Selon les tests d’Artificial Analysis, ces affirmations ne se vérifient pas. Au niveau d’effort maximum Fable 5.1 coûte 20 % plus cher à la tâche que son prédécesseur (3,69 dollars vs 3,14 dollars). Cela s’explique par le fait que Fable 5.1 a besoin de générer 1,7 fois plus de tokens pour répondre aux mêmes requêtes.

« La réduction du prix du cache permet d’économiser environ 1,40 dollar par tâche dans le cadre des évaluations agentiques où la majorité des tokens en entrée sont lus en cache », écrivent les analystes. En clair, sans l’ajustement tarifaire, le coût des tâches agentiques serait en large hausse. Le cas de Mythos 5.1 n’est pas étudié, mais l’on peut imaginer qu’il n’y a pas de grande différence de comportement au vu de la proximité des deux checkpoints.

Les fournisseurs de LLM conseillent eux-mêmes d’évaluer les impacts sur un projet avant de changer de modèle. Rien ne vaut donc des évaluations « maison ». Sur le papier, GPT-5.6 demeure plus avantageux, mais c’est aussi une question d’écosystème.

Enterprise Frontier Safeguards : Anthropic laissera les entreprises stocker les données d’audit

Concernant la politique de rétention de données, Anthropic introduit Enterprise Frontier Safeguards (EFS).

Pour rappel, le fournisseur applique une rétention de données de 30 jours pour Fable 5. Par défaut, Fable 5.1 est logé à la même enseigne.

Avec EFS, le fournisseur promet de rétablir la politique zéro rétention pour ces deux modèles et d’aller un peu plus loin. Les données de supervision seront stockées dans l’infrastructure cloud du client sur Amazon S3, Azure Blob Storage ou Google Cloud Storage. Anthropic dit travailler avec d’autres acteurs tiers pour étendre ce service. Les clients pourront utiliser leurs propres clés de chiffrement, politiques d’accès et contrôles d’audit. Le dispositif cible particulièrement les secteurs régulés (finance, santé) et les entreprises soumises au RGPD et à l’AI Act.

Le fournisseur de LLM se chargera de planifier des analyses automatisées des données, du trafic, des activités à partir des données en entrée et en sortie à la recherche d’usages malveillants, illégaux ou de cyberattaques. Les résultats de ces scanners seront transmis aux équipes SOC des entreprises ayant adhéré à EFS, tandis qu’Anthropic obtiendra uniquement la catégorie d’alerte et sa sévérité. LeMagIT imagine que ces métadonnées seront suffisantes pour que le fournisseur respecte ses obligations légales. Dans le cadre de la politique ZDR (Zero Data Retention) actuelle, Anthropic peut conserver jusqu’à deux ans les signaux d’activités considérées comme dangereuses en vue d’une éventuelle transmission aux autorités américaines.

Attention : les entreprises éligibles devront souscrire à cette option EFS. Elles ne paieront que les ressources et les services cloud nécessaires à ces opérations. Un surcoût qu’il faudra anticiper.

EFS a été développé en partenariat avec Goldman Sachs, Morgan Stanley, Citi, Bank of America, Wells Fargo, Comcast, KPMG, Mastercard, Salesforce et Visa. Anthropic dit avoir sollicité 25 entreprises du Fortune 100. EFS devrait être en disponibilité générale d’ici à la fin de l’année.

En ce qui concerne les filtres de sécurité de Fable 5.1, malgré l’introduction de nouvelles mesures, Anthropic a réduit de 60 % la détection de faux positifs. Elle répond là à une plainte récurrente des développeurs. Le modèle peut également être utilisé pour découvrir des vulnérabilités logicielles, mais pas pour les exploiter.

Anthropic a également renforcé ses mesures de cybersécurité et introduit des dispositifs anti-distillation pour protéger ses modèles contre l’exploitation illégitime. Des aspects que LeMagIT détaillera dans un autre article.

Pour approfondir sur IA appliquée, GenAI, IA infusée