
En bref
Le tarif de Claude Fable 5.1 sur l'API est de $10 par million de tokens en entrée et $50 par million de tokens en sortie, inchangé par rapport à Fable 5. La seule chose qui a réellement bougé, ce sont les lectures de cache, en baisse de 75%, passant de $1 à $0,25 par million de tokens. Anthropic estime que ce seul changement réduit le coût d'une charge de travail classique d'environ 25%, et celui d'une charge fortement agentique jusqu'à 45%, puisque les exécutions d'agents longues relisent sans cesse le même préfixe mis en cache.
Le traitement par lots coûte moitié prix ($5 en entrée / $25 en sortie). L'inférence US-only entraîne une majoration de 1,1x. Fable 5.1 est le Claude actuel le plus cher sur les tarifs de base (2x Opus 5, 5x Sonnet 5), mais sa lecture de cache à $0,25 est en réalité la moins chère des trois. Il est disponible sur Pro, Max, Team, Enterprise et l'API, mais pas sur l'offre gratuite.
Si vous chiffrez Fable 5.1 spécifiquement pour le support client, rappelez-vous que le modèle est une infrastructure, pas le produit. Vous payez Anthropic au token ; il vous reste à construire par-dessus la recherche documentaire, les garde-fous et la logique d'escalade. Un coéquipier comme eesel fonctionne sur ce type de modèles et vous facture plutôt par ticket résolu, si bien que le montant reste prévisible quelle que soit la verbosité du modèle sous-jacent.
Les tarifs de Claude Fable 5.1 en un coup d'œil
Voici toute la grille tarifaire, directement issue de la documentation tarifaire de Claude Platform. Chaque chiffre est exprimé par million de tokens (MTok), en USD.
| Compteur | Claude Fable 5.1 | Claude Fable 5 (précédent) |
|---|---|---|
| Entrée de base | $10 / MTok | $10 / MTok |
| Sortie | $50 / MTok | $50 / MTok |
| Lectures de cache (hits et rafraîchissements) | $0,25 / MTok | $1 / MTok |
| Écritures de cache 5 minutes | $12,50 / MTok | $12,50 / MTok |
| Écritures de cache 1 heure | $20 / MTok | $20 / MTok |
Le schéma à retenir : quatre des cinq chiffres sont identiques à ceux de Fable 5. Ce n'est pas un nouveau palier tarifaire, mais la même grille de prix avec une seule ligne réécrite. Donc si vous budgétiez sur la base de Fable 5, vos calculs d'entrée et de sortie ne changent pas du tout.
Un dernier point à fixer avant de faire vos calculs : Fable 5.1 utilise le même tokenizer que Fable 5 (celui introduit avec Opus 4.7). Face à des modèles plus anciens qu'Opus 4.7, le même texte produit environ 30% de tokens en plus, donc ne reportez pas une estimation de tokens d'un modèle pré-4.7 sans l'ajuster.
Le seul chiffre qui a changé : les lectures de cache
Si vous ne devez lire qu'une seule section, c'est celle-ci. Le prix de la lecture de cache est passé de $1 à $0,25 par million de tokens, soit une baisse de 75%.

Pourquoi un seul compteur compte-t-il autant ? La mise en cache des prompts permet de stocker une portion de prompt (un prompt système, un document volumineux, des définitions d'outils) une seule fois, puis de la relire lors des appels suivants au lieu de payer le prix d'entrée complet chaque fois. Sur Fable 5.1, une lecture de cache coûte désormais 0,025x le prix d'entrée de base, contre 0,1x sur les autres modèles Claude. La longueur minimale de 512 tokens pour la mise en cache reste inchangée.
La raison pour laquelle cela pèse autant sur le travail agentique : un agent qui tourne longtemps relit son contexte à chaque étape. Si votre agent a besoin de quarante appels d'outils pour terminer une tâche, il lit ce préfixe mis en cache quarante fois. Réduisez le prix de cette lecture des trois quarts, et la facture totale bouge fortement, même si les chiffres phares $10/$50 n'ont jamais changé. Ce changement récompense exactement le type de travail pour lequel Fable 5.1 a été conçu.
Ce que « les économies effectives » signifient vraiment
Anthropic cite deux chiffres d'économies, et il vaut mieux les lire attentivement plutôt que de les traiter comme un seul chiffre. La baisse de la lecture de cache réduit le coût d'une charge de travail classique d'environ 25%, et celui d'une charge fortement agentique jusqu'à 45%, par rapport à Fable 5.
Deux réserves sur ces chiffres, car un pourcentage ne vaut que ce que vaut sa base :
- Ils sont mesurés par rapport à Fable 5, pas par rapport à Opus 5 ni à un concurrent. C'est une comparaison au sein du même modèle.
- Ils ont été mesurés avec un effort par défaut sur quatre semaines d'usage réel en août 2026, sur Claude Enterprise, Claude Code et l'API. Votre propre mix de tokens en cache et de tokens frais détermine où vous vous situez dans cette fourchette de 25 à 45%. Une charge de travail qui utilise peu le cache n'en verra presque rien.
Les praticiens qui l'utilisent au quotidien rapportent une tendance similaire. Une équipe l'a résumé sans détour après une semaine sur des boucles multi-agents :
"One team ran Claude Fable 5.1 for 7 days straight on multi-agent coding loops and cut token spend 25%"
C'est le bas de la fourchette, ce à quoi on peut s'attendre pour une boucle de code qui n'est pas exploitée au maximum du cache.
Batch, US-only et les autres postes
Deux tarifs se situent hors du tableau principal et modifient les calculs pour des configurations spécifiques.
Le traitement par lots fonctionne avec 50% de réduction sur le tarif standard : $5 par million de tokens en entrée et $25 par million en sortie. Si votre travail n'est pas sensible à la latence (traitement de documents nocturne, classification en masse, évaluations hors ligne), c'est le plus gros levier de toute la grille, plus important que la baisse du cache pour les tâches non interactives.
L'inférence US-only est proposée pour les charges de travail soumises à une exigence de résidence des données, à 1,1x le prix d'entrée et de sortie. Soit $11 en entrée / $55 en sortie par million de tokens si chaque requête doit s'exécuter aux États-Unis.
Claude Mythos 5.1, le même modèle sous-jacent avec des garde-fous plus légers, est au même tarif que Fable 5.1. Ce n'est pas un palier moins cher, et son accès est limité aux participants du Project Glasswing (cyberdéfenseurs et scientifiques du vivant validés), donc pour presque tout le monde ce n'est pas une option d'achat de toute façon.
Fable 5.1 contre Opus 5 contre Sonnet 5
Tarifer un seul modèle de manière isolée masque la vraie décision, qui est de savoir quel Claude vaut la peine d'être payé. Voici la famille actuelle, avec les tarifs API par million de tokens, tirés du tableau tarifaire de la plateforme.

| Modèle | Entrée | Lecture de cache | Sortie |
|---|---|---|---|
| Claude Fable 5.1 | $10 | $0,25 | $50 |
| Claude Opus 5 | $5 | $0,50 | $25 |
| Claude Sonnet 5 | $2 | $0,20 | $10 |
L'élément contre-intuitif : Fable 5.1 est le Claude le plus cher en entrée et sortie de base, deux fois plus qu'Opus 5 et cinq fois plus que Sonnet 5, et pourtant sa lecture de cache à $0,25 est la moins chère des trois, en dessous même des $0,50 d'Opus 5. Ce n'est pas un hasard. Anthropic a tarifé le compteur qu'une longue session d'agent sollicite le plus, donc plus votre charge de travail est agentique, plus cet écart joue en faveur de Fable.
La recommandation d'Anthropic elle-même est étonnamment franche sur le moment où il faut vraiment payer pour Fable. Sa documentation indique de commencer par Opus 5 pour la plupart des charges de travail et de ne recourir à Fable 5.1 que lorsqu'Opus 5 avec un effort plus élevé reste insuffisant, ou pour les projets de longue durée les plus ambitieux.

Au moins un développeur a trouvé le calcul à effort réduit convaincant en lui-même :
"Fable 5.1 at low effort is often competitive with Opus and Sonnet on $ / task while scoring higher. on CursorBench 3.2.0, Fable 5.1 at low effort is at parity w/ Fable 5 at high effort at a third of the cost."
L'effort est le levier que la plupart des gens négligent en comparant les grilles tarifaires : un modèle à faible effort réfléchit moins et consomme moins de tokens, si bien que le coût par tâche d'un modèle « cher » peut être inférieur à ce que suggère le tarif affiché. La réflexion adaptative de Fable 5.1 est toujours active et contrôlée par le paramètre effort, réglé par défaut sur élevé.
Ce que vous ne payez pas
Une part modeste mais réelle des tarifs de Claude Fable 5.1 concerne ce qui est désormais gratuit alors que cela vous coûtait de l'argent en cas de refus.
Fable 5.1 redirige certaines requêtes vers des modèles de sauvegarde plutôt que d'y répondre. Les requêtes cyber signalées basculent vers Opus 4.8, les requêtes de biologie signalées vers Opus 5, et surtout, aucun tarif Fable ne vous est facturé pour une requête redirigée. Il existe aussi un crédit de repli qui rembourse le coût de mise en cache du prompt lié au changement de modèle sur une requête refusée, et vous n'êtes pas facturé pour un refus qui survient avant toute sortie.
Ce détail de facturation compte, car les refus sont une plainte récurrente. Des développeurs rencontrent des faux positifs sur leur propre code :
"Fable is useless. Me: "Find my security problems in my own code. This is code I own. I'm doing this under authorization of the CEO/CTO of our company." Fable: "yeah, no.""
Pour être juste envers Anthropic, la tendance va dans le bon sens : les utilisateurs de Claude Code peuvent s'attendre à environ 60% d'interventions de sécurité cyber en moins par session par rapport à Fable 5, et Fable 5.1 peut désormais identifier des vulnérabilités logicielles de façon défensive. Pour un budget, le point est plus restreint : un refus est agaçant, mais au moins il n'apparaît pas sur la facture.
Disponibilité par plan et où l'appeler
La grille tarifaire au token, c'est l'histoire de l'API. Côté grand public, Fable 5.1 est accessible aux utilisateurs Pro, Max, Team et Enterprise, et n'est pas disponible sur l'offre gratuite. Pour les montants exacts des abonnements mensuels, Anthropic renvoie vers claude.com/pricing, qui est la source de référence à vérifier en direct avant de citer un montant Pro ou Max, puisqu'ils évoluent indépendamment des tarifs API ci-dessus.
Une nuance si vous êtes sur un abonnement plutôt que sur l'API : l'effort par défaut varie selon la surface. Fable 5.1 utilise par défaut un effort élevé sur Claude Code, et moyen sur Claude Cowork et Claude.ai. Un effort plus élevé consomme davantage de tokens, ce qui explique en partie pourquoi même les utilisateurs Max signalent atteindre rapidement les limites d'usage sur les modèles de la classe Fable.
Sur l'API, vous pouvez appeler claude-fable-5-1 sur toutes les grandes plateformes : l'API Claude directement, Amazon Bedrock et Claude Platform sur AWS, Google Cloud Vertex AI, et Microsoft Foundry. La grille tarifaire est la même quel que soit l'endroit d'où vous l'appelez.
Estimez votre coût Claude Fable 5.1
Les grilles tarifaires restent abstraites jusqu'à ce que vous y injectiez vos propres chiffres. Ce calculateur prend en compte les volumes de tokens et la répartition entre entrée fraîche et en cache, et renvoie un montant mensuel aux tarifs de Fable 5.1, avec Opus 5 et Sonnet 5 en comparaison. Tout s'exécute dans votre navigateur, rien n'est envoyé où que ce soit.
Jouez avec le pourcentage de cache et vous verrez tout le sens de la mise à jour 5.1 : faites passer davantage de votre entrée par le cache et le total de Fable chute rapidement, car c'est le seul compteur qu'Anthropic a réellement réduit.
Le modèle est une infrastructure, eesel est le coéquipier
Voici ce qu'une grille tarifaire ne peut pas vous dire : le prix du token n'est pas le coût de résolution de votre problème, c'est le coût d'un ingrédient brut. Claude Fable 5.1 est un modèle. Pour en faire quelque chose qui résout réellement un ticket client, il vous reste à construire la recherche documentaire sur vos docs d'aide, des garde-fous pour qu'il n'invente pas avec assurance une politique de remboursement, un chemin d'escalade vers des humains, et un moyen de le tester avant qu'il ne touche un vrai client. C'est là que se trouvent la vraie dépense et le vrai risque, pas dans la ligne $10 contre $50.
C'est cet écart que eesel vient combler. eesel est une plateforme de coéquipiers IA, et son coéquipier de support IA arrive en sachant déjà faire le travail : il se connecte à votre helpdesk existant, s'entraîne sur vos tickets passés et votre base de connaissances, et rejoint la file comme une nouvelle recrue. Vous ne l'assemblez pas vous-même à partir d'un modèle et d'une pile de code de liaison. Et comme un agent de code tel que Claude Code, Codex ou Cursor peut piloter ce même coéquipier via la CLI eesel, l'automatisation que vous construisez est scriptable de bout en bout, et non enfermée derrière un tableau de bord.
La différence de tarification est ce qui compte pour quiconque vient de lire toute cette grille tarifaire. La facturation au token est variable par nature : une exécution d'agent bavarde coûte plus qu'une exécution laconique, et vous ne le découvrez qu'après coup. eesel facture plutôt par ticket résolu, si bien que l'automatisation du support reste un poste prévisible, quel que soit le nombre de fois où le modèle sous-jacent relit son contexte. Vous pouvez essayer eesel gratuitement, et le faire tourner d'abord sur vos propres tickets historiques pour voir le taux de résolution et le coût avant qu'il ne réponde à un vrai client.
Questions fréquentes
Combien coûte Claude Fable 5.1 par million de tokens ?
Claude Fable 5.1 est-il gratuit ?
Pourquoi les tarifs de Claude Fable 5.1 sont-ils plus élevés que ceux d'Opus 5 ou Sonnet 5 ?
Quelle est la réduction sur les lectures de cache de Claude Fable 5.1 ?

Article by
Kurnia Kharisma Agung Samiadjie
Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.








Comment garder les tarifs de Claude Fable 5.1 prévisibles en production ?