
Tarifs Claude Opus 5 en un coup d'œil
Claude Opus 5 a été lancé le 24 juillet 2026, décrit par Anthropic comme un modèle qui « s'approche de l'intelligence de pointe de Claude Fable 5 à moitié prix ». Le tarif API est le même que celui que la gamme Opus applique depuis Opus 4.5.
| Ce que vous payez | Tarif Claude Opus 5 |
|---|---|
| Tokens en entrée | $5 par million |
| Tokens en sortie (thinking inclus) | $25 par million |
| Écriture de cache 5 minutes | $6,25 par million |
| Écriture de cache 1 heure | $10 par million |
| Lecture de cache | $0,50 par million |
| Batch API entrée / sortie | $2,50 / $12,50 par million |
| Mode fast entrée / sortie | $10 / $50 par million |
Inférence US uniquement (inference_geo) | 1,1x sur chaque catégorie de token |
Tous les chiffres ci-dessus proviennent de la documentation tarifaire d'Anthropic. Quelques spécificités qui pèsent sur la facture plus que le tarif lui-même :
- L'ID du modèle est
claude-opus-5sur l'API Claude,anthropic.claude-opus-5sur Bedrock. - Le contexte est de 1M tokens en entrée, 128k tokens en sortie, montant à 300k en sortie sur la Batch API avec un en-tête bêta.
- La date de coupure de connaissance fiable est mai 2026.
- Opus 5 dispose de son propre groupe de limitation de débit. Opus 4.8, 4.7, 4.6 et 4.5 partagent un pool combiné et Opus 5 n'y puise pas, donc déplacer du trafic entre eux ne libère pas de marge.
Si vous comparez cela à la génération précédente, notre guide tarifaire d'Opus 4.5 et le détail d'Opus 4.6 affichent le même tarif, ce qui rend la comparaison de version à version particulièrement propre.
Ce qui vous est réellement facturé
Voici la partie qui surprend ceux qui migrent depuis Opus 4.8. Sur 4.8, une requête qui omettait le champ thinking s'exécutait sans thinking. Sur Opus 5, la même requête exécute l'adaptive thinking, et chaque token de thinking est facturé comme sortie à $25 par million.

Deux effets secondaires à budgéter :
max_tokenscouvre désormais le thinking et la réponse ensemble. Un plafond que vous aviez ajusté serré autour de la réponse visible sur 4.8 peut tronquer la réponse en cours de route sur Opus 5. Le guide de migration d'Anthropic suggère au moins 64k comme point de départ en effort xhigh ou max.- Opus 5 écrit plus long par défaut. Le guide de migration est direct : les réponses visibles comme les livrables écrits sont plus longs que sur 4.8, et baisser l'effort réduit le volume de thinking sans raccourcir de manière fiable la réponse visible. La longueur doit être demandée dans le prompt, pas réglée avec un curseur.
Il y a une troisième ligne de facturation que les gens oublient dans les boucles agentiques : chaque résultat d'outil que vous renvoyez revient comme entrée au tour suivant. Une exécution agentique de 30 étapes paie encore et encore pour la même transcription grandissante, ce qui explique pourquoi le cache compte plus ici qu'en chat. Si votre boucle récupère du contexte via des outils MCP ou des Claude Skills, chacun de ces résultats atterrit du côté entrée de la même facture.
Un modèle, quatre prix
Les mêmes poids et le même ID de modèle peuvent être facturés à quatre tarifs différents selon uniquement la manière dont vous les appelez.

Le cache de prompt est le plus grand levier pour tout ce qui a un préfixe stable. Les écritures coûtent 1,25x l'entrée de base sur le cache 5 minutes et 2x sur le cache 1 heure, et les lectures coûtent 0,1x. La mise à niveau discrète sur Opus 5 se trouve au niveau du plancher : le préfixe minimum cachable descend à 512 tokens, contre 1 024 sur 4.8 et 4 096 sur Opus 4.6. Des system prompts qui étaient silencieusement non cachables auparavant se mettent désormais en cache sans aucun changement de code.
Batch retire 50 % dans les deux sens, et se cumule avec le cache. Si votre charge de travail tolère une file d'attente, c'est de l'argent gratuit.
Le mode fast va dans l'autre sens. Selon la documentation du mode fast, il livre jusqu'à 2,5 fois plus de tokens de sortie par seconde pour exactement le double du prix, et l'échange mérite d'être nommé précisément : à $10 et $50, Opus 5 en mode fast coûte le même prix par token que Claude Fable 5 standard. C'est aussi un aperçu de recherche disponible uniquement sur l'API en première partie, et cela ne fonctionne pas avec Batch.
L'inférence US uniquement ajoute un multiplicateur fixe de 1,1x sur chaque catégorie de token, ce qui donne $5,50 et $27,50.
L'effort est le vrai curseur de prix
C'est la section que je relirais deux fois si je devais dimensionner un budget. Opus 5 prend en charge cinq niveaux d'effort, et la recommandation s'est inversée par rapport à l'ère des 4.x : là où 4.7 et 4.8 conseillaient de démarrer en xhigh pour le travail agentique, Opus 5 recommande de démarrer au niveau high par défaut et de redescendre.

Les chiffres derrière ce conseil viennent de l'exécution par Anthropic de son propre Frontier-Bench v0.1, un benchmark de terminal à 74 tâches qui a succédé à Terminal-Bench 2.1 :
| Effort | Score Frontier-Bench | Remarque sur les tokens |
|---|---|---|
| low | 25 % | 64 % de tokens de sortie en moins |
| high | 39 % | 19 % de tokens de sortie en moins |
| xhigh | 44,4 % | meilleur résultat |
| max | ~43 % | plus de dépense, légèrement pire |
Deux choses ressortent. L'effort max a obtenu un score pire que xhigh tout en coûtant plus cher, et l'effort low a livré bien plus de la moitié du score pour environ un tiers des tokens de sortie. Anthropic explique la baisse de l'effort max sur FrontierCode 1.1 par le fait que le modèle fait « plus de changements que la tâche ne l'exige », ce que le correcteur pénalise.

Lisez ce graphique comme un graphique de prix, pas comme un classement. Tout l'argument de coût d'Opus 5 tient dans le fait que sa courbe se situe au-dessus et à gauche de celle de Fable 5 : il atteint un score plus élevé pour un coût par tentative plus bas. C'est une affirmation plus utile que n'importe quel chiffre de benchmark isolé, et c'est la même forme qu'Anthropic rapporte sur CursorBench, où Opus 5 se situe « à 0,5 % du score maximal de Fable 5, mais à la moitié du coût par tâche ».
Calculez votre propre facture mensuelle
Les tarifs affichés ne deviennent réels que lorsque vous y appliquez votre propre volume. Entrez un mois d'utilisation et voyez ce que font les leviers.
Une réserve que le calculateur ne peut pas modéliser : les nombres de tokens ne sont pas comparables d'une génération à l'autre. Anthropic indique que Claude 4.7 et les versions ultérieures tokenisent le même texte en environ 30 % de tokens en plus par rapport à Sonnet 4.6 et antérieurs, donc une comparaison plate par million contre un modèle plus ancien sous-estime la facture réelle.
Comment Opus 5 se positionne face au reste de la gamme
| Modèle | Entrée / MTok | Sortie / MTok | Contexte | Où il se place |
|---|---|---|---|---|
| Claude Fable 5 | $10 | $50 | 1M | Le plafond de capacité |
| Claude Opus 5 | $5 | $25 | 1M | Codage agentique, travail en entreprise |
| Claude Opus 4.8 | $5 | $25 | 1M | Priority Tier, web fetch |
| Claude Sonnet 5 | $2 (puis $3) | $10 (puis $15) | 1M | Travail à fort volume |
| Claude Sonnet 4.6 | $3 | $15 | 1M | Ancien cheval de bataille |
| Claude Haiku 4.5 | $1 | $5 | 200K | Classification, routage |
La propre recommandation d'Anthropic est de commencer par Opus 5 et de ne monter à Fable 5 que lorsque vous avez besoin du plafond.
Face au reste du marché, nos comparaisons des tarifs Gemini et des tarifs GPT-5.6 placent Opus 5 dans la catégorie « cher mais efficace ». Les confrontations directes dans Gemini 3 Pro et Codex contre Opus 4.6 décrivent toujours la forme de ce compromis, et la comparaison des trois API est le moyen le plus rapide de vérifier un changement.
Deux choses qu'Opus 4.8 conserve et qu'Opus 5 perd, et elles comptent pour la planification : selon les notes de migration, web fetch n'est pas disponible sur Opus 5 et Priority Tier n'est pas pris en charge. Si vous détenez un engagement Priority Tier, cette capacité ne vous suit pas.
Ce que coûtent réellement les charges de travail
Les tarifs sont abstraits. Ce qui suit ne l'est pas.
Une session de codage. L'exemple concret d'Anthropic situe une session Opus 5 d'une heure à 50 000 tokens en entrée et 15 000 en sortie : $0,25 plus $0,375 plus $0,08 de temps d'exécution Managed Agents, soit $0,705. Activez le cache pour 40 000 de ces tokens en entrée et la même session tombe à $0,525, une réduction de 25 % sans aucun changement de comportement.
Un workflow métier. Sur l'AutomationBench de Zapier, Opus 5 a obtenu 24 % à effort medium pour $0,89 par tâche, ce qu'Anthropic qualifie de « nettement supérieur à Claude Opus 4.8 et Fable 5 pour moins de la moitié du coût ».

Une suite d'évaluation complète. À l'autre extrême, Artificial Analysis publie ce qu'ils ont dépensé pour faire tourner leur propre indice :
"In total, it cost $3835.51 to evaluate Claude Opus 5 (Adaptive Reasoning, Max Effort) on the Intelligence Index."
Ce chiffre est le contrepoids honnête de tous les graphiques de coût par tâche ci-dessus. Opus 5 domine ce même indice avec 61 points, classé premier sur 190 modèles, mais il a brûlé 100M tokens de sortie pour y arriver contre une médiane de 63M. L'efficacité par tâche accomplie et la dépense totale sont deux questions différentes, et Opus 5 y répond différemment.

Plusieurs clients en accès anticipé ont chiffré le même effet. Une équipe d'agents juridiques a rapporté 26 % de tokens en moins pour une performance similaire par rapport à Opus 4.8 en max reasoning, et un benchmark de trading a abouti à « environ un septième des tokens de reasoning et moins de la moitié de la latence ». Ces chiffres sont fournis par les fournisseurs et non nommés, il faut donc les pondérer en conséquence, mais la tendance est cohérente sur six témoignages distincts.
Claude Pro, Max, Team et Enterprise
Tout le monde ne se tourne pas vers l'API. Selon le billet de lancement, Opus 5 est le nouveau modèle par défaut sur Claude Max et le modèle le plus puissant sur Claude Pro.
| Forfait | Mensuel | Annuel | Accès à Opus 5 |
|---|---|---|---|
| Free | $0 | $0 | Non, Sonnet et Haiku uniquement |
| Pro | $20 | $17/mois, $200 d'avance | Oui, plus Fable via crédits |
| Max 5x | $100 | Mensuel uniquement | Oui, modèle par défaut |
| Max 20x | $200 | Mensuel uniquement | Oui, modèle par défaut |
| Team (standard) | $25/poste | $20/poste | Oui |
| Team (premium) | $125/poste | $100/poste | Oui, 5x l'usage standard |
| Enterprise | - | $20/poste plus usage | Oui, contexte 500k |
Les prix proviennent de la page tarifaire de Claude. Deux détails qui piègent les acheteurs :
- Les limites sont basées sur des sessions, pas sur des messages. Elles se réinitialisent sur une fenêtre glissante de cinq heures avec des plafonds hebdomadaires par-dessus, et le web, le bureau, le mobile et Claude Code puisent tous dans un pool unique. Il n'y a pas de nombre de messages contre lequel planifier.
- Les forfaits payants débordent sur les tarifs API. En atteignant une limite, vous pouvez activer des crédits d'usage pour continuer à travailler aux tarifs standard, ce qui est le point où les $5 et $25 mentionnés plus haut commencent à s'appliquer à un poste d'abonnement.
Ce modèle de session produit des expériences très différentes sur la même sortie, et l'écart suit presque parfaitement le niveau de forfait. Un utilisateur Max 20x :
"I have now been using Opus 5 only (since I'm out of Fable) for about 7 hours and it drained about 6% of my weekly usage."
Et un utilisateur Pro la même semaine :
"I'm only on the Pro plan but a single prompt with Opus 5 w/ high thinking used 100% of my 5-hour usage limit."
Les deux peuvent être vrais, car une limite de session est un pool de tokens et Opus 5 y puise plus vite à effort élevé. Sur un poste Pro à $20, ce pool est assez petit pour qu'un seul prompt gourmand en thinking l'épuise. La solution pratique à laquelle les gens sont arrivés n'est pas une montée en forfait : c'est de baisser l'effort pour le travail routinier et de réserver high aux tâches qui en ont besoin.
Pour les équipes qui pèsent la voie de l'abonnement contre la dépense API brute, notre guide tarifaire de Claude Code et la visite guidée de Claude Code en entreprise couvrent le calcul des postes. La configuration de modèle dans Claude Code est l'endroit où vous épinglez Opus 5 plutôt que de le laisser choisir automatiquement, et le guide de sélection de modèle couvre le moment où le laisser redescendre vers un niveau moins cher. Si vous hésitez encore à savoir si l'écosystème entier vous convient, notre avis sur Claude et le guide tarifaire de Claude Cowork offrent une vue plus large.
Bedrock, Vertex, Foundry et la subtilité des CCU
Opus 5 est disponible sur toutes les plateformes dès le premier jour, mais la facturation n'est pas identique.
- Amazon Bedrock et Google Cloud sont exploités par des partenaires. Le fournisseur cloud vous facture, et Anthropic renvoie vers les tarifs Bedrock et les tarifs Vertex AI comme source de vérité plutôt que de publier ses propres tarifs.
- Les endpoints régionaux portent une majoration de 10 % par rapport aux endpoints globaux sur les deux clouds.
- Claude Platform sur AWS et Microsoft Foundry facturent en Claude Consumption Units. Elles sont évaluées en USD aux tarifs standard par modèle puis converties à $0,01 par CCU avec un décompte horaire. Votre facture affiche une seule ligne CCU, pas de détail par token.
- Le mode fast est réservé à la première partie. Il n'existe pas sur Bedrock, Google Cloud ou Foundry.
Si votre équipe finance rapproche une facture AWS d'un modèle par token, la conversion CCU est l'endroit où les deux cessent de correspondre.
Ce que disent les développeurs
La réaction de la semaine de lancement s'est presque immédiatement scindée en deux camps, et cette scission porte entièrement sur les tokens, pas sur les tarifs. Le premier camp a fait les calculs et a trouvé que le prix affiché cachait une véritable augmentation.
"At the same levels of thinking it's appears that Opus 5 in it's current form uses about 2x the amount of output tokens to do similar tasks. So per token is the same, but the models don't use the same amount of tokens to do the same task."
Un développeur a dépensé de l'argent réel pour trancher la question. En exécutant la même tâche à différents niveaux d'effort, il a enregistré Opus 5 à $0,41514 en low et $0,801965 en medium, contre $0,210415 pour Opus 4.8 en low :
"At matched effort, Opus 5 spends roughly 2x the output tokens of 4.8."
Des classements tiers ont capté le même signal sous un angle différent :
"Vals Index Opus 4.8 > 5.0 goes from $2.90 to $8.54, for 4% gain ... That is a massive cost increase. Sure, 20% cheaper then Fable, but that is a 3x price increase compared to Opus 4.8 in that test."
Le mécanisme que les gens décrivent sans cesse est le scope creep, le même comportement contre lequel la documentation d'Anthropic met en garde lorsqu'elle recommande de supprimer les instructions de vérification héritées car Opus 5 vérifie son propre travail sans qu'on le lui demande :
"it just reviews every minor change with unnecessary checks that would take a couple minutes to check manually, it wants to spend an hour and spend $25 of tokens"
Le contre-argument est juste et mérite d'être retenu. Le total des tokens brûlés est le mauvais dénominateur si le modèle termine un travail que le moins cher abandonne :
"When we look at some benchmarks that publish the cost per successful task, Claude seems to be way cheaper than I expected. For example on https://livebench.ai/
here the cost per successful task for Opus 5 is lower than Sol."
Et pas mal de gens sont tout simplement satisfaits du changement :
"I switched from 4.8 to 5 yesterday and I'd have to say that I've noticed an improvement, though not hugely perceptible, the model seems to want to do more work per turn, possibly a tiny bit faster, and little less verbose when it isnt necessary to be so."
Ma lecture : les deux camps ont raison, et le désaccord porte en réalité sur le dénominateur contre lequel vous facturez. Si vous mesurez les tokens, Opus 5 est devenu plus cher. Si vous mesurez les tâches terminées, il est devenu moins cher. Lequel des deux décrit votre activité est la vraie question à laquelle cette page tarifaire ne peut pas répondre à votre place.
Claude Opus 5 vaut-il ses $5 et $25 ?
Pour le travail agentique à long horizon, oui, et l'argument ne porte pas vraiment sur le tarif. Opus 5 facture ce que facturait Opus 4.8 tout en obtenant 96,0 % sur SWE-bench Verified et en faisant plus que doubler 4.8 sur Frontier-Bench. Quand une exécution coûte $0,89 et se termine plutôt que $0,40 et échoue deux fois, le modèle moins cher par token n'a jamais été vraiment moins cher.
Trois réserves honnêtes avant de le standardiser :
- Il est verbeux, et la verbosité est facturée à $25. Artificial Analysis le qualifie de « particulièrement cher par rapport à d'autres modèles de prix similaire » et de « notablement lent et très verbeux ». Prévoyez du temps d'ingénierie de prompt pour contrôler la longueur, car l'effort seul n'y suffira pas.
- Les hallucinations ont légèrement évolué dans le mauvais sens. La system card déclare sans détour que le modèle « hallucine légèrement plus d'affirmations factuelles qu'Opus 4.8, malgré une précision globale supérieure ».
- Les modèles moins chers gagnent encore beaucoup de travail. Pour la classification, le routage et la rédaction en masse, Claude Sonnet 5 à 40 % du prix est le meilleur choix, et Haiku est encore meilleur. Si vous comparez les options, notre tour d'horizon des alternatives à Opus 4.6 et les précédentes alternatives à Opus 4.5 couvrent le terrain, avec les tarifs Mistral et les tarifs Groq à l'extrémité la moins chère.
L'endroit où le modèle se place dans une vraie chaîne d'outils est une question distincte de la grille tarifaire. Nos tours d'horizon des assistants de codage IA, des outils développeur Claude et de Cursor sont l'endroit où cela se décide en pratique.
Pour mémoire, mon propre réglage par défaut sur les outils internes est l'effort high avec un cache d'une heure sur le system prompt et Batch pour tout ce qui peut attendre. Cette combinaison ramène la plupart des travaux entre un quart et la moitié de la facture naïve au tarif standard.
Là où la facture de tokens cesse d'être votre problème
Tout ce qui précède suppose que vous voulez posséder la plomberie : la logique de nouvelle tentative, le réglage de l'effort, l'invalidation du cache, le repli quand un classificateur de sécurité refuse une requête. C'est un vrai projet d'ingénierie, et j'ai vu plusieurs clients techniques quitter eesel pour construire exactement cela directement sur l'API Claude.
Certains d'entre eux en sont parfaitement satisfaits. D'autres finissent là où ce client a fini :
"We could try to write our own LLM application but we didn't want to invest our time into that. We wanted something that we would not have to maintain."
Karel, GENERAL BYTES
C'est la décision réelle derrière une page tarifaire Claude Opus 5. Si vous voulez qu'un modèle de pointe réponde aux tickets de support, le tarif des tokens représente peut-être un cinquième du travail. Le reste consiste à l'ancrer dans votre centre d'aide et vos anciens tickets, à le garder silencieux sur les questions qu'il ne devrait pas toucher, et à savoir ce qu'il va faire avant qu'il ne touche une file d'attente en direct.

eesel est exactement cette couche, vendue comme un prix par tâche avec la dépense de modèle déjà incluse, si bien qu'un mois chargé se traduit par plus de tickets traités plutôt que par une facture de tokens à expliquer. Vous pouvez le simuler sur vos propres tickets historiques avant qu'il ne réponde à qui que ce soit, et le connecter en quelques minutes. Essayez eesel gratuitement.
Si le contenu plutôt que le support est votre cas d'usage, la même logique anime notre rédacteur de blog IA, et les guides sur le meilleur LLM pour le blogging et sur comment rendre le contenu IA plus humain sont le point de départ.
Questions fréquentes
Combien coûte Claude Opus 5 par million de tokens ?
Claude Opus 5 est-il plus cher que Claude Opus 4.8 ?
Quel est le moyen le moins cher de faire tourner Claude Opus 5 ?
Le tarif de Claude Opus 5 change-t-il avec la fenêtre de contexte de 1M ?
Combien coûte Claude Opus 5 sur les forfaits Pro et Max ?
Claude Opus 5 ou Claude Sonnet 5, lequel offre le meilleur rapport qualité-prix ?
Qu'apporte le mode fast au tarif de Claude Opus 5 ?

Article by
Rama Adi Nugraha
Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.






