Tarifs de Claude Sonnet 5 : le coût réel en 2026

Kurnia Kharisma Agung Samiadjie
Écrit par

Kurnia Kharisma Agung Samiadjie

Katelin Teen
Relu par

Katelin Teen

Dernière modification July 2, 2026

Vérifié par un expert
Illustration des tarifs de Claude Sonnet 5 avec le logo Anthropic

Le tarif de Claude Sonnet 5 en un coup d'œil

Anthropic a lancé Claude Sonnet 5 le 30 juin 2026 comme modèle intermédiaire (« classe Sonnet »), et l'argument principal mis en avant est le rapport valeur/prix : une qualité proche d'Opus sur le code et les tâches agentiques, au prix d'un Sonnet. Voici le chiffre que tout le monde attend.

PériodeEntrée / MTokSortie / MTok
Lancement (jusqu'au 31 août 2026)2 $10 $
Standard (à partir du 1er sept. 2026)3 $15 $

Le tarif standard de 3 $/15 $ est identique à Sonnet 4.6 (et à 4.5, et à Sonnet 4 avant lui). Anthropic a fixé la remise de lancement délibérément, afin que la migration vers Sonnet 5 reste « à peu près neutre en coût » tant que la remise est active, malgré le nouveau tokenizer. Plus de détails sur pourquoi ce bémol compte plus bas.

Pour situer sa place, Sonnet 5 est le choix par défaut au quotidien : c'est le modèle par défaut pour les plans Free et Pro sur Claude.ai, et il est aussi disponible pour les utilisateurs Max, Team et Enterprise, ainsi que pour Claude Code et Cowork. Donc pour la plupart des gens, « quel Claude j'utilise » signifie désormais Sonnet 5, sauf changement manuel.

Le tableau complet des tarifs de Claude Sonnet 5

Le tarif de base n'est que le point de départ. La mise en cache des prompts et le traitement par lots changent beaucoup le calcul réel par requête, surtout pour une charge de support qui réutilise le même contexte de base de connaissances à chaque ticket.

Catégorie de tarifLancement (jusqu'au 31 août 2026)Standard (à partir du 1er sept. 2026)
Entrée de base2 $ / MTok3 $ / MTok
Écriture cache 5 minutes2,50 $ / MTok3,75 $ / MTok
Écriture cache 1 heure4 $ / MTok6 $ / MTok
Lectures et rafraîchissements de cache0,20 $ / MTok0,30 $ / MTok
Sortie10 $ / MTok15 $ / MTok
Entrée API Batch (-50 %)1 $ / MTok1,50 $ / MTok
Sortie API Batch (-50 %)5 $ / MTok7,50 $ / MTok

Tous ces chiffres proviennent de la documentation tarifaire d'Anthropic. Les multiplicateurs de cache sont cohérents sur tous les modèles : une écriture de 5 minutes coûte 1,25x le tarif d'entrée de base, une écriture d'une heure coûte 2x, et une lecture de cache coûte 0,1x. La page produit d'Anthropic évoque « jusqu'à 90 % d'économies avec la mise en cache des prompts et 50 % d'économies avec le traitement par lots ». Deux modificateurs s'ajoutent : l'inférence US uniquement (inference_geo: "us") ajoute un multiplicateur de 1,1x sur toutes les catégories de tokens, et la fenêtre complète de 1M de tokens est facturée au tarif standard par token, sans surcoût de contexte long.

Comment le tarif de Sonnet 5 se compare dans la famille Claude 5

L'intérêt de Sonnet 5 réside dans son rapport prix/capacité, donc il ne prend tout son sens qu'à côté du reste de la gamme. Voici où se situent les tarifs standards.

ModèleEntrée / MTokSortie / MTokContexte
Claude Fable 510 $50 $1M
Claude Mythos 510 $50 $1M
Claude Opus 4.85 $25 $1M
Claude Sonnet 53 $ (2 $ en lancement)15 $ (10 $ en lancement)1M
Claude Sonnet 4.63 $15 $1M
Claude Haiku 4.51 $5 $200K

Ce qui rend le prix du modèle intermédiaire intéressant, c'est que la qualité de Sonnet 5 n'a rien d'intermédiaire. Le propre tableau de benchmarks d'Anthropic le place un cran en dessous d'Opus 4.8, mais nettement au-dessus de Sonnet 4.6, pour 40 % du prix de sortie d'Opus.

Tableau de benchmarks de Claude Sonnet 5 comparant Sonnet 5 à Sonnet 4.6 et Opus 4.8 sur le code agentique, le raisonnement et l'utilisation d'ordinateur, tiré d'Anthropic
Tableau de benchmarks de Claude Sonnet 5 comparant Sonnet 5 à Sonnet 4.6 et Opus 4.8 sur le code agentique, le raisonnement et l'utilisation d'ordinateur, tiré d'Anthropic

Sur SWE-bench Pro (code agentique), Sonnet 5 obtient 63,2 % contre 58,1 % pour Sonnet 4.6 et 69,2 % pour Opus 4.8. Sur OSWorld-Verified (utilisation d'ordinateur), il atteint 81,2 %, tout près des 83,4 % d'Opus 4.8. Anthropic présente les choses ainsi : Sonnet 5 « couvre un éventail bien plus large d'options coût-performance qu'Opus 4.8 » et ses exécutions à effort élevé « peuvent égaler Opus 4.8 sur certaines tâches ». C'est tout l'argument de vente : vous montez l'effort quand vous en avez besoin, et vous payez le tarif Sonnet le reste du temps.

Le piège du tokenizer : même prix par token, facture plus élevée

Voici la ligne budgétaire que la plupart des modèles économiques passent sous silence. Sonnet 5 utilise un nouveau tokenizer (la même famille introduite avec Opus 4.7) qui « produit environ 30 % de tokens en plus pour le même texte ». La note de bas de page de l'annonce de lancement donne une fourchette plus précise, d'environ 1,0x à 1,35x selon le type de contenu.

Schéma montrant le même prompt facturé à 1 000 tokens sur Sonnet 4.6 mais environ 1 300 tokens sur Sonnet 5 à cause du nouveau tokenizer
Schéma montrant le même prompt facturé à 1 000 tokens sur Sonnet 4.6 mais environ 1 300 tokens sur Sonnet 5 à cause du nouveau tokenizer

Donc le prix affiché correspond à Sonnet 4.6, mais une parité par token n'est pas une parité par requête. Le même prompt et la même réponse exacts sont facturés sur davantage de tokens. Anthropic a conçu la remise de lancement pour absorber cet effet afin que la transition reste « à peu près neutre en coût » tant qu'elle est active. Une fois le tarif standard en vigueur au 1er septembre 2026, cette inflation de tokens devient une véritable hausse de coût par requête équivalente par rapport à Sonnet 4.6. Si vous établissez une prévision de dépenses, appliquez le multiplicateur de tokens d'environ 1,0x à 1,35x en plus du tarif, plutôt que de comparer directement les $/MTok affichés. C'est exactement le genre de détail qui peut discrètement ruiner une estimation naïve d'économies de coûts.

Le curseur d'effort est votre véritable levier de coût

Le paramètre effort de Sonnet 5 (low / medium / high / xhigh / max) est le levier pratique pour le coût. Un effort plus élevé signifie plus de tokens de réflexion, donc un coût plus élevé mais une capacité accrue. Il est réglé par défaut sur high sur l'API Claude et Claude Code, et Sonnet 5 est le premier modèle de classe Sonnet à obtenir le nouveau niveau xhigh.

Un curseur allant de low à max montrant qu'un effort plus élevé signifie plus de tokens de réflexion et un coût plus élevé, avec Sonnet 5 en medium à peu près équivalent à Sonnet 4.6 en high
Un curseur allant de low à max montrant qu'un effort plus élevé signifie plus de tokens de réflexion et un coût plus élevé, avec Sonnet 5 en medium à peu près équivalent à Sonnet 4.6 en high

La correspondance d'efficacité donnée par Anthropic mérite d'être connue avant de fixer un réglage par défaut : Sonnet 5 en medium équivaut à peu près à Sonnet 4.6 en high, et Sonnet 5 en high équivaut à peu près à Sonnet 4.6 en max. En clair, vous pouvez souvent baisser d'un niveau d'effort par rapport à 4.6 et obtenir le même résultat avec moins de tokens. Pour une charge à fort volume comme la résolution automatisée de tickets, c'est ce curseur qui détermine votre facture mensuelle réelle, pas le tarif affiché. Anthropic a même relevé les limites de débit sur Chat, Cowork, Claude Code et la Platform, spécifiquement pour accompagner un usage à effort plus élevé.

Ce que Sonnet 5 coûte vraiment par tâche

C'est là que l'argument de valeur devient concrètement discutable. Anthropic et les premiers enthousiastes ont présenté Sonnet 5 comme « le travail d'Opus au prix de Sonnet », et sur le papier c'est vrai. Mais la communauté a rapidement réagi, et cette réaction est la partie vraiment utile pour un acheteur.

Artificial Analysis, un agrégateur de benchmarks tiers reconnu, a rapporté que Sonnet 5 obtenait 53 sur son Intelligence Index et coûtait environ 2,29 $ par tâche sur ce test, et a noté que sans le tarif promotionnel, il peut coûter plus cher par tâche qu'Opus 4.8 sur cet index, car les exécutions de Sonnet 5 à effort élevé consomment beaucoup de tokens.

Claude Sonnet 5 obtient 53 sur l'Artificial Analysis Intelligence Index, mais sans le tarif promotionnel, il coûtera plus cher par tâche qu'Opus 4.8.

C'est la même dynamique tokenizer-et-effort qui se traduit dans un chiffre réel. Tout le monde n'est pas d'accord sur cette lecture, et certains opérateurs reconnus l'apprécient toujours pour le travail quotidien. Wade Foster, PDG de Zapier, a exposé clairement l'argument pratique en sa faveur.

Claude Sonnet 5 est en ligne. Il fait du travail de niveau Opus au tarif de Sonnet. Voici quand l'utiliser.

Les deux affirmations sont vraies, et la clé de résolution est le curseur d'effort. Faites tourner Sonnet 5 en effort low ou medium et il est clairement moins cher par tâche qu'Opus 4.8 pour la plupart des travaux. Poussez-le en xhigh ou max sur des problèmes difficiles et le coût par tâche peut s'inverser. Vérifiez les chiffres exacts à la source avant de les citer, mais la logique de l'arbitrage est claire : le $/MTok affiché ne raconte pas toute l'histoire du coût, et pour une comparaison de coûts, il vous faut aussi le nombre de tokens par tâche.

La question de tarif qui compte vraiment pour les équipes support

Voici où je dois être direct, car c'est l'erreur que je vois le plus souvent chez les équipes. Un modèle moins cher, proche d'Opus, comme Sonnet 5, rend l'idée « on va juste construire notre propre bot de support sur l'API » plus tentante que jamais. Et le modèle est effectivement bon marché maintenant. Mais le modèle n'a jamais été la partie difficile.

Comparaison entre le petit coût en tokens de Claude Sonnet 5 et la pile bien plus haute du coût réel d'un agent de support : récupération d'informations, garde-fous, actions et escalade
Comparaison entre le petit coût en tokens de Claude Sonnet 5 et la pile bien plus haute du coût réel d'un agent de support : récupération d'informations, garde-fous, actions et escalade

J'ai vu un bot à l'air confiant donner discrètement de mauvaises réponses à des clients, c'est pourquoi tout déploiement sérieux est désormais simulé sur des tickets historiques avant de toucher une file en production. Un agent de support auquel vos clients peuvent faire confiance repose sur la récupération d'informations dans vos documents et anciens tickets, un routage basé sur la confiance, des actions réelles dans votre helpdesk, une escalade propre vers des humains, et des tests. Sonnet 5 vous donne un moteur intelligent pour quelques centimes. Il ne vous donne rien de ces 80 % restants.

Donc la question de tarif qui compte n'est pas « 2 $ ou 3 $ par million de tokens ». C'est le coût total par ticket résolu une fois que vous ajoutez la couche applicative, et le temps d'ingénierie pour la construire et la maintenir. C'est ce chiffre qui décide si construire vaut mieux qu'acheter, et c'est presque toujours là que le plan API brute s'effondre. Si vous voulez vérifier vos propres calculs, le guide sur le coût d'un agent de support IA et le ROI du service client IA détaillent tous les deux ce calcul, et le comparatif plus large sur l'IA pour le service client couvre le côté achat.

Essayez eesel

Si vous étudiez le tarif de Sonnet 5 parce que vous voulez un agent IA qui résout des tickets, eesel représente les 80 % que le tarif de l'API n'inclut pas. Il se connecte à votre helpdesk existant, apprend de vos anciens tickets et de votre centre d'aide, et fonctionne avec une tarification à l'usage sans frais par siège, donc votre coût suit les tickets résolus plutôt qu'une licence fixe. Le point que je soulignerais le plus : avant la mise en production, eesel simule l'agent sur des milliers de vos tickets historiques réels afin que vous voyiez le taux de résolution et le coût exact par ticket à l'avance, au lieu de le découvrir en production.

Tableau de bord des rapports eesel AI montrant les analyses de résolution et d'utilisation
Tableau de bord des rapports eesel AI montrant les analyses de résolution et d'utilisation

C'est gratuit à essayer, et vous pouvez le pointer vers vos propres documents en quelques minutes pour voir à quoi ressemble un vrai taux de résolution sur vos tickets, quel que soit le modèle Claude qui tourne dessous.

Questions fréquentes

Combien coûte Claude Sonnet 5 ?
Le tarif de Claude Sonnet 5 est de 3 $ par million de tokens en entrée et 15 $ par million en sortie, avec des tarifs de lancement de 2 $/10 $ jusqu'au 31 août 2026. C'est le coût brut de l'API. Si vous budgétez un bot de support complet, le guide sur le coût d'un agent de support IA montre ce qui vient s'ajouter à la facture.
Le tarif de Claude Sonnet 5 est-il moins cher qu'Opus 4.8 ?
Oui, sur le papier. Sonnet 5 est à 3 $/15 $ contre Opus 4.8 à 5 $/25 $ par million de tokens. Mais au tarif standard et avec un effort élevé, Sonnet 5 peut générer suffisamment de tokens par tâche pour coûter plus cher qu'Opus 4.8 sur certains benchmarks, donc modélisez les tokens, pas seulement le tarif. Voir la présentation complète de Claude Sonnet 5.
Pourquoi le tarif de Claude Sonnet 5 est-il identique à celui de Sonnet 4.6 mais ma facture a augmenté ?
Sonnet 5 utilise un nouveau tokenizer qui compte environ 30 % de tokens en plus pour le même texte, donc le même prompt est facturé sur plus de tokens même si le tarif par token est identique. Revérifiez votre coût réel par conversation plutôt que de réutiliser d'anciennes estimations. Plus d'informations sur le choix du modèle dans le guide sur la plateforme de chatbot IA.
Puis-je faire tourner un agent de support client uniquement avec le tarif de Claude Sonnet 5 ?
Le tarif de l'API ne concerne que le modèle. Un agent en production a aussi besoin de récupération d'informations (retrieval), d'un routage basé sur la confiance, d'actions dans votre helpdesk, d'une escalade et de tests avant la mise en production, ce qui explique pourquoi les équipes qui utilisent l'API brute finissent souvent par reconstruire ce qu'une plateforme d'IA pour le service client propose déjà. Ce comparatif des agents de support IA couvre le côté achat.
Le tarif de Claude Sonnet 5 inclut-il des tarifs batch et cache moins chers ?
Oui. L'API Batch est à -50 % (entrée et sortie), et les lectures de cache sont facturées à 0,1x le tarif d'entrée de base, ce qu'Anthropic annonce pouvoir réduire les coûts jusqu'à 90 % sur du contexte répété. Pour un support à fort volume qui réutilise la même base de connaissances, ces deux points comptent pour les économies de coûts.

Share this article

Kurnia Kharisma Agung Samiadjie

Article by

Kurnia Kharisma Agung Samiadjie

Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.

Related Posts

All posts →
Illustration représentant les forfaits tarifaires et les coûts de Claude Code
AI news

Prix de Claude Code (2026) : forfaits, coût réel, pièges cachés

Claude Code coûte de gratuit à plus de 200 $/mois selon le forfait, mais les données mêmes d'Anthropic situent la dépense réelle des équipes entre 150 et 250 $ par développeur. Voici le détail complet.

Rama Adi NugrahaRama Adi NugrahaJul 10, 2026
Illustration de Claude Sonnet 5 avec le symbole Anthropic et un flux de travail de support
Guides

Claude Sonnet 5 : ce que cela change pour le support client

Claude Sonnet 5 offre une qualité de codage et d'agent proche d'Opus à un prix intermédiaire. Voici ce que le modèle change réellement pour les équipes de support, et ce qu'il ne change pas.

Rama Adi NugrahaRama Adi NugrahaJul 1, 2026
Bannière illustrée pour une analyse des tarifs de GPT-5.6 Sol, le niveau phare de modèle d'OpenAI, avec un motif solaire et des étiquettes de prix
AI news

Tarifs de GPT-5.6 Sol : ce que coûte vraiment le niveau phare d'OpenAI

GPT-5.6 Sol est le niveau phare d'OpenAI à 5$/30$ par million de tokens. Voici le tarif complet, la comparaison avec GPT-5.5, les coûts cachés et où vous pouvez l'utiliser.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 10, 2026
Illustration comparant les alternatives à Claude Sonnet 5, des modèles d'IA de pointe, dans un style aux accents Anthropic
Guides

Les 7 meilleures alternatives à Claude Sonnet 5 en 2026

Les 7 meilleures alternatives à Claude Sonnet 5 en 2026, de GPT-5.6 et Gemini aux modèles à poids ouverts comme GLM-5.2, avec l'avis d'un praticien sur celui à choisir concrètement.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 2, 2026
Bannière de l'avis sur Claude Sonnet 5 avec le logo Anthropic
Guides

Avis sur Claude Sonnet 5 : est-ce le modèle à utiliser vraiment ?

Un avis pratique sur Claude Sonnet 5 : les benchmarks, le piège tarifaire, comment il se compare à Opus 4.8, et si c'est le modèle Claude à utiliser par défaut.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 2, 2026
Bannière présentant les tarifs de GPT-5.6 pour Sol, Terra et Luna
AI news

Tarifs GPT-5.6 : ce que coûtent vraiment Sol, Terra et Luna

Les tarifs de GPT-5.6 pour Sol, Terra et Luna expliqués : les vrais coûts par token, la comparaison avec GPT-5.5, un exemple de facture mensuelle et la place de ChatGPT dans tout ça.

Rama Adi NugrahaRama Adi NugrahaJun 29, 2026
Illustration of a person weighing a small low-cost AI model against a larger caped flagship model on pedestals
Trending

Claude Opus 5 vs Fable 5 : lequel utiliser réellement ?

Fable 5 coûte exactement le double d'Opus 5. J'ai passé en revue les deux system cards, la documentation et les benchmarks indépendants pour déterminer quand ce dollar supplémentaire apporte vraiment quelque chose.

Rama Adi NugrahaRama Adi NugrahaJul 27, 2026
Illustration of a Claude Opus 5 pricing breakdown showing cost per million tokens
Guides

Tarifs Claude Opus 5 en 2026 : coûts API, forfaits, factures réelles

Anthropic a maintenu Opus 5 aux tarifs d'Opus 4.8, mais le thinking est désormais activé par défaut. Voici ce que coûte réellement une exécution de Claude Opus 5 une fois l'effort et le cache pris en compte.

Rama Adi NugrahaRama Adi NugrahaJul 27, 2026
Illustration principale de la comparaison GPT-5.6 face à Claude, deux familles de modèles d'IA en équilibre l'une contre l'autre
Trending

GPT-5.6 vs Claude : quel modèle d'IA l'emporte en 2026 ?

Une comparaison concrète entre GPT-5.6 et Claude : les niveaux Sol/Terra/Luna face à Opus 4.8 et Sonnet 5, sur le prix, les benchmarks, le contexte et les agents de support IA.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 10, 2026

Prêt à recruter votre collègue IA ?

Configuration en quelques minutes. Pas de carte bancaire requise.

Commencer gratuitement