Tarifs de Claude Sonnet 5.5 en 2026 : prix de l'API, forfaits et coûts réels

Rama Adi
Écrit par

Rama Adi

Katelin Teen
Relu par

Katelin Teen

Dernière modification September 29, 2026

Vérifié par un expert
Illustration dessinée à la main d'une équipe examinant une jauge de coût et un graphique en barres sur les tarifs de Claude Sonnet 5.5

En bref

Claude Sonnet 5.5 coûte 2 $ par million de tokens en entrée et 10 $ par million de tokens en sortie, comme Sonnet 5 et exactement la moitié de Claude Opus 5.5 sur l'entrée, la sortie, les écritures de cache et le Batch. Il n'y a aucun supplément de contexte long sur toute la fenêtre de 1M, et il est inclus dans le forfait Claude gratuit.

Le piège, c'est la seule ligne qui n'est pas à moitié prix. Les lectures de cache coûtent 0,20 $ par million sur Sonnet 5.5 comme sur Opus 5.5. Dans les tests d'Artificial Analysis, les lectures de cache représentaient 40 % de la facture de Sonnet 5.5 en effort maximal, et avec ce réglage il coûtait 7,60 $ par tâche contre 5,98 $ pour Opus 5.5. En effort Low et Medium, Sonnet 5.5 est l'option économique et rapide qu'il prétend être. Au-delà de High, Opus 5.5 en Medium donne en général le même score pour moins cher.

Chez eesel, j'écris le code d'intégration qui envoie ces appels d'API, donc je lis les grilles tarifaires par la ligne qui finit sur la facture. Si vous chiffrez Sonnet 5.5 pour une file de support, eesel fait tourner des modèles comme celui-ci dans un collègue de helpdesk IA facturé par ticket traité, de sorte que le curseur d'effort n'apparaît jamais sur votre facture.

Tarifs de Claude Sonnet 5.5 en un coup d'œil

Claude Sonnet 5.5 a été lancé le 28 septembre 2026, et Anthropic a laissé le prix inchangé. Voici la grille complète de l'API tirée de la documentation tarifaire de Claude, par million de tokens, à côté de ses deux plus proches cousins :

Prix par 1M de tokensClaude Sonnet 5.5Claude Opus 5.5Claude Haiku 4.5
Entrée$2$4$1
Sortie (réflexion incluse)$10$20$5
Écriture de cache de 5 minutes$2.50$5$1.25
Écriture de cache de 1 heure$4$8$2
Lecture de cache$0.20$0.20$0.10
Batch entrée / sortie$1 / $5$2 / $10$0.50 / $2.50
Fast modeNon proposé$8 / $40Non proposé
Fenêtre de contexte1M1M200K
Sortie max128K (300K en bêta Batch)128K (300K en Batch)64K
Supplément contexte longAucunAucunn/a
L'onglet API de la page tarifaire de Claude montrant Sonnet 5.5 à 2 $ en entrée, 10 $ en sortie, 0,20 $ en lecture de cache et 2,50 $ en écriture de cache par million de tokens, à côté de Fable 5.1, Opus 5.5 et Haiku 4.5, capturé sur la page tarifaire de Claude
L'onglet API de la page tarifaire de Claude montrant Sonnet 5.5 à 2 $ en entrée, 10 $ en sortie, 0,20 $ en lecture de cache et 2,50 $ en écriture de cache par million de tokens, à côté de Fable 5.1, Opus 5.5 et Haiku 4.5, capturé sur la page tarifaire de Claude

Quelques détails de ce tableau comptent plus qu'il n'y paraît :

  • La réflexion est facturée comme de la sortie. Sonnet 5.5 utilise une réflexion adaptative, donc chaque token de raisonnement coûte 10 $ par million, comme la réponse.
  • L'effort par défaut de l'API est high, d'après la présentation du modèle. Les applications Claude et Claude Code utilisent Medium par défaut. Ce seul réglage change votre facture plus que tout le reste de cette page.
  • Le prompt minimal pouvant être mis en cache fait 512 tokens, donc même un court prompt système de support peut être mis en cache.
  • Le tokenizer est inchangé depuis Sonnet 5, donc le même texte produit le même nombre de tokens. Toute économie vient du fait que le modèle écrit moins, pas d'un comptage plus généreux.

Si vous venez de la génération précédente, rien n'a bougé sur l'étiquette par rapport aux tarifs de Sonnet 5, et il reste en dessous des 3 $ et 15 $ de Claude Sonnet 4.6. L'argument d'Anthropic, c'est que la facture baisse quand même, parce que le modèle termine le même travail avec moins de tokens.

La moitié du prix d'Opus sur toutes les lignes sauf une

Voici la partie que la plupart des résumés tarifaires sautent. Sonnet 5.5 coûte exactement la moitié de Claude Opus 5.5 sur l'entrée, la sortie, les écritures de cache et le Batch. Sur les lectures de cache, il n'est pas moins cher du tout.

Comparaison dessinée à la main des tarifs de Sonnet 5.5 et d'Opus 5.5 par million de tokens, avec l'entrée, la sortie, l'écriture de cache et la sortie Batch à moitié prix et les lectures de cache entourées au même prix de 0,20 $
Comparaison dessinée à la main des tarifs de Sonnet 5.5 et d'Opus 5.5 par million de tokens, avec l'entrée, la sortie, l'écriture de cache et la sortie Batch à moitié prix et les lectures de cache entourées au même prix de 0,20 $

Cela vient du fait qu'Opus 5.5 a reçu un cache exceptionnellement bon marché. Son multiplicateur de lecture de cache est de 0,05x de l'entrée, là où Sonnet applique le 0,1x standard, d'après le tableau du prompt caching. L'entrée d'Opus coûte 4 $, donc 0,05x donne 0,20 $. L'entrée de Sonnet coûte 2 $, donc 0,1x donne aussi 0,20 $. Le même chiffre par deux chemins.

Pour un chatbot qui envoie un prompt et reçoit une réponse, cela ne change presque rien, mais pour un agent, cela compte beaucoup. Chaque tour d'une boucle d'agent renvoie toute la conversation jusque-là, et avec le cache activé, l'essentiel de ce renvoi est facturé en lectures de cache. Plus la session dure, plus cette ligne grossit, et c'est la seule ligne où choisir le plus petit modèle ne vous fait rien économiser.

La communauté l'a repéré dès le jour du lancement :

Hacker News

"Cache read is the same as Opus as well where most agentic workflow cost comes from. Not quite sure where this fits well."

Ce que coûte réellement une exécution réelle

Une grille tarifaire donne le prix d'un token. Elle ne dit pas combien de tokens un modèle dépense pour terminer un travail, et c'est là que Sonnet 5.5 devient intéressant. Artificial Analysis a fait tourner son Intelligence Index à chaque niveau d'effort et a publié le coût mesuré par tâche.

Page du modèle Claude Sonnet 5.5 sur Artificial Analysis en effort maximal, montrant un Intelligence Index de 56, 137,6 tokens de sortie par seconde, 7,60 $ de coût par tâche et 410M de tokens de sortie, capturée sur Artificial Analysis
Page du modèle Claude Sonnet 5.5 sur Artificial Analysis en effort maximal, montrant un Intelligence Index de 56, 137,6 tokens de sortie par seconde, 7,60 $ de coût par tâche et 410M de tokens de sortie, capturée sur Artificial Analysis

La page est franche sur le coût. En effort maximal, Sonnet 5.5 a généré 410M de tokens de sortie sur l'ensemble de l'index contre une médiane de classe de 88M, et le propre résumé d'AA le qualifie de "very verbose". Voici l'échelle complète de la page Sonnet 5.5 d'AA, à côté des lignes correspondantes de sa page Opus 5.5 :

EffortScore Sonnet 5.5Coût par tâche Sonnet 5.5Tokens de sortie par tâcheScore Opus 5.5Coût par tâche Opus 5.5
Low36$0.4113.9k42$0.55
Medium41$0.5919.5k51$1.34
High47$1.0834.5k54$1.82
Xhigh52$2.7473.7k56$3.46
Max56$7.60192.8k58$5.98

En lisant la colonne Sonnet de haut en bas, le coût double à peu près à chaque palier au-dessus de Medium, puis presque triple de Xhigh à Max. En lisant en travers, la tendance s'inverse autour de High. Sonnet 5.5 en effort maximal coûte 27 % de plus par tâche qu'Opus 5.5 au maximum, avec deux points de score en moins. Il a utilisé 193k tokens de sortie par tâche là, contre 119k pour Opus.

Échelle dessinée à la main des niveaux d'effort montrant les scores et le coût par tâche de Sonnet 5.5 et d'Opus 5.5, avec Sonnet Xhigh à 52 pour 2,74 $ entouré face à Opus Medium à 51 pour 1,34 $
Échelle dessinée à la main des niveaux d'effort montrant les scores et le coût par tâche de Sonnet 5.5 et d'Opus 5.5, avec Sonnet Xhigh à 52 pour 2,74 $ entouré face à Opus Medium à 51 pour 1,34 $

La paire sur laquelle je m'attarderais, c'est Sonnet Xhigh contre Opus Medium. Ils obtiennent 52 et 51, et Opus coûte 1,34 $ contre 2,74 $ pour Sonnet. Si vous vous retrouvez à pousser Sonnet 5.5 au-delà de High pour obtenir la qualité voulue, vous finissez par payer plus que ce que coûterait le plus gros modèle à son réglage par défaut.

C'est aussi la lecture honnête de l'affirmation d'Anthropic « jusqu'à 30 % de moins par tâche ». L'annonce de lancement dit que Sonnet 5.5 "complements Opus 5.5 best when running at lower effort settings, where it costs less per task. At higher settings, it can perform comparably at a similar cost." Les chiffres d'AA le confirment exactement.

Où passe l'argent sur une facture d'agent

AA répartit aussi le coût de chaque exécution par type de token, et c'est ici que la ligne des lectures de cache vue plus haut cesse d'être théorique. Pour l'exécution complète de l'Intelligence Index en effort maximal, la facture de Sonnet 5.5 s'est élevée à 8 977 $ :

Barre empilée dessinée à la main répartissant la facture de benchmark de 8 977 $ de Sonnet 5.5 en effort maximal en lectures de cache 3 605 $, écritures de cache 1 195 $, entrée fraîche 71 $ et sortie plus réflexion 4 106 $, avec les lectures de cache indiquées comme facturées au tarif d'Opus
Barre empilée dessinée à la main répartissant la facture de benchmark de 8 977 $ de Sonnet 5.5 en effort maximal en lectures de cache 3 605 $, écritures de cache 1 195 $, entrée fraîche 71 $ et sortie plus réflexion 4 106 $, avec les lectures de cache indiquées comme facturées au tarif d'Opus
PosteSonnet 5.5 en MaxPartSonnet 5.5 en MediumPart
Lectures de cache$3,60540%$18026%
Écritures de cache$1,19513%$15522%
Entrée fraîche$711%$7010%
Sortie et réflexion$4,10646%$29542%
Total$8,977$701

Deux choses sautent aux yeux. L'entrée fraîche, la ligne que la plupart des gens imaginent en pensant « tokens d'entrée », est presque nulle, car presque tous les tokens d'entrée d'une exécution d'agent sont une lecture ou une écriture de cache. Et les lectures de cache, la ligne sans remise Sonnet, passent d'un quart de la facture en Medium à 40 % en Max, parce qu'une réflexion plus longue signifie plus de tours et plus de relectures.

En mettant les deux modèles côte à côte sur la même exécution, l'écart se réduit, ce qui raconte la même histoire que l'ancienne comparaison Opus 5 vs Sonnet 5. En Medium, l'exécution de l'index avec Sonnet 5.5 a coûté 701 $ contre 1 627 $ pour Opus 5.5, soit 43 % de la facture d'Opus. En Max, Sonnet a coûté 8 977 $ contre 8 708 $ pour Opus. La moitié du prix affiché, 3 % de plus sur la facture.

Exemples chiffrés pour trois types de charge

Les benchmarks correspondent à la charge de travail de quelqu'un d'autre, voici donc le calcul à partir de la grille pour trois cas courants, en utilisant uniquement les prix publiés. Considérez les nombres de tokens comme illustratifs, et saisissez les vôtres dans le calculateur ci-dessous.

1. Un bot de réponse au support. Chaque réponse envoie 8 000 tokens d'entrée, dont 6 000 de prompt système et d'articles d'aide en cache, et reçoit 1 500 tokens en retour, réflexion comprise.

  • Sonnet 5.5 : 0,004 $ d'entrée fraîche + 0,0012 $ de lectures de cache + 0,015 $ de sortie = environ 2 centimes par réponse, soit 202 $ pour 10 000 tickets
  • Opus 5.5 : 0,008 $ + 0,0012 $ + 0,03 $ = environ 3,9 centimes, soit 392 $ pour 10 000
  • Haiku 4.5 : 0,002 $ + 0,0006 $ + 0,0075 $ = environ 1 centime, soit 101 $ pour 10 000

La sortie domine ici, donc la moitié de prix de Sonnet sur la sortie se répercute presque entièrement. C'est le cas où Sonnet 5.5 est clairement le meilleur achat face à Opus. Pour une vue plus large de ce que coûte le support par IA au-delà du modèle, consultez le guide du coût du service client par IA.

2. Une longue session d'agent. Imaginez un agent de code ou d'exploitation qui fait 30 tours, relit un contexte de 60 000 tokens depuis le cache à chaque tour, ajoute 3 000 tokens frais et en écrit 2 000 par tour.

  • Sonnet 5.5 : 0,36 $ de lectures de cache + 0,18 $ d'entrée fraîche + 0,60 $ de sortie = 1,14 $
  • Opus 5.5 : 0,36 $ + 0,36 $ + 1,20 $ = 1,92 $

Supposons maintenant que Sonnet ait besoin de 40 tours là où Opus en a besoin de 25, ce qui va dans le sens des nombres de tokens d'AA à effort élevé. Sonnet passe à 0,48 $ + 0,24 $ + 0,80 $ = 1,52 $, et Opus à 0,30 $ + 0,30 $ + 1,00 $ = 1,60 $. Le modèle « à moitié prix » n'est plus qu'à 8 centimes du modèle cher.

3. Un job Batch de nuit. Vous extrayez des champs de 10 000 documents à 20 000 tokens d'entrée et 1 000 tokens de sortie chacun, et rien ne nécessite de réponse en temps réel.

  • Sonnet 5.5 en Batch : 200 $ d'entrée + 50 $ de sortie = 250 $
  • Opus 5.5 en Batch : 400 $ + 100 $ = 500 $
  • Haiku 4.5 en Batch : 100 $ + 25 $ = 125 $

Il n'y a ni relectures de cache ni boucle d'agent, donc le rapport de 2x tient assez proprement. Le Batch se cumule aussi avec le prompt caching, d'après la documentation tarifaire.

Estimez votre propre facture mensuelle

Renseignez le nombre de tokens par tâche pour votre charge de travail et voyez ce que coûte chaque modèle par mois. Les écritures de cache sont laissées de côté par souci de simplicité, car avec un cache chaud elles pèsent peu dans une charge régulière.

Si le preset d'agent vous surprend, c'est la ligne des lectures de cache à l'œuvre. Avec 1,8M de tokens en cache par session, Sonnet et Opus paient les mêmes 0,36 $ pour les relectures, et seule la ligne de sortie les sépare encore.

L'effort est le bouton du prix, et le défaut de l'API est high

Anthropic vous laisse régler l'effort par requête, et c'est le levier le plus important sur une facture Sonnet 5.5. Simon Willison a lancé le même prompt SVG à chaque niveau et a publié les coûts dans le fil du lancement :

EffortCoût d'un promptDurée
Low1,6 centime10s
Medium1,8 centime11s
High2,3 centimes17s
Xhigh5,7 centimes41s
Max$1.2815m 40s, et il a échoué

En Max, le modèle a, selon ses mots, "burned through 128,000 thinking tokens (taking 15 minutes to do that) and ran out before it had produced the final SVG". Cela représente un bond de coût de 80x de Low à Max pour un résultat moins bon.

Mon conseil pratique, en tant que personne qui intègre ces appels dans du code de production :

  1. Réglez l'effort explicitement à chaque requête. Le défaut de l'API est high, pas le Medium des applications, donc une intégration naïve démarre un cran au-dessus de la zone économique.
  2. Commencez à Low pour le travail courant comme la classification, l'étiquetage et les réponses courtes, puis montez uniquement là où vos évaluations montrent un vrai écart.
  3. Considérez Xhigh et Max comme un signal pour changer de modèle. Au-delà de High, Opus 5.5 en Medium tend à battre Sonnet en score comme en prix.
  4. Relancez vos tests d'effort si vous migrez depuis Sonnet 5. Anthropic a recalibré les niveaux dans la page des nouveautés, donc les anciens réglages ne se transposent pas.

Le gain est important en bas du cadran. AA a mesuré Sonnet 5.5 en Medium avec un score de 41 pour 0,59 $ par tâche, contre Claude Sonnet 5 en Max avec un score de 38 pour 5,09 $. C'est un meilleur résultat pour environ un neuvième du coût, ce qui est l'argument de mise à niveau qu'Anthropic vend, et il tient la route.

Remises, options et petits postes

Au-delà de l'effort, quatre modificateurs font bouger le prix par token, tous tirés de la documentation tarifaire de Claude :

ModificateurEffet sur Sonnet 5.5Remarques
Prompt cachingLectures à $0.20 (0,1x), écritures à $2.50 (5 min) ou $4 (1 heure)Rentabilisé dès une lecture sur le cache de 5 minutes
API Batch50 % de remise : $1 en entrée, $5 en sortieSe cumule avec le caching ; 300K de sortie avec un header bêta
Inférence réservée aux États-Unis1,1x sur chaque catégorie de tokenActivée avec inference_geo: "us"
Fast modeNon disponibleOpus 5.5 uniquement, à $8 / $40

Les frais d'outils s'ajoutent aux tokens. La recherche web coûte 10 $ pour 1 000 recherches, le web fetch n'a pas de frais supplémentaires, et l'exécution de code est gratuite quand elle est utilisée avec la recherche ou le fetch web, sinon 1 550 heures de conteneur gratuites par mois puis 0,05 $ de l'heure. Sonnet 5.5 ajoute 286 tokens de prompt système dès que des outils sont présents. Les sessions Claude Managed Agents ajoutent 0,08 $ par heure de session en cours en plus des tarifs standard de tokens.

Un coût facile à manquer : l'usage forcé d'outils (tool_choice réglé sur any ou sur un outil nommé) renvoie désormais une erreur 400 sur Sonnet 5.5, d'après les notes de migration. Ce n'est pas un prix, mais si votre bot de support en dépendait, la reprise du travail est un vrai coût du changement. L'article de référence détaille les cinq changements incompatibles.

Claude Free, Pro, Max, Team et Enterprise

Si vous utilisez Sonnet 5.5 dans les applications Claude plutôt que via l'API, vous payez par siège, pas par token. D'après la page tarifaire de Claude :

ForfaitPrixAccès à Sonnet 5.5Remarques
Free$0OuiAnthropic dit "anyone can chat with Claude using Sonnet 5.5"
Pro$17/mois facturé annuellement, $20 au moisOuiAjoute Opus et des crédits d'usage
Max 5x / 20xÀ partir de $100/moisOui5x ou 20x l'usage de Pro, accès prioritaire
Team standard$20/siège/mois en annuel, $25 au moisOuiPour 2 à 150 personnes
Team premium$100/siège/mois en annuel, $125 au moisOui5x l'usage du siège standard
Enterprise$20/siège/mois plus l'usage aux tarifs de l'APIOuiL'usage est facturé aux tarifs de tokens ci-dessus

Deux choses changent le calcul ici. Sur Free et Pro, Sonnet est le modèle que la plupart des gens utiliseront réellement, et les utilisateurs gratuits ont désormais Sonnet 5.5. Sur Enterprise, le prix du siège n'est que le début, car l'usage est facturé aux mêmes tarifs d'API que tout cet article. Le guide des tarifs de Claude et le détail de Claude Pro couvrent les limites d'usage, et le guide des tarifs de Claude Code couvre le côté développeur, où l'effort Medium est le défaut.

Un développeur a bien résumé le partage entre abonnement et API le jour du lancement :

Hacker News

"Sonnet 5.5 might not be useful or necessary in a Claude Code session but it could be good value in the API when you pay per token."

Bedrock, Google Cloud et Foundry

Sonnet 5.5 est arrivé sur tous les grands clouds dès le premier jour, sous le nom anthropic.claude-sonnet-5-5 sur Amazon Bedrock et claude-sonnet-5-5 sur Google Cloud et Microsoft Foundry, d'après la présentation du modèle. La façon dont vous êtes facturé dépend de la porte que vous empruntez :

  • Amazon Bedrock et Google Cloud sont exploités par des partenaires. Ils vous facturent directement à leurs propres tarifs publiés, alors consultez les tarifs de Bedrock avant de supposer la parité. Google publie aussi ses propres tarifs Vertex AI.
  • Claude Platform on AWS et Claude in Microsoft Foundry sont exploités par Anthropic. Ils valorisent votre usage aux prix standard d'Anthropic, appliquent toute remise négociée et convertissent en Claude Consumption Units à 0,01 $ l'unité, facturées à l'heure a posteriori via la marketplace.
  • L'inférence réservée aux États-Unis applique le même multiplicateur de 1,1x sur l'API directe, Claude Platform on AWS et les déploiements US Data Zone de Foundry.

Si vous faites déjà tourner Claude via un cloud, le guide Bedrock et le guide Vertex AI couvrent la configuration.

Comment Sonnet 5.5 se positionne face à GPT-6 Sol et Gemini 3.8 Flash

La comparaison la plus frappante n'est pas au sein de la gamme d'Anthropic. GPT-6 Sol a une grille affichée identique : 2 $ en entrée, 10 $ en sortie, 0,20 $ en entrée en cache, 2,50 $ en écriture de cache, d'après le détail des tarifs de GPT-6 Sol.

Par 1M de tokensClaude Sonnet 5.5GPT-6 SolGemini 3.8 Flash
Entrée$2$2$0.75 (passe à $1.50 le 1er janv. 2027)
Sortie$10$10$3.75 (passe à $7.50)
Lecture de cache$0.20$0.20$0.075
Prime contexte longAucune jusqu'à 1MTarif supérieur au-delà de 272K en entréeAucune
Coût par tâche AA (réglage)$1.08 (high)$1.05 (max)Non comparable
AA Intelligence Index47 (high)48 (max)Non comparable

Les lignes AA sont révélatrices. Sonnet 5.5 en High et GPT-6 Sol en max atterrissent à presque le même score pour presque le même coût par tâche. La différence se joue plutôt aux marges : Sonnet n'a pas de supplément de contexte long, donc un agent de support qui charge une grosse base de connaissances dans le contexte ne franchit pas de falaise tarifaire, alors que Sol le fait au-delà de 272K. Les chiffres AA de Gemini venaient d'une version antérieure de l'index, je les ai donc écartés de la comparaison directe, et les tarifs de Gemini 3.8 Flash doublent en janvier. La comparaison des trois API va plus loin si vous choisissez un fournisseur plutôt qu'un modèle.

Pour les tickets de support en particulier, le classement dépend moins du prix que de la fiabilité sur vos propres données, c'est pourquoi le classement des modèles pour tickets de support place la précision en premier.

Ce que les développeurs disent du prix

La réaction du jour du lancement sur Hacker News portait surtout sur sa position face à Opus. Le point de vue sceptique :

Hacker News

"I feel like sonnet is priced too close to opus right now. If Sonnet 5.5 were half its current price it would make sense to use."

Le point de vue mesuré, qui correspond à l'échelle AA ci-dessus :

Hacker News

"Per the charts, there is largely no point to using Sonnet 5.5 at high+ as opus low generally will give similar performance at similar or lower cost."

Et le point de vue enthousiaste, d'un utilisateur qui le compare au modèle phare d'OpenAI à un réglage plus bas :

Reddit

"Sonnet 5.5 medium scores better than gpt 5.6 Sol high and is less than 1/5 the cost Absolutely bonkers"

Le schéma sur lequel les gens revenaient sans cesse était une configuration partagée : Sonnet 5.5 en Low ou Medium pour le travail à gros volume en tant que sous-agent, avec Opus 5.5 pour orchestrer ou finir les parties difficiles. Si aucune de ces options ne convient, le panorama des alternatives à Claude couvre d'autres pistes. Cela correspond à la tarification, puisque la remise de Sonnet est réelle sur les appels à forte sortie et contexte court, et s'estompe sur les longues boucles chargées en cache.

Claude Sonnet 5.5 vaut-il 2 $ et 10 $ ?

Oui, en effort Low et Medium, et je n'hésiterais pas là-dessus. Il bat le meilleur score de Sonnet 5 pour une fraction du coût, il coûte moitié moins qu'Opus sur la ligne de sortie qui domine les charges de type chat, et il n'a pas de supplément de contexte long. Pour un bot de réponse au support, un classifieur, une étape de rédaction ou un job Batch de nuit, c'est mon choix par défaut.

C'est un achat moins convaincant dans deux cas. Si votre charge est une longue boucle d'agent, les lectures de cache rongent la remise car elles coûtent pareil sur les deux modèles. Et si vous avez besoin de Xhigh ou Max pour obtenir la qualité voulue, Opus 5.5 en Medium est généralement moins cher pour le même score. Testez d'abord Sonnet en Low, mesurez, puis décidez si l'écart vaut 1,34 $ par tâche.

Si le travail est une file de support, un coût de plus doit entrer dans le calcul : planifier une dépense qui varie avec l'effort et le volume. Un acheteur lors des appels commerciaux d'eesel a atteint 200 interactions en une seule journée de test et s'est immédiatement inquiété du coût par interaction à grande échelle. Les factures au token rendent cette inquiétude plus difficile à lever, car le même ticket peut coûter 1,6 centime ou 1,28 $ selon un réglage.

Essayez eesel pour une facture fixe par ticket

Sonnet 5.5 est le moteur. Si ce que vous voulez, ce sont des tickets traités, eesel est l'employé : un collègue de helpdesk IA qui se branche sur Zendesk, Freshdesk, Gorgias et vos autres outils, apprend de vos anciens tickets et de votre centre d'aide, et vous laisse le simuler sur des tickets historiques avant qu'il ne réponde à un vrai client. Vous ne choisissez jamais de niveau d'effort et ne surveillez pas les lectures de cache. Les tarifs d'eesel sont un forfait mensuel fixe de crédits où un ticket ou un chat traité vaut un crédit, à partir de 299 $ pour 500 crédits, avec un niveau gratuit de 100 crédits pour essayer.

Si vous travaillez dans un terminal, la CLI d'eesel pilote le même collègue. Vous pouvez connecter des intégrations et modifier ses instructions permanentes, mais aussi approuver ou refuser des actions et lire son journal d'activité en JSON. Des agents de code comme Claude Code peuvent aussi l'exécuter, via le serveur MCP du workspace.

Tableau de bord eesel montrant l'activité sur les tickets Zendesk du collègue de helpdesk IA
Tableau de bord eesel montrant l'activité sur les tickets Zendesk du collègue de helpdesk IA

Essayez eesel et voyez ce que coûte votre file par ticket plutôt que par token.

Questions fréquentes

Combien coûte Claude Sonnet 5.5 par million de tokens ?
Le tarif de Claude Sonnet 5.5 sur l'API Claude est de 2 $ par million de tokens en entrée et 10 $ par million de tokens en sortie. Les lectures de cache coûtent 0,20 $, les écritures de cache de 5 minutes 2,50 $ et celles de 1 heure 4 $. Les tokens de réflexion sont facturés comme de la sortie. La liste complète se trouve dans le guide des tarifs de l'API Anthropic.
Claude Sonnet 5.5 est-il plus cher que Claude Sonnet 5 ?
Non. La grille est identique aux tarifs de Sonnet 5, 2 $ et 10 $, avec le même tokenizer. Anthropic affirme qu'il coûte jusqu'à 30 % de moins par tâche car il termine avec moins de tokens, et Artificial Analysis a mesuré Sonnet 5.5 en effort moyen battant Sonnet 5 en effort maximal pour environ un neuvième du coût par tâche.
Claude Sonnet 5.5 coûte-t-il la moitié de Claude Opus 5.5 ?
Sur l'entrée, la sortie, les écritures de cache et le Batch, oui. Sur les lectures de cache, non : les deux coûtent 0,20 $ par million. Les charges de travail d'agents dépensent une grande part de leur facture en lectures de cache, donc l'écart réel par tâche est généralement inférieur à 2x. Consultez les tarifs de Claude Opus 5.5 pour l'autre côté de la comparaison.
Quelle est la façon la moins chère d'utiliser Claude Sonnet 5.5 ?
Gardez l'effort sur Low ou Medium, mettez en cache votre prompt système stable et passez tout ce qui peut attendre par l'API Batch à 1 $ et 5 $. Ces trois leviers réduisent le coût de Claude Sonnet 5.5 bien plus que n'importe quel choix de forfait. Pour les tickets plus simples, Haiku 4.5 coûte encore moitié moins.
Puis-je utiliser Claude Sonnet 5.5 gratuitement ?
Oui, dans les applications Claude. Sonnet est inclus dans le forfait Free, et Anthropic indique que tout le monde peut discuter avec Sonnet 5.5 sur Claude.ai. Les forfaits payants ajoutent davantage d'usage, à commencer par Pro à 17 $ par mois avec facturation annuelle. Le guide des tarifs de Claude Pro détaille les limites.
Claude Sonnet 5.5 facture-t-il un supplément pour le contexte long ?
Non. La fenêtre de contexte complète de 1M de tokens est facturée au tarif standard, donc une requête de 900k tokens paie le même prix par token qu'une de 9k. C'est différent des tarifs de GPT-6 Sol, qui bascule vers un tarif de contexte long plus élevé au-delà de 272K tokens d'entrée.
Combien coûte Claude Sonnet 5.5 sur Amazon Bedrock ou Google Cloud ?
Sonnet 5.5 est disponible sur Bedrock, Google Cloud et Microsoft Foundry dès le premier jour, mais les clouds partenaires vous facturent à leurs propres tarifs publiés. Claude Platform on AWS et Claude in Foundry facturent aux tarifs standard d'Anthropic convertis en unités de consommation à 0,01 $ l'unité. L'inférence réservée aux États-Unis ajoute un multiplicateur de 1,1x. Le guide de configuration de Bedrock couvre la partie technique.
Combien coûterait Claude Sonnet 5.5 pour un bot de support client ?
Avec un prompt de 8 000 tokens (dont 6 000 en cache) et 1 500 tokens de sortie, une réponse coûte environ 2 centimes, soit environ 200 $ pour 10 000 tickets avant les écritures de cache. Le niveau d'effort fait bouger ce chiffre plus que tout le reste. Si vous préférez payer par ticket plutôt que par token, les tarifs d'eesel facturent chaque ticket traité comme un crédit.

Share this article

Rama Adi

Article by

Rama Adi

Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.

Related Posts

All posts →
Illustration of a Claude Opus 5 pricing breakdown showing cost per million tokens
Guides

Tarifs Claude Opus 5 en 2026 : coûts API, forfaits, factures réelles

Anthropic a maintenu Opus 5 aux tarifs d'Opus 4.8, mais le thinking est désormais activé par défaut. Voici ce que coûte réellement une exécution de Claude Opus 5 une fois l'effort et le cache pris en compte.

Rama AdiRama AdiJul 27, 2026
Une illustration comparant Claude Mythos 5.1 et Fable 5.1 comme le même modèle sous-jacent derrière des couches de garde-fous différentes
Trending

Avis sur Claude Mythos 5.1 : le modèle frontière verrouillé d'Anthropic vaut-il la course ?

Un avis pratique sur Claude Mythos 5.1 : ce que c'est, comment il se compare à Fable 5.1, le vrai prix de la lecture de cache, qui peut réellement y accéder, et ce que j'utiliserais à la place.

Kurnia KharismaKurnia KharismaSep 8, 2026
Une illustration d'une porte de coffre-fort ouverte par une petite liste approuvée de chercheurs, représentant l'accès sur invitation uniquement à Claude Mythos 5.1
Trending

Claude Mythos 5.1 : ce que c'est, qui y a accès, et que faire tourner à la place

Claude Mythos 5.1 est sorti le 1er septembre 2026, et presque personne ne peut y accéder. Voici la vraie fiche technique, les deux programmes d'accès, et le modèle que vous devriez réellement utiliser.

KiraKiraSep 2, 2026
Illustration dessinée à la main d'un agent de support devant un ordinateur portable qui vide rapidement une pile de tickets, pour un article sur Claude Sonnet 5.5
Trending

Claude Sonnet 5.5 : même prix, moins de tokens et 5 changements qui cassent la compatibilité

Claude Sonnet 5.5 conserve le prix de Sonnet 5 (2 $/10 $) mais fait le même travail avec beaucoup moins de tokens. Ce qui a changé, ce qui casse et ce que cela signifie pour le support.

Riellvriany IndriawanRiellvriany IndriawanSep 29, 2026
Image de bannière pour le test de Claude Sonnet 4.6 : Le juste milieu entre performance et prix
Guides

Test de Claude Sonnet 4.6 : Le juste milieu entre performance et prix

Claude Sonnet 4.6 d'Anthropic surpasse sa catégorie de poids avec des performances de codage de niveau supérieur, une fenêtre contextuelle de 1 million de jetons et des améliorations significatives par rapport à Sonnet 4.5.

Stevia PutriStevia PutriFeb 26, 2026
Deux personnes examinant des compteurs de tokens, des grilles tarifaires par million de tokens et une longue facture imprimée
Trending

Tarifs de l'API Anthropic en 2026 : tous les tarifs et les vrais leviers de coût

La grille tarifaire complète de l'API Anthropic pour chaque modèle Claude, plus les quatre multiplicateurs qui déterminent votre facture réelle : mise en cache, batch, effort et deux majorations.

Kurnia KharismaKurnia KharismaAug 13, 2026
Un guide complet sur les tarifs de Claude Opus 4.5
Guides

Tarifs Claude Opus 4.5 2026 : Coûts API et forfaits

Vous envisagez d'utiliser Claude Opus 4.5 ? Nous détaillons les tarifs de l'API à 5 $/25 $, comparons le modèle à GPT-5.1 et Gemini 3 Pro, et vous montrons comment optimiser vos coûts.

Kenneth PanganKenneth PanganJan 6, 2026
Tarifs Kling AI (2026) : un guide complet des forfaits, des crédits et des coûts réels
Uncategorized

Tarifs Kling AI (2026) : un guide complet des forfaits, des crédits et des coûts réels

Une analyse complète des cinq niveaux de tarification de Kling AI, du fonctionnement réel du système de crédits, des coûts de l'API, des packs complémentaires et d'une comparaison directe avec Runway, Pika et Sora.

Riellvriany IndriawanRiellvriany IndriawanJun 5, 2026
Un guide pratique de l'API Perplexity AI : ce qu'il faut savoir avant de construire
Guides

L'API Perplexity AI : Ce qu'il faut savoir avant de développer (2026)

L'API Perplexity AI offre des réponses en temps réel avec des citations, mais les coûts cachés et les problèmes de fiabilité la rendent risquée pour le support. Découvrez pourquoi les plateformes d'IA intégrées fonctionnent mieux.

Kenneth PanganKenneth PanganSep 7, 2025

Prêt à recruter votre collègue IA ?

Configuration en quelques minutes. Pas de carte bancaire requise.

Commencer gratuitement