
要点
Claude Sonnet 5.5は入力100万トークンあたり$2、出力100万トークンあたり$10で、Sonnet 5と同じ料金であり、入力、出力、キャッシュ書き込み、BatchについてはClaude Opus 5.5のちょうど半額です。100万ウィンドウ全体で長文コンテキストの追加料金はなく、無料のClaudeプランにも含まれています。
落とし穴は、半額にならない唯一の項目です。キャッシュ読み取りは、Sonnet 5.5もOpus 5.5も100万あたり$0.20です。Artificial Analysisのテストでは、最大エフォートでキャッシュ読み取りがSonnet 5.5の請求額の40%を占め、その設定ではタスクあたり$7.60かかり、Opus 5.5の$5.98を上回りました。LowとMediumのエフォートなら、Sonnet 5.5は謳い文句どおり安くて速い選択肢です。High以上では、MediumのOpus 5.5のほうが、たいてい同じスコアをより安く出せます。
eeselで私は、これらのAPI呼び出しを送る統合コードを書いているので、料金表は請求書に載る行で読みます。サポートキュー向けにSonnet 5.5の費用を見積もっているなら、eeselはこのようなモデルを、対応したチケット単位で課金するAIヘルプデスクのチームメイトの中で動かすため、エフォートの設定が請求額に現れることはありません。
Claude Sonnet 5.5の料金一覧
Claude Sonnet 5.5は2026年9月28日にリリースされ、Anthropicは価格を据え置きました。以下はClaudeの料金ドキュメントにあるAPIの全料金表で、100万トークンあたり、最も近い2つの兄弟モデルと並べています。
| 100万トークンあたりの料金 | Claude Sonnet 5.5 | Claude Opus 5.5 | Claude Haiku 4.5 |
|---|---|---|---|
| 入力 | $2 | $4 | $1 |
| 出力(思考を含む) | $10 | $20 | $5 |
| 5分キャッシュ書き込み | $2.50 | $5 | $1.25 |
| 1時間キャッシュ書き込み | $4 | $8 | $2 |
| キャッシュ読み取り | $0.20 | $0.20 | $0.10 |
| Batch入力 / 出力 | $1 / $5 | $2 / $10 | $0.50 / $2.50 |
| Fast mode | 提供なし | $8 / $40 | 提供なし |
| コンテキストウィンドウ | 1M | 1M | 200K |
| 最大出力 | 128K(Batchベータで300K) | 128K(Batchで300K) | 64K |
| 長文コンテキスト追加料金 | なし | なし | 該当なし |

この表のいくつかの詳細は、一見した印象以上に重要です。
- 思考は出力として課金されます。 Sonnet 5.5は適応型の思考を使うため、推論トークンは1つ残らず100万あたり$10で、回答と同じ料金です。
- APIのデフォルトのエフォートは
highです。モデル概要にそう書かれています。ClaudeアプリとClaude CodeのデフォルトはMediumです。この設定1つが、このページのほかのどれよりも請求額を左右します。 - キャッシュ可能な最小プロンプトは512トークンです。 短いサポート用システムプロンプトでもキャッシュできます。
- トークナイザーはSonnet 5から変わっていません。 同じテキストなら同じトークン数になります。節約はモデルが書く量を減らすことから生まれるのであって、数え方が甘くなったわけではありません。
前世代からの移行なら、定価はSonnet 5の料金から何も動いておらず、Claude Sonnet 4.6の$3と$15より安いままです。Anthropicが訴えているのは、同じ作業をより少ないトークンで終えるため、それでも請求額は下がるという点です。
1項目を除いてOpusの半額
多くの料金まとめが飛ばす部分です。Sonnet 5.5は、入力、出力、キャッシュ書き込み、BatchでClaude Opus 5.5のちょうど半額です。キャッシュ読み取りに限っては、まったく安くなりません。

これは、Opus 5.5のキャッシュが異例に安く設定されたためです。プロンプトキャッシュの表によると、Opusのキャッシュ読み取りの係数は入力の0.05倍で、Sonnetは標準の0.1倍です。Opusの入力は$4なので0.05倍で$0.20になり、Sonnetの入力は$2なので0.1倍でも$0.20になります。同じ数字に、別々の道筋でたどり着いています。
プロンプトを1回送って1回答えが返るチャットボットなら、ほとんど関係ありません。しかしエージェントでは大いに関係します。エージェントループのターンごとに、それまでの会話全体が再送信され、キャッシュが有効ならその再送の大半はキャッシュ読み取りとして課金されます。セッションが長くなるほどこの項目は大きくなり、小さいモデルを選んでも何も節約できない唯一の項目です。
コミュニティは公開初日にこれに気づきました。
"Cache read is the same as Opus as well where most agentic workflow cost comes from. Not quite sure where this fits well."
実際の実行に本当にかかる費用
料金表からわかるのはトークン1つの価格です。モデルが仕事を終えるまでに何トークン使うかはわからず、そこがSonnet 5.5の興味深い点です。Artificial Analysisは、すべてのエフォートレベルでIntelligence Indexを実行し、測定したタスクあたりのコストを公開しました。

このページはコストについて率直です。最大エフォートで、Sonnet 5.5はインデックス全体で410Mの出力トークンを生成しましたが、同クラスの中央値は88Mで、AA自身のまとめでも「very verbose」と評されています。以下はAAのSonnet 5.5ページにある全段階で、Opus 5.5のページの対応する行と並べたものです。
| エフォート | Sonnet 5.5 スコア | Sonnet 5.5 タスクあたりコスト | タスクあたり出力トークン | Opus 5.5 スコア | Opus 5.5 タスクあたりコスト |
|---|---|---|---|---|---|
| Low | 36 | $0.41 | 13.9k | 42 | $0.55 |
| Medium | 41 | $0.59 | 19.5k | 51 | $1.34 |
| High | 47 | $1.08 | 34.5k | 54 | $1.82 |
| Xhigh | 52 | $2.74 | 73.7k | 56 | $3.46 |
| Max | 56 | $7.60 | 192.8k | 58 | $5.98 |
Sonnetの列を上から下に読むと、Medium以上では段階ごとにコストがほぼ倍になり、XhighからMaxではほぼ3倍になります。横に読むと、Highあたりでパターンが逆転します。最大エフォートのSonnet 5.5は、最大エフォートのOpus 5.5よりタスクあたり27%高く、スコアは2ポイント低くなります。そこでは1タスクあたり193kの出力トークンを使っており、Opusの119kを大きく上回っています。

私がじっくり見比べたい組み合わせは、Sonnet XhighとOpus Mediumです。スコアは52と51で、コストはOpusが$1.34、Sonnetが$2.74です。必要な品質を得るためにSonnet 5.5をHighより上げていくと、デフォルト設定の大きいモデルより高くつくことになります。
これはAnthropic自身の「タスクあたり最大30%安い」という主張の正直な読み方でもあります。公開記事には、Sonnet 5.5は"complements Opus 5.5 best when running at lower effort settings, where it costs less per task. At higher settings, it can perform comparably at a similar cost."とあります。AAの数字はまさにそれを裏付けています。
エージェントの請求額でお金が流れる先
AAは各実行のコストをトークンの種類別にも分けており、ここで先ほどのキャッシュ読み取りの項目が理屈でなくなります。最大エフォートでのIntelligence Index全体の実行では、Sonnet 5.5の請求額は$8,977でした。

| 項目 | Sonnet 5.5 Max | 割合 | Sonnet 5.5 Medium | 割合 |
|---|---|---|---|---|
| キャッシュ読み取り | $3,605 | 40% | $180 | 26% |
| キャッシュ書き込み | $1,195 | 13% | $155 | 22% |
| 新規入力 | $71 | 1% | $70 | 10% |
| 出力と思考 | $4,106 | 46% | $295 | 42% |
| 合計 | $8,977 | $701 |
ここから2点が目を引きます。「入力トークン」と聞いて多くの人が思い浮かべる新規入力は、ほぼゼロです。エージェントの実行では入力トークンのほとんどがキャッシュ読み取りかキャッシュ書き込みだからです。そして、Sonnetの割引がないキャッシュ読み取りは、Mediumでは請求額の4分の1なのに、Maxでは40%にまで増えます。思考が長くなるほどターンが増え、再読み込みが増えるためです。
同じ実行で2つのモデルを並べると差は縮まり、古いOpus 5 vs Sonnet 5の比較が語ったのと同じ話になります。Mediumでは、Sonnet 5.5のインデックス実行は$701で、Opus 5.5の$1,627に対してOpus請求額の43%でした。Maxでは、Sonnetが$8,977、Opusが$8,708でした。定価は半額なのに、請求書では3%高くなります。
3つのワークロードでの計算例
ベンチマークは他人のワークロードなので、公開されている価格だけを使って、よくある3つのパターンを料金表から計算します。トークン数は例示として扱い、下の計算ツールにご自身の数字を入れてください。
1. サポート返信ボット。 1回の返信で入力8,000トークンを送り、そのうち6,000はキャッシュされたシステムプロンプトとヘルプ記事です。出力は思考を含めて1,500トークンです。
- Sonnet 5.5:新規入力$0.004 + キャッシュ読み取り$0.0012 + 出力$0.015 = 1返信あたり約2セント、1万チケットで$202
- Opus 5.5:$0.008 + $0.0012 + $0.03 = 約3.9セント、1万チケットで$392
- Haiku 4.5:$0.002 + $0.0006 + $0.0075 = 約1セント、1万チケットで$101
ここでは出力が支配的なので、Sonnetの出力半額がほぼそのまま効いてきます。これはSonnet 5.5がOpusより明らかに良い買い物になるパターンです。モデル以外にAIサポートがいくらかかるかという全体像は、AIカスタマーサービスのコストガイドをご覧ください。
2. 長いエージェントセッション。 コーディングや運用のエージェントが30ターン実行し、毎ターン60,000トークンのコンテキストをキャッシュから再読み込みし、新規トークンを3,000追加し、2,000を書き出すとします。
- Sonnet 5.5:キャッシュ読み取り$0.36 + 新規入力$0.18 + 出力$0.60 = $1.14
- Opus 5.5:$0.36 + $0.36 + $1.20 = $1.92
ここで、Opusが25ターンで済むところをSonnetが40ターン必要だとします。これは高いエフォートでのAAのトークン数が示す方向です。するとSonnetは$0.48 + $0.24 + $0.80 = $1.52、Opusは$0.30 + $0.30 + $1.00 = $1.60になります。「半額」のモデルが、高いモデルと8セント差まで迫ります。
3. 夜間のBatchジョブ。 1万件のドキュメントから、1件あたり入力20,000トークン、出力1,000トークンでフィールドを抽出し、リアルタイムの回答は不要とします。
- BatchでのSonnet 5.5:入力$200 + 出力$50 = $250
- BatchでのOpus 5.5:$400 + $100 = $500
- BatchでのHaiku 4.5:$100 + $25 = $125
キャッシュの再読み込みもエージェントループもないので、2倍の比率がきれいに保たれます。料金ドキュメントによると、Batchはプロンプトキャッシュとも併用できます。
月額を自分で見積もる
ワークロードに合わせてタスクあたりのトークン数を設定すると、各モデルの月額が表示されます。キャッシュ書き込みは、キャッシュが温まった安定運用ではごく一部なので、簡略化のため除外しています。
エージェントのプリセットに驚いたなら、それはキャッシュ読み取りの項目が効いているのです。1セッションあたり180万のキャッシュトークンでは、SonnetもOpusも再読み込みに同じ$0.36を払い、両者を分けるのは出力の項目だけです。
エフォートが価格のつまみで、APIのデフォルトはhigh
Anthropicはリクエストごとにエフォートを設定でき、Sonnet 5.5の請求額に対して最大の手段です。Simon Willisonは同じSVGプロンプトをすべてのレベルで実行し、公開スレッドでコストを投稿しました。
| エフォート | 1プロンプトのコスト | 時間 |
|---|---|---|
| Low | 1.6セント | 10秒 |
| Medium | 1.8セント | 11秒 |
| High | 2.3セント | 17秒 |
| Xhigh | 5.7セント | 41秒 |
| Max | $1.28 | 15分40秒、かつ失敗 |
Maxでは、彼の言葉を借りれば、モデルは"burned through 128,000 thinking tokens (taking 15 minutes to do that) and ran out before it had produced the final SVG"という状態でした。LowからMaxまででコストは80倍に跳ね上がり、結果はむしろ悪化しています。
これらの呼び出しを本番コードに組み込んでいる立場からの、実践的なアドバイスです。
- リクエストごとにエフォートを明示的に設定してください。 APIのデフォルトはアプリで見るMediumではなく
highなので、何も考えない統合は安いゾーンより1段上から始まります。 - 分類、タグ付け、短い返信のような定型作業はLowから始めて、 評価で本当に差が出る箇所だけ引き上げてください。
- XhighやMaxは、モデルを切り替えるべきサインと捉えてください。 High以上では、MediumのOpus 5.5がスコアでも価格でもSonnetに勝る傾向があります。
- Sonnet 5から移行する場合は、エフォートのテストをやり直してください。 Anthropicは新機能ページでレベルを再調整しているため、古い設定は引き継げません。
つまみの下のほうでは、効果が大きく現れます。AAは、MediumのSonnet 5.5がタスクあたり$0.59でスコア41、Claude Sonnet 5の最大エフォートが$5.09でスコア38だと測定しました。約9分の1のコストでより良い結果が出ており、Anthropicが売りにしているアップグレードの話が裏付けられています。
割引、オプション、細かい項目
エフォート以外に、トークンあたりの価格を動かす修飾要素が4つあり、すべてClaudeの料金ドキュメントにあります。
| 修飾要素 | Sonnet 5.5への影響 | 備考 |
|---|---|---|
| プロンプトキャッシュ | 読み取り$0.20(0.1倍)、書き込み$2.50(5分)または$4(1時間) | 5分キャッシュは1回読めば元が取れる |
| Batch API | 50%オフ:入力$1、出力$5 | キャッシュと併用可。ベータヘッダーで出力300K |
| 米国内限定の推論 | すべてのトークン区分で1.1倍 | inference_geo: "us"で設定 |
| Fast mode | 利用不可 | Opus 5.5のみ、$8 / $40 |
ツール料金はトークンに上乗せされます。Web検索は1,000回あたり$10、web fetchに追加料金はなく、コード実行はWeb検索またはfetchと併用する場合は無料で、そうでなければ月1,550コンテナ時間まで無料、その後は1時間$0.05です。Sonnet 5.5は、ツールがあるたびに286個のシステムプロンプトトークンを追加します。Claude Managed Agentsのセッションは、標準のトークンレートに加えて、稼働中のセッション1時間あたり$0.08が加算されます。
見落としやすいコストが1つあります。移行ノートによると、強制的なツール使用(tool_choiceをanyまたは名前付きツールに設定)は、Sonnet 5.5では400エラーを返すようになりました。価格ではありませんが、サポートボットがこれに依存していた場合、作り直しは切り替えの実際のコストです。ハブ記事では5つの破壊的変更をすべて解説しています。
Claude Free、Pro、Max、Team、Enterprise
APIではなくClaudeアプリでSonnet 5.5を使う場合は、トークン単位ではなくシート単位の支払いです。Claudeの料金ページより。
| プラン | 料金 | Sonnet 5.5の利用 | 備考 |
|---|---|---|---|
| Free | $0 | 可 | Anthropicは"anyone can chat with Claude using Sonnet 5.5"と述べている |
| Pro | 年払い月$17、月払い$20 | 可 | Opusと利用クレジットが追加 |
| Max 5x / 20x | 月$100から | 可 | Pro比5倍または20倍の利用量、優先アクセス |
| Team standard | 年払い1シート月$20、月払い$25 | 可 | 2〜150人向け |
| Team premium | 年払い1シート月$100、月払い$125 | 可 | standardシートの5倍の利用量 |
| Enterprise | 1シート月$20 + API料金での利用分 | 可 | 利用分は上記のトークンレートで課金 |
ここで計算が変わる点が2つあります。FreeとProでは、ほとんどの人が実際に使うのはSonnetで、無料ユーザーもSonnet 5.5を使えるようになりました。Enterpriseでは、シート料金は始まりにすぎず、利用分はこの記事全体と同じAPIレートで課金されます。Claude料金ガイドとClaude Proの内訳が利用上限を扱い、Claude Codeの料金ガイドが、Mediumエフォートがデフォルトの開発者向けの側面を扱っています。
公開初日のある開発者が、サブスクリプションとAPIの使い分けをうまく表現していました。
"Sonnet 5.5 might not be useful or necessary in a Claude Code session but it could be good value in the API when you pay per token."
Bedrock、Google Cloud、Foundry
Sonnet 5.5は初日から主要クラウドすべてで公開され、モデル概要によると、Amazon Bedrockではanthropic.claude-sonnet-5-5、Google CloudとMicrosoft Foundryではclaude-sonnet-5-5です。どの窓口を使うかで課金のされ方が変わります。
- Amazon BedrockとGoogle Cloudはパートナー運営です。各社が公表する独自のレートで直接請求するため、同額と決めつける前にBedrockの料金を確認してください。Googleも独自のVertex AIレートを公開しています。
- Claude Platform on AWSとClaude in Microsoft FoundryはAnthropic運営です。利用分をAnthropicの標準価格で計算し、交渉済みの割引を適用し、1ユニット$0.01のClaude Consumption Unitsに換算して、マーケットプレイス経由で1時間ごとに後払いで請求します。
- 米国内限定の推論は、ファーストパーティAPI、Claude Platform on AWS、FoundryのUS Data Zoneデプロイで同じ1.1倍の係数がかかります。
すでにクラウド経由でClaudeを動かしている場合は、BedrockガイドとVertex AIガイドでセットアップを解説しています。
Sonnet 5.5とGPT-6 Sol、Gemini 3.8 Flashの料金比較
最も目を引く比較は、Anthropicのラインナップの中にはありません。GPT-6 Solは表面上の料金表がまったく同じで、GPT-6 Solの料金の内訳によると、入力$2、出力$10、キャッシュ入力$0.20、キャッシュ書き込み$2.50です。
| 100万トークンあたり | Claude Sonnet 5.5 | GPT-6 Sol | Gemini 3.8 Flash |
|---|---|---|---|
| 入力 | $2 | $2 | $0.75(2027年1月1日に$1.50へ上昇) |
| 出力 | $10 | $10 | $3.75($7.50へ上昇) |
| キャッシュ読み取り | $0.20 | $0.20 | $0.075 |
| 長文コンテキストの割増 | 1Mまでなし | 272K入力超で高いレート | なし |
| AAのタスクあたりコスト(設定) | $1.08(high) | $1.05(max) | 比較不可 |
| AA Intelligence Index | 47(high) | 48(max) | 比較不可 |
AAの行がすべてを物語っています。HighのSonnet 5.5とmaxのGPT-6 Solは、ほぼ同じスコアでタスクあたりのコストもほぼ同じです。違いはむしろ端にあります。Sonnetには長文コンテキストの追加料金がないので、大きなナレッジベースをコンテキストに読み込むサポートエージェントが価格の崖を越えることはありませんが、Solは272Kを超えると越えます。GeminiのAA数値はインデックスの以前のバージョンによるものだったため、直接比較からは外しました。またGemini 3.8 Flashの料金は1月に倍になります。モデルではなくプロバイダーを選ぶ場合は、3社のAPI比較がさらに詳しいです。
サポートチケットに限れば、順位は価格よりも自社データでの信頼性に左右されるため、サポートチケット向けモデルランキングは精度を最優先にしています。
価格について開発者が語っていること
公開初日のHacker Newsでの反応は、Opusとの位置関係についてが中心でした。懐疑的な見方はこうです。
"I feel like sonnet is priced too close to opus right now. If Sonnet 5.5 were half its current price it would make sense to use."
上のAAの段階と一致する、冷静な見方です。
"Per the charts, there is largely no point to using Sonnet 5.5 at high+ as opus low generally will give similar performance at similar or lower cost."
そして、より低い設定でOpenAIのフラッグシップと比べたユーザーによる、熱狂的な見方です。
"Sonnet 5.5 medium scores better than gpt 5.6 Sol high and is less than 1/5 the cost Absolutely bonkers"
人々が繰り返し行き着いたパターンは分業型の構成でした。LowかMediumのSonnet 5.5が大量処理をサブエージェントとして担い、Opus 5.5が全体の指揮や難しい部分の仕上げを担当します。どちらも合わなければ、Claudeの代替のまとめが別の選択肢を紹介しています。これは価格設定とも一致します。Sonnetの割引は、出力が多くコンテキストが短い呼び出しでは本物で、長くキャッシュ比重の大きいループでは薄れるからです。
Claude Sonnet 5.5は$2と$10の価値があるか
LowとMediumのエフォートなら、あります。そこでは迷いません。Sonnet 5の最高スコアを何分の一かのコストで上回り、チャット型のワークロードで支配的な出力の項目ではOpusの半額で、長文コンテキストの追加料金もありません。サポート返信ボット、分類器、下書きの工程、夜間のBatchジョブなら、私ならこれをデフォルトにします。
割に合わないのは2つのケースです。ワークロードが長いエージェントループの場合、キャッシュ読み取りが両モデルで同額なので、割引が食われます。そして、求める品質を得るためにXhighやMaxが必要なら、MediumのOpus 5.5のほうが同じスコアでたいてい安くなります。まずLowでSonnetを試し、測定し、その差がタスクあたり$1.34に見合うか判断してください。
仕事がサポートキューなら、もう1つコストを計算に入れる必要があります。エフォートとボリュームで動く支出の見通しを立てることです。eeselの営業通話である購入検討者は、テスト1日で200件のやり取りに達し、大規模時のやり取りあたりのコストをすぐに心配しました。トークン課金では、その心配に答えるのが難しくなります。同じチケットでも、設定次第で1.6セントにも$1.28にもなるからです。
チケットあたり固定の請求ならeeselを試す
Sonnet 5.5はエンジンです。求めているのが回答済みのチケットなら、eeselは社員にあたります。AIヘルプデスクのチームメイトがZendesk、Freshdesk、Gorgiasなどのツールにつながり、過去のチケットとヘルプセンターから学習し、実際の顧客に返信する前に過去のチケットでシミュレーションできます。エフォートレベルを選ぶ必要も、キャッシュ読み取りを気にする必要もありません。eeselの料金は月額固定のクレジットプランで、対応したチケットまたはチャット1件が1クレジット、500クレジットで$299から、お試し用に100クレジットの無料枠があります。
ターミナルで作業する場合は、eesel CLIが同じチームメイトを操作します。連携の接続や常設の指示の編集ができ、アクションの承認や拒否、アクティビティログのJSON読み取りもできます。Claude Codeのようなコーディングエージェントも、ワークスペースのMCPサーバー経由で実行できます。

eeselを試して、キューがトークンあたりではなくチケットあたりでいくらかかるかを確かめてください。
よくある質問
Claude Sonnet 5.5は100万トークンあたりいくらですか?
Claude Sonnet 5.5はClaude Sonnet 5より高いですか?
Claude Sonnet 5.5はClaude Opus 5.5の半額ですか?
Claude Sonnet 5.5を最も安く使う方法は?
Claude Sonnet 5.5を無料で使えますか?
Claude Sonnet 5.5は長いコンテキストで追加料金がかかりますか?
Amazon BedrockやGoogle CloudでのClaude Sonnet 5.5の料金は?
カスタマーサポートボットでClaude Sonnet 5.5を使うといくらかかりますか?

Article by
Rama Adi
Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.







