
Claude Opus 5の料金早見表
Claude Opus 5がローンチしたのは2026年7月24日で、Anthropicはこれを「半額でClaude Fable 5に迫るフロンティア級の知性」を持つモデルと表現しています。API料率はOpus系列がOpus 4.5以来維持してきたものと同じです。
| 支払う対象 | Claude Opus 5の料率 |
|---|---|
| 入力トークン | 100万あたり$5 |
| 出力トークン(thinking含む) | 100万あたり$25 |
| 5分間キャッシュ書き込み | 100万あたり$6.25 |
| 1時間キャッシュ書き込み | 100万あたり$10 |
| キャッシュ読み取り | 100万あたり$0.50 |
| Batch API 入力/出力 | 100万あたり$2.50 / $12.50 |
| fastモード 入力/出力 | 100万あたり$10 / $50 |
US専用推論(inference_geo) | 全トークンカテゴリに1.1倍 |
上記の数値はすべてAnthropicの料金ドキュメントからのものです。料率以上に請求額を左右する仕様がいくつかあります。
- モデルIDはClaude API上で
claude-opus-5、Bedrock上でanthropic.claude-opus-5です。 - コンテキストは入力100万トークン、出力128kトークンで、Batch APIでベータヘッダーを使うと出力300kまで拡張されます。
- 信頼できる知識のカットオフは2026年5月です。
- Opus 5は独自のレート制限バケットに属します。Opus 4.8、4.7、4.6、4.5は共通のプールを共有していますが、Opus 5はそこから引き出さないため、トラフィックを移してもゆとりは生まれません。
前世代と比較検討している場合、Opus 4.5の料金ガイドとOpus 4.6の内訳は同じ料率を採用しているため、バージョン間の比較が異例なほどクリーンにできます。
実際に課金される対象
Opus 4.8から移行する人が引っかかるポイントがここです。4.8では、thinkingフィールドを省略したリクエストはthinkingなしで実行されていました。Opus 5では同じリクエストがadaptive thinkingを実行し、すべてのthinkingトークンは100万あたり$25の出力として課金されます。

予算を組む上で注意すべき二次的な影響が二つあります。
max_tokensはいまやthinkingと回答の両方をカバーします。 4.8で表示される回答だけを想定してタイトに調整していた上限は、Opus 5では回答の途中で切れることがあります。Anthropicの移行ガイドは、xhighまたはmax effortの場合、最低でも64kを出発点にすることを勧めています。- Opus 5はデフォルトでより長く書きます。 移行ガイドは、表示される回答も生成物も4.8より長くなることをはっきりと述べており、effortを下げるとthinkingの量は減るが、表示される回答の長さは確実には短くならないとしています。長さはダイヤルで調整するものではなく、プロンプトで指示するものです。
エージェント的なループで見落とされがちな三つ目の請求項目があります。返したツール結果はすべて次のターンで入力として再び入ってきます。30ステップのエージェント実行では、同じ肥大化していくトランスクリプトに何度も料金を払うことになり、これこそキャッシュがチャットよりも重要になる理由です。ループがMCPツールやClaude Skillsからコンテキストを引っ張ってくる場合、それらの結果はすべて同じ請求書の入力側に計上されます。
一つのモデル、四つの価格
同じ重み、同じモデルIDでも、呼び出し方だけで四つの異なる料率で課金されることがあります。

プロンプトキャッシュは、安定した接頭辞を持つあらゆるワークロードにとって最大のレバーです。書き込みは5分キャッシュで基本入力の1.25倍、1時間キャッシュで2倍のコストがかかり、読み取りは0.1倍です。Opus 5での静かなアップグレードは下限で、キャッシュ可能な最小プレフィックスが512トークンまで下がりました。4.8では1,024トークン、Opus 4.6では4,096トークンでした。これまで静かにキャッシュ不可能だったシステムプロンプトが、コード変更なしでキャッシュされるようになります。
Batchは両方向を50%引きにし、キャッシュと併用できます。ワークロードがキューを許容できるなら、これはタダ同然のお得さです。
fastモードは逆方向です。fastモードのドキュメントによれば、価格を正確に2倍にする代わりに出力トークンの処理速度を最大2.5倍高速化します。この取引は正確に言い表す価値があります。100万あたり$10と$50という価格では、fastモードのOpus 5は標準のClaude Fable 5と同じトークン単価になります。これもファーストパーティAPI限定のリサーチプレビューで、Batchとは併用できません。
US専用推論は全トークンカテゴリに一律1.1倍が加算され、$5.50と$27.50になります。
effortこそが本当の価格ダイヤル
予算を見積もるなら、この章は二度読む価値があります。Opus 5は五段階のeffortレベルをサポートしており、ガイダンスは4.x時代から反転しました。4.7と4.8ではエージェント的な作業でxhighから始めるよう指示していましたが、Opus 5ではデフォルトのhighから始めて必要に応じて下げるよう案内されています。

この助言の裏付けとなる数値は、Terminal-Bench 2.1の後継である74タスクのターミナルベンチマーク、Anthropic自身によるFrontier-Bench v0.1の実行結果から来ています。
| Effort | Frontier-Benchスコア | トークンに関する注記 |
|---|---|---|
| low | 25% | 出力トークン64%削減 |
| high | 39% | 出力トークン19%削減 |
| xhigh | 44.4% | 最良の結果 |
| max | ~43% | 支出は増えるがやや悪化 |
二点が際立ちます。max effortはxhighよりコストが高いのにスコアが悪化し、low effortはおよそ3分の1の出力トークンでスコアの半分以上を叩き出しました。AnthropicはFrontierCode 1.1におけるmax effortのスコア低下について、モデルが「タスクが要求する以上の変更」を行うことが原因であり、これが採点者に減点されると説明しています。

このチャートはリーダーボードとしてではなく、価格チャートとして読んでください。Opus 5のコストに関する主張全体は、そのカーブがFable 5のカーブより上かつ左に位置しているという点にあります。つまり、より低いコストでより高いスコアに到達するということです。これは単一のベンチマーク数値よりも有用な主張であり、AnthropicがCursorBenchで報告している形と同じです。そこではOpus 5が「Fable 5のピークスコアの0.5%以内に達しながら、タスクあたりのコストは半分」とされています。
自分の月間請求額を計算する
表面上の料率は、自分のボリュームを当てはめて初めて現実味を帯びます。1か月分の使用量を入力し、各レバーが何をするか確認してみてください。
計算機がモデル化できない注意点が一つあります。トークン数は世代をまたいで比較できません。Anthropicの指摘によれば、Claude 4.7以降は同じテキストをSonnet 4.6以前よりもおよそ30%多いトークンにトークナイズするため、旧モデルとの単純な100万あたり比較は実際の請求額を過小評価します。
Opus 5をラインナップの他モデルと比較する
| モデル | 入力/MTok | 出力/MTok | コンテキスト | 適した用途 |
|---|---|---|---|---|
| Claude Fable 5 | $10 | $50 | 1M | 能力の上限 |
| Claude Opus 5 | $5 | $25 | 1M | エージェント的なコーディング、エンタープライズ業務 |
| Claude Opus 4.8 | $5 | $25 | 1M | Priority Tier、web fetch |
| Claude Sonnet 5 | $2 (その後$3) | $10 (その後$15) | 1M | 大量処理向け |
| Claude Sonnet 4.6 | $3 | $15 | 1M | 従来の主力 |
| Claude Haiku 4.5 | $1 | $5 | 200K | 分類、ルーティング |
Anthropic自身の方針はまずOpus 5から始め、上限性能が必要な時だけFable 5にステップアップするというものです。
市場の他社と比較すると、Geminiの料金とGPT-5.6の料金に関する記事から、Opus 5は「高価だが効率的」という枠に位置づけられます。Gemini 3 ProやCodex対Opus 4.6の対決記事は、その取引の形をいまも描写しており、3社APIの比較は切り替えを最速で見極める手段です。
Opus 4.8が維持している一方でOpus 5では失われる二つの点は、計画上重要です。移行ノートによれば、web fetchはOpus 5では利用できず、Priority Tierもサポートされません。Priority Tierのコミットメントを持っている場合、その容量は引き継がれません。
実際のワークロードのコストはいくらか
料率は抽象的なものです。以下は違います。
あるコーディングセッション。 Anthropic自身の実例によれば、1時間のOpus 5セッションは入力5万トークン、出力1万5千トークンで、$0.25 + $0.375 + Managed Agentsランタイムの$0.08、合計**$0.705です。そのうち入力4万トークン分にキャッシュを有効にすると、同じセッションは$0.525**になり、動作は変わらずに25%削減されます。
あるビジネスワークフロー。 ZapierのAutomationBenchでは、Opus 5はmedium effortで24%のスコアをタスクあたり$0.89で達成しました。Anthropicはこれについて「Claude Opus 4.8とFable 5の両方を、半分以下のコストで大きく上回っている」と述べています。

あるフル評価スイート。 対極として、Artificial Analysisは自社のインデックスを実行するのに費やした金額を公表しています。
"In total, it cost $3835.51 to evaluate Claude Opus 5 (Adaptive Reasoning, Max Effort) on the Intelligence Index."
この数字は、上記のあらゆるタスクあたりコストのチャートに対する正直な対抗軸です。Opus 5は同インデックスで61ポイントを獲得し190モデル中1位にランクされていますが、そこに至るまでに1億の出力トークンを消費しており、中央値の6300万トークンに対して突出しています。完了タスクあたりの効率と総支出は別の問いであり、Opus 5はその二つに異なる答えを出します。

早期アクセスの顧客の中には、同じ効果を数字で語る人が複数いました。ある法務エージェントチームは、max reasoningでOpus 4.8と同等の性能に対してトークンを26%削減できたと報告し、あるトレーディングのベンチマークでは「reasoningトークンがおよそ7分の1、レイテンシは半分未満」という結果に着地しました。これらはベンダー提供かつ匿名の情報なので相応に割り引いて受け取るべきですが、6件の独立した報告で方向性は一貫しています。
Claude Pro、Max、Team、Enterprise
誰もがAPIに手を伸ばすわけではありません。ローンチ記事によれば、Opus 5はClaude Maxの新しいデフォルトモデルであり、Claude Proでは最強のモデルです。
| プラン | 月額 | 年額 | Opus 5へのアクセス |
|---|---|---|---|
| Free | $0 | $0 | 不可、SonnetとHaikuのみ |
| Pro | $20 | 月$17、前払い$200 | 可、加えてクレジットでFableも |
| Max 5x | $100 | 月額のみ | 可、デフォルトモデル |
| Max 20x | $200 | 月額のみ | 可、デフォルトモデル |
| Team (standard) | 席あたり$25 | 席あたり$20 | 可 |
| Team (premium) | 席あたり$125 | 席あたり$100 | 可、standardの5倍の使用量 |
| Enterprise | - | 席あたり$20+使用量 | 可、コンテキスト50万 |
価格はClaude料金ページからのものです。購入者が引っかかりやすい点が二つあります。
- 制限はメッセージ数ベースではなくセッションベースです。 5時間のローリングウィンドウでリセットされ、その上に週次の上限が重なります。web、デスクトップ、モバイル、Claude Codeはすべて同じ一つのプールから消費します。計画の目安となるメッセージ数というものは存在しません。
- 有料プランはAPI料金にこぼれ込みます。 上限に達すると使用量クレジットを有効にして標準料金で作業を続けられます。これがサブスクリプションの席に対して上記の$5と$25が適用され始めるポイントです。
このセッションモデルは、同じリリースでもまったく異なる体験を生んでおり、その差はプラン階層とほぼ完全に対応しています。あるMax 20xユーザーの声です。
"I have now been using Opus 5 only (since I'm out of Fable) for about 7 hours and it drained about 6% of my weekly usage."
そして同じ週のあるProユーザーの声です。
"I'm only on the Pro plan but a single prompt with Opus 5 w/ high thinking used 100% of my 5-hour usage limit."
両方とも真実でありえます。なぜならセッション制限はトークンのプールであり、high effortだとOpus 5はそこからより速く消費するからです。月$20のProの席では、そのプールはthinkingを多用するプロンプト一回で使い切ってしまうほど小さいのです。人々がたどり着いた実践的な対処法はプランのアップグレードではなく、日常業務ではeffortを下げ、必要なタスクのためにhighを温存することです。
サブスクリプション経路とAPIの生の支出を比較検討しているチームには、Claude Codeの料金ガイドとエンタープライズClaude Codeの解説が席数計算をカバーしています。Claude Codeでのモデル設定では、自動選択に任せる代わりにOpus 5を固定する方法を扱っており、モデル選択ガイドでは、いつより安価な階層に落とすべきかを解説しています。エコシステム全体が自分に合うかまだ検討中なら、ClaudeのレビューとClaude Cowork料金ガイドがより広い視点を与えてくれます。
Bedrock、Vertex、Foundry、そしてCCUのくせ
Opus 5は初日から全プラットフォームで利用可能ですが、課金方式は同一ではありません。
- Amazon BedrockとGoogle Cloudはパートナー運営です。 請求はクラウドプロバイダーから来て、Anthropicは自ら料率を公表するのではなく、Bedrockの料金とVertex AIの料金を正しい情報源として指し示しています。
- リージョナルエンドポイントには両クラウドともグローバルエンドポイントより10%の割増があります。
- AWS上のClaude PlatformとMicrosoft FoundryはClaude Consumption Unit(CCU)で課金します。 標準的なモデルごとの料率でUSD建てにレーティングされたのち、時間単位の計測で1CCUあたり$0.01に換算されます。請求書にはトークンの内訳ではなく、一行のCCU項目が表示されます。
- fastモードはファーストパーティ限定です。 Bedrock、Google Cloud、Foundryには存在しません。
経理担当がトークン単位のモデルとAWSの請求書を突き合わせようとしている場合、CCU換算がその二つが一致しなくなるポイントです。
開発者の声
ローンチ週の反応はほぼ即座に二つの陣営に分かれ、その分裂は料率ではなく完全にトークンをめぐるものでした。第一陣営は数字を計算し、フラットな価格の裏に実質的な値上げが隠れていることを発見しました。
"At the same levels of thinking it's appears that Opus 5 in it's current form uses about 2x the amount of output tokens to do similar tasks. So per token is the same, but the models don't use the same amount of tokens to do the same task."
あるデベロッパーは実際にお金を使ってそれを検証しました。同じタスクを複数のeffortレベルで実行し、Opus 5はlowで$0.41514、mediumで$0.801965を記録した一方、Opus 4.8のlowは$0.210415でした。
"At matched effort, Opus 5 spends roughly 2x the output tokens of 4.8."
サードパーティのリーダーボードも、別の角度から同じシグナルを拾っています。
"Vals Index Opus 4.8 > 5.0 goes from $2.90 to $8.54, for 4% gain ... That is a massive cost increase. Sure, 20% cheaper then Fable, but that is a 3x price increase compared to Opus 4.8 in that test."
人々が繰り返し語っているメカニズムはスコープの肥大化で、これはAnthropicの公式ドキュメントが引き継がれた検証指示を削除するよう警告している行動とも一致します。なぜならOpus 5は指示されなくても自分の作業を検証しに行くからです。
"it just reviews every minor change with unnecessary checks that would take a couple minutes to check manually, it wants to spend an hour and spend $25 of tokens"
反論も公正で、心に留めておく価値があります。もしモデルが安価なほうのモデルなら諦めてしまう作業を完了させるのであれば、消費された総トークン数は間違った分母です。
"When we look at some benchmarks that publish the cost per successful task, Claude seems to be way cheaper than I expected. For example on https://livebench.ai/
here the cost per successful task for Opus 5 is lower than Sol."
そして単純にこの切り替えに満足している人も大勢います。
"I switched from 4.8 to 5 yesterday and I'd have to say that I've noticed an improvement, though not hugely perceptible, the model seems to want to do more work per turn, possibly a tiny bit faster, and little less verbose when it isnt necessary to be so."
私の見立てはこうです。両陣営とも正しく、意見の相違は本当のところ、どの分母に対して課金しているかの問題です。トークンを計測するならOpus 5は高くなった。完了したタスクを計測するなら安くなった。どちらが自分のビジネスに当てはまるかは、この料金ページが答えられない実際の問いです。
Claude Opus 5は$5と$25に見合うか
長時間にわたるエージェント的な作業においては、答えはイエスであり、その論拠は本当のところ料率についてではありません。Opus 5はOpus 4.8と同じ価格を維持しながら、SWE-bench Verifiedで96.0%を記録し、Frontier-Benchで4.8を2倍以上上回っています。あるタスクが$0.89で完走するのと、$0.40で2回失敗するのとでは、トークン単価が安いほうのモデルが安かったことは一度もなかったことになります。
これを標準にする前に、正直に三つの注意点があります。
- 冗長であり、その冗長さは$25で課金されます。 Artificial Analysisは「同程度の価格の他モデルと比較して特に高価」であり「著しく遅く、非常に冗長」と評しています。effortだけでは長さは制御できないため、長さを抑えるプロンプトエンジニアリングの時間を見込んでおいてください。
- ハルシネーションはわずかに悪化しました。 system cardは率直に、このモデルは「全体的な正確性が向上しているにもかかわらず、Opus 4.8よりわずかに多く事実に関するハルシネーションを起こす」と述べています。
- 安価なモデルの方が優れている作業も依然として多い。 分類、ルーティング、大量のドラフト作成には、価格が40%のClaude Sonnet 5のほうが良い買い物で、Haikuはさらに良い選択です。他の選択肢を検討しているなら、Opus 4.6の代替ツールまとめと以前のOpus 4.5の代替が全体像をカバーしており、より安価な選択肢としてはMistralの料金とGroqの料金があります。
実際のツールチェーンの中でこのモデルがどこに位置づくかは、料金表とは別の問いです。AIコーディングアシスタント、Claude開発者向けツール、Cursorに関するまとめ記事が、実際にそれを判断する場所です。
参考までに、私自身の社内ツールでのデフォルトは、システムプロンプトに1時間キャッシュを効かせたhigh effortで、待てるものはBatchに回すという組み合わせです。この組み合わせで、ほとんどの業務は素朴な標準料金の請求額の4分の1から半分の間に収まります。
トークンの請求があなたの問題でなくなる場所
ここまでの話はすべて、配管部分を自分で持ちたいという前提に立っています。リトライロジック、effortの調整、キャッシュの無効化、安全性の分類器がリクエストを拒否した時のフォールバック。これは本物のエンジニアリングプロジェクトであり、私は何人もの技術力ある顧客がeeselを離れ、まさにそれをClaude API上で直接構築するのを見てきました。
彼らの中には十分満足している人もいます。一方で、この顧客のような状況にたどり着く人もいます。
"We could try to write our own LLM application but we didn't want to invest our time into that. We wanted something that we would not have to maintain."
Karel, GENERAL BYTES
これがClaude Opus 5の料金ページの裏にある本当の意思決定です。フロンティアモデルにサポートチケットへの回答をさせたいなら、トークン料率はおそらく全体の仕事の5分の1にすぎません。残りは、自社のヘルプセンターや過去のチケットにモデルを根拠づけること、触れるべきでない質問については黙らせておくこと、実際のキューに触れる前にそれが何をするかを把握しておくことです。

eeselはまさにその層で、モデルの支出をすでに内包したタスク単位の価格で提供されるため、忙しい月はトークンの請求書として説明する必要があるものではなく、処理したチケット数の増加として現れます。誰にも返信する前に、自社の過去のチケットに対してシミュレーションでき、数分で接続できます。ぜひeeselを無料で試してみてください。
サポートではなくコンテンツが自分のユースケースであれば、同じロジックが私たちのAIブログライターを動かしており、ブログ執筆に最適なLLMとAIコンテンツを人間らしくする方法のガイドが出発点になります。
よくある質問
Claude Opus 5は100万トークンあたりいくらですか?
Claude Opus 5はClaude Opus 4.8より高いのですか?
Claude Opus 5を最も安く運用する方法は何ですか?
Claude Opus 5の料金は100万トークンのコンテキストウィンドウで変わりますか?
Claude Opus 5のProプランとMaxプランの料金はいくらですか?
Claude Opus 5とClaude Sonnet 5、どちらがコスパが良いですか?

Article by
Rama Adi Nugraha
Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.








