
Grok 4.6の公式料金表
こちらがxAI自身のページからのライブなテキストモデル表で、すべてのモデル、両方のコンテキスト帯域、丸めなしのデータだ。ページ自身のフッターはこれを2026年7月3日付としている。
| モデル | コンテキスト | 入力 | キャッシュ | 出力 | 長文:入力/キャッシュ/出力 |
|---|---|---|---|---|---|
grok-4.6 | 500k | 2.00ドル | 0.50ドル | 6.00ドル | 4.00ドル / 1.00ドル / 12.00ドル |
grok-4.5 | 500k | 2.00ドル | 0.30ドル | 6.00ドル | 4.00ドル / 0.60ドル / 12.00ドル |
grok-build-0.1 | 256k | 1.00ドル | 0.20ドル | 2.00ドル | 2.00ドル / 0.40ドル / 4.00ドル |
grok-4.3 | 1M | 1.25ドル | 0.20ドル | 2.50ドル | 2.50ドル / 0.40ドル / 5.00ドル |
grok-4.20-multi-agent-0309 | 1M | 1.25ドル | 0.20ドル | 2.50ドル | 2.50ドル / 0.40ドル / 5.00ドル |
grok-4.20-0309-reasoning | 1M | 1.25ドル | 0.20ドル | 2.50ドル | 2.50ドル / 0.40ドル / 5.00ドル |
grok-4.20-0309-non-reasoning | 1M | 1.25ドル | 0.20ドル | 2.50ドル | 2.50ドル / 0.40ドル / 5.00ドル |
この表の中で立ち止まる価値のある点が3つある。
200kのしきい値はリクエスト全体を切り替えるものだ。 xAIの文言は明確だ:長文コンテキスト料金を持つモデルは、プロンプトがしきい値に達すると「リクエスト内のすべてのトークン」に長文レートを課金する。201,000トークンのプロンプトは最後の1,000トークンにだけ2倍を払うのではない。201,000トークンすべてに2倍を払う。ツールの出力をターンごとに積み重ねていくエージェント的なループでは、9ターン目でその線を越えると、9ターン目全体がその最初のトークンから再度課金される。
フラッグシップはxAIが販売する中で最も広いコンテキストウィンドウではない。 grok-4.3と4.20ファミリー全体は1Mを持つ。4.6は500kで、出力レートは2倍だ。仕事が1回の呼び出しで巨大な文書1つを処理することなら、旧モデルの方が広く、かつ安い。
キャッシュ入力は4.6が4.5より高い唯一の列で、0.50ドル対0.30ドルだ。方向については正確を期す価値がある:xAIは運用途中で価格を上げたわけではない。Grok 4.5のキャッシュレートはローンチ後に0.30ドルに下がり、4.6は旧来の数字でスタートした。今日の表への影響はどちらにせよ同じで、固定プロンプトを繰り返し送るワークロードに最も厳しく響く。世代を比較しているなら、当社のGrok 4.5料金の投稿に旧世代のラダーがあり、xAI料金ガイドはGrok Imagineや音声モデルを含むラインナップ全体をカバーしている。
人々が実際に支払っている金額
これはローンチ時の報道が決して持たない部分だ。プレスリリースではなく実際のトラフィックが必要だからだ。OpenRouterは、掲載価格とユーザーに実際に課金される価格の両方を、実際のリクエストにわたって集計して公開している。

| エンドポイント | 実効入力 | 実効出力 | 掲載 | キャッシュヒット率 | トークンシェア |
|---|---|---|---|---|---|
| SpaceXAI | 0.7249ドル | 6.125ドル | 2ドル / 6ドル | 90.3% | 64.5% |
| SpaceXAI(ZDR) | 0.7812ドル | 6.116ドル | 2ドル / 6ドル | 88.0% | 35.5% |
| 加重平均 | 0.7448ドル | 6.122ドル | 2ドル / 6ドル |
この2つの列は別々に読んでほしい。異なることを語っているからだ。
入力では、実際の価格は定価のおよそ3分の1であり、その理由はすべてキャッシュにある。実際のGrok 4.6トラフィックでは、入力トークンの10個に9個が2.00ドルで計算されるのではなく、0.50ドルでキャッシュから提供されている。これはxAIが宣伝する割引ではない。安定したプレフィックスを持つ長い会話の中で、モデルが実際にどう使われているかから生まれる副産物的な性質だ。
出力では、実効レートが定価を上回っている。6.122ドル対6.00ドルということは、実際のトラフィックの一部が200,000トークンを超え、12.00ドルの長文コンテキストレートを支払っていることを意味する。総量としては小さいが、その崖が理論上のものではないという直接的な証拠だ。
この系はどちらの数字よりも重要だ:キャッシュヒット率は、Grok 4.6の請求書に対する最大のレバーであり、どんなモデル乗り換えよりも価値がある。そして人々が思うほど自動には起きない。キャッシュはそれ自体で起きるものだが、xAIのプロンプトキャッシュのドキュメントは「キャッシュヒット率を最大化するために」x-grok-conv-idヘッダーを設定することを特に推奨している。これは会話のリクエストを同じサーバーにルーティングするためだ。このヘッダーを省略すると、フリート平均が0.72ドルを支払っているところで、2.00ドルを支払うことになりかねない。
モデルを比較する実践者たちは、反対側から同じ非対称性に気づいている:
"About the cost, Grok doesn't really cost less outright. Output token is cheaper, but their cache is not that cheap. Grok use less token than Sonnet tho."
そのコメントはGrok 4.5についてのもので、そのキャッシュレートはより安い0.30ドルだ。4.6ではその論点が和らぐどころか鋭くなる。
誰も予算に入れていないメーター
トークンレートは、はるかに長い請求書の1行にすぎない。ここにxAIが同じページで課金しうるその他すべてを挙げる。

サーバー側ツールはトークンに加えて、呼び出しごとに課金される。
| ツール | レート |
|---|---|
| ウェブ検索、X検索、コード実行 | 1kコールあたり5ドル |
| ファイル添付検索 | 1kコールあたり10ドル |
| コレクション検索(RAG) | 1kコールあたり2.50ドル |
| 画像理解、X動画、リモートMCP | トークンベース、呼び出し料金なし |
| 画像生成 | Imagine APIのレートで課金 |
どんな検索構築でも注視すべき項目は、1,000回あたり2.50ドルのコレクション検索だ。これは、あなたのエージェントが自身のアップロード済み文書を検索するたびに発動するメーターであり、生のLLMに対するRAGの背後にある仕組みそのものだ。根拠のある回答はすべてツール呼び出しであり、すべてのツール呼び出しにはモデルとは無関係の価格がついている。
ストレージはまた別のメーターだ。 ファイルストレージは1GiBあたり1日0.025ドル、コレクションストレージは1GiBあたり1日0.10ドル、ダウンロードは転送1GiBあたり0.20ドルだ。50GiBの知識コレクションが放置されているだけで、誰かが質問するかどうかにかかわらず、1日5ドルかかる。
Priority Processingはすべてに対して一律2倍だ。 入力、出力、キャッシュ、推論のすべてのトークンが2倍になる。xAIが公開しており評価に値する公平な2つの詳細:キャッシュ割引は乗数の前に適用され、レスポンスが"service_tier": "priority"を確認した場合にのみ優先レートで課金される。デフォルトのティアで処理された場合は、標準レートを支払う。
バッチ割引はフラッグシップを対象外としている。 Batch APIの20%割引はgrok-4.3と3つのgrok-4.20バリアントをカバーする。4.6、4.5、grok-build-0.1はカバーされない。そのため、チケット分類やバックログのトリアージのような夜間のバッチ処理向けの作業では、1年前のgrok-4.3が割引後に入力1.00ドル、出力2.00ドルとなり、フラッグシップの半額で済む。メインの料金表はそのヒントを一切与えてくれない。
ブロックされたリクエストでもお金はかかる。 Responses APIで生成前に検出された違反には、リクエストあたり0.05ドルの手数料がかかる。受け取ることのなかった出力に5セントを支払うことになりうる。
自分の請求書を組み立ててみる
トークンの計算だけでは、実際の支出を過小評価してしまう。ツールをオンにして、比率がどう動くかを見てほしい。
どの窓口から買うかで価格が変わる
同じモデルでも、購入経路は5つあり、そのうち2つはまだ販売していない。

xAI APIは基準価格だ:2.00ドル / 0.50ドル / 6.00ドル、従量課金制、公表された無料枠なし。
OpenRouterは同一の2.00ドル / 6.00ドル / 0.50ドルのキャッシュ読み取りレートを掲載しており、「マークアップなしで」プロバイダーの価格をそのまま通していると明言している。コストは別のところにある:クレジット購入時に5.5%の手数料がかかり、最低0.80ドル、暗号資産では5%、未使用クレジットは1年後に失効する。自分自身のxAIキーを持ち込む場合、プラン割り当てを超える利用には、同じリクエストが本来かかったであろう金額の5%の手数料がかかる。また、標準とゼロデータ保持の2つのエンドポイントを同じレートで運用しているが、計測された速度は異なる:中央値で毎秒74トークン対80トークン、レイテンシは1.02秒対0.81秒で、どちらも30日間で稼働率100%だ。
月額30ドルのSuperGrokは、xAIの料金ページによれば、Grok 4.6を特典として明示する最も安いコンシューマー向けプランだ。SuperGrok Plusは月額100ドル。Free、SuperGrok Lite、SuperGrok Heavy、Business、Enterpriseはすべてプラン比較に表示されるが、公表された金額があるのはFree、SuperGrok、SuperGrok Plusのみで、残りは営業への問い合わせか非公開だ。
Azure AI FoundryとAWS Bedrockは依然として1世代遅れている。AzureのGrok料金ページは最新でもGrok-4.3 Globalまでで、入力1.25ドル、出力2.50ドルだ。トークンあたりは安いが、2世代前のものだ。調達方針として推論を単一のクラウドに通さなければならない場合、Grok 4.6はあなたにとって、どんな価格でもまだ購入不可能だ。これはGrok BotやGrok音声エージェントビルダーで見たのと同じパターンだ:xAIはまず自社のプラットフォームに出荷し、リセラーには後から追いつかせる。
Grok 4.6と他のフラッグシップの比較
| モデル | コンテキスト | 入力/1M | キャッシュ/1M | 出力/1M |
|---|---|---|---|---|
| Grok 4.6 | 500k | 2.00ドル | 0.50ドル | 6.00ドル |
| Claude Sonnet 5 | 1M | 2.00ドル | 0.20ドル | 10.00ドル |
| Claude Opus 5 | 1M | 5.00ドル | 0.50ドル | 25.00ドル |
| GPT-5.6 Sol | 1.05M | 5.00ドル | 0.50ドル | 30.00ドル |
| DeepSeek V4 Flash | 1M | 0.14ドル | 0.0028ドル | 0.28ドル |
出力では、Grok 4.6はここで最も安いオープンウェイトではないフロンティア級の選択肢だ。6.00ドル対10、15、25、30ドルは僅差の勝負ではなく、なぜこのモデルがまずコーディングエージェントに登場するのかを説明している:そうしたワークロードは出力が多く、コンテキストが流動的だからだ。
キャッシュ列に目を移すと、順位は逆転する。Sonnet 5はGrok 4.6の0.50ドルに対して0.20ドルでキャッシュされ、長文コンテキストの割増なしで1Mのウィンドウを持ち、Grok 4.6にはないバッチ割引もある。大きな固定プロンプトを送信し、3文だけを返すワークロード、まさにサポートキューがやっていることだが、その場合、安い出力レートはほとんど問題にならない。
この比較自体についての公平性に関する注意点:キャッシュ入力はベンダー間で同じ製品ではない。AnthropicとOpenAIはキャッシュエントリを書き込むために別途課金し、Googleは時間単位でキャッシュストレージを課金し、xAIはページ上に別の書き込み料金なしで読み取りレートを公開している。キャッシュ列だけを比較すると、料金を分割しているベンダーを実際以上に良く見せてしまう。より広い分野が見たいなら、Grok 4.5の代替が最も近い競合をカバーし、Qwen3.8 Maxがオープンウェイト側をカバーしている。
サポートキューで実際にかかるコスト
ウィジェットの初期設定で計算すると、Grok 4.6は会話1件あたり約1.5セントのトークン代がかかり、検索や検索拡張が有効になるとさらに1セント程度上乗せされる。月間20,000件の会話で、それは数百ドルになる。
次に構築の残りの部分に価格を付けてみよう:ヘルプデスク統合、トリアージルール、確信度ゲート、エスカレーション経路、レビューループ、何かがおかしくなったときのオンコール対応。トークンはそれらすべてに対して丸め誤差にすぎない。
だからこそ私は、購入検討者に100万トークンあたりのコストではなく解決あたりのコストを見るよう繰り返し勧めており、サポートROIの測定は料金表を最適化するよりも有益な取り組みなのだ。
料金の相談で繰り返し目にする2つの失敗パターンがあり、どちらもトークン表では警告されない。
1つ目は、レートではなく量だ。自社製品をテストしていたある購入検討者は、1日の評価だけで200件のインタラクションに達し、すぐに月9,000件を予測し始めた。価格には何も変化がなかった。変わったのは、それがどれくらいの頻度で使われるかという見積もりであり、それは常にスプレッドシートが言っていたよりも高い。
2つ目は、料金モデルそのものの形だ。あるトライアルユーザーは12件のテストチャットを行い、エージェントがうまく機能するのを見て、請求ページを開き、その場で解約を申請した。製品は機能していた。問題は請求書の構造だった。だからこそ私は、サポートの購入検討者には100万トークンあたりの数字よりも、解決済みチケットあたりの数字を提示したい。誰も自分のトークン消費量を予測できないが、誰もが自分のチケット数を数えることはできるのだから。
そして、安いモデルでは決して解決できないこと:自社コンテンツへのグラウンディングだ。Grok 4.6の知識のカットオフは、あなたの返品ポリシーやSKU、先週の障害について何も知らないことを意味する。それはあなたのナレッジベースと過去のチケットから得られるものであり、どのモデルがその下にあるかにかかわらず構築コストだ。
敵対的テストや封じ込め率の測定についても同じことが言える。実在する項目であり、料金表にはそれらが含まれていない。
eeselはトークンではなく成果に価格をつける
私はここ数年、モデルとヘルプデスクの間の層を構築することに費やしてきた。サポートプロジェクトを念頭にトークン表を読んでいる誰かに伝えたいのは、あなたが仕事の中で最も安い5%に価格をつけているということだ。
eeselは残りの95%だ。数分でZendesk、Freshdeskなどに接続し、あなたのヘルプセンター、マクロ、解決済みチケットから学習することで、すでにあなたのチームのように話し、実際のライブ顧客に1件でも返信する前に、あなた自身の過去のチケットに対してシミュレーションを行う。まず自社データでの精度を確認し、そこで明らかになったギャップを埋め、再実行してから本番稼働させる。

課金はメーターではなく成果に基づいて機能する:当社の料金ページによれば、対応したチケットまたはチャット1件あたり40セントで、返信ごとではなく会話ごとに課金され、シート料金はなく、あなたのスタッフが対応したチケットには一切課金されない。カード登録なしで50ドル分の無料利用枠があり、まず一部の量だけをルーティングでき、月間支出に上限を設けることもできる。忘れがちなキャッシュキーヘッダーもなく、200kの崖もなく、回答を生み出した検索のための別行もない。当社のセキュリティとエンタープライズのページがコンプライアンス面をカバーしている。
コーディングエージェントではなくサポートキュー向けにモデルを選んでいるなら、その仕事に対して最適なAIエージェントは、どんな料金表よりも良い出発点であり、AIカスタマーサービスソフトウェアはその上のプラットフォーム層をカバーしている。
私が展開を評価する基準にしたい数字は、100万トークンあたりのドルではなく、自動化されたチケット解決と解決率だ。実際のキューでそれが通用するかどうかは、当社の顧客事例ページが答えるためのものだ。
eeselを無料で試し、シミュレーションを実行し、トークンではなく成果に価格をつけよう。

Article by
Kurnia Kharisma Agung Samiadjie
Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.








