Grok 4.5: ベンチマーク、料金、そしてサポート業務への意味

Kurnia Kharisma Agung Samiadjie
執筆者

Kurnia Kharisma Agung Samiadjie

Katelin Teen
レビュー者

Katelin Teen

最終更新 July 9, 2026

専門家による検証済み
Grokのロゴマーク、サポート担当エージェント、ベンチマークと料金のパネルを描いた手描きイラスト

Grok 4.5とは実際何なのか

Grokはxaiのアシスタント兼APIプラットフォームであり、4.5はそのラインの最新フラッグシップだ。xAI自身のドキュメントは、これを「コーディング、エージェント型タスク、知識労働向けに構築されたSpaceXAIのフロンティアモデル」と説明している(同社は現在、あらゆるプロパティで社名を「SpaceXAI」と表記しているが、モデル自体は依然として単にGrokと呼ばれている)。モデル概要ページでは、このモデルが誰向けかを示す3つの言葉、「エージェント型ツール利用、最小限のハルシネーション、設定可能な推論」を冒頭に掲げている。

Grok 4系列と比べて新しい点がいくつかある。

  • 50万トークンのコンテキストウィンドウ。これはモデルページで確認されており、20万トークンのしきい値を超えると料金率が上がる。これはおおよそ、1回のリクエストで小さな本1冊分のコンテキストに相当する。
  • 設定可能な推論reasoning_effort設定により低・中・高(高がデフォルト)を選べ、呼び出しごとにレイテンシと深さをトレードオフできる。
  • 最小限のハルシネーションという明確な設計上の主張。xAIはこれを脚注に埋もれさせるのではなく、前面に押し出している。
  • マルチモーダル入力モデル詳細ページによれば、テキストと画像を受け取り、テキストを返す。
  • サーバーサイドの組み込みツールファンクション呼び出し、Web検索、X検索、コード実行がAPI経由でそのまま利用できる。

初日からすでに多くの場所で利用可能だ。xAI API、xAIのGrok Buildコーディングエージェントのデフォルトモデルとして、Cursor内、Microsoft Officeアドインのデフォルトとして、そしてOpenRouterやVercelといったゲートウェイを通じて。EUでのAPIアクセスがローンチ時点で唯一の未対応部分で、「今月後半に対応予定」とされている。

サポート自動化のためのAnthropicのClaudeアップデートに関する私たちの考察を読んだ方には、ここでの構図はおなじみだろう。強力なコーディング・エージェントモデルが競争力のある価格で登場し、数週間ごとにリーダーボードが入れ替わる市場に投入される、というものだ。

ベンチマーク: 話題性と実際の立ち位置

ここは、話題性重視の記事なら普通は言葉を濁す部分だ。ここでは濁さない。以下の数値は、Grok 4.5(高設定)に関するArtificial Analysisの独立測定であり、ベンダーの発表当日の図表よりもクリーンな引用元だ。

2026年7月のAI Intelligence Indexを示す横棒グラフ。Claude Fable 5が60、Claude Opus 4.8が56、GPT-5.5が55、Grok 4.5がハイライトされ54、Claude Opus 4.7が54
2026年7月のAI Intelligence Indexを示す横棒グラフ。Claude Fable 5が60、Claude Opus 4.8が56、GPT-5.5が55、Grok 4.5がハイライトされ54、Claude Opus 4.7が54

Artificial Analysisのスコアカードを率直に読み解くとこうなる。

  • Intelligence Index: 54、168モデル中第4位。 Claude Fable 5(60)、Claude Opus 4.8(56)、GPT-5.5(55)のすぐ後ろに位置し、Claude Opus 4.7(54)と同点だ。これはクラス平均の約29を大きく上回っており、第4位は非常に良い結果だが、第1位ではない。
  • エージェント型ツール利用: 33%で、掲載されている全モデル中最高スコア。 GPT-5.5やClaude Sonnet 4.6を上回る。これがGrok 4.5の本当の強みであり、サポート自動化にとってはこのページで最も関連性の高い数字だ。
  • GPQA Diamond(科学的推論): 93%。 トップ集団に位置する。
  • Terminal-Bench(エージェント型コーディング): 82%。 第5位で、トップのClaudeやGPTのリリースには及ばない。
  • 速度: 出力85.6トークン/秒。 平均の約73を上回り、生成量が際立って簡潔だ。

話題性とスコアカードのギャップは指摘しておく価値がある。ローンチ時、CursorのCEOはこれを「Opusクラスのモデル」と呼び、「速くて低コスト」だと評したが、これは妥当な評価だ。ただしCursorがこのモデルを共同ローンチしていたことは念頭に置く価値がある。独立した数値では、生の知能ではOpus 4.8よりわずかに劣るが、コスト対性能のフロンティアでは明確に優位に立っている。つまり、地に足のついた結論はこうだ。ドルあたりではOpusクラスの知能だが、Opusを打ち負かす知能ではない。 多くの購入者にとって、ドルあたりの性能こそが実際に重要な数字だ。

Grok 4.5の料金

Grok 4.5は価格で下回ることを狙っており、おおむねそれを実現している。以下はxAIの料金ドキュメントモデルページから得た全体像だ。

プラン概要入力出力備考
Grok 4.5 API従量課金トークン$2.00 / 1M$6.00 / 1Mキャッシュ入力は0.50ドル/1M(−75%)、コンテキスト50万、20万超で料金率上昇
Grok(無料)コンシューマーアプリ--grok.com、X、iOS、Androidで1日あたりの利用に制限あり
SuperGrokコンシューマーサブスクリプション--上限緩和で月額約30ドル(金額はコミュニティ報告であり、一次情報での確認は取れていない)
SuperGrok Heavyコンシューマー最上位プラン--月額約300ドル(コミュニティ報告。grok.comには確認できる価格表記がない)

xAI自身のドキュメントで確認できるため、基準とすべきはAPIの数字だ。入力2ドル・出力6ドルで、Grok 4.5は多くのフロンティア級の競合よりも安価でありながら、それらに近いスコアを出している。これがこのモデルの売り文句すべてだ。Hacker Newsであるコメント投稿者は、その反応を率直にこうまとめている。

Hacker News

「かなり良い出来で、いくつかの旧世代のOpusモデルに匹敵する。しかもトークンあたりの価格はかなり安い。」

トークンあたりが安いのは事実だが、そここそがAIサポートのコスト計算の多くが誤る箇所でもある。トークン単価は解決済みチケット1件あたりのコストと同じではない。1回のやり取りで簡潔に答える簡素なモデルの方が、堂々巡りして再試行し、エスカレーションを繰り返す「安価な」モデルよりも、実際には安く済むことがある。この点はAIサポートエージェントのコストという記事で詳しく分解しており、要点を一言でいえば、価格を付けるべき単位は100万トークンではなく、解決済みの会話1件だということだ。

実際に人々が語っていること

Grok 4.5はリリースされてまだ数時間しか経っていないため、検証可能な議論は通常のレビューサイトではなく、Hacker NewsやXに集中している。世論は3つの明確な陣営に分かれている。

ファン層はドルあたりの知能を気に入っている。Artificial Analysisは指摘した通り、「スコア54で第4位につけている」一方で、コストの面では「明らかにパレートフロンティア上」にある。

懐疑派は率直で、彼らの不満は能力そのものよりも、ビジネス環境における信頼に関するものだ。

Hacker News

「xAIのモデルが、返答を政治的なナラティブに合わせて積極的に形作ろうとしていると知っている以上、私はそのモデルを絶対に信頼できるとは思えない。裏側でモデルが操作されていると知っていながら、ビジネス環境で信頼できるモデルだとどうして言えるのか?」

同じスレッドには、実際にテストした人からの公平な反論もある。

Hacker News

「私のテストではほとんどの場合、GrokはGPTやGeminiよりも政治的に慎重だった……grok.comやアプリ内でのGrokはとても控えめだ。むしろ退屈なくらい控えめだと言ってもいい。」

そして、リーダーボードではなく手作業でコーディングの売り文句を検証する、現実確認派もいる。

Hacker News

「Claudeが一貫して最良の結果を出し、Grokが一貫して最悪の結果を出しているという記事を丸ごと書いておきながら、最悪の結果を最速で出したというだけの理由でGrokを勝者にするのは、なんとも奇妙だ。」

まとめると、コミュニティの評価は「安価、高速、信頼に値する実力はあるが未証明、そして一部の人にとっては信頼しづらい」というものだ。最後の点こそ、サポートのリーダーがじっくり考えるべきものだ。モデルが顧客と会話する以上、信頼こそがすべてだからだ。

新モデルがカスタマーサポートに変えること(そして変えないこと)

ここが私が最も気にかけている部分だ。私は検索意図が実際の購買にまつわる質問にどう変わるかを考えることに時間を使っており、「サポート用AIを新モデルに切り替えるべきか?」は、まさに今日多くの人が入力している質問だからだ。正直な答えはこうだ。AIサポートがうまく機能するかどうかを決めるのは、モデルの階級であることは滅多にない。

矢印でつながれた2つのパネル。左側は、モデルが提供するもの: 強力な推論、エージェント型ツール呼び出し、より少ないハルシネーション。右側は、実際のキューが必要とするもの: 自社の知識のみ、確信度ルーティング、過去のチケットでのシミュレーション、人間へのエスカレーション。キャプションには「モデルはエンジンであり、車そのものではない」とある
矢印でつながれた2つのパネル。左側は、モデルが提供するもの: 強力な推論、エージェント型ツール呼び出し、より少ないハルシネーション。右側は、実際のキューが必要とするもの: 自社の知識のみ、確信度ルーティング、過去のチケットでのシミュレーション、人間へのエスカレーション。キャプションには「モデルはエンジンであり、車そのものではない」とある

フロンティアモデルが与えてくれるのは3つ、強力な推論、エージェント型ツール呼び出し、より少ないハルシネーションだ。実際のサポートキューには、どのモデルにも標準搭載されていない、さらに4つのものが必要になる。自社の知識だけにスコープされた回答、確信が持てないときに沈黙を保つための確信度ベースのルーティング、本番投入前に実際のチケット履歴に対してシミュレーションする手段、そして人間へのクリーンなエスカレーションだ。私たちはこの3年以上、実際のサポートキューにAIエージェントを投入し続けてきたが、そのパターンは決して変わらない。成功も失敗も、この2つ目のリストから生まれるのであって、1つ目のリストからではない。

「最小限のハルシネーション」を例に取ろう。少ない方が良く、Grok 4.5がその主張に見合っているのは良いニュースだ。しかし、少ないことはゼロではなく、サポートキューにおける失敗のパターンは特定できる。

「最小限のハルシネーションでもゼロではない」と題されたビフォーアフター。左側では、生のモデルが「はい、それはサポートしています」と答え、自信満々に間違っている。右側では、確信度ゲートにより、同じ低確信度の回答が自動送信ではなく人間向けの下書きとして作成される
「最小限のハルシネーションでもゼロではない」と題されたビフォーアフター。左側では、生のモデルが「はい、それはサポートしています」と答え、自信満々に間違っている。右側では、確信度ゲートにより、同じ低確信度の回答が自動送信ではなく人間向けの下書きとして作成される

私たちが協力したあるチーム、Zendeskで月間約200件のチケットを処理し、2,000件規模へと拡大しつつあるB2Bの車両テレマティクスサポートグループでは、ボットがデータベースに存在しない自動車ブランドを、ヘルプセンターの一文に「すべての車種に対応しています」とあったせいで、堂々と対応可能だと確認してしまうのを目にした。フロンティアモデルはそれだけでは解決してくれない。これは知識のスコープ設定と確信度の問題であり、低確信度の回答を自動送信するのではなく、人間向けの下書きへとゲートすることで解決される。あるDTCサプリメントブランドのCXリーダーは、この原則を私よりもうまく言い表していた。

「AIが100%の質問に答えられるようになることは決してない。私が必要としているのは、自信を持って対応できるチケットだけを処理し、それ以外にはすべて手を出さないAIだ。」

それがすべてであり、これはモデルの問題ではなくワークフローの問題だ。だからこそ、確信度ベースのルーティングとハルシネーション対策のガードレールは、その下にあるモデルよりも解決率にとって重要なのだ。Hacker Newsでの信頼に関する懸念が、実は本物の購買シグナルである理由もここにある。モデルの挙動を制御できないなら、ベンチマークがどうであろうと顧客の前に出すことはできない。知識、ルーティング、そしてシミュレーションのステップを自社で所有していれば、基盤となるモデルは交換可能な部品になる。

eeselを試す

Grok 4.5を見てサポートスタックを作り直すべきか迷っているなら、より良い一手は、モデルを今すぐ賭けなければならない決断ではなく、後から変更できる細部にすることだ。eeselはまさにそれを実現するレイヤーだ。導入初日から過去のチケットとヘルプ文書から学習し、自社の知識のみに回答をスコープし、確信が持てないときは沈黙を保つよう確信度でルーティングし、そして1件でも実際の顧客に返信する前に、何千もの実際の過去チケットに対してシミュレーションできる。

eeselのAIヘルプデスクエージェントのページ。ヘルプデスクへの接続方法、過去のチケットや文書からの学習方法、本番投入前のカバレッジのシミュレーション方法を示している

これが、チームがリーダーボードの数字ではなく本物の数字を手にする方法だ。Gridwiseはeeselが導入初月にTier-1リクエストの73%を解決したのを目にしており、7日間のトライアル中からその兆候が現れていた。Zendesk、Freshdesk、Gorgias、Frontに接続し、下書きモードで開始し、実績を積んだチケットにのみ自律性を与えることができる。新しいモデルはワクワクするものだ。しかし成果を生むのはその裏側の仕組みだ。eeselは無料で試せる。50ドル分の利用枠付きで、クレジットカードも不要だ。

よくある質問

Grok 4.5とは何ですか、いつリリースされましたか?
Grok 4.5は、コーディング、エージェント型タスク、知識労働向けのxAIのフラッグシップモデルで、2026年7月8日に一般公開されました。50万トークンのコンテキストウィンドウ、設定可能な推論、Web検索およびX検索の組み込み機能を備えています。こうしたモデルをチケット対応に活用する仕組みをお探しなら、eeselのAIヘルプデスクエージェントをご覧ください。
Grok 4.5の料金はいくらですか?
Grok 4.5のAPI料金は、入力トークン100万あたり2.00ドル、出力トークン100万あたり6.00ドルで、キャッシュされた入力は100万あたり0.50ドルです。コンシューマー向けアクセスはGrokのSuperGrok各プランを通じて提供されます。ただし、トークン単価だけでは話の半分にすぎないため、実際のAIエージェント対人間のエージェントのコストと合わせて読むとよいでしょう。
Grok 4.5はClaudeやGPTより優れていますか?
独立系のArtificial Analysis Intelligence Indexでは、Grok 4.5はスコア54で第4位となり、Claude Fable 5、Claude Opus 4.8、GPT-5.5に次ぐ位置ですが、エージェント型ツール利用ではトップに立っています。サポート業務においてはモデル自体よりもその周りの仕組みの方が重要であり、だからこそカスタマーサービスに最適なAIエージェントは、単に最高スコアのLLMであることは滅多にありません。
Grok 4.5をカスタマーサポートに使えますか?
使うこと自体は可能ですが、生のモデルを本番のキューに投入すると、答えるべきでない場面でも自信満々に回答してしまいます。実際に顧客に返信する前に、自社の知識、ハルシネーション対策のガードレール、そして確信度ベースのルーティングで包み込む必要があります。
Grok 4.5は旧モデルよりハルシネーションが少ないですか?
xAIはハルシネーションの少なさをGrok 4.5の目玉特性として掲げており、少ないことは良いことです。しかし、少ないことはゼロではないため、顧客対応の業務では引き続き確信度ゲートと明確な知識スコープが必要です。詳しくは自動チケット解決のガイドをご覧ください。

Share this article

Kurnia Kharisma Agung Samiadjie

Article by

Kurnia Kharisma Agung Samiadjie

Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.

Related Posts

All posts →
ノートパソコンの前にいるAIチームメイトを、チェックリストと虫眼鏡を持った2人の同僚がレビューしているイラスト。左側にGrokのマークがある
Trending

Grok Botレビュー: 早期ベータで実際に使える機能とは

Grok Botは、すべてのAIチームメイトにクラウドコンピュータと実際のログイン情報を与える。ドキュメントの全ページと最初の1週間のユーザー報告を読み込み、実際に機能する部分を検証した。

Rama Adi NugrahaRama Adi NugrahaAug 13, 2026
デスクで2人の同僚と並んで働くAIチームメイトのイラスト。上部にはツールのアイコン、左にはGrokのロゴが描かれている
Trending

Grok Botとは何か:xAIの常時稼働AIチームメイトが実際にすること

Grok Botは、AIチームメイト一体一体に専用のクラウドコンピューターを与え、実際のツールにサインインさせる。その仕組み、料金、そして設計の破綻点を解説する。

Alicia Kirana UtomoAlicia Kirana UtomoAug 12, 2026
Grokのロゴ、ベンチマークバー、価格タグを描いたGrok 4.5レビューを表すエディトリアルイラスト
Trending

Grok 4.5レビュー: ベンチマーク、価格、そして評価

xAIのGrok 4.5は7月8日に登場し、Intelligence Indexで4位、リーダーボードで最高のエージェント型ツール使用スコアを記録した。ここでは実際のレビュー、ベンチマーク、価格、そして誰が実際に使うべきかを解説する。

Rama Adi NugrahaRama Adi NugrahaJul 9, 2026
Googleブルーの背景に浮かぶGemini 3.5 Flash-Liteのヒーローバナー
Trending

Gemini 3.5 Flash-Liteとは?価格と向いている用途を解説

Gemini 3.5 Flash-Liteは、Googleの最速・最安の3.5系モデルで、100万トークンあたり$0.30/$2.50です。その正体、料金、使うべき場面を解説します。

Rama Adi NugrahaRama Adi NugrahaJul 22, 2026
Google Blueの背景にあるGemini 3.6 Flash料金のヒーローバナー
Trending

Gemini 3.6 Flashの料金:2026年の全コスト内訳

Gemini 3.6 Flashは入力$1.50、出力$7.50(100万トークンあたり)。料金表の全体、見えにくいコスト、実際の運用コストを解説します。

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 22, 2026
Googleブルーの背景に浮かぶGemini 3.6 Flashのヒーローバナー
Trending

Gemini 3.6 Flashとは?できること・料金・向いている人を解説

Gemini 3.6 FlashはGoogleの新しい主力モデルです。出力トークンが17%減り、出力コストも下がり、コンテキストウィンドウは100万トークン。その正体と、どんな人に向いているかを解説します。

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 22, 2026
1つのAIモデルが一方のタスクはきれいに終わらせ、隣のタスクでは行き詰まる、開発者の作業台。Metaのブランドブルーで描かれている
Trending

Meta Muse Spark 1.1 レビュー:天井は高く、底は低いモデル

Muse Spark 1.1 はボード上で最速のモデルでありながら、エージェント性能では最下位クラス。この安価なトークンが実際にどの仕事で通用するのかをレビューする。

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieAug 5, 2026
Gemini 3.5 Flash Cyber hero banner on a Google-blue background
Trending

Gemini 3.5 Flash Cyberとは何か、誰が使えるのか

Gemini 3.5 Flash Cyberは、コードの脆弱性を発見して修正するためのGoogleのセキュリティモデルだ。何をするのか、CodeMenderがどう使っているのか、そしてなぜまだほとんどの人が触れないのかを解説する。

Alicia Kirana UtomoAlicia Kirana UtomoJul 22, 2026
Gemini 3.5 Flash-Liteの料金を紹介するGoogleブルーの背景のヒーローバナー
Trending

Gemini 3.5 Flash-Liteの料金:費用と向いている用途

Gemini 3.5 Flash-LiteはGoogleの最も安価なモデルで、100万トークンあたり$0.30/$2.50。料金表全体、実際のコスト例、向いている用途を解説する。

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 22, 2026

AIチームメイトを採用する準備はできましたか?

数分でセットアップ。クレジットカード不要。

無料で始める