Gemini 3.6 Flashの料金:2026年の全コスト内訳

Kurnia Kharisma Agung Samiadjie
執筆者

Kurnia Kharisma Agung Samiadjie

Katelin Teen
レビュー者

Katelin Teen

最終更新 August 6, 2026

専門家による検証済み
Google Blueの背景にあるGemini 3.6 Flash料金のヒーローバナー

Gemini 3.6 Flashの料金一覧

こちらがGoogleの料金ページをもとにした標準ティアの料金表全体です。選ぶ消費モードによって、他の何よりも料金が大きく変わります。

消費モード入力(100万あたり)出力(thinking含む)コンテキストキャッシュ
Standard$1.50$7.50$0.15
Batch(50%オフ)$0.75$3.75$0.075
Flex$0.75$3.75$0.075
Priority$2.70$13.50$0.27
無料ティア無料無料無料

簡単に言うと、Standardがデフォルトで、BatchとFlexはリアルタイム性が不要な作業向けに同じ50%オフの料金、Priorityは低遅延を保証するために1.8倍の料金がかかります。100万あたり$0.15のコンテキストキャッシュは、多くのチームが使いこなせていないレバーです。毎回の呼び出しで同じシステムプロンプトやナレッジのチャンクに対して入力料金を払い直さずに済みます。これはGeminiファミリーの中で最新の主力モデルであり、以前は3.5 Flashを使っていた場面に収まります。

実際のコストを計算する

見出しの料金は、実際のトラフィックにかけ合わせてこそ意味を持ちます。月間のリクエスト数と平均トークン数を入力すると、標準ティアとバッチティアの月間コスト、およびリクエストあたりのコストが分かります。

ここから多くのチームが学ぶ教訓は、実際のボリュームでは出力トークンが請求額を支配するという点です。だからこそ$9.00→$7.50への出力カットが最大の変更点であり、100万あたり数セント安いモデルよりも、少ないトークンで完了するモデルの方が価値があるのです。

Gemini 3.5 Flashからの変更点

世代間の変化は、痛いところであるコスト面での純粋な改善です。標準ティアでの両モデルの比較を、予算重視の選択肢と並べて見てみましょう。

モデル入力(100万あたり)出力(100万あたり)位置づけ
Gemini 3.6 Flash$1.50$7.50最も高性能なFlash、速度重視で設計
Gemini 3.5 Flash$1.50$9.00前世代のフラッグシップFlash
Gemini 3.5 Flash-Lite$0.30$2.50最も安価なGAモデル、高ボリューム作業向け
Gemini 3.6 Flashは3.5 Flashよりも出力トークンあたりの品質が高いことを示す図。9to5Googleより引用
Gemini 3.6 Flashは3.5 Flashよりも出力トークンあたりの品質が高いことを示す図。9to5Googleより引用

実際には二つの節約が重なっています。一つ目は約17%低い出力料金です。二つ目はトークン効率です。Artificial Analysis Indexによると、3.6 Flashは同じ作業を行うのに17%少ない出力トークンで済み、DeepSWEのようなエージェント型ベンチマークではその差が65%に達しました(タスクあたりの平均出力が276Kトークンから97Kトークンに減少)。低い料金と少ないトークン数が組み合わさることで、実際のワークロードでの節約効果は見た目の料金カットよりも大きくなります。バッチティアでも同様の傾向が見られます。3.6 Flashのバッチは$0.75/$3.75で、3.5 Flashの$0.75/$4.50より安くなっています。

ベンダー間で比較すると、この$7.50という出力料金はClaude Sonnet 5(定価で出力約$15)を大きく下回りながら、多くのエージェント型作業では同程度の品質帯に収まります。フラッグシップクラスを本当に求めているなら、3.5 Proの提供が遅れている間、Google自身が提供するGeminiの代替候補も検討する価値があります。

料金表に載っていない隠れたコスト

ここが、実際の請求額が見出しの$1.50/$7.50から外れていくポイントです。多くのチームが見落としがちな4つの項目があります。

  • thinkingトークンは出力として課金されます。 3.6 Flashはthinkingに対応しており、その推論トークンは$7.50の出力料金に加算されます。トークン効率の向上は助けになりますが、推論の多いプロンプトは見た目の回答の長さよりも高く課金されます。
  • 検索グラウンディングは別枠で計測されます。 Gemini 3ファミリー全体で月5,000件のグラウンディング付きプロンプトまで無料ですが、それを超えると1,000件の検索クエリあたり$14かかり、1件の顧客リクエストで複数の課金対象クエリが発生することもあります。
  • 無料ティアはデータを学習に利用します。 無料ティアでは、Googleはコンテンツを自社製品の改善に利用します。有料ティアではこれは行われません。顧客データを扱う用途では、この点だけで無料ティアは選択肢から外れます。
  • Priorityモードは1.8倍の追加料金です。 低遅延を保証したい場合、Priorityは$2.70/$13.50となり、標準料金のほぼ2倍です。ほとんどのチームには不要ですが、うっかり有効にしたまま忘れてしまうこともあります。

Gemini 3.6 Flash対3.5 Flash-Lite:安価なモデルが勝つ場面

Geminiの請求額を減らす最も効果的な方法は、実は3.6 Flashを使うことではなく、単純な作業をGemini 3.5 Flash-Liteに振り分けることであることが多いです。$0.30/$2.50のFlash-Liteは入力が約5倍、出力が約3倍安く、毎秒約350出力トークンの速度で動作します。

判断基準はブランドへの好みではなく、推論の深さです。コーディングや複数システムに触れるエージェント、複雑なサポートチケットのように本当に複数ステップの推論が必要な作業には3.6 Flashを使いましょう。1件ごとの内容が単純でボリュームが多い、一次的なチケットトリアージやよくある質問のライブチャット対応の削減にはFlash-Liteを使いましょう。多くの本番スタックは両方を運用し、難易度に応じて振り分けており、これが最もコストを抑えた構成です。本物のエージェントを作るかルールベースのボットにするかは、モデル選びとは別の判断です。

アカウントティア、支出上限、レート制限

Geminiの料金は、レート制限ページにある、あなたの請求アカウントがどの利用ティアに属しているかによっても左右されます。

利用ティア条件課金上限
無料アクティブなプロジェクトまたは無料トライアルなし
Tier 1有効な請求先アカウントの連携$250
Tier 2$100支払い+3日経過$2,000
Tier 3$1,000支払い+30日経過$20,000以上

実務上の注意点が二つあります。まず、支出に基づくレート制限は10分間のローリングウィンドウで動作し(Tier 1は$10、Tier 2と3は$200が上限)、これを超えると429 RESOURCE_EXHAUSTEDエラーが返されるため、トラフィックの急増によって月間予算に達する前にスロットリングされることがあります。次に、本当に大規模に運用する場合、GoogleのEnterpriseティアには、公開料金表には載っていないプロビジョニングされたスループットやボリュームディスカウントが用意されています。コンシューマー向けGeminiプランとの比較については、Geminiの料金ガイドGemini Workspaceの料金で詳しく解説しています。

サポートエージェントを運用する実際のコスト

ここは、モデルの料金について書かれた記事のほとんどが省略している部分であり、目的がカスタマーサポートであるなら、トークン料金をあまり重視しすぎない方がいいと私が言う理由です。

安くて速いモデルが登場するのは良いニュースです。しかし$1.50/$7.50は素のエンジンのコストであって、車全体のコストではありません。私はこの3年以上、実際のサポートキューでAIを運用してきましたが、繰り返し見てきた失敗はモデルが高すぎることではなく、モデルの周りのレイヤーに誰も投資しなかったために、自信満々な口調のボットが誤った回答をしてしまうことです。その周辺のレイヤーこそが本当のコストです。

サポートエージェントの最下層はモデルであり、その上に検索(リトリーバル)、ガードレール、シミュレーション、ヘルプデスク連携が積み重なっている図
サポートエージェントの最下層はモデルであり、その上に検索(リトリーバル)、ガードレール、シミュレーション、ヘルプデスク連携が積み重なっている図

ヘルプセンター全体を対象にした検索により、推測ではなく実際のドキュメントから回答できるようになります。ハルシネーション対策のガードレールにより、返金ポリシーを勝手に作り出すのではなく、きれいにハンドオフできます。連携機能により、チケッティングシステムの中で実際に動作できます。そしてテストにより、顧客に触れる前にどう振る舞うかを把握できます。これを生のAPI上で自分で構築するなら、支払っているのは100万トークンあたり$7.50ではなく、検索、シミュレーション、あらゆるヘルプデスク連携をゼロから作り、数週間ごとにモデルが変わるたびに保守し続けるエンジニアリングチームのコストです。これが、DIYスタックよりも専用に作られたヘルプデスクAIを使うべき理由であり、AIチャットボットの問題がほとんどの場合、モデルのティアではなく配管部分に原因があるという理由でもあります。

eeselを試す

これこそ、eeselが担うために作られたレイヤーです。既存のヘルプデスクに接続するだけで、過去のチケットやナレッジベースからそのまま学習し、Geminiのようなフロンティアモデルの上で動作するため、APIを自分で組んだりトークン計算をしたりせずに効率化のメリットを得られます。

解決率とコスト分析を表示するeesel AIのレポートダッシュボード
解決率とコスト分析を表示するeesel AIのレポートダッシュボード

料金にとって最も重要な二つのポイントは、トークン料金では分からないものです。まず、eeselでは実際の顧客に応答する前に、過去のチケットに対してエージェントをシミュレーションできるため、解決率や実際に送られるであろう返信内容を確認でき、支出が何に使われるかを推測する必要がありません。次に、実際に行った作業に対して課金されるため、トークン単位ではなく解決件数単位で料金が決まり、忙しい月でも予期しないAPI料金の請求に驚くことがありません。サポート自動化のためにモデルのコストを検討しているなら、まず得たい成果から考え、配管部分はプラットフォームに任せましょう。無料でお試しいただけます。

Frequently Asked Questions

Gemini 3.6 Flashの料金はいくらですか?
標準の有料ティアでは、Gemini 3.6 Flashの料金は入力100万トークンあたり$1.50、出力100万トークンあたり$7.50です(出力にはthinkingトークンも含まれます)。バッチモードは一律50%オフの$0.75/$3.75で、無料ティアもありますが、その場合Googleがコンテンツを自社製品の改善に利用する可能性があります。Geminiファミリー全体についてはGeminiの料金ガイドを参照してください。
Gemini 3.6 FlashはGemini 3.5 Flashと比べて料金はどうですか?
入力は100万トークンあたり$1.50で変わりませんが、出力はGemini 3.5 Flashの$9.00から3.6 Flashでは$7.50に下がり、費用がかさみやすい出力側で約17%のカットとなります。さらにタスクあたりの出力トークンも約17%少なくなるため、同じエージェント型のワークロードでも実際の運用コストはかなり下がります。
Gemini 3.6 FlashはGemini 3.5 Flash-Liteより安いですか?
いいえ。Gemini 3.5 Flash-Liteは3.6 Flashに比べて入力が約5倍安く($0.30)、出力も約3倍安い($2.50)です。Flash-Liteはトリアージや翻訳のような高ボリューム・低推論のタスクに向いており、3.6 Flashは複数ステップの推論が必要な作業向けです。
Gemini 3.6 Flashに無料ティアはありますか?
はい。Gemini 3.6 Flashは標準モードの無料ティアでは無料で利用できますが、その場合Googleはコンテンツを自社製品の改善に利用します。顧客データを扱う用途では、コンテンツが学習に使われない有料ティアを利用してください。Batch、Flex、Priorityの各モードは有料ティア専用です。
Gemini 3.6 Flashの料金に隠れたコストはありますか?
thinkingトークンは出力として課金され、検索グラウンディングは月5,000プロンプトの無料枠を超えると1,000クエリあたり$14かかり、1件の顧客リクエストで複数の課金対象クエリが発生することもあります。Priorityモードは標準料金の1.8倍です。これらの項目が、見出しの$1.50/$7.50から実際の請求額を大きくずらす要因です。
Gemini 3.6 Flashでカスタマーサポートエージェントを運用するコストはどれくらいですか?
トークン料金は実際のコストのごく一部にすぎません。実際に機能するサポートエージェントには、モデルに加えて検索(リトリーバル)、ガードレール、テスト、ヘルプデスクとの連携が必要です。AIカスタマーサービスソフトウェアのようなプラットフォームは、トークン単位ではなくチケットごとの実作業に対して課金するため、会話ごとにトークン計算をする必要がありません。
Gemini 3.6 FlashはGPT-5.6やClaudeと料金を比べるとどうですか?
$1.50/$7.50のGemini 3.6 Flashは、出力面でClaude Sonnet 5(定価で概ね$3/$15)を大きく下回りながら、多くのエージェント型タスクで同程度の品質帯に収まります。詳しくはGemini対ClaudeGemini対ChatGPTの比較記事をご覧ください。

Share this article

Kurnia Kharisma Agung Samiadjie

Article by

Kurnia Kharisma Agung Samiadjie

Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.

Related Posts

All posts →
Googleブルーの背景に浮かぶGemini 3.5 Flash-Liteのヒーローバナー
Trending

Gemini 3.5 Flash-Liteとは?価格と向いている用途を解説

Gemini 3.5 Flash-Liteは、Googleの最速・最安の3.5系モデルで、100万トークンあたり$0.30/$2.50です。その正体、料金、使うべき場面を解説します。

Rama Adi NugrahaRama Adi NugrahaJul 22, 2026
Googleブルーの背景に浮かぶGemini 3.6 Flashのヒーローバナー
Trending

Gemini 3.6 Flashとは?できること・料金・向いている人を解説

Gemini 3.6 FlashはGoogleの新しい主力モデルです。出力トークンが17%減り、出力コストも下がり、コンテキストウィンドウは100万トークン。その正体と、どんな人に向いているかを解説します。

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 22, 2026
Gemini 3.5 Flash Cyber hero banner on a Google-blue background
Trending

Gemini 3.5 Flash Cyberとは何か、誰が使えるのか

Gemini 3.5 Flash Cyberは、コードの脆弱性を発見して修正するためのGoogleのセキュリティモデルだ。何をするのか、CodeMenderがどう使っているのか、そしてなぜまだほとんどの人が触れないのかを解説する。

Alicia Kirana UtomoAlicia Kirana UtomoJul 22, 2026
Gemini 3.5 Flash-Liteの料金を紹介するGoogleブルーの背景のヒーローバナー
Trending

Gemini 3.5 Flash-Liteの料金:費用と向いている用途

Gemini 3.5 Flash-LiteはGoogleの最も安価なモデルで、100万トークンあたり$0.30/$2.50。料金表全体、実際のコスト例、向いている用途を解説する。

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 22, 2026
ヒューマノイドロボットの制御モデルを描いたイラスト、Gemini Robotics 2を表現
Trending

Gemini Robotics 2:DeepMind自身の数字が示すもの

Gemini Robotics 2は3つのモデルを同時に出し、タスク別成功率の表ではほとんどのスコアが80%を下回る。この表こそ、今回のリリースで最も役に立つ部分だ。

Alicia Kirana UtomoAlicia Kirana UtomoAug 4, 2026
画像、動画、文書のパネルがビジョン言語モデルに入力される様子を描いたイラスト、Qwenのロゴ付き
Trending

Qwen 3.7 Flash: スペック、価格、そして実際にできること

Qwen 3.7 Flashはブログ記事もベンチマークも重みの公開もないまま登場した。ここでは完全なスペックシート、段階的な料金、そしてQwenが決して主張しなかったことをまとめる。

Alicia Kirana UtomoAlicia Kirana UtomoJul 31, 2026
Image alt text
Guides

Gemini Agentic Visionの概要:その仕組みとAIにとっての意味

GoogleのGemini Agentic Visionは、Gemini 3 Flashモデルの新機能であり、AIの画像への関わり方を変えるものです。受動的な閲覧を、より高い精度を実現するための能動的で多段階の調査へと転換させます。

Stevia PutriStevia PutriJan 30, 2026
単一バイナリとして動作するセルフホスト型AIエージェントランタイムのイラスト
Trending

ZeroClawレビュー:オープンソースAIエージェントランタイムを正直に検証

ZeroClawの正直なレビュー:オープンソースでRustベースのAIエージェントランタイムが優れている点、セキュリティ面での不安、そして避けるべき人について解説します。

Rama Adi NugrahaRama Adi NugrahaJul 19, 2026
Inklingの代替としてのAIモデル比較を表すエディトリアルイラスト
Trending

2026年版 Inklingの代替8選

Inklingはオープンで興味深いモデルだが、オープンウェイトとしては高価で、実行できる中で最も賢いモデルというわけでもない。実際に試す価値のある8つの代替モデルを、実際の価格とそれぞれの強みとともに紹介する。

Rama Adi NugrahaRama Adi NugrahaJul 20, 2026

AIチームメイトを採用する準備はできましたか?

数分でセットアップ。クレジットカード不要。

無料で始める