
Gemini 3.6 Flashの料金一覧
こちらがGoogleの料金ページをもとにした標準ティアの料金表全体です。選ぶ消費モードによって、他の何よりも料金が大きく変わります。
| 消費モード | 入力(100万あたり) | 出力(thinking含む) | コンテキストキャッシュ |
|---|---|---|---|
| Standard | $1.50 | $7.50 | $0.15 |
| Batch(50%オフ) | $0.75 | $3.75 | $0.075 |
| Flex | $0.75 | $3.75 | $0.075 |
| Priority | $2.70 | $13.50 | $0.27 |
| 無料ティア | 無料 | 無料 | 無料 |
簡単に言うと、Standardがデフォルトで、BatchとFlexはリアルタイム性が不要な作業向けに同じ50%オフの料金、Priorityは低遅延を保証するために1.8倍の料金がかかります。100万あたり$0.15のコンテキストキャッシュは、多くのチームが使いこなせていないレバーです。毎回の呼び出しで同じシステムプロンプトやナレッジのチャンクに対して入力料金を払い直さずに済みます。これはGeminiファミリーの中で最新の主力モデルであり、以前は3.5 Flashを使っていた場面に収まります。
実際のコストを計算する
見出しの料金は、実際のトラフィックにかけ合わせてこそ意味を持ちます。月間のリクエスト数と平均トークン数を入力すると、標準ティアとバッチティアの月間コスト、およびリクエストあたりのコストが分かります。
ここから多くのチームが学ぶ教訓は、実際のボリュームでは出力トークンが請求額を支配するという点です。だからこそ$9.00→$7.50への出力カットが最大の変更点であり、100万あたり数セント安いモデルよりも、少ないトークンで完了するモデルの方が価値があるのです。
Gemini 3.5 Flashからの変更点
世代間の変化は、痛いところであるコスト面での純粋な改善です。標準ティアでの両モデルの比較を、予算重視の選択肢と並べて見てみましょう。
| モデル | 入力(100万あたり) | 出力(100万あたり) | 位置づけ |
|---|---|---|---|
| Gemini 3.6 Flash | $1.50 | $7.50 | 最も高性能なFlash、速度重視で設計 |
| Gemini 3.5 Flash | $1.50 | $9.00 | 前世代のフラッグシップFlash |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | 最も安価なGAモデル、高ボリューム作業向け |

実際には二つの節約が重なっています。一つ目は約17%低い出力料金です。二つ目はトークン効率です。Artificial Analysis Indexによると、3.6 Flashは同じ作業を行うのに17%少ない出力トークンで済み、DeepSWEのようなエージェント型ベンチマークではその差が65%に達しました(タスクあたりの平均出力が276Kトークンから97Kトークンに減少)。低い料金と少ないトークン数が組み合わさることで、実際のワークロードでの節約効果は見た目の料金カットよりも大きくなります。バッチティアでも同様の傾向が見られます。3.6 Flashのバッチは$0.75/$3.75で、3.5 Flashの$0.75/$4.50より安くなっています。
ベンダー間で比較すると、この$7.50という出力料金はClaude Sonnet 5(定価で出力約$15)を大きく下回りながら、多くのエージェント型作業では同程度の品質帯に収まります。フラッグシップクラスを本当に求めているなら、3.5 Proの提供が遅れている間、Google自身が提供するGeminiの代替候補も検討する価値があります。
料金表に載っていない隠れたコスト
ここが、実際の請求額が見出しの$1.50/$7.50から外れていくポイントです。多くのチームが見落としがちな4つの項目があります。
- thinkingトークンは出力として課金されます。 3.6 Flashはthinkingに対応しており、その推論トークンは$7.50の出力料金に加算されます。トークン効率の向上は助けになりますが、推論の多いプロンプトは見た目の回答の長さよりも高く課金されます。
- 検索グラウンディングは別枠で計測されます。 Gemini 3ファミリー全体で月5,000件のグラウンディング付きプロンプトまで無料ですが、それを超えると1,000件の検索クエリあたり$14かかり、1件の顧客リクエストで複数の課金対象クエリが発生することもあります。
- 無料ティアはデータを学習に利用します。 無料ティアでは、Googleはコンテンツを自社製品の改善に利用します。有料ティアではこれは行われません。顧客データを扱う用途では、この点だけで無料ティアは選択肢から外れます。
- Priorityモードは1.8倍の追加料金です。 低遅延を保証したい場合、Priorityは$2.70/$13.50となり、標準料金のほぼ2倍です。ほとんどのチームには不要ですが、うっかり有効にしたまま忘れてしまうこともあります。
Gemini 3.6 Flash対3.5 Flash-Lite:安価なモデルが勝つ場面
Geminiの請求額を減らす最も効果的な方法は、実は3.6 Flashを使うことではなく、単純な作業をGemini 3.5 Flash-Liteに振り分けることであることが多いです。$0.30/$2.50のFlash-Liteは入力が約5倍、出力が約3倍安く、毎秒約350出力トークンの速度で動作します。
判断基準はブランドへの好みではなく、推論の深さです。コーディングや複数システムに触れるエージェント、複雑なサポートチケットのように本当に複数ステップの推論が必要な作業には3.6 Flashを使いましょう。1件ごとの内容が単純でボリュームが多い、一次的なチケットトリアージやよくある質問のライブチャット対応の削減にはFlash-Liteを使いましょう。多くの本番スタックは両方を運用し、難易度に応じて振り分けており、これが最もコストを抑えた構成です。本物のエージェントを作るかルールベースのボットにするかは、モデル選びとは別の判断です。
アカウントティア、支出上限、レート制限
Geminiの料金は、レート制限ページにある、あなたの請求アカウントがどの利用ティアに属しているかによっても左右されます。
| 利用ティア | 条件 | 課金上限 |
|---|---|---|
| 無料 | アクティブなプロジェクトまたは無料トライアル | なし |
| Tier 1 | 有効な請求先アカウントの連携 | $250 |
| Tier 2 | $100支払い+3日経過 | $2,000 |
| Tier 3 | $1,000支払い+30日経過 | $20,000以上 |
実務上の注意点が二つあります。まず、支出に基づくレート制限は10分間のローリングウィンドウで動作し(Tier 1は$10、Tier 2と3は$200が上限)、これを超えると429 RESOURCE_EXHAUSTEDエラーが返されるため、トラフィックの急増によって月間予算に達する前にスロットリングされることがあります。次に、本当に大規模に運用する場合、GoogleのEnterpriseティアには、公開料金表には載っていないプロビジョニングされたスループットやボリュームディスカウントが用意されています。コンシューマー向けGeminiプランとの比較については、Geminiの料金ガイドとGemini Workspaceの料金で詳しく解説しています。
サポートエージェントを運用する実際のコスト
ここは、モデルの料金について書かれた記事のほとんどが省略している部分であり、目的がカスタマーサポートであるなら、トークン料金をあまり重視しすぎない方がいいと私が言う理由です。
安くて速いモデルが登場するのは良いニュースです。しかし$1.50/$7.50は素のエンジンのコストであって、車全体のコストではありません。私はこの3年以上、実際のサポートキューでAIを運用してきましたが、繰り返し見てきた失敗はモデルが高すぎることではなく、モデルの周りのレイヤーに誰も投資しなかったために、自信満々な口調のボットが誤った回答をしてしまうことです。その周辺のレイヤーこそが本当のコストです。

ヘルプセンター全体を対象にした検索により、推測ではなく実際のドキュメントから回答できるようになります。ハルシネーション対策のガードレールにより、返金ポリシーを勝手に作り出すのではなく、きれいにハンドオフできます。連携機能により、チケッティングシステムの中で実際に動作できます。そしてテストにより、顧客に触れる前にどう振る舞うかを把握できます。これを生のAPI上で自分で構築するなら、支払っているのは100万トークンあたり$7.50ではなく、検索、シミュレーション、あらゆるヘルプデスク連携をゼロから作り、数週間ごとにモデルが変わるたびに保守し続けるエンジニアリングチームのコストです。これが、DIYスタックよりも専用に作られたヘルプデスクAIを使うべき理由であり、AIチャットボットの問題がほとんどの場合、モデルのティアではなく配管部分に原因があるという理由でもあります。
eeselを試す
これこそ、eeselが担うために作られたレイヤーです。既存のヘルプデスクに接続するだけで、過去のチケットやナレッジベースからそのまま学習し、Geminiのようなフロンティアモデルの上で動作するため、APIを自分で組んだりトークン計算をしたりせずに効率化のメリットを得られます。

料金にとって最も重要な二つのポイントは、トークン料金では分からないものです。まず、eeselでは実際の顧客に応答する前に、過去のチケットに対してエージェントをシミュレーションできるため、解決率や実際に送られるであろう返信内容を確認でき、支出が何に使われるかを推測する必要がありません。次に、実際に行った作業に対して課金されるため、トークン単位ではなく解決件数単位で料金が決まり、忙しい月でも予期しないAPI料金の請求に驚くことがありません。サポート自動化のためにモデルのコストを検討しているなら、まず得たい成果から考え、配管部分はプラットフォームに任せましょう。無料でお試しいただけます。
Frequently Asked Questions
Gemini 3.6 Flashの料金はいくらですか?
Gemini 3.6 FlashはGemini 3.5 Flashと比べて料金はどうですか?
Gemini 3.6 FlashはGemini 3.5 Flash-Liteより安いですか?
Gemini 3.6 Flashに無料ティアはありますか?
Gemini 3.6 Flashの料金に隠れたコストはありますか?
Gemini 3.6 Flashでカスタマーサポートエージェントを運用するコストはどれくらいですか?
Gemini 3.6 FlashはGPT-5.6やClaudeと料金を比べるとどうですか?

Article by
Kurnia Kharisma Agung Samiadjie
Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.







