Gemini 3.6 Flashとは?できること・料金・向いている人を解説

Kurnia Kharisma Agung Samiadjie
執筆者

Kurnia Kharisma Agung Samiadjie

Katelin Teen
レビュー者

Katelin Teen

最終更新 August 6, 2026

専門家による検証済み
Googleブルーの背景に浮かぶGemini 3.6 Flashのヒーローバナー

Gemini 3.6 Flashの正体

Gemini 3.6 Flashのタイトルアート、Googleより提供
Gemini 3.6 Flashのタイトルアート、Googleより提供

GoogleはGeminiファミリーを大きく2つのラインに分けています。Proモデルは難しい推論やコーディング向けの最上位モデルで、Flashモデルはワークホース、つまり低コストで高速、1日に何千回も呼び出されるプロダクションアプリ向けに調整されたモデルです。Gemini 3.6 Flashはそのワークホースの最新版で、I/O 2026のリリース以降の開発者フィードバックを反映した3.5 Flashの直接的な進化版です。

Googleの言葉を借りれば、そのねらいは「フロンティアの知能と優れた検索・グラウンディングを組み合わせた、速度のためのモデル」です。実際には、単発の難しいリサーチ課題を解くためというより、信頼性高く安価に動かし続ける必要があるAIエージェントを組み立てるときに手を伸ばすモデルということです。テキスト、画像、動画、音声、PDFを入力として扱え、関数呼び出しと構造化出力に対応し、いまではコンピュータユースも標準搭載のツールとして含まれています。

ローンチ関連の報道の多くが飛ばしている正直な捉え方はこうです。実運用のユースケースの大部分では、Flashクラスのモデルはすでに十分すぎるほど優秀です。2026年に問われるべき本当の質問は「このモデルは十分に賢いか」ではなく、「これを100万回動かすと一体いくらかかるのか」です。3.6 Flashはまさにその質問に答えるために作られています。

見出しの数字:仕事は増え、トークンは減る

Googleが打ち出す数字はトークン効率です。Artificial Analysis Indexによると、3.6 Flashは同じ仕事をするのに3.5 Flashより出力トークンが17%少ないとされています。一部のエージェント的なベンチマークではその差はさらに大きく、DeepSWEではGoogleの計測で最大65%の出力トークン削減が確認され、1タスクあたりの平均出力は276Kトークンから97Kトークンまで下がりました。

Gemini 3.6 FlashはDeepSWEとArtificial Analysis Indexにおいて、3.5 Flashより1タスクあたりの出力トークンが大幅に少ない、Google提供のデータより
Gemini 3.6 FlashはDeepSWEとArtificial Analysis Indexにおいて、3.5 Flashより1タスクあたりの出力トークンが大幅に少ない、Google提供のデータより

これが生の品質スコアより重要なのはなぜでしょうか。出力トークンは料金の高い側であり、より少ない推論ステップとツール呼び出しで答えに到達するエージェントは、その分速く、脱線しにくくもなるからです。Googleによれば、3.6 Flashはマルチステップのワークフローを完了するのにより少ない推論ステップとツール呼び出しで済み、コストを静かに膨らませる冗長な饒舌さも減っています。これを月に数万件のチケットを処理するサポートキュー全体に掛け合わせると、積み重なる節約こそがこの話のすべてです。

Gemini 3.6 Flashの料金

全体像はこうです。意味のある変更は出力価格で、入力は1.50ドルのまま、出力は100万トークンあたり7.50ドルに下がります。

利用モード入力(100万トークンあたり)出力(思考込み)コンテキストキャッシュ
標準$1.50$7.50$0.15
バッチ(50%オフ)$0.75$3.75$0.075
Flex$0.75$3.75$0.075
優先(Priority)$2.70$13.50$0.27
無料プラン無料無料無料

スプレッドシートに入力する前に、押さえておくべき点がいくつかあります。

  • 無料プランには落とし穴があります。 無料プランでは、Googleはコンテンツを製品改善に利用します。有料プランではそれはありません。顧客データを扱うものであれば、その一点だけで無料プランは選択肢から外れます。
  • 検索グラウンディングは別料金です。 Gemini 3ファミリー全体で月5,000回までのグラウンディング付きプロンプトが無料ですが、それを超えると1,000検索クエリあたり14ドルになり、顧客からの1件のリクエストが複数の課金対象クエリを発生させることもあります。
  • バッチモードは一律50%オフです。 リアルタイム性が不要な作業向けです。

コンシューマー向けGeminiプランや他のAPI料金レベルとの比較については、Geminiの料金ガイドに全体像があり、Gemini Workspaceの料金は法人向けプランをカバーしています。

GPT-5.6・Claudeとの比較

Googleは直接対決の比較表を公開しており、3.6 Flashが勝っていない部分についても意外なほど正直です。コンピュータユース(OSWorld-Verified 83.0%)、チャート推論、長尺動画の理解、そして他のモデルがほぼ結果を出せていない過酷な100万トークンのGDM-MRCRテストでのロングコンテキスト再現(54.0%)ではリードしています。しかしGPT-5.6 LunaClaude Sonnet 5は、いくつかのコーディングや知識労働系ベンチマークでいまもリードを保っています。

Gemini 3.6 FlashをGPT-5.6 Luna、Grok 4.5、Claude Sonnet 5と価格・ベンチマークで比較したGoogleの表、Googleより提供
Gemini 3.6 FlashをGPT-5.6 Luna、Grok 4.5、Claude Sonnet 5と価格・ベンチマークで比較したGoogleの表、Googleより提供

もっと役に立つ見方は、能力あたりの価格です。1.50ドル/7.50ドルという価格で、3.6 FlashはClaude Sonnet 5(リスト価格で概ね3ドル/15ドル)を出力コストで大きく下回りながら、多くのエージェント的な作業では同程度の品質帯に収まっています。それこそがFlashラインの勝ち筋です。「リーダーボードで最も賢いモデル」ではなく、「大量に実行する作業に対して最もコストパフォーマンスの良いモデル」であることです。両者を直接比較検討しているなら、Gemini vs ClaudeGemini vs ChatGPTで詳しく解説しています。

自社の前世代モデルと比べると、エージェント系ベンチマーク全体できれいな世代間の伸びが見られます。

Gemini 3.6 FlashはDeepSWE、MLE-Bench、知識労働、コンピュータユースにおいて3.1 Proと3.5 Flashを上回る、Google提供のデータより
Gemini 3.6 FlashはDeepSWE、MLE-Bench、知識労働、コンピュータユースにおいて3.1 Proと3.5 Flashを上回る、Google提供のデータより

コーディングはDeepSWEで37%から49%に、機械学習エンジニアリングはMLE-Benchで49.7%から63.9%に、知識労働はGDPval-AAで1349から1421に上昇しています。ナレッジカットオフも2025年1月から2026年3月へと前進しており、直近の出来事について答えるエージェントにとっては重要な点です。

同時に出荷された2つのモデル

3.6 Flashは単独ではありませんでした。Googleは同じ日に3つのモデルを出荷しており、どれがどれなのかを知っておくと、間違ったモデルを選ばずに済みます。

2026年7月のGeminiラインアップ:3.6 Flashと3.5 Flash-Liteが出荷、3.5 Flash Cyberはパイロット中、3.5 Proは延期、Gemini 4は予告のみ
2026年7月のGeminiラインアップ:3.6 Flashと3.5 Flash-Liteが出荷、3.5 Flash Cyberはパイロット中、3.5 Proは延期、Gemini 4は予告のみ

Gemini 3.5 Flash-Liteは3.5クラスで最速・最安のモデルで、入力0.30ドル/出力2.50ドル出力350トークン/秒です。エージェント的な検索、文書処理、翻訳といった大量・低レイテンシーの仕事向けに作られており、Google検索の内部にも展開が進んでいます。前世代からの伸びは大きなものです。

Gemini 3.5 Flash-Liteはエージェント的なターミナルコーディングと知識労働で3.1 Flash-Liteを上回る、Google提供のデータより
Gemini 3.5 Flash-Liteはエージェント的なターミナルコーディングと知識労働で3.1 Flash-Liteを上回る、Google提供のデータより

Gemini 3.5 Flash Cyberは、GoogleのCodeMenderエージェント内で動く、セキュリティ脆弱性の発見と修正に特化したスペシャリストモデルです。デュアルユース(軍民両用)の性質を踏まえ、政府機関と信頼されたパートナーのみに限定パイロットとして提供されており、多くのチームが直接触れることはありません。

では2つの汎用モデルのうち、実際にどちらを選ぶべきでしょうか。目安はシンプルです。

分岐点:複数ステップの推論、コーディング、複雑なチケットにはGemini 3.6 Flash、大量処理・単純なトリアージ・翻訳にはGemini 3.5 Flash-Lite
分岐点:複数ステップの推論、コーディング、複雑なチケットにはGemini 3.6 Flash、大量処理・単純なトリアージ・翻訳にはGemini 3.5 Flash-Lite

本当の推論が必要な仕事、つまりマルチステップのエージェント、コーディング、複数のシステムに触れる複雑なサポートチケットには3.6 Flashを使いましょう。個々の項目が単純な大量処理、たとえば一次的なチケットのトリアージや、よくある質問のライブチャットの一次対応にはFlash-Liteを使いましょう。実際のエージェントを作るかスクリプト型のボットにするかは、モデル選びとは別の判断です。

部屋の中の象:Gemini 3.5 Proの不在

この発表で最も物語っているのは、含まれていなかったものです。GoogleのフラッグシップであるProモデルは2026年2月に最終更新されたままで、3.5 Proは5月に「すでに社内で使われている」と予告されていました。それでもまだ出荷されていません。Bloombergの報道によれば、Googleは社内の性能目標を下回ったことで遅延しているとされています。

同じ時期にOpenAIはGPT-5.6を展開し、AnthropicはClaude Sonnet 5を出荷し、Fable 5を拡大しました。Googleの今の判断は、フラッグシップが仕上がるまで、収益を稼ぐ大量処理向けのFlash階層を新鮮かつ安価に保つというものです。DeepMindのLogan Kilpatrickは述べています、3.5 Proはパートナーとテスト中で「近いうちに登場する」はずであり、チームはすでにGemini 4に向けた「これまでで最も野心的な事前学習ラン」を開始しているとのことです。今すぐトップクラスのモデルが必要なら、Geminiの代替ツールのまとめ記事が、待っている間に見るべき正直な選択肢です。

サポート向けAIを構築するならどういう意味を持つか

ここで率直に言わせてください。モデル発表の記事の多くが、サポートチームに対してここを間違えます。

安くて速いモデルは良いニュースです。しかしGemini 3.6 Flashに乗り換えたところで、動くサポートエージェントが手に入るわけではありません。速いエンジンを買っても車が手に入るわけではないのと同じです。私はこの3年以上、AIを実際のサポートキューに投入してきましたが、何度も見てきた失敗はモデルが賢くないことではなく、モデルの周りの層を誰も作らなかったせいで、自信満々に聞こえるボットが実際の顧客に間違った答えを返すことでした。モデルはスタックの一番下であり、それ自体がすべてではありません。

モデルはサポートエージェントの一番下の層であり、その上に検索・取得、ガードレール、シミュレーション、ヘルプデスク連携が積み重なる
モデルはサポートエージェントの一番下の層であり、その上に検索・取得、ガードレール、シミュレーション、ヘルプデスク連携が積み重なる

その上に積み重なる層こそが実際の作業です。検索・取得があるからこそ、モデルは推測ではなくあなたのヘルプセンターや過去のチケットから答えます。ガードレールとスコープがあるからこそ、返金ポリシーを勝手に作り出さず、きれいに引き継ぎます。連携があるからこそ、実際にあなたのチケッティングシステムの中で動けます。そしてテストがあるからこそ、顧客に触れる前にその振る舞いを把握できます、後になってからではありません。これは生のAPIと本物のAIカスタマーサービスソフトウェアを分けているのと同じギャップであり、AIチャットボットの問題がほとんど常にモデルではなく配管部分に起因する理由でもあります。

だからこそ、私は生のGemini APIを自分でヘルプデスクに組み込むことに慎重であるべきだと考えています。検索・取得、ハルシネーション対策のガードレール、シミュレーション、あらゆるヘルプデスク連携をゼロから作り直し、モデルが数週間ごとに変わるたびにそれを維持することになります。これこそが、DIYのスタックより専用に作られたヘルプデスクAIを選ぶべき理由です。モデルの階層は単なる項目の一つであり、その周りのシステムこそが本当のプロダクトなのです。

eeselを試す

これはまさにeeselが担うために作られた層です。既存のヘルプデスクに組み込むだけで、過去のチケットとナレッジベースからすぐに学習し、Geminiのようなフロンティアモデルの上で動くので、APIを自分で組み上げずに効率の恩恵を受けられます。

eesel AIのヘルプデスクダッシュボード概要
eesel AIのヘルプデスクダッシュボード概要

ここで最も重要な差別化要因は、3.6 Flash単体では得られないものです。eeselなら、実際の顧客に答える前に過去のチケットに対してエージェントをシミュレーションでき、解決率と実際に送られる返信内容を事前に確認できます。しかも実際に行った作業に応じた価格設定であり、トークン単位ではないので、チケットごとにトークン計算をする必要もありません。サポート自動化を構築するためにモデルを評価しているなら、欲しい成果から出発し、配管部分はプラットフォームに任せましょう。無料でお試しいただけます。

Frequently Asked Questions

Gemini 3.6 Flashとは何ですか?
Gemini 3.6 Flashは、2026年7月21日にリリースされたGoogleの最新の主力モデルです。大規模にAIエージェントを運用する際の速度と効率のために作られており、Gemini 3 Flashの前世代と比べて出力トークンを約17%削減しつつ、出力トークン単価も下げています。Googleのモデルファミリー全体についてはGemini AI概要の記事も参考にしてください。
Gemini 3.6 Flashの料金はいくらですか?
標準の有料プランでは、Gemini 3.6 Flashの料金は入力100万トークンあたり1.50ドル、出力100万トークンあたり7.50ドルで、3.5 Flashの出力9.00ドルより下がっています。バッチモードではどちらも半額になります。無料プランもありますが(Googleがコンテンツを製品改善に利用する場合があります)。より広いGeminiの料金体系についてはGeminiの料金ガイドで比較できます。
Gemini 3.6 Flashはカスタマーサポートに向いていますか?
モデル自体は十分に高性能ですが、モデルはサポートエージェントの一番下の層にすぎません。ヘルプセンターに対する検索・取得、ガードレール、公開前のテストがそれでも必要です。AIカスタマーサービスソフトウェアのようなプラットフォームがその層を担ってくれるので、自分で生のAPIを組み上げる必要がなくなります。
Gemini 3.6 FlashはGPT-5.6やClaudeとどう比べられますか?
Google自身のチャートでは、3.6 Flashはコンピュータユースとロングコンテキストのタスクでリードしていますが、GPT-5.6とClaude Sonnet 5はいくつかのコーディングや知識系ベンチマークでリードしています。全体像についてはGemini vs ClaudeGemini vs ChatGPTの比較記事をご覧ください。
GoogleはなぜGemini 3.5 Proをリリースしなかったのですか?
Googleは3つのFlashクラスのモデルを出荷しましたが、フラッグシップの3.5 Proは見送りました。3.5 Proは社内の性能目標を下回ったと報じられており、いまもパートナーとテスト中です。待っている間の選択肢を検討するなら、Geminiの代替ツールのまとめ記事が参考になります。

Share this article

Kurnia Kharisma Agung Samiadjie

Article by

Kurnia Kharisma Agung Samiadjie

Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.

Related Posts

All posts →
Googleブルーの背景に浮かぶGemini 3.5 Flash-Liteのヒーローバナー
Trending

Gemini 3.5 Flash-Liteとは?価格と向いている用途を解説

Gemini 3.5 Flash-Liteは、Googleの最速・最安の3.5系モデルで、100万トークンあたり$0.30/$2.50です。その正体、料金、使うべき場面を解説します。

Rama Adi NugrahaRama Adi NugrahaJul 22, 2026
Google Blueの背景にあるGemini 3.6 Flash料金のヒーローバナー
Trending

Gemini 3.6 Flashの料金:2026年の全コスト内訳

Gemini 3.6 Flashは入力$1.50、出力$7.50(100万トークンあたり)。料金表の全体、見えにくいコスト、実際の運用コストを解説します。

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 22, 2026
Gemini 3.5 Flash Cyber hero banner on a Google-blue background
Trending

Gemini 3.5 Flash Cyberとは何か、誰が使えるのか

Gemini 3.5 Flash Cyberは、コードの脆弱性を発見して修正するためのGoogleのセキュリティモデルだ。何をするのか、CodeMenderがどう使っているのか、そしてなぜまだほとんどの人が触れないのかを解説する。

Alicia Kirana UtomoAlicia Kirana UtomoJul 22, 2026
Gemini 3.5 Flash-Liteの料金を紹介するGoogleブルーの背景のヒーローバナー
Trending

Gemini 3.5 Flash-Liteの料金:費用と向いている用途

Gemini 3.5 Flash-LiteはGoogleの最も安価なモデルで、100万トークンあたり$0.30/$2.50。料金表全体、実際のコスト例、向いている用途を解説する。

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 22, 2026
ヒューマノイドロボットの制御モデルを描いたイラスト、Gemini Robotics 2を表現
Trending

Gemini Robotics 2:DeepMind自身の数字が示すもの

Gemini Robotics 2は3つのモデルを同時に出し、タスク別成功率の表ではほとんどのスコアが80%を下回る。この表こそ、今回のリリースで最も役に立つ部分だ。

Alicia Kirana UtomoAlicia Kirana UtomoAug 4, 2026
画像、動画、文書のパネルがビジョン言語モデルに入力される様子を描いたイラスト、Qwenのロゴ付き
Trending

Qwen 3.7 Flash: スペック、価格、そして実際にできること

Qwen 3.7 Flashはブログ記事もベンチマークも重みの公開もないまま登場した。ここでは完全なスペックシート、段階的な料金、そしてQwenが決して主張しなかったことをまとめる。

Alicia Kirana UtomoAlicia Kirana UtomoJul 31, 2026
Image alt text
Guides

Gemini Agentic Visionの概要:その仕組みとAIにとっての意味

GoogleのGemini Agentic Visionは、Gemini 3 Flashモデルの新機能であり、AIの画像への関わり方を変えるものです。受動的な閲覧を、より高い精度を実現するための能動的で多段階の調査へと転換させます。

Stevia PutriStevia PutriJan 30, 2026
単一バイナリとして動作するセルフホスト型AIエージェントランタイムのイラスト
Trending

ZeroClawレビュー:オープンソースAIエージェントランタイムを正直に検証

ZeroClawの正直なレビュー:オープンソースでRustベースのAIエージェントランタイムが優れている点、セキュリティ面での不安、そして避けるべき人について解説します。

Rama Adi NugrahaRama Adi NugrahaJul 19, 2026
Inklingの代替としてのAIモデル比較を表すエディトリアルイラスト
Trending

2026年版 Inklingの代替8選

Inklingはオープンで興味深いモデルだが、オープンウェイトとしては高価で、実行できる中で最も賢いモデルというわけでもない。実際に試す価値のある8つの代替モデルを、実際の価格とそれぞれの強みとともに紹介する。

Rama Adi NugrahaRama Adi NugrahaJul 20, 2026

AIチームメイトを採用する準備はできましたか?

数分でセットアップ。クレジットカード不要。

無料で始める