Gemini 3.5 Flash-Liteとは?価格と向いている用途を解説

Rama Adi Nugraha
執筆者

Rama Adi Nugraha

Katelin Teen
レビュー者

Katelin Teen

最終更新 August 6, 2026

専門家による検証済み
Googleブルーの背景に浮かぶGemini 3.5 Flash-Liteのヒーローバナー

Gemini 3.5 Flash-Liteの正体

GoogleはGeminiファミリーを大きく二つの系統に分けている。Proモデルは難しい推論のためのトップティアだ。Flashモデルは働き者で、より安く、より速く、1日に何千回も呼び出すアプリ向けに調整されている。Flash-Liteはその働き者の中でも最も軽量な存在で、Googleは大量のエージェント的タスク、翻訳、単純なデータ処理向けに位置づけている。

個々のタスクは簡単だが量が容赦ないような仕事に向けるモデルだと考えるといい。サポートチケットの分類、PDFからのフィールド抽出、チャットメッセージの翻訳、一次検索の実行などだ。テキスト、画像、動画、音声、PDF入力を扱え、ファンクションコーリング、構造化出力、コード実行、キャッシュ、検索グラウンディングをサポートし、上位モデルと同じ約100万トークンのコンテキストウィンドウ(入力でA4用紙およそ1,500ページ相当)を備えている。

意図的に省かれている機能を見ると、誰のためのモデルかがわかる。Flash-Liteはコンピュータ操作、画像生成、音声生成、Live APIをサポートしない。エージェントにブラウザを操作させたりメディアを生成させたりする必要があるなら、それはGemini 3.6 FlashかProモデルの仕事であり、これではない。Flash-Liteは意図的に狭い範囲にとどまっている。テキストを読み、判断し、テキストを書く、それを速く安くやる、というだけだ。

Gemini 3.5 Flash-Liteの料金

全体像はこうだ。このモデルが存在する理由そのものなので、スプレッドシートに数字を入れる前によく読んでおく価値がある。

利用モード入力(100万トークンあたり)出力(thinking含む)コンテキストキャッシュ
Standard$0.30$2.50$0.03
Batch(50%オフ)$0.15$1.25$0.02
Flex$0.15$1.25$0.02
Priority$0.54$4.50$0.05
無料プラン無料無料無料

いくつか注意しておきたい点がある。

  • 無料プランには落とし穴がある。 無料プランではGoogleがコンテンツを使用してプロダクトを改善する。有料プランではそれがない。顧客データに触れる用途であれば、この一点だけで無料プランは選択肢から外れる。
  • バッチモードは一律50%オフで、実際には大量処理のジョブの大半がここで動くべきだ。フレックス推論も同じ割引だ。作業がリアルタイムでなくてよいなら、支払いは$0.15/$1.25になる。
  • キャッシュヒットは安い。 キャッシュされた入力トークンは100万あたり$0.03で、90%の削減だ。繰り返し使うコンテキスト(システムプロンプトやナレッジの断片)はほとんどコストに乗らない。
  • 検索グラウンディングは別途課金される。 Gemini 3ファミリー全体で月5,000件のグラウンディング済みプロンプトまで無料で、それを超えると検索クエリ1,000件あたり$14だ。

Artificial Analysisからの一つ正直な補足を挙げておく。$0.30/$2.50という価格は152モデル中87位で、単純な価格の安さでは「市場最安」ではない。「Lite」が意味するのはGemini 3.5系列の中で最安でありながら、トップクラスの知能スコアを保っているということだ。これがコンシューマー向けGeminiプランや他のAPIティアとどう比較されるかについては、Geminiの料金ガイドに全体の内訳があり、Gemini Workspaceの料金ではビジネスプランを扱っている。

速度こそが最大の売り

価格がFlash-Liteを候補に入れる理由なら、速度は使い続ける理由だ。Artificial Analysisの計測では約毎秒490トークンで、テストした152モデル中2位。Google自身のベンチマークでは毎秒350トークンとしている。どちらの数字でも、業界トップ級であることは変わらない。

Gemini 3.5 Flash-Liteのエージェント型ターミナルコーディングとナレッジワークのスコアを示すベンチマーク表, as shared by Google
Gemini 3.5 Flash-Liteのエージェント型ターミナルコーディングとナレッジワークのスコアを示すベンチマーク表, as shared by Google

プロダクトマネージャーに「1秒未満の返信」を約束する前に知っておくべき注意点が一つある。最初のトークンが出るまでの時間(TTFT)は中央値でおよそ6秒と、このクラスの中では高めだ。モデルの思考ステップが最初に見えるトークンより前に走るためだ。つまり、いったんストリームが始まれば猛烈に速いが、開始自体は難しいプロンプトだと遅れることがある。ほとんどのサポート業務(短い回答、単純な分類)では思考にかける予算は小さく、その遅れは無視できるレベルだ。ミリ秒単位で計測するような用途なら、まず自分のプロンプトで試してみてほしい。

先代モデルと比べると、エージェント型コーディングとナレッジワークのベンチマークで世代間の伸びは明確だ。

Gemini 3.5 Flash-Liteがエージェント型ターミナルコーディングとナレッジワークで3.1 Flash-Liteを上回る様子, as shared by Google
Gemini 3.5 Flash-Liteがエージェント型ターミナルコーディングとナレッジワークで3.1 Flash-Liteを上回る様子, as shared by Google

Flash-Liteか3.6 Flashか?正しい方を選ぶ

これはほとんどのチームが間違える判断だ。二つが同日に登場し、名前もほとんど変わらないからだ。この二つは同じ仕事の正反対の端のために作られている。下のセレクターを試してみてほしい。

どのGeminiモデルを使うべき?
自分のワークロードに最も近い項目を選んでください。
Gemini 3.5 Flash-Lite。 3.5系列の中で最安($0.30/$2.50、バッチならその半額)で、速度は業界トップ級。まさに「Lite」が意味するところだ。
Gemini 3.6 Flash。 コンピュータ操作を内蔵し、より強力な多段階推論を持つ働き者だ。Flash-Liteはそれらを意図的に省いている。
モデル選びは簡単な部分にすぎない。 どちらのモデルでも機能するが、その周りに検索、ガードレール、テストが必要なのは変わらない。この先を読み進めるか、下のセクションへジャンプしてほしい。

基本的な目安はこうだ。個々の項目が単純で、量そのものが課題になっている場合、たとえば一次チケットトリアージティア1の振り分け、日常的なライブチャットの振り分けなどにはFlash-Liteを選ぶ。複数のシステムをまたいで本当に推論が必要な仕事には3.6 Flashを選ぶ。本物のAIエージェントを作るかスクリプト型のボットにするかは、モデル選びとは別の判断だ。

同じ日に登場したその他のモデル

Flash-Liteは単独で登場したわけではない。Googleは7月21日に3つのモデルを出荷し、1つを保留した。このラインアップを知っておくと、間違ったティアを選ぶのを避けられる。

Gemini 3.6 Flashは新しい看板の働き者で、入力$1.50・出力$7.50、コンピュータ操作を内蔵し、3.5 Flashより出力トークン数がおよそ17%少ない。Gemini 3.5 Flash Cyberはセキュリティ専門モデルで、GoogleのCodeMenderエージェント内で脆弱性を見つけて修正するようにファインチューニングされており、政府機関と信頼されたパートナー限定の限定パイロットとしてのみ利用できる。

目立って欠けているのは、フラッグシップのGemini 3.5 Proだ。Bloombergの報道によれば、社内の性能目標に届かず遅延が発生しており、DeepMindのLogan Kilpatrickも述べている通り、まだパートナーとテスト中だという。つまりGoogleの動き方は分かりやすい。フラッグシップを仕込んでいる間、安価で大量処理向けのティアは新しい状態を保つ、というものだ。もし今すぐトップティアのモデルが必要なら、Geminiの代替ツールのまとめが正直な出発点になるし、Gemini対ClaudeGemini対ChatGPTでは正面対決を扱っており、AIカスタマーサービス企業ではこれらのモデルの上に構築しているベンダーをまとめている。

サポート向けにAIを構築するならこれが意味すること

ここは率直に言わせてほしい。モデルのローンチ記事のほとんどが、サポートチームにとって一番重要なこの部分を素通りしてしまうからだ。

より速く、より安いモデルが出るのは良いニュースだ。しかしFlash-Liteに切り替えただけで動くサポートエージェントが手に入るわけではない。速いCPUを積んだだけでアプリが完成するわけではないのと同じだ。私はeeselにインテグレーションやAPIを組み込む仕事を日々しており、3年以上にわたって実際のサポートキューにAIを載せてきた中で、何度も目にしてきた失敗はモデルが頭が悪いということではなく、モデルの周りに必要な層を誰も作らなかったせいで、自信満々に振る舞うボットが実際の顧客に間違った答えを返してしまうことだった。モデルはスタック全体ではなく、その一番下の層にすぎない。

その層こそが本当の作業だ。検索(リトリーバル)があれば、モデルは推測ではなくナレッジベースや過去のチケットから答えるようになる。ガードレールとスコープがあれば、返金ポリシーを勝手に作り出す代わりに、きれいにエスカレーションできる。インテグレーションがあれば、チケッティングシステムの中で実際に行動できる。そしてテストがあれば、顧客に触れる前にどう振る舞うかがわかる、後になってからではない。これが生のAPIと本物のAIカスタマーサービスソフトウェアとの差であり、AIチャットボットの問題がほぼ常にモデルではなく配管部分に起因する理由でもある。

だからこそ、生のGemini APIを自分でヘルプデスクに組み込むことには異を唱えたい。検索、ハルシネーション対策のガードレール、シミュレーション、そしてすべてのヘルプデスク連携をゼロから組み直すことになり、しかもGoogleが数週おきに新モデルを出す(今回は1日で3つだ)たびに保守し続けることになる。この入れ替わりの速さこそ、自作のスタックより専用に作られたヘルプデスク向けAIを選ぶべき理由そのものだ。モデルのティアは差し替え可能な一項目にすぎず、周りのシステムこそが製品なのだ。

eeselを試す

これこそが、eeselが作られている理由そのものの層だ。既存のヘルプデスクに組み込むだけで、導入初日から過去のチケットとナレッジベースから学習し、Geminiのようなフロンティアモデルの上で動く。だからFlash-Liteのようなモデルの速さとコスト削減を、自分でAPIを組まずに得られる。

eesel AIヘルプデスクダッシュボードの概観
eesel AIヘルプデスクダッシュボードの概観

ここで一番重要な違いは、Flash-Lite単体では得られないものだ。eeselなら実際の顧客に応答する前に、過去のチケットに対してエージェントをシミュレーションでき、解決率や実際に送信されたであろう返信をそのまま確認できる。そして成果に応じた価格設定であり、トークン単位の課金ではないので、チケットごとにトークンの計算をする必要もない。サポート自動化のためにモデルを検討しているなら、まず達成したい成果から考え、配管部分の選定はプラットフォームに任せてほしい。無料で試せる。

Frequently Asked Questions

Gemini 3.5 Flash-Liteとは何ですか?
Gemini 3.5 Flash-Liteは、Googleの Gemini 3.5系列の中で最速・最安のモデルで、2026年7月21日にGemini 3.6 Flashと同時に発表されました。エージェント型検索、ドキュメント処理、翻訳といった大量・低遅延の作業向けに作られています。ファミリー全体を知りたい場合はGemini AI概要をご覧ください。
Gemini 3.5 Flash-Liteの料金はいくらですか?
標準の有料プランでは、Gemini 3.5 Flash-Liteの料金は入力100万トークンあたり$0.30、出力100万トークンあたり$2.50で、バッチモードとフレックスモードはその半額($0.15/$1.25)です。無料プランもありますが、その場合Googleがコンテンツをプロダクト改善に利用することがあります。詳しい内訳はGeminiの料金まとめで比較できます。
Gemini 3.5 Flash-Liteはカスタマーサポートに向いていますか?
一次トリアージのような単純で大量な作業には非常に適していますが、モデルはサポートエージェントの最下層にすぎません。ヘルプセンターに対する検索、ガードレール、そして本番稼働前のテストが依然として必要です。AIカスタマーサービスソフトウェアのようなプラットフォームがその層を担ってくれるので、生のAPIを自分で組む必要はありません。
大量利用時のGemini 3.5 Flash-Liteの料金はどうなりますか?
バッチモードは標準の一律50%オフなので、大量かつリアルタイム不要な作業は100万トークンあたり入力$0.15・出力$1.25で動きます。キャッシュヒットは100万あたり$0.03まで下がります。何百万回も実行する作業にとって、この差こそが3.6 FlashよりFlash-Liteを選ぶ理由そのものです。
Gemini 3.5 Flash-Liteと3.6 Flash、どちらを使うべきですか?
個々の項目が単純で量を処理している場合、チケットトリアージや日常的なライブチャットの振り分けのような作業ならFlash-Liteを選んでください。本当の意味での多段階推論が必要な作業には3.6 Flashを選んでください。どちらも合わない場合はGeminiの代替ツールのまとめをご覧ください。
Gemini 3.5 Flash-Liteの速度はどれくらいですか?
Artificial Analysisの計測では出力速度は約毎秒490トークンで、テストした152モデル中2位でした。Google自身のベンチマークでは毎秒350トークンとしています。いずれにしても現在利用できる中で最速クラスのモデルであり、それこそがLiteモデルの狙いです。ただし最初のトークンが出るまでの時間は長めで、これは最初のトークンが表示される前に思考ステップが走るためです。
Gemini 3.5 Flash-Liteはコンピュータ操作に対応していますか?
対応していません。コンピュータ操作、画像生成、音声生成、Live APIはFlash-Liteでサポートされていません。一方でファンクションコーリング、構造化出力、コード実行、キャッシュ、検索グラウンディングには対応しています。コンピュータ操作が必要な場合はGemini 3.6 Flashを選んでください。

Share this article

Rama Adi Nugraha

Article by

Rama Adi Nugraha

Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.

Related Posts

All posts →
Gemini 3.5 Flash-Liteの料金を紹介するGoogleブルーの背景のヒーローバナー
Trending

Gemini 3.5 Flash-Liteの料金:費用と向いている用途

Gemini 3.5 Flash-LiteはGoogleの最も安価なモデルで、100万トークンあたり$0.30/$2.50。料金表全体、実際のコスト例、向いている用途を解説する。

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 22, 2026
Google Blueの背景にあるGemini 3.6 Flash料金のヒーローバナー
Trending

Gemini 3.6 Flashの料金:2026年の全コスト内訳

Gemini 3.6 Flashは入力$1.50、出力$7.50(100万トークンあたり)。料金表の全体、見えにくいコスト、実際の運用コストを解説します。

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 22, 2026
Googleブルーの背景に浮かぶGemini 3.6 Flashのヒーローバナー
Trending

Gemini 3.6 Flashとは?できること・料金・向いている人を解説

Gemini 3.6 FlashはGoogleの新しい主力モデルです。出力トークンが17%減り、出力コストも下がり、コンテキストウィンドウは100万トークン。その正体と、どんな人に向いているかを解説します。

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 22, 2026
Gemini 3.5 Flash Cyber hero banner on a Google-blue background
Trending

Gemini 3.5 Flash Cyberとは何か、誰が使えるのか

Gemini 3.5 Flash Cyberは、コードの脆弱性を発見して修正するためのGoogleのセキュリティモデルだ。何をするのか、CodeMenderがどう使っているのか、そしてなぜまだほとんどの人が触れないのかを解説する。

Alicia Kirana UtomoAlicia Kirana UtomoJul 22, 2026
ヒューマノイドロボットの制御モデルを描いたイラスト、Gemini Robotics 2を表現
Trending

Gemini Robotics 2:DeepMind自身の数字が示すもの

Gemini Robotics 2は3つのモデルを同時に出し、タスク別成功率の表ではほとんどのスコアが80%を下回る。この表こそ、今回のリリースで最も役に立つ部分だ。

Alicia Kirana UtomoAlicia Kirana UtomoAug 4, 2026
画像、動画、文書のパネルがビジョン言語モデルに入力される様子を描いたイラスト、Qwenのロゴ付き
Trending

Qwen 3.7 Flash: スペック、価格、そして実際にできること

Qwen 3.7 Flashはブログ記事もベンチマークも重みの公開もないまま登場した。ここでは完全なスペックシート、段階的な料金、そしてQwenが決して主張しなかったことをまとめる。

Alicia Kirana UtomoAlicia Kirana UtomoJul 31, 2026
Image alt text
Guides

Gemini Agentic Visionの概要:その仕組みとAIにとっての意味

GoogleのGemini Agentic Visionは、Gemini 3 Flashモデルの新機能であり、AIの画像への関わり方を変えるものです。受動的な閲覧を、より高い精度を実現するための能動的で多段階の調査へと転換させます。

Stevia PutriStevia PutriJan 30, 2026
Grokのロゴマーク、サポート担当エージェント、ベンチマークと料金のパネルを描いた手描きイラスト
Trending

Grok 4.5: ベンチマーク、料金、そしてサポート業務への意味

xAIがGrok 4.5をリリースした。実際のベンチマーク、トークン料金、そして話題の新モデルがサポートキューにとって本当に何かを変えるのかを詳しく調べた。

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 9, 2026
Inklingの代替としてのAIモデル比較を表すエディトリアルイラスト
Trending

2026年版 Inklingの代替8選

Inklingはオープンで興味深いモデルだが、オープンウェイトとしては高価で、実行できる中で最も賢いモデルというわけでもない。実際に試す価値のある8つの代替モデルを、実際の価格とそれぞれの強みとともに紹介する。

Rama Adi NugrahaRama Adi NugrahaJul 20, 2026

AIチームメイトを採用する準備はできましたか?

数分でセットアップ。クレジットカード不要。

無料で始める