Gemini Omni Flashレビュー:Googleの高速・低価格なAI動画モデル

Alicia Kirana Utomo
執筆者

Alicia Kirana Utomo

Katelin Teen
レビュー者

Katelin Teen

最終更新 July 10, 2026

専門家による検証済み
Google Blueで描かれたGemini Omni Flashレビューのヒーローバナー

Gemini Omni Flashの実態

Gemini Omni Flashは、Google DeepMindが新たに立ち上げた「Gemini Omni」ファミリーの第一弾モデルであり、モデルカードでは「あらゆる入力からあらゆるものを作成・編集できるモデルへ向けた次の一歩であり、まずは動画から始める」と位置づけられています。平たく言えば、テキスト、画像、音声、動画を受け付け、音声付きの高解像度動画を出力する、ネイティブなマルチモーダルモデルです。

Google自身による一言が、私が見た中で最も分かりやすい説明です。「Gemini Omniは、動画版のNano Bananaだと考えてください。」GoogleのNano Banana画像編集ツール、つまり連続したプロンプトで画像を少しずつ調整していくあのツールを使ったことがあるなら、それを動画に移植した体験だと考えれば分かりやすいでしょう。

モデルカードは2026年5月19日に公開され、一般消費者向けにはまずGeminiアプリとYouTubeを通じて展開され、開発者は2026年6月30日にモデルID gemini-omni-flash-preview としてAPIアクセスを得ました。これはRunwayPika、そしてByteDanceのSeedanceとまさに同じ土俵にあるモデルであり、Google自身のフラッグシップであるVeoからは一段下に位置づけられます。

Gemini Omni Flashの仕組み:あらゆる入力を受け取り、会話形式の編集ループを経て720p動画を出力する
Gemini Omni Flashの仕組み:あらゆる入力を受け取り、会話形式の編集ループを経て720p動画を出力する

Gemini Omni Flashの仕組み

内部的には、テキスト、視覚、動画、音声にネイティブ対応したトランスフォーマーベースのモデルであり、GoogleのTPU上で学習されています。Googleの謳い文句は、生成メディアとGeminiの世界知識を組み合わせているため、出力は「単にスタイル的にそれらしいだけでなく、物理的にも論理的にも整合性が取れている」ことを目指しているというもので、これは「物理法則の理解」に加え、歴史、科学、文化に関する知識を活用しているとされています。

APIは5つの機能ファミリーを公開しています。テキストから動画・音声への変換、画像から動画・音声への変換、参照素材から動画・音声への変換、動画編集、そして画像生成です。ここではっきり述べておくべき注意点があります。Googleはこれらのいずれについても評価スコアを公表していません。モデルカードは率直にベンチマークを先送りしており、「開発者および企業顧客向けにAPI経由で展開する際に公開する予定」だとしています。つまり、Omni Flashが数値上で競合を上回っていると主張する人がいれば、それは単なる推測です。なぜなら、その数値はまだ存在しないからです。

本当の目玉は会話形式の編集

もし1つの機能がこのローンチを正当化するとすれば、それはステートフルな編集です。変更したいたびに巨大なプロンプトを書き直す代わりに、まずクリップを生成し、その後は指示を1つずつ重ねて調整していけばよく、モデルはシーンの残りの部分を覚えています。

これはGoogleのInteractions APIを通じて動作し、その仕組みは previous_interaction_id という単一のフィールドだけで、「前の動画を再アップロードすることなく」フォローアップを前の結果に連結します。Google自身が示す実例を見ると、このループは一目瞭然です。

Python
# Turn 1: Generate initial video
res1 = client.interactions.create(model="gemini-omni-flash-preview", input="A woman playing violin outdoors.")

# Turn 2: Edit the previous video
res2 = client.interactions.create(
    model="gemini-omni-flash-preview",
    previous_interaction_id=res1.id,
    input="Make the violin invisible."
)

Googleのプロンプトガイダンスも同じ発想を推奨しています。編集は短く保つこと(「この動画をアニメ調にして」「照明をもっとドラマチックに変えて」)、シーンを固定するために「それ以外はすべて同じままにして」を加えること、そして過剰な説明よりも削除を優先すること(「電話を消して」の方が長い段落より効果的)です。これは実に良く出来たメンタルモデルであり、文書を編集するかのように動画を編集できる、最も近い体験と言えます。

これを実際に使う前に指摘しておきたい落とし穴が2つあります。1つ目は、生成を高速化するためにstore=falseを設定すると、そのクリップは以降のターンで編集できなくなり、この機能の本質を静かに壊してしまう点です。2つ目は、自分でアップロードした動画の編集はEEA、スイス、英国では利用できない点で、モデルが生成したクリップの編集はどこでも機能するのとは対照的です。この地域制限は、ヨーロッパのユーザーが実際にぶつかるまで見落とされがちです。

Gemini Omni Flashの料金

まず実際の数字を先に示すと、動画出力は100万トークンあたり17.50ドルで課金され、Googleは720p動画を1秒あたり5,792トークンと価格設定しているため、Standard料金では実質1秒あたり約0.10ドルになります。入力はすべてのモダリティを通じて一律100万トークンあたり1.50ドルです。

項目無料枠有料ティア
入力(テキスト/画像/動画/音声)利用不可100万トークンあたり1.50ドル
出力(テキスト)利用不可100万トークンあたり9.00ドル
出力(動画)利用不可100万トークンあたり17.50ドル(720p動画1秒あたり約0.10ドル相当)
バッチ/フレックス/優先処理割引なし記載なし
プロビジョニング済みスループット非対応非対応
Googleの製品改善への利用ありなし

いくつか目を引く点があります。無料枠がないため、有料キーなしでは試すことすらできません。また、ほとんどのGemini 3.xラインアップとは異なり、このモデルにはBatch、Flex、Priorityの料金表もないため、大量のジョブ向けに頼れる文書化された50%のバッチ割引もありません。0.10ドル/秒というレート自体は妥当ですが、これは秒単位で加算されるメーターであり、規模が大きくなると急速に積み上がります。

0.10ドル/秒が実際に意味するコスト:10秒のクリップは約1ドル、60秒のクリップは約6ドル、720pに制限され無料枠もない
0.10ドル/秒が実際に意味するコスト:10秒のクリップは約1ドル、60秒のクリップは約6ドル、720pに制限され無料枠もない

規模感をつかむために言うと、10秒のクリップで約1ドル、30秒のクリップで約3ドル、1分の動画で約6ドルになり、これはあらゆるAI動画ワークフローで必要になる再生成分を数える前の話です。ローンチ時点でGoogleは1回の生成につき10秒の上限を設けており、より長い尺は「近日公開」としていたため、現時点では短いクリップ向けのツールであり、フルシーンを作るためのものではありません。より広い料金の全体像を比較したいなら、私がまとめたGemini、OpenAI、AnthropicのAPIの比較記事で、これらの計測方法がどう積み上がるかを解説しています。

位置づけ:Googleの最高品質モデルではない

これは、私がローンチ報道の中で最も強く異を唱えたいフレーミングです。Omni Flashは明示的に高速・手頃な価格のティアとして位置づけられており、Googleは0.10ドル/秒というレートがVeo 3.1 Fastと同水準であると述べています。「高速」という言葉が本質を物語っています。これはGoogleの絶対的な最高フレーム品質を求めるときに手を伸ばすモデルではなく、それはVeoの役割です。そして現在の独立系フロンティアと比べると、その評判は控えめなものにとどまっています。

ポジショニングの象限図:Gemini Omni FlashはSeedanceやVeoより下に位置する、より安価でフロンティアから一歩遅れた領域にある
ポジショニングの象限図:Gemini Omni FlashはSeedanceやVeoより下に位置する、より安価でフロンティアから一歩遅れた領域にある

Hacker Newsのローンチスレッド(323ポイント)で最も大きかったテーマは、ヘビーユーザーたちがこれをByteDanceのSeedanceと比較して不利だと評価していたことです。Seedanceに数千ドルを費やしてきたと語るある人物は率直にこう述べています。

Hacker News

「最初に使ってみた印象では、あまり感心しませんでした。私はこれまでSeedance 2に数千ドルは費やしてきていると思いますが、いくつかのサンプルをシステムに通してみた限り、Google Omni FlashがSeedanceより優れている点を見つけられませんでした。」

別のユーザーもこれに同調し、Seedanceの次バージョンがすでに間近に迫っていると指摘しました。

Hacker News

「Seedance 2.0を少しでも使ったことがある人なら、Geminiが少し遅れていることが分かるはずだし、Seedance 2.1はもう目前だ。」

これが正直な競争環境の実態です。ヘビーユーザーが現時点でフロンティアより下に位置づける、有能で安価なモデルであり、生の品質ではなくワークフローと価格で売っています。

知っておくべき限界

Googleはモデルカードの中で率直に、3つの未解決課題を挙げています。編集を重ねる中での一貫性の維持、複雑な動きの生成、そして画面上の文字を正確にレンダリングすることです。コミュニティはこの粗い部分をすぐに見つけました。日々物理シミュレーションを書いているある開発者は、自身の定番テストを実行しました。

Hacker News

「『ジェンガのブロックタワーが、1本のブロックを抜いた瞬間に崩れる動画。それぞれのブロックの物理挙動はリアルでなければならない』と指示したところ、ブロックが突然消えたり、他のブロックに変形したりする動画が返ってきた。」

別のユーザーは、この不安定さの背後にあるより深い問題を指摘しました。

Hacker News

「微妙な空間的誤りや、視界から外れて戻ってくるたびに形状が変わってしまうジオメトリは、Googleが深い空間理解の問題をまだ解決できていないことを物語っている。」

品質面以外にも、構築できるものの範囲を左右する実用上の制限が3つあります。音声・発話の編集ができない点です。技術的にはモデルが人の発言内容を変えることは可能ですが、Googleは肖像・声の悪用防止策として意図的にこれを制限しています。動画の延長や補間もできないため、シーンをつなぎ合わせたい場合はVeo 3.1に誘導されます。そして、複数動画にまたがる推論や音声参照のアップロードもまだ対応していません。安全面では、すべてのクリップに目に見えないSynthID透かしが付与されており、プログラムで検出可能なため、来歴証明の点では本物のプラスと言えます。

繰り返し挙がっていた、率直なブランディングへの不満もあり、これはもっともな指摘です。

Hacker News

「製品ラインもかなり乱雑だ。Veo、Gemini Omni Flash、Spark、Flow、Duo……競合し合う紛らわしい製品ラインが多すぎる。」

Omni Flashは、姉妹モデルである画像モデルのNano Banana 2 Liteと同時にローンチされました。これはGoogleの「Lite/standard/Pro」という階層型の画像ラインアップに組み込まれるもので、Omni Flashが動画において体現しているのと同じ「安価・高速 対 高価・高品質」という区分けです。

Omni Flashと同時にローンチされた姉妹ラインアップ、GoogleのNano Banana画像モデルの各ティアを示す、Google DeepMindの発表に掲載された図
Omni Flashと同時にローンチされた姉妹ラインアップ、GoogleのNano Banana画像モデルの各ティアを示す、Google DeepMindの発表に掲載された図

では、使うべきか?

クリエイティブ系や動画系のツールを作っていて、本当に快適な会話形式の編集ループを備えた安価なモデルが欲しいなら、Omni Flashは試してみる価値があります。特に短い720pクリップが自分のユースケースに合っていて、無料枠なしでもやっていけるならなおさらです。もしあなたの基準がクラス最高峰の忠実度、複雑な物理演算、あるいは長いシーンなのであれば、コミュニティ自身のテスト結果からすると、Googleの最高品質を求めるならVeo、現在の独立系フロンティアを求めるならSeedanceの方が満足できるはずです。そして、まだ初期段階です。ベンチマークがなく、プレビューというラベルが付き、「近日公開」の機能群がロードマップに並んでいることを考えると、今日の評価は変わる可能性があります。

あるHNのコメント投稿者が、この話全体を的確な視点で捉えており、私もその精神には同意します。

Hacker News

「AIに一発で完璧な仕上がりを期待する人がこんなにも多いのは、なかなか笑える。」

一発勝負の神託ではなく、反復的な編集パートナーとして扱えば、これは堅実で手頃な選択肢です。ただし、この高速ティアをGoogleの最高品質だと勘違いしないようにしてください。

eesel:動画モデルには手が届かない業務のためのAI

ここはeeselのブログなので、正直に一言だけ添えておきます。Omni Flashはメディアモデルであり、サポートキューのためにできることは何もありません。しかし、「接続するだけで面倒な作業をこなしてくれるAI」という同じ発想こそ、まさに私がeeselで取り組んでいることであり、対象が動画ではなくカスタマーサポートというだけです。

Omni Flashがクリップを生成するのに対し、eeselのAIエージェントは既存のヘルプデスク(Zendesk、Freshdesk、Gorgiasなど)に接続し、過去のチケットやヘルプセンターから学習し、実際の顧客対応を自力で解決します。私たちは何年もの間、実運用のサポートキューでAIを動かしてきており、そこで学んだのは、実際の顧客に触れる前にすべてのロールアウトを過去のチケットに対してシミュレーションするという、デモ動画には決して映らない地味なエンジニアリングです。無料で試すことができ、Omni Flashとは違い、実際に無料で始める方法があります。

実際の顧客チケットを解決するAIエージェントが動作する、eesel AIヘルプデスクダッシュボード
実際の顧客チケットを解決するAIエージェントが動作する、eesel AIヘルプデスクダッシュボード

よくある質問

Gemini Omni Flashとは何ですか?
Gemini Omni Flashは、Google DeepMindのAI動画生成・編集モデルであり、新しい「Gemini Omni」ファミリーの第一弾です。テキスト、画像、音声、動画を入力として受け取り、音声付きの720p動画を出力し、その動画を平易な英語の指示を1つずつ重ねる会話形式で編集できます。Gemini APIの有料ティアでgemini-omni-flash-previewとして提供されています。
Gemini Omni Flashの料金はいくらですか?
動画出力は100万トークンあたり17.50ドルで課金され、これは720p動画1秒あたり約0.10ドルに相当し、これに加えて入力は100万トークンあたり1.50ドルかかります。このモデルには無料枠もバッチ割引もありません。10秒のクリップで約1ドル、60秒のクリップで約6ドルになります。
Gemini Omni Flashは他のAI動画モデルより優れていますか?
明確にそうとは言えません。Hacker Newsのヘビーユーザーは、生の品質という点ではByteDanceのSeedance 2.0/2.1に劣ると評価しており、Googleはまだベンチマークスコアを公表していません。真の強みは、クラス最高峰の忠実度ではなく、安価で高速な会話形式の編集にあります。
Gemini Omni Flashで自分がアップロードした動画を編集できますか?
はい、Files API経由で可能ですが、制限があります。アップロードした動画の編集はEEA、スイス、英国では利用できず、音声・発話の編集は意図的に制限されています。すべての出力には、来歴証明のために目に見えないSynthID透かしが付与されます。
企業がカスタマーサポートにGemini Omni Flashを使うべきでしょうか?
これはクリエイティブなメディアモデルであり、サポートツールではありません。実際にカスタマーチケットを解決するには、動画生成ツールではなく、ヘルプデスクに接続し自社のナレッジをもとに回答するeeselのような専用に構築されたAIエージェントが必要です。

Share this article

Alicia Kirana Utomo

Article by

Alicia Kirana Utomo

Kira is a writer at eesel AI with a Computer Science background and over a year of hands-on experience evaluating AI-powered customer service tools. She focuses on breaking down how helpdesk platforms and AI agents actually work so that support teams can make better buying decisions.

Related Posts

All posts →
Google ブルーで描かれたGemini 3.5 Proレビューのヒーローバナー
Trending

Gemini 3.5 Pro レビュー:Googleのフラッグシップの正直な現状

Gemini 3.5 Proの正直なレビュー:まだリリースされていない。Googleが確認したこと、遅れている理由、実在するベンチマーク、そして今使うべきモデルをまとめた。

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 21, 2026
GPT-5.6とGemini 3を比較するヒーローイラスト、拮抗する2つのAIモデルファミリー
Trending

GPT-5.6 vs Gemini 3:2026年、どちらのAIモデルが勝つのか

GPT-5.6 vs Gemini 3を比較。Sol・Terra・LunaとGemini 3.5 Flash・3.1 Proを価格、ベンチマーク、コンテキスト、AIサポートエージェントへの適性で検証する。

Rama Adi NugrahaRama Adi NugrahaJul 10, 2026
Gemini Omni Flashの秒単位AI動画生成料金を表すイラスト
Guides

Gemini Omni Flashの料金:動画1本の実際のコストは?

Gemini Omni Flashは動画出力に対して100万トークンあたり17.50ドル、1秒あたり約0.10ドルを課金します。無料枠もバッチ割引もありません。ここでは料金の全内訳を解説します。

Alicia Kirana UtomoAlicia Kirana UtomoJul 3, 2026
Anthropicのロゴが入ったClaude Sonnet 5レビューのヒーローバナー
Guides

Claude Sonnet 5レビュー:本当に使うべきモデルなのか?

Claude Sonnet 5の実践レビュー:ベンチマーク、価格面の落とし穴、Opus 4.8との比較、そしてデフォルトで使うべきClaudeモデルなのかどうかを検証する。

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 2, 2026
DeepSeek V4 Flashの料金:実際の請求額はどうなるか
Trending

DeepSeek V4 Flashの料金:実際の請求額はどうなるか

DeepSeek V4 Flashの公式価格は100万トークンあたり入力$0.14、出力$0.28。実際のユーザーは1セント未満の混合レートを報告している。どちらになるかを決める要因を解説する。

Alicia Kirana UtomoAlicia Kirana UtomoAug 4, 2026
低とマックスというラベルの付いた2つのエフォートダイヤルとDeepSeekのクジラの横で、判定スコアカードを見ているレビュアー
Trending

DeepSeek V4 Flashレビュー: 1つのモデル、2つの人格

両方のスコアボードが公開する数値に基づくDeepSeek V4 Flashレビュー。安価な実行と賢い実行は同じ重みファイルであり、それが評価を変えてしまう。

Riellvriany IndriawanRiellvriany IndriawanAug 4, 2026
DeepSeek V4 Flashのスペックと価格、実際の使い道
Trending

DeepSeek V4 Flashのスペックと価格、実際の使い道

DeepSeek V4 Flashは100万トークンあたり入力$0.14、出力$0.28で、DeepSeek自身の高価な上位モデルより高いスコアを記録している。価格表からは見えてこないポイントを解説する。

Rama Adi NugrahaRama Adi NugrahaAug 4, 2026
ヒューマノイドロボットの制御モデルを描いたイラスト、Gemini Robotics 2を表現
Trending

Gemini Robotics 2:DeepMind自身の数字が示すもの

Gemini Robotics 2は3つのモデルを同時に出し、タスク別成功率の表ではほとんどのスコアが80%を下回る。この表こそ、今回のリリースで最も役に立つ部分だ。

Alicia Kirana UtomoAlicia Kirana UtomoAug 4, 2026
DeepSeek V4 FlashとMoonshot AIのKimi K3を比較したイラスト
Trending

DeepSeek V4 Flash vs Kimi K3、どちらを使うべきか?

一方のモデルはタスクあたりのコストがもう一方の29倍にもなる。両方の公開データをすべて調べてみたが、面白いのは誰も選ぶべきではない「中間の選択肢」の存在だ。

Alicia Kirana UtomoAlicia Kirana UtomoAug 4, 2026

AIチームメイトを採用する準備はできましたか?

数分でセットアップ。クレジットカード不要。

無料で始める