Tarifs de Gemini Omni Flash : le coût réel d'une vidéo

Alicia Kirana Utomo
Écrit par

Alicia Kirana Utomo

Katelin Teen
Relu par

Katelin Teen

Dernière modification July 3, 2026

Vérifié par un expert
Illustration représentant la tarification à la seconde de la génération vidéo par IA de Gemini Omni Flash

Ce qu'est Gemini Omni Flash, en bref

Gemini Omni Flash est le premier modèle de la nouvelle famille « Omni » de Google DeepMind : vous lui fournissez du texte, une image, une vidéo ou de l'audio, et il génère une vidéo en haute résolution que vous éditez ensuite par la conversation plutôt qu'en reformulant tout le prompt. Il a d'abord été déployé auprès du grand public via l'application Gemini, Google Flow et YouTube Shorts, avant de s'ouvrir aux développeurs le 30 juin 2026 via la Gemini API, Google AI Studio et la Gemini Enterprise Agent Platform. J'ai déjà détaillé ce que fait réellement ce modèle et où il montre ses limites ailleurs ; cet article ne traite que du chiffre qui détermine s'il correspond à votre budget.

Le détail complet des tarifs

La page de tarification de la Gemini API pour Gemini Omni Flash est étonnamment simple à lire, principalement parce qu'il n'y a qu'un seul palier à lire. La plupart des modèles Gemini 3.x se déclinent en onglets Standard, Batch, Flex et Priority ; Omni Flash Preview n'a que le Standard.

ÉlémentPrix
Entrée (texte, image, vidéo, audio, tarif unique)1,50 $ / million de tokens
Sortie - texte9,00 $ / million de tokens
Sortie - vidéo17,50 $ / million de tokens
Taux effectif vidéo≈ 0,10 $ / seconde de vidéo en 720p
Offre gratuiteAucune
Remise Batch APINon proposée

La page de tarification de Google détaille directement la conversion : la facturation se fait sur la consommation totale de tokens de sortie, à un taux fixe de 5 792 tokens par seconde de vidéo en 720p. Multipliez ce chiffre par le tarif de 17,50 $ par million de tokens de sortie vidéo, et vous obtenez environ 0,1014 $ la seconde, que Google arrondit à « environ 0,10 $ » sur la page elle-même.

Diagramme montrant les mécanismes de facturation de Gemini Omni Flash : tokens d'entrée à 1,50 $ par million, tokens de sortie vidéo à 17,50 $ par million, facturés à 5 792 tokens par seconde, soit environ 0,10 $ par seconde
Diagramme montrant les mécanismes de facturation de Gemini Omni Flash : tokens d'entrée à 1,50 $ par million, tokens de sortie vidéo à 17,50 $ par million, facturés à 5 792 tokens par seconde, soit environ 0,10 $ par seconde

Logan Kilpatrick, responsable des relations développeurs pour la Gemini API, a annoncé ce tarif en ces termes lors de l'ouverture du modèle aux développeurs :

« Omni Flash is SOTA at video editing at $0.10 / sec, same as Veo 3.1 Fast! » - Logan Kilpatrick, X

Google ne cache pas qu'il s'aligne sur un concurrent direct. Le billet de lancement lui-même indique que le prix est fixé pour être « compétitif... le même que Veo 3.1 Fast ». Je n'ai trouvé aucun tarif Veo 3.1 Fast indépendant et sourcé permettant de vérifier cette affirmation, donc traitez cette comparaison comme le cadrage de Google lui-même, pas comme une vérification tierce, mais elle indique tout de même où Google a positionné ce modèle face à son rival le plus proche dès le premier jour.

Ce que coûte réellement un clip, à l'unité et à grande échelle

À la limite actuelle de 10 secondes, la sortie vidéo seule revient à environ 1,01 $ par clip (10 secondes x 0,1014 $/sec). L'entrée ajoute un peu plus selon la quantité de texte, d'image de référence ou de vidéo de référence que vous fournissez, puisqu'elle est facturée séparément au tarif fixe de 1,50 $/million, mais pour un prompt court avec une ou deux images de référence, cela représente généralement une fraction infime comparée au coût de sortie vidéo.

En passant à l'échelle, la facture mensuelle d'une équipe de contenu ou de marketing ressemble à ceci, pour le seul coût de sortie vidéo :

Clips par moisCoût approximatif de sortie vidéo
1010,10 $
5050,50 $
100101,00 $
500505,00 $

C'est un chiffre réel à budgétiser, pas un tarif « à partir de ». Si vous faites tourner un petit lot de test, 10 à 50 $ par mois n'est rien. Si une équipe marketing veut intégrer Omni Flash dans un pipeline de production générant quelques centaines de clips par mois, on parle de quatre chiffres bas avant même d'avoir payé la moindre heure de relecture humaine.

Où se situe Omni Flash par rapport au reste de la gamme Gemini

Comme Omni Flash n'a qu'un palier Standard, il est intéressant de comparer cela à la structure de remises dont bénéficie le reste de la famille Gemini 3.x. Gemini 3.5 Flash, par exemple, propose les paliers Standard, Batch (environ 50 % de remise sur le Standard), Flex et Priority, plus une véritable offre gratuite à accès limité. Omni Flash ne bénéficie d'aucune de ces flexibilités.

Comparaison montrant que la plupart des modèles Gemini proposent les paliers Standard, Batch à 50 % de remise et Priority, tandis que Gemini Omni Flash ne propose qu'un seul palier Standard, sans remise Batch ni offre gratuite
Comparaison montrant que la plupart des modèles Gemini proposent les paliers Standard, Batch à 50 % de remise et Priority, tandis que Gemini Omni Flash ne propose qu'un seul palier Standard, sans remise Batch ni offre gratuite

Pour référence, voici comment les chiffres phares d'Omni Flash se situent par rapport à quelques autres modèles sur la même page de tarification :

ModèleEntrée (Standard)Sortie (Standard)Offre gratuite
Gemini Omni Flash (vidéo)1,50 $ / million de tokens17,50 $ / million de tokens (vidéo)Non
Gemini 3.5 Flash1,50 $ / million de tokens9,00 $ / million de tokensOui
Gemini 3.1 Pro Preview2,00-4,00 $ / million de tokens12,00-18,00 $ / million de tokensNon
Gemini 2.5 Flash0,30-1,00 $ / million de tokens2,50 $ / million de tokensOui
Nano Banana 2 Lite (image, gemini-3.1-flash-lite-image)0,25 $ / million de tokens0,034 $ par image en résolution 1KNon

Si vous n'avez besoin que d'images fixes plutôt que de mouvement, Nano Banana 2 Lite est le modèle jumeau bien moins cher que Google a lancé dans la même annonce, à environ 3,4 centimes par image contre plus d'un dollar par clip vidéo.

Les lignes cachées de la facture

Deux détails dans les notes de bas de page de la page de tarification sont faciles à manquer, et tous deux font grimper le coût réel, ou le risque réel, au-delà du tarif affiché.

Pas de remise Batch. La plupart des modèles Gemini du palier payant permettent de réduire les coûts d'environ moitié en soumettant les requêtes via la Batch API plutôt qu'en Standard, en échange d'un traitement asynchrone. Omni Flash Preview ne propose pas du tout cet arbitrage pour l'instant, donc il n'y a aucun levier « moins cher si vous pouvez attendre » à actionner.

Contenu utilisé pour améliorer les produits de Google, même sur le palier payant. La plupart des modèles Gemini du palier payant sont marqués « Non » sur ce point dans la page de tarification, ce qui est tout l'intérêt de payer : vos données ne servent pas à l'entraînement. Gemini Omni Flash Preview fait partie des rares lignes du palier payant marquées « Oui ». Si vous lui soumettez quoi que ce soit de sensible, des assets de marque, des images inédites, les photos produit d'un client, c'est un point à connaître avant de cliquer sur générer, pas après.

Le compte indépendant d'actualité IA Rohan Paul, en décortiquant le lancement sur X, a signalé une limite pratique connexe qui affecte la rentabilité réelle de chaque dollar dépensé par clip :

« Gemini Omni Flash currently generates 10-second clips and lacks API audio reference support. [...] Google says the API accepts video references up to 3 seconds, but Gemini Omni Flash does not process them correctly yet. » - Rohan Paul, X

Le calcul d'environ 1 $ par clip suppose donc que vous obtenez un résultat propre de 10 secondes du premier coup. Si la cohérence des personnages dérive au fil d'un montage, selon la limite documentée du modèle lui-même, et que vous régénérez, ce coût s'accumule vite.

Tarification à l'usage contre tarification fixe

Toute API à l'usage, Omni Flash y compris, vous laisse le travail de budgétisation : lire le tarif, faire la multiplication, surveiller la consommation par rapport à un plafond. C'est un compromis acceptable pour un modèle de génération de contenu où le volume de sortie varie réellement d'un clip à l'autre. C'est un compromis moins bon quand ce que vous chiffrez est une charge de travail prévisible et récurrente, comme une file de support qui reçoit à peu près le même nombre de tickets chaque semaine.

Comparaison montrant la tarification à l'usage basée sur les tokens comme un coût croissant et imprévisible, contre la tarification fixe par tâche comme un tarif plat et prévisible
Comparaison montrant la tarification à l'usage basée sur les tokens comme un coût croissant et imprévisible, contre la tarification fixe par tâche comme un tarif plat et prévisible

C'est la logique derrière la tarification propre d'eesel : 0,40 $ par ticket de support résolu ou session de chat, à tarif fixe, quel que soit le nombre de messages nécessaires ou le modèle sous-jacent qui traite la demande. En coulisses, eesel répartit déjà le travail entre OpenAI, Anthropic et les propres modèles Gemini de Google selon la tâche, y compris en utilisant Gemini pour faire fonctionner le générateur gratuit de mots-clés SEO d'eesel. La complexité de la tarification au token que vous venez de parcourir dans cet article est exactement ce que cette structure à tarif fixe est conçue pour absorber, afin qu'un responsable support n'ait pas à devenir analyste de pages tarifaires pour savoir à quoi ressemblera la facture du mois prochain.

Essayez eesel si le chiffre que vous budgétisez vraiment est un ticket, pas un clip

Si vous êtes arrivé ici en train de chiffrer une IA pour une file de support en croissance plutôt qu'un pipeline vidéo, eesel est le coéquipier IA que je conçois exactement pour ce travail. Il se branche sur Zendesk, Freshdesk, Intercom, ou quel que soit le helpdesk que vous utilisez déjà, apprend dès le premier jour à partir de vos tickets passés et de votre documentation d'aide, et rédige, trie ou résout les demandes de niveau 1.

Vue d'ensemble du tableau de bord de l'agent d'assistance IA d'eesel
Vue d'ensemble du tableau de bord de l'agent d'assistance IA d'eesel

La tarification est de 0,40 $ par ticket résolu, sans frais de siège, sans frais de plateforme sur le plan self-service, et les 50 premiers dollars d'utilisation sont gratuits pour que vous puissiez voir le chiffre réel par rapport à votre propre volume de tickets avant de vous engager. C'est ainsi que Gridwise a résolu 73 % des demandes de niveau 1 dès son premier mois, et que Smava fait tourner un agent entièrement automatisé sur plus de 100 000 tickets par mois sans le moindre tableur de calcul au token en vue. Gemini Omni Flash est une bonne réponse si la question est « combien coûte une vidéo ». Si la question est « combien coûte ma file de support », essayez eesel et obtenez une réponse fixe plutôt qu'une formule.

Questions fréquentes

Combien coûte Gemini Omni Flash ?
Sur le palier payant de la Gemini Developer API, la sortie vidéo est facturée 17,50 $ par million de tokens, ce qui revient à environ 0,10 $ par seconde de vidéo en 720p. L'entrée (texte, image, vidéo ou audio) est facturée à un taux fixe de 1,50 $ par million de tokens, et la sortie texte à 9,00 $ par million de tokens.
Gemini Omni Flash propose-t-il une offre gratuite ?
Non. Contrairement à la plupart des modèles de la gamme Gemini, qui offrent un palier gratuit à accès limité, Gemini Omni Flash Preview est réservé au palier payant : chaque seconde de vidéo générée coûte de l'argent dès le premier clip.
Comment le prix de 0,10 $ par seconde est-il calculé ?
Google facture en fonction du total de tokens de sortie, à un taux fixe de 5 792 tokens par seconde de vidéo en 720p, multiplié par le prix de 17,50 $ par million de tokens de sortie vidéo. Ce calcul aboutit à un taux effectif légèrement supérieur à 0,10 $ la seconde, si bien qu'un clip de 10 secondes, la durée maximale actuelle, revient à un peu plus de 1 $ rien qu'en coût de sortie.
Quels coûts cachés faut-il prévoir avec Gemini Omni Flash ?
Deux points surprennent souvent : il n'existe aucune remise Batch API pour ce modèle (la plupart des modèles Gemini réduisent les coûts d'environ 50 % via Batch ; Omni Flash ne propose que la tarification Standard), et Google indique que ce modèle utilise votre contenu pour améliorer ses produits même sur le palier payant, contrairement à la plupart des autres modèles Gemini payants.
Existe-t-il une alternative à tarif fixe à la tarification à l'usage pour l'automatisation du support client ?
Oui. Si ce que vous cherchez réellement à chiffrer, c'est l'automatisation du support plutôt que la génération vidéo, eesel facture un tarif fixe de 0,40 $ par ticket résolu, sans calcul au token, sans frais de siège et sans palier Batch à prendre en compte.

Share this article

Alicia Kirana Utomo

Article by

Alicia Kirana Utomo

Kira is a writer at eesel AI with a Computer Science background and over a year of hands-on experience evaluating AI-powered customer service tools. She focuses on breaking down how helpdesk platforms and AI agents actually work so that support teams can make better buying decisions.

Related Posts

All posts →
Illustration éditoriale sur Nano Banana 2 Lite, le modèle de génération d'images IA rapide de Google, en bleu Google
Guides

Avis Nano Banana 2 Lite : le modèle image le plus rapide de Google est-il vraiment bon ?

Nano Banana 2 Lite génère une image en 4 secondes pour 0,034 $. J'ai passé au crible les propres benchmarks de Google, les comparaisons d'images et les premiers retours de développeurs pour voir si la vitesse coûte de la qualité.

Rama Adi NugrahaRama Adi NugrahaJul 3, 2026
Illustration éditoriale représentant Nano Banana 2 Lite, le modèle de génération d'images IA rapide et économique de Google
Guides

Qu'est-ce que Nano Banana 2 Lite ? Le modèle d'image IA le plus rapide de Google

Nano Banana 2 Lite est le modèle d'image le moins cher et le plus rapide de Google à ce jour : génération en 4 secondes, 0,034 $ pour 1 000 images. Voici ce que c'est et à quoi il sert.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 3, 2026
Illustration représentant le modèle de génération et d'édition vidéo IA Gemini Omni Flash de Google
Guides

Qu'est-ce que Gemini Omni Flash ? Le nouveau modèle vidéo IA de Google expliqué

Gemini Omni Flash est le nouveau modèle vidéo any-to-any de Google : édition conversationnelle, plafond de 10 secondes, et tarif à 0,10 $/seconde. Voici ce qu'il fait et ce qu'il coûte.

Rama Adi NugrahaRama Adi NugrahaJul 3, 2026
Texte alternatif de l'image
Guides

Gemini 3 Pro vs Claude Opus 4.6 : une comparaison pratique

Ce guide propose un regard direct et pratique sur Gemini 3 Pro et Claude Opus 4.6. Nous irons au-delà du battage médiatique pour nous concentrer sur les différences concrètes qui comptent lorsque vous mettez ces outils au travail.

Stevia PutriStevia PutriFeb 6, 2026
Gemini vs ChatGPT : Quelle IA est la mieux adaptée à votre entreprise ?
Guides

Gemini vs ChatGPT testés : Le gagnant m'a surpris (2026)

Gemini contre ChatGPT : Découvrez le duel complet de l'IA et comment les deux se comparent en 2025.

Stevia PutriStevia PutriAug 22, 2025
Gemini vs Claude : Quel modèle d'IA est fait pour vous en 2025 ?
Guides

Gemini vs Claude : Quel modèle d'IA est fait pour vous en 2025 ?

Gemini vs Claude : explorez les forces, les différences et les caractéristiques clés de chaque IA pour découvrir laquelle correspond le mieux à vos besoins.

Stevia PutriStevia PutriAug 22, 2025
Illustration éditoriale des tarifs de Nano Banana 2 Lite, montrant le coût par image et la comparaison de vitesse sur fond bleu Google
Guides

Tarifs de Nano Banana 2 Lite : le détail complet des coûts pour 2026

Nano Banana 2 Lite coûte 0,034 $ par image de 1K en Standard, deux fois moins en Batch. Voici le calcul complet par token, l'arbitrage Batch vs Standard, et où se cachent les coûts additionnels.

Alicia Kirana UtomoAlicia Kirana UtomoJul 3, 2026
Qu'est-ce que Tavus ? Une plongée profonde dans les humains IA et les répliques vidéo
Guides

Qu'est-ce que Tavus ? Répliques vidéo AI & humains numériques (2026)

Explorez Tavus et sa technologie révolutionnaire d''humains IA'. Découvrez ses fonctionnalités, ses cas d'utilisation idéaux et comprenez pourquoi une approche différente pourrait être meilleure pour le CS et l'ITSM.

Stevia PutriStevia PutriOct 8, 2025
Deux personnes parlant des langues différentes reliées par une onde sonore en direct, illustrant Gemini 3.5 Live Translate
Guides

Qu'est-ce que Gemini 3.5 Live Translate ?

Gemini 3.5 Live Translate est le modèle de traduction vocale en temps réel de Google pour plus de 70 langues. Voici ce qu'il fait, comment il fonctionne et où il s'intègre.

Riellvriany IndriawanRiellvriany IndriawanJun 17, 2026

Prêt à recruter votre collègue IA ?

Configuration en quelques minutes. Pas de carte bancaire requise.

Commencer gratuitement