DEV Community

Cover image for Gemini Omni 1.1 Flash prix : ce que coûte réellement une seconde de vidéo
Antoine Laurent
Antoine Laurent

Posted on Originally published at apidog.com

Gemini Omni 1.1 Flash prix : ce que coûte réellement une seconde de vidéo

Le coût réel de la génération vidéo avec Gemini Omni 1.1 Flash

Une seconde de vidéo 720p avec Gemini Omni 1.1 Flash coûte environ 0,10 $. C'est le chiffre à utiliser pour planifier votre budget, tel qu'indiqué sur la page de tarification de Google. Il n'existe aucun niveau gratuit : le premier clip généré en suivant la documentation sera facturé.

Essayez Apidog dès aujourd’hui

Le modèle est facturé en jetons, et non à la durée. Comprendre ce mécanisme permet d'identifier immédiatement les leviers d'optimisation. Le plus efficace consiste à utiliser le 360p pour les brouillons : vos coûts d'itération diminuent des deux tiers.

La grille tarifaire

Élément Prix
Entrée (texte, image, vidéo, audio) 1,50 $ par million de jetons
Sortie texte 9,00 $ par million de jetons
Sortie vidéo 17,50 $ par million de jetons
Niveau gratuit Aucun

Ces tarifs concernent gemini-omni-1.1-flash, le modèle GA (Disponibilité Générale) publié le 27 août 2026, ainsi que le point d'accès gemini-omni-flash-preview, qui sera retiré. Consultez les fonctionnalités livrées avec la version GA.

Comment la sortie vidéo est convertie en jetons

Google facture la vidéo comme le texte : par jetons de sortie. Une seconde de vidéo 720p correspond à 5 792 jetons :

5,792 tokens x ($17.50 / 1,000,000) = $0.1014 per second
Enter fullscreen mode Exit fullscreen mode

Un clip 720p de 10 secondes coûte donc environ 1,01 $. Une scène de 40 secondes créée avec quatre appels d'extension coûte environ 4,06 $, auxquels s'ajoutent les jetons d'entrée du contexte précédent relu à chaque étape.

L'entrée reste peu coûteuse. À 1,50 $ par million de jetons, les images de référence et les vidéos jointes pèsent peu face à la sortie. N'optimisez pas la longueur du [REDACTED PROMPT]

Le levier du 360p

Google génère les aperçus 360p pour un tiers du coût du 720p et jusqu'à 60 % plus rapidement. Un brouillon de 10 secondes revient ainsi à environ 0,34 $, contre 1,01 $ en 720p.

L'itération des prompts vidéo nécessite rarement une seule tentative. Une session réaliste peut demander douze essais avant d'obtenir une prise exploitable :

Flux de travail 12 brouillons 1 rendu final Total
Tout en 720p 12,17 $ 1,01 $ 13,18 $
Brouillons en 360p, final en 720p 4,06 $ 1,01 $ 5,07 $

Vous obtenez le même résultat avec 62 % de dépenses en moins, et les brouillons sont plus rapides à générer. Définissez resolution sur 360p dans response_format pendant l'itération, puis passez à une résolution supérieure uniquement lorsque le prompt est validé. Consultez le guide de l'API pour la structure de la requête.

Les résolutions 1080p et 4K sont des suréchantillonnages des images générées, et non des rendus natifs. Elles coûtent donc plus cher que le 720p. Avant de budgétiser un pipeline 4K, vérifiez les tarifs actuels par seconde sur la page de tarification de Google, qui fait autorité.

Combien coûte l'extension d'une scène ?

L'extension est souvent responsable des dépassements de budget. Une vidéo de 40 secondes ne correspond pas à une seule requête : elle comprend une génération initiale et trois appels d'extension, chacun facturant ses propres 10 secondes de sortie ainsi que le contexte précédent.

En 720p, une scène complète de 40 secondes coûte environ 4,06 $. Si un segment s'écarte du scénario, il faut régénérer à partir de ce segment.

La méthode la plus économique est la suivante :

  1. Ébauchez toute la scène en 360p, pour environ 1,35 $.
  2. Vérifiez la continuité sur les quatre segments.
  3. Relancez le rendu final en 720p.

Le guide d'extension de scène détaille les situations où les extensions échouent le plus souvent.

Comparaison avec Veo 3.1

Les deux modèles utilisent la même clé API Gemini, ce qui peut masquer leur différence de prix :

Modèle 720p par seconde 4K par seconde Niveau gratuit
Gemini Omni 1.1 Flash ~0,10 $ Niveau d'upscale, voir la page de tarification Non
Veo 3.1 0,40 $ 0,60 $ Non
Veo 3.1 Fast 0,10 $ 0,30 $ Non
Veo 3.1 Lite 0,05 $ Non disponible Non

Veo 3.1 standard coûte environ quatre fois plus cher qu'Omni en 720p. Veo 3.1 Lite est moins cher qu'Omni, mais le prix par seconde ne suffit pas pour choisir :

  • Veo génère de l'audio natif et s'étend jusqu'à 148 secondes, par segments de 7 secondes.
  • Omni propose une boucle d'édition conversationnelle sans équivalent direct dans Veo.

La comparaison complète explique quel modèle choisir selon le cas d'usage. Si vous utilisez déjà Veo, ce guide d'intégration reste valable.

Trois erreurs qui font exploser les coûts

Rendre en pleine résolution pour vérifier une petite modification.

Utilisez le 360p pour confirmer qu'une modification du prompt fonctionne. Réservez le 720p au rendu livré.

Régénérer en production ce qui pourrait être mis en cache.

La sortie est suffisamment déterministe pour être réutilisée. Stockez chaque fichier et indexez-le à partir du prompt et des paramètres. Régénérer deux fois le même clip est une dépense inutile.

Réessayer automatiquement après un timeout.

Un timeout côté client ne signifie pas nécessairement que la génération a échoué. Votre logique de retry peut donc facturer deux fois un seul clip. Augmentez le délai d'attente et vérifiez l'état de l'interaction avant de relancer.

Testez ce comportement avant la mise en production. Enregistrez la requête dans Apidog avec un timeout réaliste, validez la structure de la réponse et exécutez-la volontairement. Configurez également une alerte de dépenses dans Google Cloud Billing.

Estimer une facture mensuelle

Commencez par le nombre de secondes finalisées, puis ajoutez le coût des brouillons :

monthly cost = finished_seconds x $0.10
             + draft_seconds x $0.034
Enter fullscreen mode Exit fullscreen mode

Exemple : une équipe livre 5 minutes de vidéo 720p par mois avec un ratio brouillon/final de plus grande part de la facture, même à un tiers du prix, car ils sont dix fois plus nombreux que les livrables. Pour réduire ce montant, diminuez le nombre de tentatives par élément conservé grâce à de meilleurs prompts et au contrôle des keyframes. Réduire le coût du rendu final aura beaucoup moins d'impact.

FAQ

Gemini Omni 1.1 Flash est-il gratuit ?

Pas via l'API. Omni n'a aucun niveau gratuit, même s'il est disponible gratuitement sur YouTube Shorts et YouTube Create. Le résumé des accès gratuits présente ces options. Les modèles de texte Google, comme Gemini 3.6 Flash, offrent encore un accès gratuit limité en débit via AI Studio.

Combien coûte une vidéo de 10 secondes ?

Environ 1,01 $ en 720p et 0,34 $ en 360p.

Pourquoi la vidéo est-elle facturée en jetons ?

Google facture toutes les sorties de modèles en jetons pour garantir un modèle de facturation cohérent. En 720p, une seconde de vidéo équivaut à 5 792 jetons, facturés 17,50 $ par million de jetons de sortie vidéo.

Les images d'entrée et les clips de référence coûtent-ils plus cher ?

Ils sont facturés 1,50 $ par million de jetons d'entrée, ce qui reste minime face au coût de la sortie vidéo. Ce n'est pas le principal poste à optimiser.

Le 4K en vaut-il la peine ?

Uniquement pour les livrables finaux. Le 1080p et le 4K sont des suréchantillonnages : ils n'ajoutent pas de détails que le modèle n'a pas générés, tout en augmentant la taille des fichiers et le coût.

Une génération échouée est-elle toujours facturée ?

Une génération qui renvoie une vidéo est facturée. Les rejets du filtre de contenu et les erreurs sans sortie ne devraient pas l'être. Surveillez toutefois votre tableau de bord de facturation pendant la première semaine de chaque nouveau pipeline.

La maîtrise des coûts repose davantage sur la discipline que sur l'optimisation théorique : brouillons en basse résolution, cache agressif, timeouts contrôlés et une requête enregistrée par type de tâche. Vous pourrez ainsi détecter rapidement une modification du modèle ou du prix avant qu'elle ne se transforme en facture. Téléchargez Apidog pour valider vos requêtes avant de découvrir leur coût.

Top comments (1)

Collapse
 
topstar_ai profile image
Luis Cruz

The detailed breakdown of video generation costs with Gemini Omni 1.1 Flash is incredibly insightful, especially the emphasis on using 360p for drafts to optimize expenses. This approach to iterating with lower-quality previews can significantly enhance the efficiency of the production pipeline. It might also be beneficial to explore potential automation for switching resolutions based on prompt validation status to further streamline the workflow. I'm open to collaborating on any project that requires deeper implementation in this area if you're looking for additional support. What other strategies have you considered for managing costs effectively while maintaining quality?