DEV Community

Cover image for Precios Gemini Omni 1.1 Flash: cuánto cuesta un segundo de video
Roobia
Roobia

Posted on Originally published at apidog.com

Precios Gemini Omni 1.1 Flash: cuánto cuesta un segundo de video

Costos de Gemini Omni 1.1 Flash para generación de video

Un segundo de video 720p de Gemini Omni 1.1 Flash cuesta aproximadamente $0.10. Esa es la cifra que cita la propia página de precios de Google. No existe una capa gratuita, así que el primer clip que generes mientras lees la documentación se facturará a tu cuenta.

Prueba Apidog hoy

Lo importante es entender cómo Google llega a esa cifra: la facturación se basa en tokens, no en tiempo. Una vez entendido el mecanismo, las principales palancas de costo son evidentes. La más efectiva es generar borradores a 360p, lo que reduce en dos tercios el gasto de iteración.

Tabla de tarifas

Elemento Precio
Entrada (texto, imagen, video, audio) $1.50 por 1M de tokens
Salida de texto $9.00 por 1M de tokens
Salida de video $17.50 por 1M de tokens
Capa gratuita Ninguna

Estas tarifas corresponden a gemini-omni-1.1-flash, el modelo GA lanzado el 27 de agosto de 2026, y al endpoint en retirada gemini-omni-flash-preview. Consulta las novedades de la versión GA.

Cómo se convierte el video en tokens

Google factura el video como salida del modelo. Un segundo de video 720p equivale a 5,792 tokens de salida:

5,792 tokens x ($17.50 / 1,000,000) = $0.1014 por segundo
Enter fullscreen mode Exit fullscreen mode

Por tanto:

  • Un clip 720p de 10 segundos cuesta aproximadamente $1.01.
  • Una escena de 40 segundos creada mediante cuatro llamadas de extensión cuesta aproximadamente $4.06.
  • A esto hay que añadir los tokens de entrada del contexto previo que se lee en cada turno.

La entrada es barata en comparación: a $1.50 por millón de tokens, las imágenes y los videos de referencia tienen un impacto reducido. Optimiza la cantidad de segundos generados y la resolución, no la longitud del prompt.

Usa 360p para iterar

Google genera vistas previas de 360p a un tercio del costo de 720p y hasta un 60 % más rápido. Un borrador de 10 segundos cuesta aproximadamente $0.34 en lugar de $1.01.

La iteración de prompts en video rara vez acierta a la primera. Si necesitas doce intentos antes de obtener un resultado usable, la diferencia es significativa:

Flujo de trabajo 12 borradores 1 render final Total
Todo a 720p $12.17 $1.01 $13.18
Borrador a 360p, final a 720p $4.06 $1.01 $5.07

El resultado final es el mismo, pero el gasto se reduce un 62 %. Además, los borradores regresan más rápido y permiten completar más iteraciones.

Configura resolution como 360p dentro de response_format mientras ajustas el prompt. Cámbialo a 720p solo cuando la escena sea correcta. Consulta la guía de uso de la API para conocer la estructura de la solicitud.

Los niveles de 1080p y 4K se escalan a partir de los fotogramas generados, en lugar de producirse como renders nativos, y se facturan por encima de la tarifa de 720p. Antes de presupuestar un pipeline 4K, verifica las cifras actuales por segundo en la página de precios de Google: esas tarifas se introdujeron con el lanzamiento GA y esa página es la fuente de autoridad.

Coste de extender escenas

La extensión de escenas es un punto frecuente de desviación presupuestaria. Un video de 40 segundos no es una sola solicitud: consiste en una generación inicial más tres llamadas de extensión. Cada llamada factura sus propios 10 segundos de salida y el contexto previo que recibe como entrada.

A 720p, una escena completa de 40 segundos cuesta alrededor de $4.06 en salida. Si una extensión rompe la continuidad, tendrás que regenerar desde el segmento afectado.

Un flujo más eficiente es:

  1. Crear un borrador de todo el arco a 360p por aproximadamente $1.35.
  2. Confirmar que la historia funciona en los cuatro segmentos.
  3. Volver a renderizar la versión final a 720p.

La guía de extensión de escenas explica dónde suelen fallar las extensiones.

Comparación con Veo 3.1

Ambos modelos utilizan la misma clave API de Gemini, por lo que sus diferencias de precio pueden pasar desapercibidas.

Modelo 720p por segundo 4K por segundo Capa gratuita
Gemini Omni 1.1 Flash ~$0.10 Nivel de escalado, ver página de precios No
Veo 3.1 $0.40 $0.60 No
Veo 3.1 Rápido $0.10 $0.30 No
Veo 3.1 Lite $0.05 No disponible No

Veo 3.1 estándar cuesta aproximadamente cuatro veces más por segundo 720p que Omni. Veo 3.1 Lite es más económico que Omni, pero el precio no es el único factor:

  • Veo genera audio nativo.
  • Veo permite extensiones de hasta 7 segundos por llamada y hasta 148 segundos.
  • Omni ofrece un ciclo de edición conversacional que no tiene un equivalente en Veo.

La comparación completa explica qué modelo conviene usar en cada escenario. Si ya utilizas Veo, la guía de integración sigue siendo válida.

Tres formas de gastar de más

Renderizar nuevamente a resolución completa para verificar un cambio pequeño. Si solo ajustas una cláusula del prompt, un pase a 360p te permite comprobar si el cambio funcionó. Reserva el render 720p para la versión que entregarás.

Generar en producción contenido que podrías reutilizar desde caché. La salida de video es suficientemente determinista como para almacenarla y reutilizarla. Guarda cada archivo junto con su prompt y sus parámetros. Regenerar dos veces el mismo clip es un gasto innecesario.

Reintentar por un tiempo de espera sin verificar el estado. La generación de video puede ser lenta. Un timeout del cliente no significa necesariamente que la generación haya fallado. Si el reintento se activa automáticamente, podrías pagar dos veces por un solo clip.

Aumenta el tiempo de espera y verifica si existe una interacción completada antes de reintentar. Antes de llevar el pipeline a producción, guarda la solicitud en Apidog, configura un timeout realista, comprueba la estructura de la respuesta y ejecútala de forma controlada. También configura una alerta de gasto en Google Cloud.

Estima tu factura mensual

Calcula primero los segundos finales y después aplica la relación de borradores:

costo_mensual = segundos_terminados x $0.10
             + segundos_borrador x $0.034
Enter fullscreen mode Exit fullscreen mode

Ejemplo: un equipo entrega cinco minutos de video 720p al mes, con una relación de diez borradores por cada render final a 360p:

300 segundos terminados x $0.10       = $30.00
3,000 segundos borrador x $0.034       = $102.00
                                     -------
                                     $132.00
Enter fullscreen mode Exit fullscreen mode

Los borradores dominan el costo incluso a un tercio del precio, porque se generan diez veces más segundos de borrador que de video final. Si necesitas reducir la factura, la palanca principal es disminuir los intentos por resultado final mediante mejores prompts y control de fotogramas clave, no abaratar el render final.

Preguntas frecuentes

¿Gemini Omni 1.1 Flash es gratuito?

No a través de la API. Omni no tiene capa gratuita, aunque sí es gratuito en YouTube Shorts y YouTube Create. El resumen de opciones de acceso gratuito explica esas alternativas. Los modelos de texto de Google, como Gemini 3.6 Flash, todavía ofrecen una vía gratuita con límite de tasa mediante AI Studio.

¿Cuánto cuesta un video de 10 segundos?

Aproximadamente $1.01 a 720p o $0.34 a 360p.

¿Por qué el video se factura en tokens?

Google convierte toda la salida del modelo en tokens para mantener un sistema de facturación consistente. En 720p, un segundo de video equivale a 5,792 tokens, facturados a $17.50 por millón de tokens de salida de video.

¿Las imágenes de entrada y los clips de referencia tienen un costo adicional?

Sí. Cuestan $1.50 por millón de tokens de entrada, una cantidad pequeña frente al costo de salida. No son el principal elemento a optimizar.

¿Vale la pena usar 4K?

Solo para entregables finales. 1080p y 4K son resoluciones escaladas, así que no añaden detalles que el modelo no haya generado. Sí aumentan el tamaño del archivo y el costo.

¿Una generación fallida se factura?

Una generación que devuelve video se factura. Los rechazos del filtro de contenido y los errores que no producen salida no deberían facturarse. Aun así, supervisa el panel de facturación durante la primera semana de cualquier pipeline nuevo.

La economía de esta API recompensa la disciplina: genera borradores baratos, usa caché, configura timeouts adecuados y guarda una solicitud por tipo de tarea. Así podrás detectar si una actualización del modelo cambia el resultado que obtienes por tus $0.10. Descarga Apidog para validar tus solicitudes antes de que lo haga la factura.

Top comments (0)