Un segundo de video 720p de Gemini Omni 1.1 Flash cuesta aproximadamente $0.10. Esa es la cifra a tener en cuenta, y es la que la propia página de precios de Google cita. No hay una capa gratuita, por lo que el primer clip que generes mientras lees la documentación se facturará a tu cuenta.
La parte interesante es cómo Google llega a esa cifra, porque el modelo de facturación se basa en tokens en lugar de en el tiempo. Una vez que entiendes el mecanismo, las palancas de costo se vuelven obvias, y una de ellas (la generación de borradores a 360p) reduce tu gasto de iteración en dos tercios.
La tabla de tarifas
| Elemento | Precio |
|---|---|
| Entrada (texto, imagen, video, audio) | $1.50 por 1M de tokens |
| Salida de texto | $9.00 por 1M de tokens |
| Salida de video | $17.50 por 1M de tokens |
| Capa gratuita | Ninguna |
Esas tarifas se aplican a gemini-omni-1.1-flash, el modelo GA lanzado el 27 de agosto de 2026, y al endpoint `gemini-omni-flash-preview` que se retira. Consulta lo que se incluyó en la versión GA para conocer las características.
Cómo la salida de video se convierte en tokens
Google factura el video de la misma manera que factura el texto: por tokens de salida. Un segundo de video 720p tiene un precio de 5,792 tokens de salida. Realiza la multiplicación:
5,792 tokens x ($17.50 / 1,000,000) = $0.1014 por segundo
Así, un clip de 720p de 10 segundos cuesta aproximadamente $1.01. Una escena de 40 segundos construida a través de cuatro llamadas de extensión cuesta aproximadamente $4.06, más los tokens de entrada para el contexto previo que cada turno lee.
La entrada es barata en comparación. A $1.50 por millón, las imágenes y videos de referencia que adjuntas apenas se registran junto a la salida. No optimices la longitud de tu prompt. Optimiza cuántos segundos de video generas y con qué resolución.
La palanca de 360p
Google genera vistas previas de 360p a un tercio del costo de 720p y hasta un 60% más rápido. Eso sitúa un borrador de 10 segundos en aproximadamente $0.34 en lugar de $1.01.
Esto es lo que significa en la práctica. La iteración de prompts en modelos de video es brutal: rara vez aciertas a la primera, y cada intento fallido se factura por completo. Una sesión realista se parece a doce intentos antes de obtener uno bueno.
| Flujo de trabajo | 12 borradores | 1 render final | Total |
|---|---|---|---|
| Todo a 720p | $12.17 | $1.01 | $13.18 |
| Borrador a 360p, final a 720p | $4.06 | $1.01 | $5.07 |
Misma salida, 62% menos de gasto, y los borradores regresan más rápido para que pases por los doce intentos antes. Establece `resolution` a `360p` en `response_format` mientras iteras y solo auméntala cuando el prompt sea correcto. La guía de la API tiene la forma de la solicitud.
Los niveles de 1080p y 4K son escalados de los fotogramas generados en lugar de renders nativos, y se facturan por encima de la tarifa de 720p. Verifica las cifras actuales por segundo en la página de precios de Google antes de presupuestar un pipeline 4K, ya que esos dos niveles llegaron con el lanzamiento GA y las tarifas publicadas son la autoridad.
Cuánto cuesta el flujo de trabajo de extensión
La extensión de escenas es donde los presupuestos se desvían, porque un video de 40 segundos no es una sola solicitud. Es una generación más tres llamadas de extensión, cada una facturando sus propios 10 segundos de salida más el contexto previo que lee como entrada.
A 720p, una escena completa de 40 segundos cuesta alrededor de $4.06 en salida, y cualquier intento que se desvíe de la historia significa regenerar desde el segmento que falló. Primero, haz un borrador de todo el arco a 360p por aproximadamente $1.35, confirma que la historia se mantiene en los cuatro segmentos y luego vuelve a renderizar. La guía de extensión de escenas cubre dónde las extensiones suelen fallar.
Cómo se compara con Veo 3.1
Ambos modelos se encuentran detrás de la misma clave API de Gemini, lo que hace que la diferencia de precio sea fácil de pasar por alto.
| Modelo | 720p por segundo | 4K por segundo | Capa gratuita |
|---|---|---|---|
| Gemini Omni 1.1 Flash | ~$0.10 | Nivel de escalado, ver página de precios | No |
| Veo 3.1 | $0.40 | $0.60 | No |
| Veo 3.1 Rápido | $0.10 | $0.30 | No |
| Veo 3.1 Lite | $0.05 | No disponible | No |
El Veo 3.1 estándar cuesta aproximadamente cuatro veces un segundo de Omni a 720p. Veo 3.1 Lite es más económico que Omni. Pero el precio por segundo no es toda la comparación. Veo genera audio nativo y se extiende mucho más (7 segundos a la vez, hasta 148 segundos), mientras que Omni te ofrece el ciclo de edición conversacional para el que Veo no tiene equivalente. La comparación completa detalla cuál usar para cada trabajo. Si ya usas Veo, esa guía de integración sigue siendo válida.
Tres formas en que los equipos gastan de más en esta API
Volver a renderizar a resolución completa para verificar un pequeño cambio. Si estás ajustando una cláusula en el prompt, el pase de 360p te indica si el cambio funcionó. El pase de 720p es para la versión que entregas.
Generar en producción lo que podrías cachear. La salida de video es lo suficientemente determinista como para ser reutilizada, y a $0.10 por segundo la caché se amortiza inmediatamente. Almacena el archivo generado y asócialo al prompt más los parámetros. Regenerar el mismo clip dos veces es una pérdida pura.
Reintentar por tiempo de espera sin verificar. La generación de video es lenta, y un tiempo de espera excedido del cliente no significa que la generación haya fallado. Si tu lógica de reintento se activa por tiempo de espera, puedes pagar dos veces por un solo clip. Aumenta el tiempo de espera y verifica una interacción completada antes de reintentar.
Vale la pena abordar este último punto antes de que llegue a producción. Guarda la solicitud en Apidog con un tiempo de espera realista, verifica la forma de la respuesta y ejecútala deliberadamente en lugar de dejar que un bucle de reintentos descubra el costo por ti. Configurar una alerta de gasto en la facturación de Google Cloud es la otra mitad de esa red de seguridad.
Estimando una factura mensual
Calcula a partir de los segundos de video terminado, luego multiplica por tu relación de borrador.
costo_mensual = segundos_terminados x $0.10
+ segundos_borrador x $0.034
Un equipo que entrega 5 minutos de video 720p terminado al mes, con una relación borrador-final de 10:1 a 360p:
300 segundos terminados x $0.10 = $30.00
3,000 segundos borrador x $0.034 = $102.00
-------
$132.00
Observa dónde va el dinero. La creación de borradores domina incluso a un tercio del precio, porque generas diez veces más borradores de lo que produces finalmente. Si esa cifra necesita reducirse, la palanca es menos intentos por resultado final (prompts mejores, control de fotogramas clave para limitar la salida), no un render final más barato.
Preguntas frecuentes
¿Gemini Omni 1.1 Flash es gratuito? No a través de la API. No hay una capa gratuita para Omni, aunque el modelo es gratuito en YouTube Shorts y YouTube Create; el resumen de acceso gratuito cubre esos caminos. Los modelos de texto de Google como Gemini 3.6 Flash aún ofrecen una vía gratuita con límite de tasa a través de AI Studio.
¿Cuánto cuesta un video de 10 segundos? Aproximadamente $1.01 a 720p, o aproximadamente $0.34 a 360p.
¿Por qué el video se factura en tokens? Google tarifa toda la salida del modelo en tokens para mantener la consistencia. La salida de video se convierte a 5,792 tokens por segundo de 720p, facturados a la tarifa de $17.50 por millón de tokens de salida de video.
¿Las imágenes de entrada y los clips de referencia tienen un costo adicional? Sí, a $1.50 por millón de tokens de entrada, lo cual es pequeño en comparación con la salida de video. Los medios de referencia no son el elemento a optimizar.
¿Vale la pena el 4K? Solo para entregables finales. 1080p y 4K son escalados, por lo que no añaden detalles que el modelo no haya generado. Añaden tamaño de archivo y costo.
¿Una generación fallida aún se factura? Una generación que devuelve video se factura. Los rechazos del filtro de contenido y los errores que no producen salida no deberían facturarse, pero monitorea tu panel de facturación durante la primera semana de cualquier nuevo pipeline en lugar de asumir.
La economía aquí recompensa la disciplina más que la astucia. Haz borradores baratos, cachea agresivamente, limita tus tiempos de espera y guarda una solicitud por tipo de tarea para que notes el día en que una actualización del modelo cambie lo que obtienes por tus $0.10. Descarga Apidog si quieres que esa verificación se ejecute antes de que la factura te lo diga.
