Gemini Omni 1.1 Flash: O que um segundo de vídeo realmente custa

A saída de vídeo é cobrada a $17,50 por 1 milhão de tokens e 5.792 tokens por segundo de 720p, então um segundo custa cerca de $0,10. A tabela de preços completa, a alavanca de rascunho de 360p e uma estimativa mensal.

Ashley Innocent

Ashley Innocent

28 agosto 2026

Gemini Omni 1.1 Flash: O que um segundo de vídeo realmente custa

Apidog para empresas

Implantação local

SSO & RBAC

Conforme SOC 2

Explorar Apidog Enterprise

Um segundo de vídeo 720p do Gemini Omni 1.1 Flash custa cerca de US$0,10. Esse é o número em que se basear para o planejamento, e é o número que a própria página de preços do Google informa. Não há camada gratuita, então o primeiro clipe que você gerar enquanto lê a documentação será cobrado em sua conta.

A parte interessante é como o Google chega a esse valor, porque o modelo de cobrança é baseado em tokens, e não em tempo. Uma vez que você entende o mecanismo, as alavancas de custo se tornam óbvias, e uma delas (gerar rascunhos em 360p) corta seus gastos de iteração em dois terços.

A tabela de preços

Item Preço
Entrada (texto, imagem, vídeo, áudio) US$1,50 por 1M de tokens
Saída de texto US$9,00 por 1M de tokens
Saída de vídeo US$17,50 por 1M de tokens
Camada gratuita Nenhuma

Essas taxas se aplicam ao gemini-omni-1.1-flash, o modelo GA lançado em 27 de agosto de 2026, e ao endpoint gemini-omni-flash-preview que será descontinuado. Veja o que foi lançado na versão GA para o lado dos recursos.

Como a saída de vídeo se torna tokens

O Google cobra pelo vídeo da mesma forma que cobra pelo texto: por tokens de saída. Um segundo de vídeo 720p é precificado em 5.792 tokens de saída. Faça a multiplicação:

5.792 tokens x (US$17,50 / 1.000.000) = US$0,1014 por segundo

Então, um clipe de 720p de 10 segundos custa aproximadamente US$1,01. Uma cena de 40 segundos construída através de quatro chamadas de extensão custa aproximadamente US$4,06, mais os tokens de entrada para o contexto anterior que cada turno lê.

A entrada é barata em comparação. A US$1,50 por milhão, as imagens de referência e o vídeo que você anexa mal se registram perto da saída. Não otimize o comprimento do seu prompt. Otimize quantos segundos de vídeo você gera e em qual resolução.

A alavanca 360p

O Google gera visualizações em 360p por um terço do custo de 720p e até 60% mais rápido. Isso coloca um rascunho de 10 segundos em aproximadamente US$0,34 em vez de US$1,01.

Aqui está o que isso significa na prática. A iteração de prompts em modelos de vídeo é brutal: você raramente acerta a tomada na primeira tentativa, e cada tentativa falha é cobrada integralmente. Uma sessão realista se parece com doze tentativas antes de uma ser aprovada.

Fluxo de trabalho 12 rascunhos 1 renderização final Total
Tudo em 720p US$12,17 US$1,01 US$13,18
Rascunho em 360p, final em 720p US$4,06 US$1,01 US$5,07

Mesma saída, 62% menos gastos, e os rascunhos são entregues mais rápido, para que você passe pelas doze tentativas mais rapidamente. Defina resolution para 360p em response_format enquanto estiver iterando e só aumente quando o prompt estiver correto. O guia da API mostra o formato da requisição.

As camadas 1080p e 4K são upscales dos quadros gerados, em vez de renderizações nativas, e são cobradas acima da taxa de 720p. Verifique os valores atuais por segundo na página de preços do Google antes de orçar um pipeline 4K, já que essas duas camadas chegaram com o lançamento GA e as taxas publicadas são a autoridade.

Quanto custa o fluxo de trabalho de extensão

A extensão de cena é onde os orçamentos desandam, porque um vídeo de 40 segundos não é uma única requisição. É uma geração mais três chamadas de extensão, cada uma cobrando seus próprios 10 segundos de saída mais o contexto anterior que lê como entrada.

Em 720p, uma cena completa de 40 segundos custa cerca de US$4,06 em saída, e qualquer tentativa que se desvie da história significa regenerar a partir do segmento que falhou. Rascunhe todo o arco em 360p primeiro por cerca de US$1,35, confirme que a história se mantém em todos os quatro segmentos, e então renderize novamente. O guia de extensão de cena aborda onde as extensões tendem a falhar.

Como se compara ao Veo 3.1

Ambos os modelos estão por trás da mesma chave de API Gemini, o que torna a diferença de preço fácil de ser perdida.

Modelo 720p por segundo 4K por segundo Camada gratuita
Gemini Omni 1.1 Flash ~US$0,10 Camada de upscale, ver página de preços Não
Veo 3.1 US$0,40 US$0,60 Não
Veo 3.1 Fast US$0,10 US$0,30 Não
Veo 3.1 Lite US$0,05 Não disponível Não

O Veo 3.1 padrão custa cerca de quatro vezes um segundo Omni em 720p. O Veo 3.1 Lite é mais barato que o Omni. Mas o preço por segundo não é toda a comparação. O Veo gera áudio nativo e se estende muito mais (7 segundos por vez, até 148 segundos), enquanto o Omni oferece o loop de edição conversacional para o qual o Veo não tem equivalente. A comparação completa aborda qual chamar para cada trabalho. Se você já usa Veo, esse guia de integração ainda se aplica.

Três maneiras pelas quais as equipes gastam demais nesta API

Renderizando novamente em resolução total para verificar uma pequena mudança. Se você está ajustando uma cláusula no prompt, a passagem de 360p informa se a mudança funcionou. A passagem de 720p é para a versão que você irá entregar.

Gerando em produção o que poderia ser armazenado em cache. A saída de vídeo é determinística o suficiente para ser reutilizada, e a US$0,10 por segundo o cache se paga imediatamente. Armazene o arquivo gerado e indexe-o pelo prompt mais os parâmetros. Regenerar o mesmo clipe duas vezes é uma perda pura.

Tentando novamente após um timeout sem verificar. A geração de vídeo é lenta, e um timeout do cliente não significa que a geração falhou. Se sua lógica de repetição é acionada por timeout, você pode pagar duas vezes por um clipe. Aumente o timeout e verifique se há uma interação concluída antes de tentar novamente.

Essa última vale a pena ser observada antes que chegue à produção. Salve a solicitação no Apidog com um tempo limite realista, afirme o formato da resposta e execute-a deliberadamente, em vez de deixar que um loop de repetição descubra o custo para você. Definir um alerta de gastos na fatura do Google Cloud é a outra metade dessa rede de segurança.

Estimando uma fatura mensal

Comece pelos segundos de vídeo finalizado, depois multiplique pela sua proporção de rascunhos.

custo mensal = segundos_finalizados x US$0,10
             + segundos_rascunho x US$0,034

Uma equipe que entrega 5 minutos de vídeo finalizado em 720p por mês, com uma proporção de 10:1 de rascunho para final em 360p:

300 segundos finalizados x US$0,10       = US$30,00
3.000 segundos de rascunho x US$0,034       = US$102,00
                                             -------
                                             US$132,00

Observe para onde o dinheiro vai. O rascunho domina mesmo a um terço do preço, porque você rascunha dez vezes mais do que entrega. Se esse número precisar diminuir, a alavanca é menos tentativas por versão aprovada (prompts melhores, controle de keyframe para restringir a saída), e não uma renderização final mais barata.

FAQ

O Gemini Omni 1.1 Flash é gratuito? Não através da API. Não há camada gratuita para o Omni, embora o modelo seja gratuito no YouTube Shorts e no YouTube Create; o resumo de acesso gratuito cobre esses caminhos. Os modelos de texto do Google, como o Gemini 3.6 Flash, ainda oferecem uma faixa gratuita com limite de taxa através do AI Studio.

Quanto custa um vídeo de 10 segundos? Cerca de US$1,01 em 720p, ou cerca de US$0,34 em 360p.

Por que o vídeo é cobrado em tokens? O Google precifica toda a saída do modelo em tokens para consistência. A saída de vídeo é convertida a 5.792 tokens por segundo de 720p, cobrados à taxa de US$17,50 por milhão de saída de vídeo.

As imagens de entrada e os clipes de referência custam extra? Sim, a US$1,50 por milhão de tokens de entrada, o que é insignificante perto da saída de vídeo. A mídia de referência não é o item a ser otimizado.

O 4K vale a pena? Apenas para entregas finais. 1080p e 4K são upscales, então não adicionam detalhes que o modelo não gerou. Eles adicionam tamanho de arquivo e custo.

Uma geração falha ainda é cobrada? Uma geração que retorna vídeo é cobrada. Rejeições de filtro de conteúdo e erros que não produzem saída não devem ser cobrados, mas monitore seu painel de faturamento durante a primeira semana de qualquer novo pipeline, em vez de presumir.

A economia aqui recompensa mais a disciplina do que a esperteza. Rascunhe barato, armazene em cache agressivamente, limite seus tempos limite e mantenha uma requisição salva por tipo de tarefa para perceber o dia em que uma atualização de modelo muda o que você obtém pelos seus US$0,10. Baixe o Apidog se quiser que essa verificação seja executada antes que a fatura o informe.

Pratique o design de API no Apidog

Descubra uma forma mais fácil de construir e usar APIs