Como usar Gemini 3.8 Flash de graça?

Gemini 3.8 Flash é gratuito no Google AI Studio e no nível gratuito da API Gemini. Como obter uma chave, fazer sua primeira chamada e o que a versão gratuita não oferecerá.

Ashley Innocent

Ashley Innocent

3 setembro 2026

Como usar Gemini 3.8 Flash de graça?

Apidog para empresas

Implantação local

SSO & RBAC

Conforme SOC 2

Explorar Apidog Enterprise

O Gemini 3.8 Flash foi lançado em 2 de setembro de 2026 e, ao contrário da maioria dos lançamentos de ponta este ano, ele vem com um caminho gratuito de verdade. Você pode conversar com ele no Google AI Studio sem custo, e pode chamá-lo da API Gemini no nível gratuito com uma chave que leva cerca de um minuto para ser criada. A postagem de lançamento do Google o chama de “nosso modelo Flash mais inteligente”, e o nível gratuito oferece o mesmo ID de modelo (gemini-3.8-flash) que os clientes pagantes usam, e não uma variante reduzida.

Existem três ressalvas, e este guia cobre todas elas. O nível gratuito possui limite de taxa. O Google afirma que os dados do nível gratuito são usados para melhorar seus produtos. E o aplicativo Gemini não inclui o 3.8 Flash em seu plano gratuito; você precisa de uma assinatura Google AI Pro ou Ultra para isso. Se você quiser a ficha técnica completa primeiro, comece com o que é o Gemini 3.8 Flash. Se você quiser executar uma solicitação nos próximos cinco minutos, continue lendo.

Acesso gratuito em resumo

Superfície Custo Gemini 3.8 Flash incluído? A ressalva
Google AI Studio (playground web) $0 Sim Limite de taxa; dados usados para melhorar produtos
Nível gratuito da API Gemini $0 Sim Mesmos limites, mostrados na página de limite de taxa do AI Studio
Aplicativo Gemini, plano gratuito $0 Não 3.8 Flash requer Google AI Pro ou Ultra
Modo AI na Pesquisa Google $0 Sim (consumidor) Sem API, sem controle sobre o nível de raciocínio
Gemini no Google Sheets Dependente do plano Sim (consumidor) Sem API
Fundamentação na Pesquisa Google 5.000 solicitações/mês grátis Compartilhado entre Gemini 3.x Depois $14 por 1.000 solicitações
API em Lote 50% de desconto nas taxas pagas Sim Não é gratuito; o caminho pago mais barato
Gemini 3.8 Flash Cyber Não à venda Não Somente Programa Fairwind, sem API pública a qualquer preço

Passo 1: abra o AI Studio e escolha gemini-3.8-flash

Vá para Google AI Studio e faça login com uma conta Google. Sem conta de faturamento, sem cartão de crédito. No seletor de modelos, escolha gemini-3.8-flash; é o ID estável sem sufixo de pré-visualização. As configurações de execução expõem o nível de raciocínio, que no 3.8 Flash tem três valores: low (baixo), medium (médio) e high (alto). Médio é o padrão. Não há minimal (mínimo) neste modelo, e se você o enviar pela API, receberá um erro de validação em vez de um fallback silencioso. O guia de níveis de raciocínio explica o custo de cada nível em tokens e tempo.

Duas configurações são importantes para o uso gratuito. Primeiro, deixe a temperatura como está. A orientação do Google para todos os modelos Gemini 3 é mantê-la no padrão de 1.0, pois diminuí-la pode causar loops ou saída degradada. Segundo, comece com low (baixo) enquanto estiver explorando. O 3.8 Flash foi projetado para “trabalhar mais” em tarefas complexas, dando passos de raciocínio menores e chamando ferramentas iterativamente, e o Google afirma que ele “pode usar mais tokens em tarefas mais longas e complexas, por design”. Em um nível medido em tokens por minuto, esse apetite consome sua cota mais rapidamente do que o 3.7 Flash. O nível baixo mantém os experimentos baratos.

Passo 2: obtenha uma chave de API gratuita

Dentro do AI Studio, abra a página de chaves de API e crie uma chave em um projeto novo ou existente. A chave é gratuita e funciona imediatamente com o nível gratuito. A página de preços lista a entrada e saída do 3.8 Flash como “Grátis” nesse nível, com as taxas pagas ao lado. Nosso passo a passo para a chave de API Gemini tem capturas de tela, caso você nunca tenha feito isso.

Armazene a chave como uma variável de ambiente e mantenha-a fora do seu código e do histórico do seu shell:

export GEMINI_API_KEY="paste-your-key-here"

Trate a chave como uma senha. O nível gratuito não tem faturamento anexado, então uma chave vazada não pode gerar uma fatura, mas pode esgotar sua cota diária antes que você o faça.

Passo 3: faça sua primeira chamada gratuita

O Gemini 3.x agora roda principalmente na API de Interações. Uma solicitação, sem necessidade de SDK:

curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
  -H "x-goog-api-key: $GEMINI_API_KEY" -H 'Content-Type: application/json' \
  -d '{"model":"gemini-3.8-flash","input":"Explain HTTP caching in 3 sentences.","generation_config":{"thinking_level":"low"}}'

A resposta é uma lista de etapas de execução (pensamentos do modelo, chamadas de ferramentas, se houver) terminando em uma etapa model_output com o texto. Se você tiver código existente em generateContent, ele ainda funciona; o Google o chama de legado, mas “totalmente suportado” sem data de desativação, e generationConfig.thinkingConfig.thinkingLevel é onde o nível vai nesse endpoint. Ambas as formas, além dos equivalentes em Python e multi-turno com previous_interaction_id, estão no guia da API Gemini 3.8 Flash.

Se você receber um 429, atingiu o limite de taxa do nível gratuito. Espere, ou continue lendo sobre o Nível 1.

O que o nível gratuito lhe custa

Nada em dinheiro. Três coisas, de outra forma.

Limites de taxa. O nível gratuito limita as solicitações por minuto, tokens por minuto e solicitações por dia por modelo. O Google publica os números exatos apenas na página de limite de taxa do AI Studio, e não no texto da documentação, e eles mudam sem um registro de alterações. Verifique essa página em vez de confiar em qualquer número que você leia em um blog, incluindo este. A documentação de limites de taxa explica como os níveis se acumulam.

Seus dados. O Google afirma que os prompts e as saídas do nível gratuito são usados para melhorar seus produtos. Isso é aceitável para um prompt de benchmark ou um aplicativo de teste. Não é aceitável para registros de clientes, código-fonte não lançado ou qualquer coisa sob um NDA (acordo de confidencialidade). Os níveis pagos possuem termos diferentes; se você precisar deles, vincule o faturamento antes de enviar a solicitação sensível, não depois.

Apetite por tokens. A Artificial Analysis mediu o 3.8 Flash no nível alto usando cerca de 48 mil tokens de saída por tarefa em seu índice, 30% a mais que o 3.7 Flash. Os tokens de raciocínio contam para os mesmos limites de tokens por minuto que a saída visível. Um modelo que raciocina mais arduamente é um modelo que gasta sua cota gratuita mais rapidamente, o que é a razão prática para usar low (baixo) ou medium (médio) como padrão até que você tenha pago por mais recursos.

O aplicativo Gemini não é um caminho gratuito

É aqui que a maioria das pesquisas por “Gemini 3.8 Flash grátis” erram. No lado do consumidor, o 3.8 Flash está disponível no aplicativo Gemini para assinantes Google AI Pro e Ultra. O plano gratuito do aplicativo não o inclui, de acordo com a cobertura de lançamento. Se você abrir o aplicativo sem uma assinatura e vir um modelo Flash, não é o 3.8.

As superfícies de consumidor onde você pode encontrar o 3.8 Flash sem custo adicional são o Modo AI na Pesquisa Google e o Gemini no Google Sheets. Ambos são úteis para ler suas respostas. Nenhum deles oferece controle de nível de raciocínio, contagem de tokens ou uma API, então para qualquer coisa que você chamaria de desenvolvimento, o AI Studio e o nível gratuito da API são o verdadeiro caminho gratuito.

Fundamentação gratuita: 5.000 solicitações de Pesquisa Google por mês

A fundamentação da Pesquisa Google, que permite ao modelo extrair resultados atuais da web para sua resposta, vem com 5.000 solicitações gratuitas por mês, compartilhadas entre todos os modelos Gemini 3.x. Depois disso, custa $14 por 1.000 solicitações. A cota é um pool mensal, não por modelo, então um experimento com Gemini 3 Pro fundamentado e um experimento com 3.8 Flash fundamentado consomem da mesma cota de 5.000. Para um protótipo que precisa de dados recentes, é uma permissão generosa; para um recurso de produção, você vai querer uma linha orçamentária.

Quando o gratuito acaba: os caminhos pagos mais baratos

Você saberá o momento. Um 429 chega no meio de uma demonstração, ou o limite diário é atingido às 15h. Quatro passos pagos, do mais barato primeiro.

Vincule uma conta de faturamento (Nível 1). Anexar o faturamento ao seu projeto no AI Studio o move para o Nível 1, o que aumenta os limites de taxa e define um teto de gastos de $250. O Nível 2 é desbloqueado após $100 de gastos mais três dias, com um teto de $2.000; o Nível 3 após $1.000 e 30 dias. Você não precisa gastar nada para desbloquear o Nível 1; o próprio link de faturamento faz isso.

Pague a taxa de introdução. Até 31 de dezembro de 2026, o 3.8 Flash custa $0.75 por milhão de tokens de entrada e $3.75 por milhão de tokens de saída, com os tokens de raciocínio faturados como saída. A partir de 1º de janeiro de 2027, ambos dobram para $1.50 e $7.50. Mil solicitações com 2.000 tokens de entrada e 500 de saída cada chegam a cerca de $3.38 no preço de introdução. A discriminação de preços mostra o cálculo por tarefa, incluindo por que um preço por token mais barato não significa uma tarefa mais barata neste modelo.

Processe em lote tudo o que pode esperar. A API em Lote reduz a taxa pela metade: $0.375 de entrada e $1.875 de saída por milhão até o final do ano. As mesmas mil solicitações, cerca de $1.69. Contas de Nível 1 podem ter até 3 milhões de tokens enfileirados de uma vez. Avaliações, preenchimentos retroativos e trabalhos noturnos pertencem aqui; nosso guia do modo de lote Gemini aborda o formato da solicitação.

Armazene em cache o prefixo estável. O cache de contexto custa $0.075 por milhão de tokens em cache na taxa de introdução, um décimo da entrada nova. Um prompt de sistema longo ou um documento que você reenvia a cada turno é o primeiro lugar a ser considerado.

O que o gratuito não lhe dará

Uma lista honesta, porque os resultados de pesquisa para este tópico estão cheios de desonestos.

Faça a cota gratuita durar mais com o Apidog

Um nível gratuito recompensa a disciplina. Cada solicitação que você digita novamente manualmente, cada 429 que você aciona por acidente e cada chamada de alto raciocínio que você não precisava é cota que você não recupera. O Apidog torna a disciplina barata.

Armazene GEMINI_API_KEY como uma variável de ambiente em um ambiente Apidog, para que a chave nunca apareça em um corpo de solicitação ou em uma coleção compartilhada. Salve a chamada de Interações e a chamada legada generateContent como solicitações nomeadas com o prompt, modelo e thinking_level preenchidos, e alterne os níveis com uma variável em vez de editar JSON. Adicione uma asserção no código de status para que um 429 apareça como um teste falho em vez de uma resposta em branco confusa, e uma em usageMetadata.thoughtsTokenCount no endpoint legado para que você possa ver quanto da sua cota foi gasto em raciocínio.

Em seguida, agende um pequeno teste de fumaça: uma solicitação low (baixa) por dia. Ele informa quando o comportamento do modelo ou os limites gratuitos mudam antes que seus usuários percebam. Baixe o Apidog para configurá-lo e veja como agendar testes de API no Apidog para as opções de temporização.

Perguntas Frequentes

O Gemini 3.8 Flash é gratuito? Sim, através do Google AI Studio e do nível gratuito da API Gemini, com limites de taxa e com seus dados usados para melhorar os produtos do Google. O modelo é o mesmo gemini-3.8-flash que os níveis pagos usam.

Posso usar o Gemini 3.8 Flash no aplicativo Gemini gratuitamente? Não. O aplicativo oferece o 3.8 Flash para assinantes Google AI Pro e Ultra. O Modo AI na Pesquisa Google e o Gemini no Sheets são as superfícies de consumidor onde você pode usá-lo sem uma assinatura.

Quais são os limites de taxa do nível gratuito para o Gemini 3.8 Flash? O Google os mostra por modelo na página de limite de taxa do AI Studio em vez de no texto da documentação, e eles mudam. Verifique essa página para o seu projeto. Quando precisar de mais, vincular uma conta de faturamento o move para o Nível 1 sem gasto obrigatório.

O nível gratuito inclui raciocínio? Sim. Todos os três níveis (low (baixo), medium (médio), high (alto)) funcionam no nível gratuito, e medium é o padrão. minimal (mínimo) retorna um erro no 3.8 Flash. Como os tokens de raciocínio contam para os seus limites de tokens, low estende a cota gratuita ao máximo; veja a comparação dos níveis de raciocínio para o custo medido por nível.

O Gemini 3.8 Flash Cyber é gratuito? Ele não está disponível fora do Programa Fairwind. Desenvolvedores comuns obtêm o 3.8 Flash e podem executar seus próprios testes de segurança de API contra ele.

Comece grátis, depois decida

O nível gratuito é um ambiente de avaliação real para o Gemini 3.8 Flash, não um teaser. Crie uma chave, mantenha o nível de raciocínio em low (baixo), mantenha dados sensíveis fora dele e leia a página de limite de taxa em vez de adivinhar. Quando um 429 começar a lhe custar tempo, vincule o faturamento para o Nível 1 e use o modo de lote para qualquer coisa assíncrona; a $0.375 por milhão de tokens de entrada até dezembro, o primeiro mês pago provavelmente custará menos que o café que você bebeu esperando o nível gratuito ser redefinido.

Pratique o design de API no Apidog

Descubra uma forma mais fácil de construir e usar APIs