Gemini 3.8 Flash se lanzó el 2 de septiembre de 2026, y a diferencia de la mayoría de los lanzamientos pioneros de este año, viene con un verdadero camino gratuito. Puedes chatear con él en Google AI Studio sin costo, y puedes llamarlo desde la API de Gemini en el nivel gratuito con una clave que tarda aproximadamente un minuto en crearse. La publicación de lanzamiento de Google lo califica como "nuestro modelo Flash más inteligente", y el nivel gratuito te proporciona el mismo ID de modelo (gemini-3.8-flash) que utilizan los clientes de pago, no una variante reducida.
Hay tres advertencias, y esta guía las cubre todas. El nivel gratuito tiene límites de tasa. Google dice que los datos del nivel gratuito se utilizan para mejorar sus productos. Y la aplicación Gemini no incluye 3.8 Flash en su plan gratuito; para eso necesitas una suscripción a Google AI Pro o Ultra. Si primero quieres la hoja de especificaciones completa, empieza con qué es Gemini 3.8 Flash. Si quieres ejecutar una solicitud en los próximos cinco minutos, sigue leyendo.
Acceso gratuito de un vistazo
| Superficie | Costo | ¿Gemini 3.8 Flash incluido? | La advertencia |
|---|---|---|---|
| Google AI Studio (entorno de pruebas web) | $0 | Sí | Con límites de tasa; datos utilizados para mejorar productos |
| Nivel gratuito de la API de Gemini | $0 | Sí | Mismos límites, mostrados en la página de límites de tasa de AI Studio |
| Aplicación Gemini, plan gratuito | $0 | No | 3.8 Flash requiere Google AI Pro o Ultra |
| Modo IA en la Búsqueda de Google | $0 | Sí (consumidor) | Sin API, sin control sobre el nivel de pensamiento |
| Gemini en Hojas de cálculo de Google | Depende del plan | Sí (consumidor) | Sin API |
| Contextualización de Búsqueda de Google | 5,000 solicitudes/mes gratis | Compartido entre Gemini 3.x | Luego $14 por cada 1,000 solicitudes |
| API por lotes | 50% de descuento sobre las tarifas de pago | Sí | No es gratuito; el camino de pago más económico |
| Gemini 3.8 Flash Cyber | No se vende | No | Solo Programa Fairwind, sin API pública a ningún precio |

Paso 1: abre AI Studio y elige gemini-3.8-flash
Ve a Google AI Studio e inicia sesión con una cuenta de Google. Sin cuenta de facturación, sin tarjeta de crédito. En el selector de modelos, elige gemini-3.8-flash; es el ID estable sin sufijo de vista previa. La configuración de ejecución expone el nivel de pensamiento, que en 3.8 Flash tiene tres valores: bajo, medio y alto. Medio es el predeterminado. No hay mínimo en este modelo, y si lo envías a través de la API, obtendrás un error de validación en lugar de una solución alternativa silenciosa. La guía de niveles de pensamiento explica lo que cuesta cada nivel en tokens y tiempo.
Dos configuraciones importan para el uso gratuito. Primero, deja la temperatura como está. La guía de Google para cada modelo Gemini 3 es mantenerla en el valor predeterminado de 1.0, porque reducirla puede causar bucles o una salida degradada. Segundo, comienza en bajo mientras exploras. 3.8 Flash está diseñado para "trabajar más duro" en tareas complejas, tomando pasos de razonamiento más pequeños y llamando a herramientas de forma iterativa, y Google dice que "puede usar más tokens en tareas de ejecución prolongada y complejas, por diseño". En un nivel medido en tokens por minuto, ese apetito consume tu cuota más rápido de lo que lo hizo 3.7 Flash. El nivel bajo mantiene los experimentos económicos.
Paso 2: obtén una clave API gratuita
Dentro de AI Studio, abre la página de claves API y crea una clave en un proyecto nuevo o existente. La clave es gratuita y funciona inmediatamente con el nivel gratuito. La página de precios enumera la entrada y salida de 3.8 Flash como "Gratuitas" en ese nivel, con las tarifas de pago al lado. Nuestra guía paso a paso para la clave API de Gemini incluye capturas de pantalla si nunca lo has hecho.
Guarda la clave como una variable de entorno y manténla fuera de tu código y de tu historial de shell:
export GEMINI_API_KEY="paste-your-key-here"
Trata la clave como una contraseña. El nivel gratuito no tiene facturación asociada, por lo que una clave filtrada no puede generar una factura, pero sí puede agotar tu cuota diaria antes de que la uses.
Paso 3: haz tu primera llamada gratuita
Gemini 3.x ahora funciona principalmente con la API de Interacciones. Una solicitud, no se requiere SDK:
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" -H 'Content-Type: application/json' \
-d '{"model":"gemini-3.8-flash","input":"Explain HTTP caching in 3 sentences.","generation_config":{"thinking_level":"low"}}'
La respuesta es una lista de pasos de ejecución (pensamientos del modelo, llamadas a herramientas si las hubiera) que terminan en un paso model_output con el texto. Si tienes código existente en generateContent, todavía funciona; Google lo llama heredado pero "totalmente compatible" sin fecha de finalización, y generationConfig.thinkingConfig.thinkingLevel es donde va el nivel en ese punto final. Ambas formas, además de los equivalentes en Python y la conversación multi-turno con previous_interaction_id, se encuentran en la guía de la API de Gemini 3.8 Flash.
Si recibes un 429, has alcanzado el límite de tasa del nivel gratuito. Espera, o sigue leyendo sobre el Nivel 1.
Lo que te cuesta el nivel gratuito
Nada en dólares. Tres cosas de otra manera.
Límites de tasa. El nivel gratuito establece un límite de solicitudes por minuto, tokens por minuto y solicitudes por día por modelo. Google publica las cifras exactas solo en la página de límites de tasa de AI Studio, no en el texto de la documentación, y cambian sin una entrada en el registro de cambios. Consulta esa página en lugar de confiar en cualquier número que leas en un blog, incluido este. El documento de límites de tasa explica cómo se apilan los niveles.
Tus datos. Google afirma que las solicitudes (prompts) y salidas del nivel gratuito se utilizan para mejorar sus productos. Eso está bien para una solicitud de referencia o una aplicación de juguete. No está bien para registros de clientes, código fuente no publicado o cualquier cosa bajo un acuerdo de confidencialidad (NDA). Los niveles de pago tienen términos diferentes; si los necesitas, vincula la facturación antes de enviar la solicitud sensible, no después.
Apetito de tokens. Artificial Analysis midió 3.8 Flash en el nivel alto usando aproximadamente 48k tokens de salida por tarea en su índice, un 30% más que 3.7 Flash. Los tokens de pensamiento cuentan para los mismos límites de tokens por minuto que la salida visible. Un modelo que razona más intensamente es un modelo que consume tu cuota gratuita más rápido, lo cual es la razón práctica para usar por defecto bajo o medio hasta que hayas pagado por un margen.
La aplicación Gemini no es un camino gratuito
Aquí es donde la mayoría de las búsquedas de "Gemini 3.8 Flash gratis" se equivocan. En el lado del consumidor, 3.8 Flash está disponible en la aplicación Gemini para suscriptores de Google AI Pro y Ultra. El plan de aplicación gratuito no lo incluye, según la cobertura de lanzamiento. Si abres la aplicación sin una suscripción y ves un modelo Flash, no es el 3.8.
Las superficies de consumo donde puedes encontrar 3.8 Flash sin cargo adicional son el Modo IA en la Búsqueda de Google y Gemini en Hojas de cálculo de Google. Ambas son útiles para leer sus respuestas. Ninguna te da control sobre el nivel de pensamiento, un recuento de tokens o una API, por lo que para cualquier cosa que considerarías desarrollo, AI Studio y el nivel gratuito de la API son el verdadero camino gratuito.
Contextualización gratuita: 5,000 solicitudes de Búsqueda de Google al mes
La contextualización de Búsqueda de Google, que permite al modelo incorporar resultados web actuales en su respuesta, viene con 5,000 solicitudes gratuitas al mes compartidas entre todos los modelos Gemini 3.x. Después de eso, son $14 por cada 1,000 solicitudes. La cuota es un grupo mensual, no por modelo, por lo que un experimento con 3 Pro contextualizado y un experimento con 3.8 Flash contextualizado se extraen de los mismos 5,000. Para un prototipo que necesita datos recientes, es una asignación generosa; para una función de producción, querrás una partida presupuestaria.
Cuando se agota lo gratuito: los caminos de pago más económicos
Lo sabrás en el momento. Un 429 llega a mitad de una demostración, o el límite diario se alcanza a las 3 p.m. Cuatro pasos de pago, el más económico primero.
Vincula una cuenta de facturación (Nivel 1). Adjuntar la facturación a tu proyecto en AI Studio te mueve al Nivel 1, lo que aumenta los límites de tasa y establece un tope de gasto de $250. El Nivel 2 se abre después de $100 de gasto más tres días, con un tope de $2,000; el Nivel 3 después de $1,000 y 30 días. No tienes que gastar nada para desbloquear el Nivel 1; el propio enlace de facturación lo hace.
Paga la tarifa de introducción. Hasta el 31 de diciembre de 2026, 3.8 Flash cuesta $0.75 por millón de tokens de entrada y $3.75 por millón de tokens de salida, con los tokens de pensamiento facturados como salida. A partir del 1 de enero de 2027, ambos se duplican a $1.50 y $7.50. Mil solicitudes de 2,000 tokens de entrada y 500 de salida cada una suman aproximadamente $3.38 con precios de introducción. El desglose de precios calcula las matemáticas por tarea, incluyendo por qué un precio más bajo por token no significa una tarea más barata en este modelo.
Procesa por lotes cualquier cosa que pueda esperar. La API por lotes reduce a la mitad la tarifa: $0.375 de entrada y $1.875 de salida por millón hasta fin de año. Las mismas mil solicitudes, aproximadamente $1.69. Las cuentas de Nivel 1 pueden tener hasta 3 millones de tokens en cola a la vez. Las evaluaciones, las retroalimentaciones (backfills) y los trabajos nocturnos pertenecen aquí; nuestra guía del modo por lotes de Gemini cubre la forma de la solicitud.
Almacena en caché el prefijo estable. El almacenamiento en caché de contexto cuesta $0.075 por millón de tokens en caché con la tarifa de introducción, una décima parte de la entrada nueva. Un prompt de sistema largo o un documento que reenvías en cada turno es el primer lugar donde buscar.
Lo que no obtendrás gratis
Una lista honesta, porque los resultados de búsqueda para este tema están llenos de información deshonesta.
- La aplicación Gemini. Solo Pro o Ultra, como se mencionó anteriormente.
- Privacidad. Los datos del nivel gratuito se utilizan para mejorar los productos de Google. No hay un interruptor en el nivel gratuito.
- Margen. Los límites se muestran en la página de límites de tasa y no son generosos. Lo gratuito es para evaluación y herramientas pequeñas, no para un lanzamiento.
- Gemini 3.8 Flash Cyber. El gemelo ajustado para seguridad está restringido al Programa Fairwind para gobiernos, operadores de infraestructura y mantenedores de software. Sin API pública, sin precio, sin autoalojamiento. Nadie fuera de ese programa lo tiene, ni gratis ni de pago.
- API en vivo, generación de imágenes o generación de audio. 3.8 Flash no es compatible con estas funciones en ningún nivel. Las entradas pueden ser texto, imagen, video, audio y PDF; la salida es texto.
- Un nivel "ilimitado". Los sitios que prometen acceso ilimitado a Gemini están utilizando la clave de alguien o sirviendo un modelo diferente. La guía de acceso gratuito e ilimitado a la API de Gemini explica cómo detectarlo, y la misma estrategia de nivel gratuito que funcionó para Gemini 3.6 Flash sigue siendo aplicable aquí.
Haz que la cuota gratuita rinda más con Apidog
Un nivel gratuito recompensa la disciplina. Cada solicitud que vuelves a escribir a mano, cada 429 que activas por accidente y cada llamada de pensamiento de alto nivel que no necesitabas es cuota que no recuperas. Apidog hace que la disciplina sea económica.
Almacena GEMINI_API_KEY como una variable de entorno en un entorno de Apidog, para que la clave nunca aparezca en el cuerpo de una solicitud o en una colección compartida. Guarda la llamada de Interacciones y la llamada heredada generateContent como solicitudes con nombre, con el prompt, el modelo y el thinking_level rellenados, y cambia los niveles con una variable en lugar de editar JSON. Añade una aserción sobre el código de estado para que un 429 aparezca como una prueba fallida en lugar de una respuesta en blanco confusa, y una sobre usageMetadata.thoughtsTokenCount en el endpoint heredado para que puedas ver cuánto de tu cuota se destinó al pensamiento.
Luego, programa una pequeña prueba de humo: una solicitud baja al día. Te indicará cuándo cambian el comportamiento del modelo o los límites gratuitos antes que tus usuarios. Descarga Apidog para configurarlo, y mira cómo programar pruebas de API en Apidog para las opciones de temporización.
Preguntas frecuentes
¿Es Gemini 3.8 Flash gratuito? Sí, a través de Google AI Studio y el nivel gratuito de la API de Gemini, con límites de tasa y con tus datos utilizados para mejorar los productos de Google. El modelo es el mismo gemini-3.8-flash que utilizan los niveles de pago.
¿Puedo usar Gemini 3.8 Flash en la aplicación Gemini de forma gratuita? No. La aplicación ofrece 3.8 Flash a los suscriptores de Google AI Pro y Ultra. El Modo IA en la Búsqueda de Google y Gemini en Hojas de cálculo son las superficies de consumo donde puedes usarlo sin suscripción.
¿Cuáles son los límites de tasa del nivel gratuito para Gemini 3.8 Flash? Google los muestra por modelo en la página de límites de tasa de AI Studio en lugar de en el texto de la documentación, y cambian. Consulta esa página para tu proyecto. Cuando necesites más, vincular una cuenta de facturación te mueve al Nivel 1 sin necesidad de gastar.
¿El nivel gratuito incluye el pensamiento? Sí. Los tres niveles (bajo, medio, alto) funcionan en el nivel gratuito, y medio es el predeterminado. minimal devuelve un error en 3.8 Flash. Dado que los tokens de pensamiento cuentan para tus límites de tokens, bajo estira la cuota gratuita al máximo; consulta la comparación de niveles de pensamiento para el costo medido por nivel.
¿Es Gemini 3.8 Flash Cyber gratuito? No está disponible en absoluto fuera del Programa Fairwind. Los desarrolladores regulares obtienen 3.8 Flash y pueden ejecutar sus propias pruebas de seguridad de API contra él.
Empieza gratis, luego decide
El nivel gratuito es un entorno de evaluación real para Gemini 3.8 Flash, no un avance. Crea una clave, mantén el nivel de pensamiento en bajo, mantén los datos sensibles fuera de él y lee la página de límites de tasa en lugar de adivinar. Cuando un 429 comience a costarte tiempo, vincula la facturación para el Nivel 1 y usa el procesamiento por lotes para cualquier cosa asíncrona; a $0.375 por millón de tokens de entrada hasta diciembre, es probable que el primer mes de pago cueste menos que el café que tomaste esperando que se restableciera el nivel gratuito.
