Google lanzó Gemini 3.7 Flash el 13 de agosto de 2026, tres semanas después de 3.6 Flash y mientras Gemini 3.5 Pro sigue retrasado. La compañía lo denomina "nuestro modelo de caballo de batalla más inteligente", y el anuncio oficial respalda la afirmación con saltos en los benchmarks de 10 a 16 puntos en tareas de codificación y de agente. Si desarrollas con la API de Gemini, este es el modelo que utilizarás durante los próximos meses.
Esta página es la tarjeta de referencia. Cada especificación, precio, diferencia de benchmark y canal de acceso en un solo lugar, en tablas que puedes escanear en menos de un minuto. Cuando estés listo para escribir código, el inicio rápido de la API de Gemini 3.7 Flash te guía paso a paso a través de cURL, Python y Node, y Apidog te proporciona un espacio de trabajo para enviar solicitudes de prueba al endpoint antes de que exista cualquier código.
Guarda esto en favoritos. Los números a continuación cambiarán el 1 de enero de 2027, cuando finalice la ventana de precios de introducción, y mantendremos las tablas actualizadas.
TL;DR
- El ID del modelo es
gemini-3.7-flash, disponible en la API de Gemini desde el 13 de agosto de 2026, en más de 160 países. - Especificaciones: contexto de entrada de 1M de tokens, límite de salida de 64k de tokens, entrada multimodal (texto, imagen, video, audio, PDF), salida de texto.
- Herramientas: se admiten la llamada a funciones, la búsqueda como herramienta y el uso de computadoras.
- Precio de introducción: $0.75 por 1M de tokens de entrada y $3.75 por 1M de tokens de salida hasta el 31 de diciembre de 2026. Las tarifas estándar se duplican a $1.50 y $7.50 el 1 de enero de 2027.
- Benchmarks sobre 3.6 Flash: DeepSWE v1.1 del 49.0% al 65.3%, AutomationBench del 17.0% al 30.4%, WebDev Arena Elo de 1538 a 1588.
- Accede a él a través de la API de Gemini, Google AI Studio, la aplicación Gemini, Gemini Spark, Google Antigravity, Android Studio y Gemini Enterprise.
Hoja de especificaciones de Gemini 3.7 Flash
Los números clave, directamente de la página del modelo Gemini Flash de Google y los materiales de lanzamiento.
| Especificación | Valor |
|---|---|
| ID del Modelo | gemini-3.7-flash |
| Fecha de Lanzamiento | 13 de agosto de 2026 |
| Ventana de contexto de entrada | 1,000,000 tokens |
| Límite de tokens de salida | 64,000 tokens |
| Modalidades de entrada | Texto, imagen, video, audio, PDF |
| Modalidad de salida | Texto |
| Llamada a funciones | Sí |
| Búsqueda como herramienta | Sí |
| Uso de computadoras | Sí |
| Recuperación de contexto largo (aguja de 128k) | 97.0% |
| Seguridad | Salvaguardas CBRN y cibernéticas actualizadas |
| Disponibilidad | Más de 160 países |
| Endpoint de la API | generativelanguage.googleapis.com (clave de AI Studio) o aiplatform.googleapis.com (Vertex, OAuth) |
Dos filas merecen una segunda mirada. El límite de salida de 64k es generoso para un modelo de clase Flash; significa que las reescrituras completas de archivos y las salidas estructuradas largas caben en una sola respuesta. Y el soporte para el uso de computadoras coloca a 3.7 Flash en un pequeño grupo de modelos que pueden manejar un navegador directamente, aunque para la mayoría de la automatización de producción, una llamada a la API estructurada sigue siendo superior. Las compensaciones se cubren en uso de computadoras vs APIs estructuradas.
Precios de un vistazo
Google lanzó 3.7 Flash a la mitad del precio de lanzamiento de 3.6 Flash, pero el descuento tiene una fecha de caducidad.
| Nivel | Entrada (por 1M de tokens) | Salida (por 1M de tokens) | Válido |
|---|---|---|---|
| Introductorio | $0.75 | $3.75 | Hasta el 31 de diciembre de 2026 |
| Estándar | $1.50 | $7.50 | A partir del 1 de enero de 2027 |
Eso es un salto limpio de 2x en ambos lados en el día de Año Nuevo. Si tu carga de trabajo es intensiva en tokens, la ventana de introducción es el momento de realizar benchmarks, ajustar prompts y establecer estrategias de almacenamiento en caché mientras los errores cuestan la mitad. Para ejemplos de costos trabajados, cálculos de tokens en cargas de trabajo reales y estrategias para reducir el gasto antes de que lleguen las tarifas estándar, consulta explicación de precios de Gemini 3.7 Flash. La fuente de verdad en vivo es la página de precios de la API de Gemini.
Benchmarks: 3.6 Flash vs 3.7 Flash
Google publicó las diferencias con 3.6 Flash en codificación, desarrollo web, comprensión de documentos y automatización basada en agentes. Las diferencias son grandes para una versión menor que se lanzó tres semanas después de su predecesora, un punto que la cobertura del lanzamiento de 9to5Google también señaló.
| Benchmark | Gemini 3.6 Flash | Gemini 3.7 Flash | Delta |
|---|---|---|---|
| DeepSWE v1.1 (codificación con agentes) | 49.0% | 65.3% | +16.3 |
| FrontierCode 1.1 Principal | 34.4% | 43.6% | +9.2 |
| WebDev Arena (Elo) | 1538 | 1588 | +50 |
| GDP.pdf (comprensión de documentos) | 22.0% | 34.0% | +12.0 |
| AutomationBench (automatización con agentes) | 17.0% | 30.4% | +13.4 |
| Harvey LAB-AA (legal) | n/a | 90.7% | n/a |
| Recuperación aguja de 128k | n/a | 97.0% | n/a |
El patrón en la tabla: las cargas de trabajo de agentes fueron las que más ganaron. Las mejoras declaradas por Google coinciden: mejor depuración, código más implementable en el primer intento, pensamiento más diligente en la planificación de múltiples pasos y llamadas a herramientas, y un seguimiento más estricto de las instrucciones. Cómo se comparan esos números con los modelos de Anthropic y OpenAI es una cuestión aparte, respondida en Gemini 3.7 Flash vs Claude vs GPT.
Dónde puedes usar Gemini 3.7 Flash
Siete canales de acceso en el lanzamiento. Elige según tu rol.
| Canal | Para qué sirve | A quién sirve |
|---|---|---|
| API de Gemini | Acceso programático con una clave de AI Studio | Desarrolladores que lanzan aplicaciones |
| Google AI Studio | Entorno de pruebas en navegador, iteración de prompts, gestión de claves | Desarrolladores que prototipan |
| Aplicación Gemini | Chat para consumidores en web y móvil | Usuarios finales |
| Gemini Spark | Entorno de codificación con agentes | Suscriptores de AI Pro y Ultra |
| Google Antigravity | Plataforma de desarrollo enfocada en agentes | Equipos que construyen agentes autónomos |
| Android Studio | Integración con IDE para trabajo en Android | Desarrolladores móviles |
| Gemini Enterprise | Despliegue gestionado con controles administrativos | TI empresarial |
Para el trabajo con la API, la ruta de la clave de AI Studio te permite obtener una solicitud funcional en minutos. Vertex AI contiene el mismo modelo detrás de OAuth con IAM, registros de auditoría y endpoints regionales cuando necesitas controles de producción.
Una solicitud de trabajo mínima
Obtén una clave de AI Studio, expórtala y envía una solicitud.
export GEMINI_API_KEY="AIza..."
curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.7-flash:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"contents": [{
"parts": [{ "text": "List the HTTP status codes an idempotent retry layer should handle." }]
}],
"generationConfig": {
"temperature": 0.4,
"maxOutputTokens": 1024
}
}'
El streaming intercambia el método por :streamGenerateContent?alt=sse en la misma ruta. La respuesta devuelve un array candidates con las partes de texto y un bloque usageMetadata con los recuentos de tokens por los que se te facturará.
Si prefieres no editar JSON manualmente en un terminal, Apidog importa la especificación de la API de Lenguaje Generativo, vincula GEMINI_API_KEY como una variable de entorno en el encabezado x-goog-api-key y renderiza flujos SSE en vivo. Guarda una buena respuesta como ejemplo una vez y vuelve a ejecutar pruebas contra el fixture en lugar del endpoint de pago.
Límites de tarifa y niveles
Google establece límites de tarifa por modelo y por nivel (gratuito, pago por uso y niveles aprovisionados), y los números cambian con la suficiente frecuencia como para que cualquier tabla impresa aquí se desactualice. Consulta la documentación oficial de la API de Gemini para conocer los límites actuales de solicitudes por minuto y tokens por minuto para gemini-3.7-flash.
Dos reglas generales estables. La cuota del nivel gratuito a través de AI Studio es suficiente para prototipos, pero no para producción. Y un 429 con estado RESOURCE_EXHAUSTED significa que has alcanzado un límite por minuto o por día; retrocede con un retraso aleatorio (jitter), agrupa donde puedas, o mueve el proyecto al nivel de pago.
Enlaces rápidos
- Anuncio oficial: publicación de lanzamiento con las afirmaciones y gráficos de benchmarks de Google
- Documentación de la API de Gemini: referencia de endpoints, guías de SDK, límites de tarifa
- Página de precios: tarifas en vivo por token
- Página del modelo: especificaciones y detalles de modalidad
- Obtener una clave de API: clave de AI Studio en dos clics
Preguntas Frecuentes
¿Cuáles son las especificaciones de Gemini 3.7 Flash en una sola frase?
Una ventana de contexto de entrada de 1M de tokens, un límite de salida de 64k de tokens, entrada multimodal a través de texto, imagen, video, audio y PDF, salida de texto y soporte para llamadas a funciones, búsqueda como herramienta y uso de computadoras, direccionable como gemini-3.7-flash a través de la API de Gemini.
¿Cuánto cuesta Gemini 3.7 Flash?
$0.75 por 1M de tokens de entrada y $3.75 por 1M de tokens de salida hasta el 31 de diciembre de 2026. A partir del 1 de enero de 2027 se aplican las tarifas estándar: $1.50 de entrada y $7.50 de salida. La tarifa de introducción es la mitad de lo que costó el lanzamiento de 3.6 Flash.
¿Necesito cambiar mi código para actualizar de 3.6 Flash?
El cambio en sí es una línea: cambia el ID del modelo a gemini-3.7-flash. Los cambios de comportamiento son el verdadero trabajo, ya que 3.7 piensa más en las llamadas a herramientas de varios pasos y sigue las instrucciones de manera más estricta. La guía de migración de 3.6 a 3.7 Flash cubre qué probar en regresión antes de cambiar el tráfico.
¿Por qué Google lanzó 3.7 Flash antes de Gemini 3.5 Pro?
Gemini 3.5 Pro sigue retrasado, y Axios informó que Google está lanzando actualizaciones de Flash antes de su próximo modelo insignia en lugar de retener las mejoras. La brecha de tres semanas entre 3.6 y 3.7 Flash encaja con esa cadencia.
¿Hay alguna forma gratuita de probarlo?
Sí. El nivel gratuito de AI Studio incluye una cuota diaria para gemini-3.7-flash, suficiente para pruebas de prompts y pequeños prototipos, y no se requiere una cuenta de facturación hasta que necesites límites de tarifa más altos. La guía de acceso gratuito a la API de Gemini cubre hasta dónde llega el nivel gratuito y qué hacer cuando alcanzas sus límites.
Dónde encaja 3.7 Flash en tu pila
Trata a 3.7 Flash como el modelo Gemini predeterminado para bucles de agentes, asistentes de codificación, pipelines de documentos y cualquier cosa que realice muchas llamadas a herramientas por sesión. Las ganancias en los benchmarks se dan exactamente donde residen esas cargas de trabajo, y el precio de introducción convierte los próximos cuatro meses y medio en la ventana más económica para construir. Reserva el juicio sobre el razonamiento de clase insignia hasta que se lance Gemini 3.5 Pro; para todo lo demás, este es el caballo de batalla que Google dice que es.
Antes de que el ID del modelo se acerque al código de producción, pon el endpoint a prueba. Descarga Apidog para mantener tus solicitudes de Gemini, entornos, comprobaciones de streaming y fixtures de respuesta guardados en un solo espacio de trabajo, junto con colecciones para cualquier otro proveedor que estés evaluando.
