Gemini 3.7 Flash: Especificaciones y Precios

Especificaciones de Gemini 3.7 Flash de un vistazo: 1M de contexto, 64k de salida, entrada multimodal, soporte para herramientas, comparativas frente a 3.6 Flash, niveles de precios y canales de acceso a la API.

Ashley Innocent

Ashley Innocent

19 August 2026

Gemini 3.7 Flash: Especificaciones y Precios

Apidog para empresas

Despliegue local

SSO & RBAC

Conforme con SOC 2

Explorar Apidog Enterprise

Google lanzó Gemini 3.7 Flash el 13 de agosto de 2026, tres semanas después de 3.6 Flash y mientras Gemini 3.5 Pro sigue retrasado. La compañía lo denomina "nuestro modelo de caballo de batalla más inteligente", y el anuncio oficial respalda la afirmación con saltos en los benchmarks de 10 a 16 puntos en tareas de codificación y de agente. Si desarrollas con la API de Gemini, este es el modelo que utilizarás durante los próximos meses.

Esta página es la tarjeta de referencia. Cada especificación, precio, diferencia de benchmark y canal de acceso en un solo lugar, en tablas que puedes escanear en menos de un minuto. Cuando estés listo para escribir código, el inicio rápido de la API de Gemini 3.7 Flash te guía paso a paso a través de cURL, Python y Node, y Apidog te proporciona un espacio de trabajo para enviar solicitudes de prueba al endpoint antes de que exista cualquier código.

Guarda esto en favoritos. Los números a continuación cambiarán el 1 de enero de 2027, cuando finalice la ventana de precios de introducción, y mantendremos las tablas actualizadas.

TL;DR

Hoja de especificaciones de Gemini 3.7 Flash

Los números clave, directamente de la página del modelo Gemini Flash de Google y los materiales de lanzamiento.

Especificación Valor
ID del Modelo gemini-3.7-flash
Fecha de Lanzamiento 13 de agosto de 2026
Ventana de contexto de entrada 1,000,000 tokens
Límite de tokens de salida 64,000 tokens
Modalidades de entrada Texto, imagen, video, audio, PDF
Modalidad de salida Texto
Llamada a funciones Sí
Búsqueda como herramienta Sí
Uso de computadoras Sí
Recuperación de contexto largo (aguja de 128k) 97.0%
Seguridad Salvaguardas CBRN y cibernéticas actualizadas
Disponibilidad Más de 160 países
Endpoint de la API generativelanguage.googleapis.com (clave de AI Studio) o aiplatform.googleapis.com (Vertex, OAuth)

Dos filas merecen una segunda mirada. El límite de salida de 64k es generoso para un modelo de clase Flash; significa que las reescrituras completas de archivos y las salidas estructuradas largas caben en una sola respuesta. Y el soporte para el uso de computadoras coloca a 3.7 Flash en un pequeño grupo de modelos que pueden manejar un navegador directamente, aunque para la mayoría de la automatización de producción, una llamada a la API estructurada sigue siendo superior. Las compensaciones se cubren en uso de computadoras vs APIs estructuradas.

Precios de un vistazo

Google lanzó 3.7 Flash a la mitad del precio de lanzamiento de 3.6 Flash, pero el descuento tiene una fecha de caducidad.

Nivel Entrada (por 1M de tokens) Salida (por 1M de tokens) Válido
Introductorio $0.75 $3.75 Hasta el 31 de diciembre de 2026
Estándar $1.50 $7.50 A partir del 1 de enero de 2027

Eso es un salto limpio de 2x en ambos lados en el día de Año Nuevo. Si tu carga de trabajo es intensiva en tokens, la ventana de introducción es el momento de realizar benchmarks, ajustar prompts y establecer estrategias de almacenamiento en caché mientras los errores cuestan la mitad. Para ejemplos de costos trabajados, cálculos de tokens en cargas de trabajo reales y estrategias para reducir el gasto antes de que lleguen las tarifas estándar, consulta explicación de precios de Gemini 3.7 Flash. La fuente de verdad en vivo es la página de precios de la API de Gemini.

Benchmarks: 3.6 Flash vs 3.7 Flash

Google publicó las diferencias con 3.6 Flash en codificación, desarrollo web, comprensión de documentos y automatización basada en agentes. Las diferencias son grandes para una versión menor que se lanzó tres semanas después de su predecesora, un punto que la cobertura del lanzamiento de 9to5Google también señaló.

Benchmark Gemini 3.6 Flash Gemini 3.7 Flash Delta
DeepSWE v1.1 (codificación con agentes) 49.0% 65.3% +16.3
FrontierCode 1.1 Principal 34.4% 43.6% +9.2
WebDev Arena (Elo) 1538 1588 +50
GDP.pdf (comprensión de documentos) 22.0% 34.0% +12.0
AutomationBench (automatización con agentes) 17.0% 30.4% +13.4
Harvey LAB-AA (legal) n/a 90.7% n/a
Recuperación aguja de 128k n/a 97.0% n/a

El patrón en la tabla: las cargas de trabajo de agentes fueron las que más ganaron. Las mejoras declaradas por Google coinciden: mejor depuración, código más implementable en el primer intento, pensamiento más diligente en la planificación de múltiples pasos y llamadas a herramientas, y un seguimiento más estricto de las instrucciones. Cómo se comparan esos números con los modelos de Anthropic y OpenAI es una cuestión aparte, respondida en Gemini 3.7 Flash vs Claude vs GPT.

Dónde puedes usar Gemini 3.7 Flash

Siete canales de acceso en el lanzamiento. Elige según tu rol.

Canal Para qué sirve A quién sirve
API de Gemini Acceso programático con una clave de AI Studio Desarrolladores que lanzan aplicaciones
Google AI Studio Entorno de pruebas en navegador, iteración de prompts, gestión de claves Desarrolladores que prototipan
Aplicación Gemini Chat para consumidores en web y móvil Usuarios finales
Gemini Spark Entorno de codificación con agentes Suscriptores de AI Pro y Ultra
Google Antigravity Plataforma de desarrollo enfocada en agentes Equipos que construyen agentes autónomos
Android Studio Integración con IDE para trabajo en Android Desarrolladores móviles
Gemini Enterprise Despliegue gestionado con controles administrativos TI empresarial

Para el trabajo con la API, la ruta de la clave de AI Studio te permite obtener una solicitud funcional en minutos. Vertex AI contiene el mismo modelo detrás de OAuth con IAM, registros de auditoría y endpoints regionales cuando necesitas controles de producción.

Una solicitud de trabajo mínima

Obtén una clave de AI Studio, expórtala y envía una solicitud.

export GEMINI_API_KEY="AIza..."

curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.7-flash:generateContent" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "contents": [{
      "parts": [{ "text": "List the HTTP status codes an idempotent retry layer should handle." }]
    }],
    "generationConfig": {
      "temperature": 0.4,
      "maxOutputTokens": 1024
    }
  }'

El streaming intercambia el método por :streamGenerateContent?alt=sse en la misma ruta. La respuesta devuelve un array candidates con las partes de texto y un bloque usageMetadata con los recuentos de tokens por los que se te facturará.

Si prefieres no editar JSON manualmente en un terminal, Apidog importa la especificación de la API de Lenguaje Generativo, vincula GEMINI_API_KEY como una variable de entorno en el encabezado x-goog-api-key y renderiza flujos SSE en vivo. Guarda una buena respuesta como ejemplo una vez y vuelve a ejecutar pruebas contra el fixture en lugar del endpoint de pago.

Límites de tarifa y niveles

Google establece límites de tarifa por modelo y por nivel (gratuito, pago por uso y niveles aprovisionados), y los números cambian con la suficiente frecuencia como para que cualquier tabla impresa aquí se desactualice. Consulta la documentación oficial de la API de Gemini para conocer los límites actuales de solicitudes por minuto y tokens por minuto para gemini-3.7-flash.

Dos reglas generales estables. La cuota del nivel gratuito a través de AI Studio es suficiente para prototipos, pero no para producción. Y un 429 con estado RESOURCE_EXHAUSTED significa que has alcanzado un límite por minuto o por día; retrocede con un retraso aleatorio (jitter), agrupa donde puedas, o mueve el proyecto al nivel de pago.

Enlaces rápidos

Preguntas Frecuentes

¿Cuáles son las especificaciones de Gemini 3.7 Flash en una sola frase?

Una ventana de contexto de entrada de 1M de tokens, un límite de salida de 64k de tokens, entrada multimodal a través de texto, imagen, video, audio y PDF, salida de texto y soporte para llamadas a funciones, búsqueda como herramienta y uso de computadoras, direccionable como gemini-3.7-flash a través de la API de Gemini.

¿Cuánto cuesta Gemini 3.7 Flash?

$0.75 por 1M de tokens de entrada y $3.75 por 1M de tokens de salida hasta el 31 de diciembre de 2026. A partir del 1 de enero de 2027 se aplican las tarifas estándar: $1.50 de entrada y $7.50 de salida. La tarifa de introducción es la mitad de lo que costó el lanzamiento de 3.6 Flash.

¿Necesito cambiar mi código para actualizar de 3.6 Flash?

El cambio en sí es una línea: cambia el ID del modelo a gemini-3.7-flash. Los cambios de comportamiento son el verdadero trabajo, ya que 3.7 piensa más en las llamadas a herramientas de varios pasos y sigue las instrucciones de manera más estricta. La guía de migración de 3.6 a 3.7 Flash cubre qué probar en regresión antes de cambiar el tráfico.

¿Por qué Google lanzó 3.7 Flash antes de Gemini 3.5 Pro?

Gemini 3.5 Pro sigue retrasado, y Axios informó que Google está lanzando actualizaciones de Flash antes de su próximo modelo insignia en lugar de retener las mejoras. La brecha de tres semanas entre 3.6 y 3.7 Flash encaja con esa cadencia.

¿Hay alguna forma gratuita de probarlo?

Sí. El nivel gratuito de AI Studio incluye una cuota diaria para gemini-3.7-flash, suficiente para pruebas de prompts y pequeños prototipos, y no se requiere una cuenta de facturación hasta que necesites límites de tarifa más altos. La guía de acceso gratuito a la API de Gemini cubre hasta dónde llega el nivel gratuito y qué hacer cuando alcanzas sus límites.

Dónde encaja 3.7 Flash en tu pila

Trata a 3.7 Flash como el modelo Gemini predeterminado para bucles de agentes, asistentes de codificación, pipelines de documentos y cualquier cosa que realice muchas llamadas a herramientas por sesión. Las ganancias en los benchmarks se dan exactamente donde residen esas cargas de trabajo, y el precio de introducción convierte los próximos cuatro meses y medio en la ventana más económica para construir. Reserva el juicio sobre el razonamiento de clase insignia hasta que se lance Gemini 3.5 Pro; para todo lo demás, este es el caballo de batalla que Google dice que es.

Antes de que el ID del modelo se acerque al código de producción, pon el endpoint a prueba. Descarga Apidog para mantener tus solicitudes de Gemini, entornos, comprobaciones de streaming y fixtures de respuesta guardados en un solo espacio de trabajo, junto con colecciones para cualquier otro proveedor que estés evaluando.

Practica el diseño de API en Apidog

Descubre una forma más fácil de construir y usar APIs