¿Cómo usar la API de Gemini 3.6 Flash?

Llama a la API Gemini 3.6 Flash con el ID de modelo gemini-3.6-flash: obtén una clave, haz tu primera solicitud curl y Python, luego pruébala, depúrala y prográmala en Apidog.

Ashley Innocent

Ashley Innocent

22 July 2026

¿Cómo usar la API de Gemini 3.6 Flash?

Apidog para empresas

Despliegue local

SSO & RBAC

Conforme con SOC 2

Explorar Apidog Enterprise

Llamas a Gemini 3.6 Flash con el ID de modelo gemini-3.6-flash a través de la API Gemini de Google. Esa es la base. Google lanzó la actualización de Flash el 21 de julio de 2026, y 3.6 Flash es el nivel principal: salida más barata que 3.5 Flash, una ventana de contexto de 1 millón de tokens, y entradas de texto, imagen, video, audio y PDF. Esta guía te lleva de cero a una solicitud probada. Obtendrás una clave, harás tu primera llamada en curl y Python, aprenderás los parámetros importantes y configurarás una prueba de regresión para que la llamada siga funcionando después de implementarla.

botón

Lo que necesitas antes de empezar

Tres cosas, y ninguna de ellas cuesta dinero para empezar.

No se requiere configuración de facturación por adelantado. El nivel gratuito funciona a través de AI Studio y tiene un límite de velocidad, por lo que puedes probar sin una tarjeta registrada. Más información sobre esos límites a continuación.

Obtener una clave de API de Gemini

Ve a Google AI Studio e inicia sesión con tu cuenta de Google. Haz clic en “Obtener clave de API”, luego en “Crear clave de API”. Copia la cadena que te da y guárdala en un lugar seguro. Trátala como una contraseña: cualquiera que tenga la clave puede realizar gastos en tu cuenta.

No pegues la clave en el código del lado del cliente, ni la confirmes en un repositorio. En su lugar, configúrala como una variable de entorno:

export GEMINI_API_KEY="your_key_here"

El SDK oficial de Python lee esa variable por sí solo, lo que mantiene el secreto fuera de tus archivos fuente. Para los pasos de configuración canónicos, consulta la documentación de la API de Gemini de Google.

Haz tu primera llamada a la API

El endpoint REST es una solicitud POST al método generateContent del modelo. Aquí está en curl:

curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent" \
  -H "x-goog-api-key: YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -X POST \
  -d '{
    "contents": [
      {
        "parts": [
          {"text": "Explain how APIs work"}
        ]
      }
    ]
  }'

La clave va en el encabezado x-goog-api-key. El cuerpo es un array contents; cada entrada tiene un array parts; cada parte aquí es una cadena text. Esa anidación parece complicada para una sola instrucción, pero es la misma estructura que más tarde te permite mezclar texto con imágenes y archivos en una sola solicitud.

¿Prefieres Python? Instala el SDK con pip install google-genai, luego:

from google import genai

client = genai.Client()  # lee GEMINI_API_KEY del entorno
resp = client.models.generate_content(
    model="gemini-3.6-flash",
    contents="Explain how APIs work",
)
print(resp.text)

El cliente recoge GEMINI_API_KEY por sí mismo, por lo que no hay ninguna clave en tu código. resp.text contiene la respuesta generada. Esa es una llamada funcional en cinco líneas.

Internamente, la API devuelve JSON. El texto generado se encuentra en candidates[0].content.parts[0].text. Es importante tener esto en cuenta ahora, porque es el campo exacto sobre el que harás una aserción cuando conviertas esta llamada en una prueba más adelante en la guía.

Parámetros clave que vale la pena conocer

La solicitud básica funciona, pero un puñado de configuraciones cambian lo que obtienes.

La lista completa de parámetros se encuentra en la documentación de la API de Gemini. No adivines los nombres de los campos; la documentación es la fuente de la verdad y se actualiza cuando lo hace la API.

Precios y el nivel gratuito

Gemini 3.6 Flash cuesta $1.50 por cada millón de tokens de entrada y $7.50 por cada millón de tokens de salida. Esa tasa de salida es una reducción de los $9.00 que cobraba 3.5 Flash, y 3.6 Flash también tiende a generar alrededor de un 17% menos de tokens de salida en la misma tarea, por lo que los ahorros se multiplican. Un detalle a interiorizar: el precio de salida incluye los tokens de pensamiento. El razonamiento interno del modelo se factura a la tasa de salida, por lo que una instrucción que desencadena un razonamiento intenso puede costar más de lo que sugiere la longitud visible de la respuesta. Tenlo en cuenta en tu presupuesto. Desglosamos todos los cálculos en nuestra guía de precios de Gemini 3.6 Flash.

El nivel gratuito funciona a través de AI Studio, y es real, pero tiene un límite de velocidad: solicitudes limitadas por minuto y por día, y Google puede usar datos del nivel gratuito para mejorar sus productos. Está diseñado para prototipos, no para tráfico de producción. Para aprender y probar, es suficiente. Para ver hasta dónde llega, lee cómo usar Gemini 3.6 Flash de forma gratuita. Cuando lo superes, habilitas la facturación y la misma clave sigue funcionando, sin necesidad de cambios en el código.

Probar y depurar la API de Gemini en Apidog

curl demuestra que la llamada funciona una vez. No te dirá cuándo Google cambia un campo de respuesta, cuándo tu clave expira o cuándo una implementación rompe silenciosamente la solicitud. Para eso necesitas una prueba guardada y repetible. Aquí es donde Apidog se gana su lugar en el flujo de trabajo.

Apidog es un cliente de API y una plataforma de pruebas. Aquí está el flujo para la llamada a Gemini, de principio a fin:

  1. Crea la solicitud. Añade una nueva solicitud POST con la URL https://generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent. Pega el cuerpo JSON anterior en el cuerpo de la solicitud.
  2. Almacena la clave en una variable de entorno. Añade una variable llamada GEMINI_API_KEY a un entorno de Apidog, luego referénciala en el encabezado x-goog-api-key como {{GEMINI_API_KEY}}. El secreto se mantiene fuera de la solicitud compartida, y puedes intercambiar claves por entorno (desarrollo, staging, producción) sin tocar la llamada en sí.
  3. Añade aserciones. Después de que se ejecute la solicitud, haz una aserción sobre la respuesta JSON: el estado es 200, y candidates[0].content.parts[0].text existe y no está vacío. Ahora una ejecución exitosa significa que la API realmente respondió, no solo que devolvió algo.
  4. Guárdala y prográmala. Mantén la solicitud en una colección y prográmala como una prueba de regresión. Ejecútala con un temporizador o dentro de CI, y sabrás en el momento en que la llamada a Gemini deje de funcionar correctamente, antes que tus usuarios.

Descarga Apidog y podrás tener esta prueba funcionando en unos minutos. Esa es la verdadera ventaja aquí: Apidog no ejecuta el modelo, se asegura de que la API de la que dependes siga respondiendo como tu aplicación espera.

Errores comunes y soluciones

Tres fallos cubren la mayoría de lo que encontrarás al principio.

Preguntas frecuentes

Adónde ir desde aquí

Ya tienes una clave, una llamada funcional en curl y Python, los parámetros importantes y una prueba de regresión guardada que monitorea el endpoint. Empieza con el nivel gratuito, mantén tu clave en una variable de entorno y apóyate en la documentación oficial para cualquier cosa más allá de lo básico. Cuando la llamada se convierta en algo de lo que tu aplicación dependa, envuélvela en una prueba de Apidog para que un cambio silencioso en la API nunca llegue a tus usuarios primero.

botón

Practica el diseño de API en Apidog

Descubre una forma más fácil de construir y usar APIs