Gemini 4 Argon es el nuevo modelo de frontera de Google, anunciado el 30 de septiembre de 2026, y está disponible hoy solo para los defensores del Programa Fairwind, un grupo selecto de socios de ciberdefensa. Google lo valora en $2 por millón de tokens de entrada y $10 por millón de tokens de salida durante un período introductorio, luego $4 y $20, y eleva el límite de salida a 1M de tokens por respuesta. No hay API pública, no hay ID de modelo publicado y aún no hay fecha de lanzamiento.
Esta guía es el centro de nuestra cobertura de Argon: lo que Google ha y no ha confirmado, dónde se sitúa Argon en la línea de Gemini, quién lo recibirá después, cuánto cuesta, cómo se compara y qué puedes construir hoy. ¿Eligiendo un modelo ahora mismo? Lee nuestra comparación de Gemini 4 Argon vs GPT-6 Astra vs Claude Opus 5.5. Si pruebas APIs de modelos en Apidog, la última sección muestra cómo cambiar a Argon con un solo valor.
Lo que Google ha confirmado vs. lo que no ha confirmado
La mayoría de la cobertura inicial mezcla las declaraciones de Google con las conjeturas de terceros. Aquí está la división, basada en la publicación de lanzamiento y la metodología de evaluación de Google.
| Elemento | Estado | Lo que sabemos |
|---|---|---|
| Anuncio | Confirmado | 30 de septiembre de 2026, por Koray Kavukcuoglu de Google DeepMind |
| Acceso hoy | Confirmado | Un conjunto de socios del Programa Fairwind |
| Siguientes en la lista | Confirmado, sin fecha | Clientes de API de pago y suscriptores de Google AI Ultra |
| Precio | Confirmado | $2/$10 introducción, luego $4/$20 por 1M de tokens; entrada en caché 95% de descuento |
| Límite de salida | Confirmado | 1M de tokens, de 64K |
| Benchmarks | Confirmado, informado por Google | Una tabla de 19 filas más un PDF de metodología |
| ID del modelo | No publicado | Las cadenas en línea son marcadores de posición de terceros |
| Ventana de contexto de entrada | No publicado | La evaluación de contexto largo de Google utilizó indicaciones de hasta 1M de tokens |
| Corte de conocimiento | No publicado | Nada de Google |
| Duración del período introductorio | No publicado | Sin fecha para el cambio a $4/$20 |
| Límites de tarifa, nivel gratuito | No publicado | Nada de Google |
| Fecha de lanzamiento | No publicado | "Lo antes posible" |
Si un sitio enumera una ventana de contexto, una cadena de modelo o una cifra de velocidad para Argon, trátelo como no confirmado hasta que los propios documentos de Google lo muestren.
Qué es Gemini 4 Argon y dónde se sitúa
Argon es el único modelo Gemini 4 anunciado hasta ahora y la nueva cima de la línea de Google. Google lo llama "nuestro nuevo modelo de frontera", construido "para sostener un razonamiento profundo en flujos de trabajo complejos y de largo alcance", y afirma un rendimiento de frontera en ingeniería de software, trabajo de conocimiento empresarial como legal y finanzas, y defensa de ciberseguridad. Un portavoz de Google dijo a Reuters que Argon es más grande que la línea anterior de modelos "Pro" de la compañía.

Hasta ahora, el modelo de API Gemini superior era gemini-3.1-pro-preview, todavía en vista previa: 1.048.576 tokens de entrada, 65.536 tokens de salida (los "64K" que Argon reemplaza), y $2 de entrada / $12 de salida por millón para prompts de hasta 200K. El precio de salida introductorio de Argon de $10 lo supera. Google no ha dicho si Argon tendrá un nivel de prompt largo separado como 3.1 Pro, o si otros modelos Gemini 4 le seguirán. Reuters describió el lanzamiento como "después de meses de retrasos", una referencia al lanzamiento de Gemini 3.5 Pro que se prometió para junio y luego se canceló.
Google ya utiliza Argon internamente. Afirma que miles de empleados lo usan para codificación, investigación y escritura, que los agentes Argon liberaron más de 300 TiB de memoria de flota, y que está migrando código C y C++ a Rust, hasta más de 800K líneas para el kernel Fuchsia Zircon, con esas reescrituras aún bajo auditoría antes de la producción.
Quién puede usar Gemini 4 Argon hoy y quién es el siguiente
Hoy: un subconjunto de socios de Fairwind. Fairwind es el programa de ciberdefensa de acceso limitado de Google con más de 650 socios, pero solo "un conjunto de socios del Programa Fairwind" obtienen Argon, por sí mismo o dentro de CodeMender, el agente de seguridad de código de Google. Accedido directamente "como un modelo gestionado en Gemini Enterprise", admite cero retención de datos. Los socios deben comprometerse con MFA resistente al phishing, acceso limitado a equipos internos de seguridad, respuesta a incidentes o pruebas de penetración, y seguimiento del uso por empleado. Gobiernos, operadores de infraestructura crítica y plataformas tecnológicas centrales pueden postularse en la página del Programa Fairwind.
Próximamente: clientes de API de pago y suscriptores de Google AI Ultra. Google "recopilará comentarios de los primeros probadores mientras iteramos en las salvaguardias" primero, y está participando en el proceso de acceso voluntario previo al lanzamiento del gobierno de EE. UU. La sección de lanzamiento de la publicación se titula "Próximo lanzamiento" y no da fecha. Nuestra guía de fecha de lanzamiento y acceso rastrea cada etapa.
Todavía no: todos los demás. A partir del 1 de octubre, la página de modelos de la API de Gemini, la página de precios, la aplicación Gemini, Antigravity y OpenRouter no muestran Argon. Un plan Google AI Ultra (desde $99.99 al mes en EE. UU.) es una suscripción para consumidores, no una clave de API, y Google no ha dicho qué nivel de Ultra obtiene Argon primero. No hay una ruta gratuita; ¿es Gemini 4 Argon gratis? cubre lo que puedes usar en su lugar.
Precios de Gemini 4 Argon
| Tipo de token | Introductorio (por 1M) | Después de la introducción (por 1M) |
|---|---|---|
| Entrada | $2.00 | $4.00 |
| Entrada en caché (95% de descuento) | $0.10 | $0.20 |
| Salida | $10.00 | $20.00 |
| Una respuesta completa de 1M de tokens, solo salida | $10.00 | $20.00 |
Google no ha dicho cuánto dura el período introductorio. A tarifas estándar, Argon cuesta exactamente lo mismo que Claude Opus 5.5; a tarifas introductorias, coincide con GPT-6.1 Sol y Claude Sonnet 5.5. Los precios en caché son aritméticos de la regla del 95% de Google. Los escenarios trabajados están en precios de Gemini 4 Argon.
El límite de salida de 1M
Google dice que está "expandiendo significativamente el límite de tokens de salida del modelo a un líder de la industria de 1M de tokens, desde los 64K tokens anteriores". El argumento: con espacio para generar cientos de miles de tokens en una sola trayectoria, el modelo puede resolver problemas difíciles de una sola vez. En comparación, GPT-6 Astra, Claude Opus 5.5 y Claude Fable 5.1 limitan la salida síncrona a 128K cada uno.
Dos advertencias. Este es un límite de salida, no una ventana de contexto; Google no ha publicado la ventana de entrada. Y aunque Google dice que el límite de salida de Argon es de 1M de tokens, al menos un evaluador externo, Vals AI, enumera una salida máxima de 262K para la configuración que probó. Planifique según el límite que informe su endpoint. Nuestra guía de los 1M de tokens de salida de Argon cubre los tiempos de espera, el streaming y los límites de costos.
Benchmarks de Gemini 4 Argon: el titular
Todos los números a continuación provienen de la tabla de Google. Las puntuaciones de Argon son reportadas por Google, algunas calculadas por ellos mismos y otras de tablas de clasificación como Vals AI; las puntuaciones de los competidores son en su mayoría propias de los proveedores o resultados de tablas de clasificación públicas, y las herramientas difieren. Según nuestro recuento, Argon lidera 13 de las 19 filas directamente, empata en una y está por debajo en cinco.
| Benchmark | Gemini 4 Argon | GPT-6 Astra | Claude Fable 5.1 | Claude Opus 5.5 |
|---|---|---|---|---|
| Vals Index | 68.9% | 63.1% | 65.8% | 67.0% |
| DeepSWE v1.1 | 77.9% | 74.1% | 67.4% | 74.2% |
| GraphWalks 256K a 1M (F1) | 84.2% | 71.8% | 65.0% | 66.8% |
| FrontierSWE v2 | 55.0% | 65.5% | 56.3% | 62.3% |
| Terminal-bench 4.0 | 57.4% | 58.2% | 57.9% | 66.4% |
| PostTrainBench | 45.3% | 44.3% | 40.2% | 49.3% |
Las cinco filas que pierde Argon: FrontierSWE v2, Terminal-Bench Science 0.1 y OSWorld-2.0 (frente a Astra), más Terminal-bench 4.0 y PostTrainBench (frente a Opus 5.5).
Terceros sitúan a Argon en la frontera sin un claro liderazgo. Artificial Analysis le otorga 53 en su Índice de Inteligencia, empatado con GPT-6 Astra y Claude Fable 5.1 y por debajo de Claude Opus 5.5 con 58 y Claude Sonnet 5.5 con 56 (configuración máxima); Vals lo clasifica primero de 41 modelos en el Vals Index. Las 19 filas y las notas de método de Google están en benchmarks de Gemini 4 Argon.

Ciberdefensa en un párrafo
Google afirma que "Argon puede encontrar, validar y parchear de forma autónoma vulnerabilidades de software críticas". Para los defensores de confianza y sus equipos internos, añade, "lanzaremos Argon sin barreras cibernéticas para que puedan aprovechar todas sus capacidades de defensa de ciberseguridad a nivel de frontera". En la página de ciberseguridad de DeepMind, Argon puntúa un 85.8% en el descubrimiento de vulnerabilidades del mundo real (Gemini 3.8 Flash Cyber: 71.0%), empata con Grok 4.7 y GPT-6 Astra en un 68% en CWE-bench v1, y registra la tasa de éxito más baja del gráfico para ataques de inyección de prompts indirectos Gray Swan, un 0.7% con k=15. Consulta lo que significa el lanzamiento de ciberseguridad de Argon para las APIs que ejecutas y su predecesor, Gemini 3.8 Flash Cyber.
Qué hacer ahora como desarrollador
Desarrolla en un modelo que puedas llamar hoy y mantén el nombre del modelo en una variable. gemini-3.8-flash es el sustituto: estable, 1.048.576 tokens de entrada y 65.536 de salida, un nivel gratuito y $0.75/$3.75 por millón hasta el 31 de diciembre de 2026. Los documentos de la API de Interacciones de Google dicen "todos los nuevos modelos, capacidades multimodales, herramientas y características de agente se lanzarán en la API de Interacciones", así que escribe contra ella. Google no ha publicado el ID del modelo de Argon, por lo que cambiarás la variable cuando se envíe.
MODEL="${GEMINI_MODEL:-gemini-3.8-flash}"
curl -s "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "'"$MODEL"'",
"input": "Listar los cambios importantes en este diff de OpenAPI.",
"generation_config": {"thinking_level": "medium"}
}'
En Apidog, guarda la misma llamada como una solicitud con GEMINI_API_KEY y GEMINI_MODEL como variables de entorno, luego verifica el recuento de tokens en el objeto usage de la respuesta (total_output_tokens más total_thought_tokens, ya que el pensamiento se factura como salida) para que una respuesta descontrolada falle la prueba. Mantén la respuesta de 3.8 Flash como tu línea de base. Cuando el ID de Argon aparezca en la lista de modelos, cambia GEMINI_MODEL, vuelve a ejecutar y compara.
Para formas de solicitud, consulta la guía de la API de Gemini 4 Argon. Para decidir si vale la pena esperar, lee Argon vs Gemini 3.8 Flash.
Preguntas frecuentes
¿Puedo usar Gemini 4 Argon en la API de Gemini? Todavía no. Solo un conjunto de socios de Fairwind lo tienen; la lista de modelos públicos no lo incluye.
¿Cuál es el ID del modelo Gemini 4 Argon? Google no ha publicado uno. Las cadenas en circulación, incluidos los slugs de los evaluadores, son marcadores de posición de terceros, así que no los codifiques.
¿Cuándo es el lanzamiento de Gemini 4 Argon para desarrolladores? Google no ha dado una fecha. Los clientes de API de pago y los suscriptores de Google AI Ultra son los primeros, "lo antes posible".
¿Es Gemini 4 Argon mejor que GPT-6 Astra y Claude Opus 5.5? Lidera la mayoría de las filas en la tabla de Google, pero empata con Astra en Artificial Analysis y está por debajo de Opus 5.5 allí. Para los rivales en sus propios términos, consulta qué es Claude Opus 5.5 y nuestra guía de la API de GPT-6 Astra.
¿Gemini 4 Argon tiene una ventana de contexto de 1M? Google no lo ha dicho. 1M es el límite de salida; su evaluación de contexto largo utilizó indicaciones de hasta 1M de tokens, lo cual no es una especificación publicada.
Prepárate antes de que Argon se abra
Argon está anunciado, tiene precio y benchmarks, pero aún no puedes llamarlo. Construye sobre Gemini 3.8 Flash con nuestra guía de la API de Gemini 3.8 Flash, mantén el modelo en una variable y coloca una aserción de token en cada solicitud. Para tener la solicitud, el entorno y la línea de base listos para el intercambio, descarga Apidog y configúralo hoy mismo.
