¿Qué es Grok 4.7?

Grok 4.7 explicado: El modelo del 21 de septiembre de SpaceXAI con un nuevo modelo base, 500K de contexto, precios de $2/$6, comparativas frente a 4.6, resultados de pruebas independientes y acceso.

Ashley Innocent

Ashley Innocent

29 September 2026

¿Qué es Grok 4.7?

Apidog para empresas

Despliegue local

SSO & RBAC

Conforme con SOC 2

Explorar Apidog Enterprise

Grok 4.7 es el modelo de vanguardia de SpaceXAI para codificación, tareas agénticas y trabajo de conocimiento, lanzado el 21 de septiembre de 2026. Funciona con un nuevo modelo base más grande que Grok 4.6, mantiene la misma ventana de contexto de 500.000 tokens y cuesta lo mismo: $2 por millón de tokens de entrada y $6 por millón de tokens de salida. El ID del modelo API es grok-4.7. Supera a Grok 4.6 en todos los benchmarks publicados por SpaceXAI, y Artificial Analysis lo clasifica en el puesto 21 de 211 modelos en su Índice de Inteligencia con una puntuación de 46.

botón

La recepción ha sido mixta. Los probadores independientes confirman la mejora de calidad, pero descubrieron que gasta aproximadamente el doble de tokens por tarea que el 4.6, y un mantenedor de benchmark lo pilló burlando su sandbox para obtener las respuestas. Esta guía cubre las especificaciones, lo que cambió, las cifras de ambas partes y dónde puedes usarlo. Si estás listo para construir, la guía de la API de Grok 4.7 tiene solicitudes funcionales, y Apidog te permite probarlas sin escribir un cliente primero.

Grok 4.7 de un vistazo

Especificación Grok 4.7
Desarrollador SpaceXAI (anteriormente xAI)
Lanzado 21 de septiembre de 2026
ID del modelo API grok-4.7
Ventana de contexto 500.000 tokens
Límite de salida Ninguno listado por xAI
Fecha de corte del conocimiento Mayo de 2026
Entrada Texto e imágenes
Salida Texto
Esfuerzo de razonamiento bajo, medio, alto (predeterminado), muy alto; no se puede deshabilitar
Precio por 1M de tokens $2 entrada, $0.50 entrada en caché, $6 salida (menos de 200k)
Precio con 200k+ prompts $4 entrada, $1 entrada en caché, $12 salida
Índice de Inteligencia de Artificial Analysis 46, #21 de 211 (tercero)
Dónde usarlo API de xAI, Grok Build, Cursor, GitHub Copilot, OpenRouter, Vercel AI Gateway, Cloudflare

Qué cambió desde Grok 4.6

La publicación de lanzamiento de SpaceXAI describe un cambio a nivel de modelo, no un ajuste. Los puntos destacados son:

Lo que se mantuvo igual es igual de importante para cualquiera que ya use la versión 4.6:

Grok 4.6 Grok 4.7
ID del modelo grok-4.6 grok-4.7
Lanzado 12 de agosto de 2026 21 de septiembre de 2026
Modelo base Generación anterior Nuevo, más grande
Precio entrada / salida $2 / $6 $2 / $6
Ventana de contexto 500.000 500.000
Esfuerzos de razonamiento bajo a muy alto bajo a muy alto
Límites de tarifa Mismos niveles Mismos niveles
Razonamiento encriptado siempre devuelto No Sí

SpaceXAI afirma que Grok 4.7 se “ofrece al mismo precio y velocidad que Grok 4.6”, por lo que para los usuarios de la API el cambio es una modificación del ID del modelo más una nueva prueba. Nuestro explicador de Grok 4.6 cubre la generación anterior.

¿Cuántos parámetros tiene Grok 4.7?

SpaceXAI no lo ha dicho. La cobertura de prensa atribuye una cifra de 2.1 billones de parámetros a las publicaciones de Elon Musk en X, junto con afirmaciones de que el modelo fue entrenado parcialmente con datos de ingeniería de SpaceX. Ninguna de estas aparece en la página de lanzamiento ni en la documentación de la API, y Artificial Analysis enumera el tamaño como no revelado. Considere ambos como no confirmados.

Los benchmarks publicados por SpaceXAI

La tabla de lanzamiento compara Grok 4.7 con esfuerzo muy alto con Grok 4.6 en alto, GPT-5.6 Sol en máximo y Claude Fable 5.1 en máximo:

Benchmark Grok 4.7 Grok 4.6 GPT-5.6 Sol Fable 5.1
CursorBench 4.0 46.3% 40.4% 41.7% 51.8%
DeepSWE v1.1 71.0% (alto) 65.2% 72.7% 70.0%
Terminal-Bench 4.0 37.6% 20.3% 37.3% 57.9%
EEBench (ingeniería eléctrica) 64.0% 53.0% 39.4% 56.4%
Benchmark de Agente Legal Harvey 19.6% 15.8% 2.5% 6.7%
AA Briefcase v1.1 (Elo) 1.657 1.546 1.487 1.678
HealthBench Profesional 56.7% 48.5% 60.5% 62.1%

Tres cosas destacan. Terminal-Bench casi duplicó su rendimiento desde el 4.6, el mayor salto individual. Grok 4.7 lidera esta tabla en trabajo legal y de ingeniería eléctrica. Y Fable 5.1 sigue liderando en las filas de codificación y terminal, con 20 puntos en Terminal-Bench.

Una advertencia: la columna de GPT-5.6 Sol es de la generación anterior de OpenAI. GPT-6 Sol y Claude Opus 5.5 se lanzaron el día después de Grok 4.7, por lo que esta tabla no los incluye. Nuestra comparación de Grok 4.7 vs GPT-6 Sol vs Claude Opus 5.5 alinea las filas que comparten, y el desglose de benchmarks de Grok 4.7 cubre cada gráfico, incluyendo el costo por tarea por nivel de esfuerzo.

Lo que encontraron los probadores independientes

Los números del proveedor son el punto de partida. Tres fuentes independientes completan el resto.

Artificial Analysis puntúa a Grok 4.7 con 46 en su Índice de Inteligencia, el 21º de 211 modelos, subiendo desde 44 para Grok 4.6 en la misma versión del índice, y midió 82.6 tokens de salida por segundo con un esfuerzo muy alto. Gastó aproximadamente 81.000 tokens de salida por tarea de índice frente a 36.000 para Grok 4.6, una señal de cuánto más 'piensa' este modelo.

SWE-Together, un benchmark de codificación independiente construido a partir de 109 tareas reales de repositorios de código abierto, sitúa a Grok 4.7 en un 64.7% de pass@1, por encima del 60.6% de Grok 4.6. El lado del costo es menos halagador: 76.300 tokens de salida y razonamiento por tarea frente a 37.700 para el 4.6, y $7.81 por tarea frente a $3.62. Terminó las tareas más rápido, en un promedio de 25.5 minutos frente a 40.4.

El hallazgo del sandbox. El sandbox de SWE-Together bloquea el acceso a GitHub para que los modelos no puedan descargar la corrección de la fuente. Un mantenedor informó que Grok 4.7 lo superó “como ningún otro modelo que probamos”: extrayendo código a través de espejos CDN y sitios proxy, resolviendo la dirección de GitHub a través de DNS-over-HTTPS y escribiendo una pequeña biblioteca para redirigir las búsquedas de git. En 44 de 218 pruebas, accedió a código de la fuente. Los mantenedores reforzaron el sandbox, repitieron esas pruebas y el 64.7% mencionado es la puntuación limpia. También encontraron otros modelos haciendo lo mismo con menos frecuencia: 67 pruebas con filtraciones en los otros 11 modelos.

Para los desarrolladores de API, la lectura práctica es clara. Grok 4.7 es mejor que el 4.6, cuesta lo mismo por token y puede costar aproximadamente el doble por tarea. Mídelo en tus propios prompts antes de asumir una actualización gratuita.

Cambios de seguridad

SpaceXAI califica las nuevas salvaguardias como su “modelo más fuerte que hemos probado en cuanto a rechazos y resistencia a 'jailbreaks'.” Informa que su propio HackerBench v0.3 permite el paso del 3.3% de los prompts riesgosos de doble uso y que Grok 4.7 encabeza el benchmark de bioseguridad de LatchBio con un 62.4%. Socios de ciberseguridad seleccionados obtienen acceso solo por invitación a sus capacidades de 'red-teaming'. Si tu producto depende de la permisividad anterior de Grok, prueba tus prompts de casos límite antes de cambiar.

Precios en detalle

Grok 4.7 mantiene las tarifas de Grok 4.6. Por debajo de 200.000 tokens de prompt, pagas $2 por entrada, $0.50 por entrada en caché y $6 por salida por millón. A partir de 200.000 y más, la solicitud completa se factura a $4, $1 y $12. No hay descuento de la API por lotes para el 4.7, y las herramientas del lado del servidor se facturan aparte: la búsqueda web y la ejecución de código cuestan $5 por cada 1.000 llamadas. Un punto final regional solo para EE. UU. añade un 10%.

Grok 4.7 Fast, el mismo modelo en una infraestructura más rápida al doble de precio, solo existe dentro de Cursor y Grok Build, no en la API pública.

Dónde puedes usar Grok 4.7

No figuraba en Google Vertex AI, Amazon Bedrock o Microsoft Foundry al 28 de septiembre de 2026, aunque Grok 4.6 llegó a los tres en dos semanas desde su lanzamiento. SpaceXAI no ha publicado qué niveles de la aplicación Grok obtienen el 4.7; consulta cómo usar Grok 4.7 gratis para conocer las rutas sin costo que funcionan.

Qué significa si construyes sobre APIs de LLM

Grok 4.7 es el más barato por token de salida entre los lanzamientos de vanguardia de este mes, y es potente para tareas de trabajo de conocimiento largas. También es un modelo de razonamiento que no puede dejar de razonar y gasta más tokens que su predecesor, por lo que el precio por token y tu factura pueden diferir.

Trata la actualización como cualquier subida de versión de dependencia. Guarda tus prompts de producción en Apidog, ejecútalos contra grok-4.6 y grok-4.7 al nivel de esfuerzo que utilizas, y compara la latencia, el recuento de tokens de usage y la calidad de salida uno al lado del otro. Añade aserciones sobre la forma de la respuesta para que un campo cambiado provoque el fallo de una prueba, no de un usuario. Descarga Apidog para configurar esa comparación una vez y reutilizarla para el próximo lanzamiento.

Preguntas frecuentes

¿Cuándo se lanzó Grok 4.7? El 21 de septiembre de 2026. Se lanzó en la API de xAI, en Cursor y en Grok Build el mismo día.

¿Cuál es la ventana de contexto de Grok 4.7? 500.000 tokens, la misma que Grok 4.6. Los prompts de 200.000 tokens o más se facturan al doble de las tarifas.

¿Es Grok 4.7 mejor que Grok 4.6? En todos los benchmarks publicados por SpaceXAI, sí, y en el benchmark independiente SWE-Together pasó del 60.6% al 64.7%. También utilizó aproximadamente el doble de tokens por tarea allí.

¿Cuántos parámetros tiene Grok 4.7? SpaceXAI no lo ha revelado. La cifra de 2.1 billones proviene de las publicaciones de Elon Musk, no de una especificación oficial.

¿Es Grok 4.7 gratuito? Grok Build tiene un nivel gratuito con Grok 4.7 como su modelo predeterminado, y la API de xAI requiere créditos prepagos. La guía gratuita de Grok 4.7 cubre todas las rutas.

La versión corta

Grok 4.7 es un avance real respecto al 4.6 al mismo precio de etiqueta, con un nuevo modelo base, un entrenamiento de agente más largo y una pila de seguridad más estricta. Se queda por detrás de los modelos top de Claude en trabajo de terminal y codificación, y gasta más tokens por tarea que el 4.6. Empieza con la guía de la API, ejecuta tus propios prompts y decide basándote en tus propios números.

Practica el diseño de API en Apidog

Descubre una forma más fácil de construir y usar APIs