Claude Opus 5 llegó el 24 de julio de 2026, y llegó a Claude Code el primer día. Si pagas por Max, ya es tu predeterminado. Si eres usuario Pro, ahora es el modelo más potente al que puedes acceder. Y si utilizas Claude Code con una clave API, cuesta $5 por millón de tokens de entrada y $25 por millón de salida, lo mismo que Opus 4.8.
La parte de la que nadie te advirtió es que tu configuración actual probablemente esté jugando en su contra. Opus 5 verifica su propio trabajo sin que se le pida, escribe más extensamente por defecto, y recurre a subagentes con más facilidad que Opus 4.8. Cada uno de esos comportamientos puede ser amplificado, en lugar de corregido, por tu CLAUDE.md cuidadosamente ajustado.
Esta guía cubre la selección de modelos, qué cambia según el nivel de suscripción, cómo se comporta el esfuerzo y las cuatro ediciones de prompts que vale la pena hacer el primer día. También verás cómo emparejarlo con Apidog para que el modelo pruebe la API que acaba de escribir en lugar de asumir que funciona. Para un desglose completo del modelo, comienza con nuestro resumen de Claude Opus 5, y consulta el anuncio de Claude Opus 5 de Anthropic para las especificaciones de origen.
¿Qué cambia según el nivel de suscripción?
El acceso cambió de una manera que importa más de lo habitual.
Suscriptores Max: Opus 5 se convierte en tu modelo predeterminado. No tienes que hacer nada. Abre una sesión y ya lo estarás usando. La consecuencia práctica es que tu memoria muscular en torno al costo y la verbosidad ahora está calibrada para un modelo que ya no estás utilizando.

Suscriptores Pro: Opus 5 es ahora el modelo de mayor rendimiento disponible para ti. Esto representa un cambio real en lo que ofrece una suscripción Pro. Anteriormente, la cima de tu pila estaba un escalón por debajo del nivel de frontera; ahora es el predeterminado recomendado por Anthropic en su propia documentación.
Usuarios de clave API: Opus 5 está disponible en la API de Claude, Amazon Bedrock (anthropic.claude-opus-5), Google Cloud, Microsoft Foundry y GitHub Copilot. El precio es de $5 por millón de tokens de entrada y $25 por millón de salida, sin cambios respecto a Opus 4.8 y la mitad de los $10/$50 de Fable 5. Nuestro desglose de precios de Opus 5 tiene la tabla completa, incluyendo las tarifas de caché y por lotes.

Una especificación que vale la pena conocer antes de empezar: Opus 5 tiene una fecha de corte de conocimiento de mayo de 2026, la más reciente de cualquier modelo actual de Claude. Fable 5 y Sonnet 5 se detienen en enero de 2026. Para una herramienta de codificación que pasa el día trabajando con APIs de librerías lanzadas el trimestre pasado, cinco meses adicionales de datos de entrenamiento no es poca cosa.
Seleccionar Opus 5 en Claude Code
La selección de modelos se realiza a través del comando /model. Dentro de una sesión:
/model
Aparecerá un selector que muestra los modelos disponibles. Elige Claude Opus 5.
Para configurarlo sin abrir el selector, pasa el ID directamente:
/model claude-opus-5
El ID exacto del modelo de API es claude-opus-5. Sin sufijo de fecha, sin sello de versión. Si estás programando Claude Code, configurando un valor predeterminado de proyecto o escribiendo archivos de reglas que nombran el modelo, usa esa cadena exactamente. La documentación general de modelos de Anthropic enumera los IDs por plataforma si estás en Bedrock o Google Cloud.
El contexto es de 1M de tokens por defecto y como máximo, sin encabezado beta y sin recargo por contexto largo. La salida máxima es de 128k en la API de Mensajes. Para Claude Code, esto significa que los repositorios grandes encajan, aunque alimentar todo en cada turno sigue desperdiciando dinero. Nuestra hoja de trucos de Claude Code cubre el resto de los comandos de barra.
Cómo se comporta el esfuerzo
La cobertura de prensa lo llamó un interruptor entre costo y capacidad. Lo que realmente es: output_config.effort, un parámetro de API con cinco niveles (low, medium, high, xhigh, max), que las interfaces de usuario exponen como un selector de esfuerzo.
Tres cosas que debes saber al respecto en Opus 5.
El valor predeterminado es high. No medium, no adaptativo-sin-límite-inferior. Si envías una solicitud y no dices nada sobre el esfuerzo, obtendrás high.
Los niveles han sido recalibrados. Anthropic dice claramente que no traslades tus configuraciones de esfuerzo de Opus 4.8. Realiza una nueva evaluación de tus propios criterios. El cambio específico sobre el que vale la pena actuar es que low y medium son significativamente más fuertes en Opus 5 que en cualquier modelo Opus anterior. El trabajo que nunca habrías confiado a medium en 4.8 puede funcionar bien ahora, con un ahorro de costos real. Para el trabajo de codificación y agéntico, xhigh sigue siendo el punto de partida recomendado por Anthropic.
Te espera un error 400. Combinar thinking: {type: "disabled"} con un esfuerzo xhigh o max devuelve un error 400, aplicado por solicitud. Claude Code gestiona la forma de la solicitud por ti, por lo que no te encontrarás con este error en una sesión interactiva. Lo encontrarás en el momento en que programes Claude Code o desarrolles contra el SDK con el pensamiento desactivado y el esfuerzo activado. La solución es elegir una: mantener el pensamiento activado y bajar el esfuerzo, o mantener el esfuerzo limitado a high.
Mantén el pensamiento activado, por cierto. Con el pensamiento desactivado, ocasionalmente aparecen dos artefactos en Opus 5: llamadas a herramientas escritas como texto plano que nunca se ejecutan (y el texto filtrado luego contamina los turnos posteriores en un bucle agéntico), y etiquetas XML internas que aparecen en la salida visible. La propia mitigación de Anthropic es dejar el pensamiento activado y controlar el costo a través de un menor esfuerzo en su lugar. Nuestra guía de parámetros de esfuerzo explica cómo realizar un barrido, y la guía de migración cubre el resto de los cambios importantes de 4.8.
Cuatro ediciones de prompts para hacer el primer día
Esta es la sección que te ahorrará más dinero e irritación. Todo proviene de la guía de prompts de Opus 5 de Anthropic, que vale la pena leer por completo.
1. Elimina tus instrucciones de verificación
Si tu CLAUDE.md dice algo parecido a “siempre verifica tu trabajo dos veces”, “verifica el cambio antes de reportar”, o “confirma que las pruebas pasen y luego confirma de nuevo”, elimínalo.
Opus 5 verifica su propio trabajo sin ser solicitado. Es un comportamiento aprendido, no algo que tengas que solicitar. Cuando lo solicitas además, obtienes una sobre-verificación: el modelo vuelve a leer archivos que ya leyó, vuelve a ejecutar comprobaciones que ya ejecutó y quema tokens confirmando cosas que ya había confirmado. La guía de Anthropic es explícita sobre la eliminación de estas instrucciones.
La mayoría de los usuarios de Claude Code acumularon esas líneas durante meses de trabajo con modelos anteriores que realmente necesitaban el empujón. Ahora son una carga. Abre tu CLAUDE.md de proyecto y el global, busca “verificar”, “doble verificación” y “confirmar”, y elimina lo que encuentres.
2. Limita la creación de subagentes
Opus 5 delega en subagentes con más facilidad que Opus 4.8. En una tarea de investigación grande y paralizable, eso es una característica. En una carga de trabajo sensible al costo, es una factura.
Delimítalo explícitamente. Algo como esto en las instrucciones de tu proyecto funciona:
## Delegación
No generes subagentes para tareas que se puedan terminar en una sola pasada.
Usa como máximo dos subagentes en paralelo. Si una tarea parece necesitar
más, describe la división y pregunta antes de generar más.
El objetivo no es evitar la delegación. Es hacer que el modelo lo justifique en lugar de recurrir a ello por defecto. Si estás configurando subagentes deliberadamente, nuestra guía sobre cómo crear subagentes de Claude Code cubre la estructura.
3. Solicita concisión explícitamente
Las respuestas predeterminadas y los entregables escritos de Opus 5 son más largos que los de Opus 4.8. Resúmenes más largos, explicaciones más extensas, documentos más largos cuando le pides que escriba documentos.
Aquí está la trampa: reducir el esfuerzo no soluciona esto. El esfuerzo controla la profundidad del pensamiento, no la longitud de la salida visible. Si bajas a medium esperando respuestas más cortas, obtendrás el mismo muro de texto con menos razonamiento detrás.
La longitud es ahora un control a nivel de prompt. Decláralo:
## Estilo de respuesta
Reporta los resultados en menos de 150 palabras a menos que pida detalles.
No resumas lo que acabas de hacer si puedo ver el diff.
Omite el preámbulo. Ve directo a la respuesta.
4. Restringe las tareas específicas explícitamente
Opus 5 expande el alcance de las tareas más que su predecesor y narra sus correcciones a medida que avanza. Pídele que arregle una función y es posible que razonablemente decida que el módulo circundante también necesita atención.
Cuando quieras que se cambie exactamente una cosa, dilo como un límite en lugar de como una descripción. “Arregla la verificación de nulos en parseConfig y no cambies nada más” se lee de manera diferente para el modelo que “arregla la verificación de nulos en parseConfig.” Nuestro artículo más detallado sobre prompts para Opus 5 tiene fragmentos de copiar y pegar para cada uno de estos comportamientos.
Crea una API, luego deja que Opus 5 la pruebe
Claude Code puede generar el esqueleto de tus rutas. No puede ver si el endpoint en ejecución se comporta como dice el contrato. Esa brecha es donde residen la mayoría de los errores de “parecía correcto”, y ahora es más amplia ya que el modelo verifica su propio razonamiento con confianza.
Diseña y simula la API en Apidog primero: endpoints, esquemas de solicitud y respuesta, y un servidor mock que devuelva datos realistas. Luego, mientras Opus 5 escribe la implementación, dirígelo a la especificación real a través del servidor Apidog MCP para que lea el esquema real en lugar de inferir uno. Cuando termine, haz que ejecute el escenario de prueba:
apidog run --access-token $APIDOG_TOKEN \
--project-id $PROJECT_ID \
--test-scenario "user-signup-flow"
Las aserciones fallidas regresan como salida que el modelo puede leer y sobre la que puede actuar. Ese es un bucle de verificación basado en algo externo, lo cual vale más que la auto-verificación por muy buena que sea la auto-comprobación del modelo.
La misma configuración ayuda si estás llamando a la API de Claude directamente desde tu código. Puedes enviar solicitudes de claude-opus-5 desde Apidog, observar la llegada de eventos de streaming SSE, inspeccionar las cargas útiles de las llamadas a herramientas, almacenar tu clave API como una variable de entorno en lugar de pegarla en un script, ejecutar el mismo prompt en dos niveles de esfuerzo lado a lado, y leer el bloque usage para confirmar que los aciertos de caché se están produciendo. Descarga Apidog para configurar el proyecto localmente.
El límite honesto
Opus 5 no es la cima de la pila de Claude, y vale la pena ser claro al respecto antes de asignar una carga de trabajo.
Fable 5 sigue ostentando la designación de Anthropic de “el más capaz ampliamente lanzado”. Y Opus 5 se queda atrás de Mythos 5 en explotación de ciberseguridad e investigación de biología autónoma; Anthropic lo afirma ellos mismos en lugar de que nosotros lo infiramos. Si tu trabajo en Claude Code se encuentra en cualquiera de esas áreas, Opus 5 no es el límite adecuado. Nuestro explicador de modelos de clase Mythos cubre para qué sirve ese nivel.
Sobre las afirmaciones de los benchmarks: Anthropic informa que Opus 5 más que duplica la puntuación de Frontier-Bench v0.1 de Opus 4.8, obtiene aproximadamente 3 veces la del siguiente mejor modelo en ARC-AGI 3, y se acerca a 0.5% del pico de CursorBench 3.2 de Fable 5 a mitad de precio. Esos son números proporcionados por el proveedor. A partir del 25 de julio de 2026, ninguno ha sido reproducido de forma independiente. Trátalos como una razón para ejecutar tu propia evaluación, no como un resultado definitivo.
El resumen justo es capacidad de clase frontera a la mitad del precio de frontera, con un límite nombrado por encima de ella. Eso es un buen trato. Simplemente no es la misma afirmación que “el mejor modelo disponible”.
Cuándo usar otra cosa
Permanece en Opus 5 para la mayor parte del trabajo con Claude Code: codificación agéntica, refactorizaciones de varios archivos, tareas de largo alcance, cualquier cosa donde el modelo ejecute comandos y lea la salida en un bucle.
Recurre a otro lugar cuando la carga de trabajo sea de gran volumen y esté dominada por el costo, donde Sonnet 5 cubre la edición estándar a una tarifa más baja, o cuando te encuentres en el territorio de Fable 5 o Mythos 5 para los problemas de frontera más difíciles. Cambiar es un solo comando: /model claude-sonnet-5 para el tramo económico, /model claude-opus-5 para la parte difícil. Si anteriormente ejecutaste Sonnet 5 en Claude Code o Fable 5 en Claude Code, el flujo de trabajo aquí te resultará familiar.
Consejos prácticos
- Audita primero
CLAUDE.md. Elimina las instrucciones de verificación, añade una restricción de longitud, añade un límite de delegación. Quince minutos, y cambiará cada sesión a partir de entonces. - Reevalúa el esfuerzo. Tus configuraciones de 4.8 están obsoletas.
lowymediumahora pueden manejar trabajo que antes te habrías negado a darles. - Mantén el pensamiento activado. Controla el costo con el esfuerzo, no desactivando el pensamiento. Los artefactos del pensamiento desactivado son peores que el ahorro de tokens.
- Delimita tu contexto. 1M de tokens es mucho espacio, no una razón para volcar todo el repositorio en cada turno.
- Verifica externamente. La auto-verificación es buena; una prueba fallida contra un contrato real es mejor.
Preguntas frecuentes
¿Está Claude Opus 5 disponible en Claude Code?
Sí, desde su lanzamiento el 24 de julio de 2026. Selecciónalo con /model y elige Claude Opus 5, o pasa el ID directamente con /model claude-opus-5. Es el predeterminado para los suscriptores Max y el modelo de mayor rendimiento disponible para los suscriptores Pro.
¿Necesito cambiar mi CLAUDE.md para Opus 5?
Probablemente. La guía de prompts de Anthropic dice que las instrucciones de verificación heredadas causan una sobre-verificación en Opus 5, porque verifica su propio trabajo sin ser solicitado. Elimínalas. También añade una instrucción explícita de concisión (las respuestas predeterminadas son más largas) y un límite de subagentes (delega con más facilidad).
¿Por qué reducir el esfuerzo no hizo las respuestas más cortas?
El esfuerzo controla la profundidad del pensamiento, no la longitud de la salida visible. Reducirlo recorta los tokens de razonamiento, dejando la respuesta con una longitud similar. Si quieres una salida más corta, solicítalo en el prompt.
¿Qué causa un error 400 cuando configuro el esfuerzo a xhigh?
Combinar thinking: {type: "disabled"} con un esfuerzo xhigh o max devuelve un error 400 en Opus 5, aplicado por solicitud. O activa el pensamiento o limita el esfuerzo a high. Consulta la guía de migración para conocer los demás cambios importantes de Opus 4.8.
¿Puedo usar Opus 5 en Claude Code con un plan gratuito?
Opus 5 está disponible en las suscripciones Pro y Max, y a través de la API. Pro lo alcanza como el modelo superior en ese nivel; Max lo obtiene como predeterminado. Nuestra guía de acceso gratuito a Opus 5 cubre las rutas honestas y las de pago más económicas.
