Claude Opus 5 es el modelo de nivel Opus más reciente de Anthropic, lanzado el 24 de julio de 2026. Anthropic lo posiciona para la codificación agentiva compleja y el trabajo empresarial, y la documentación ahora lo nombra como el punto de partida predeterminado: si no estás seguro de qué modelo usar, empieza con Claude Opus 5. El número principal es el precio. Opus 5 cuesta $5 por millón de tokens de entrada y $25 por millón de tokens de salida, la misma tarifa que Opus 4.8 y la mitad de lo que cobra Fable 5.
Esta guía cubre las especificaciones, la historia de precio-rendimiento, los benchmarks de lanzamiento de Anthropic y qué tan importantes son, los dos cambios de API que rompen el código existente de Opus 4.8, dónde puedes ejecutar el modelo y el límite que Anthropic advierte de antemano. Si llamas al modelo a través de HTTP, puedes enviar e inspeccionar esas solicitudes en Apidog a medida que avanzas.
Claude Opus 5 de un vistazo
| Especificación | Valor |
|---|---|
| ID del modelo API | claude-opus-5 (sin sufijo de fecha) |
| Lanzado | 24 de julio de 2026 |
| Ventana de contexto | 1,000,000 de tokens, predeterminada y máxima |
| Salida máxima | 128,000 tokens en la API de mensajes; 300,000 en la API por lotes con el encabezado beta output-300k-2026-03-24 |
| Precio base | $5 por millón de tokens de entrada, $25 por millón de tokens de salida |
| Fecha de corte de conocimiento | Mayo de 2026 |
| Pensamiento adaptativo | Activado por defecto |
| Niveles de esfuerzo | bajo, medio, alto, muy alto, máximo; por defecto alto |
| Nivel de prioridad | No soportado |
| Disponibilidad | API de Claude, claude.ai, Claude Code, Claude Cowork, Amazon Bedrock, Plataforma Claude en AWS, Google Cloud, Microsoft Foundry, GitHub Copilot |
Tres de esas filas merecen un segundo vistazo.
La ventana de contexto de 1M es tanto la predeterminada como la máxima, y no necesita un encabezado beta. Tampoco hay una prima por contexto largo, por lo que una solicitud (prompt) de 900,000 tokens se factura a la misma tarifa por token que una de 900 tokens.
La fecha de corte de conocimiento de mayo de 2026 es la más reciente de cualquier modelo Claude actual. Fable 5 y Sonnet 5 se mantienen en enero de 2026, por lo que Opus 5 conoce aproximadamente cuatro meses adicionales de bibliotecas, lanzamientos y cambios de API sin que tengas que pegarlos.
El Nivel de Prioridad es la única característica que retrocedió. Opus 4.8 lo soporta; Opus 5 no. Si la planificación de capacidad de tu empresa depende del Nivel de Prioridad, esa es una limitación real y se cubre en la guía de migración.
Para la tabla completa del modelo y cada campo textualmente, la descripción general de modelos de Anthropic es la fuente oficial.
Qué es Claude Opus 5
Opus 5 es el sucesor de Claude Opus 4.8. El ID del modelo API es la cadena exacta claude-opus-5. En Amazon Bedrock el ID es anthropic.claude-opus-5, y en Google Cloud es claude-opus-5 de nuevo. La Plataforma Claude en AWS utiliza el ID de primera parte.

El nivel Opus siempre ha sido la línea de alto rendimiento de Anthropic, situándose por encima de Sonnet y por debajo de los modelos de frontera de investigación Fable y Mythos. Lo que cambió con Opus 5 es que este nivel dejó de ser la opción costosa a la que se escala. La documentación de Anthropic ahora te indica que empieces aquí, lo cual es una postura diferente a la generación 4.x, donde Sonnet era el predeterminado y Opus la actualización.
El modelo también se está convirtiendo en el predeterminado para los suscriptores Max y el modelo de mayor rendimiento disponible en Pro, lo cual es la primera vez que un modelo de clase Opus es el techo para un plan de consumo de precio medio. El artículo sobre las rutas gratuitas y de pago más baratas explica lo que esto realmente te ofrece.
La historia de precio-rendimiento
Esta es la parte con la que comenzó cada artículo del día del lanzamiento, y se mantiene cuando miras la página de precios.
| Tarifa | Entrada (por M de tokens) | Salida (por M de tokens) |
|---|---|---|
| Estándar | $5.00 | $25.00 |
| API por lotes (50% de descuento) | $2.50 | $12.50 |
| Modo rápido (vista previa de investigación) | $10.00 | $50.00 |
| Escritura en caché, TTL de 5 minutos | $6.25 | n/a |
| Escritura en caché, TTL de 1 hora | $10.00 | n/a |
| Aciertos y actualizaciones de caché | $0.50 | n/a |
Claude Fable 5 cobra $10 y $50. Opus 5 cobra $5 y $25 por un modelo que Anthropic afirma que se sitúa a medio por ciento de Fable 5 en codificación agentiva. Esa es la propuesta completa: rendimiento de clase fronteriza a la mitad del precio fronterizo.
Algunas palancas menos obvias se encuentran dentro de esa tabla. El mínimo de caché de prompts se redujo a 512 tokens, de 1,024 en Opus 4.8, por lo que los prompts del sistema que antes eran demasiado cortos para la caché ahora se almacenan en caché sin ningún cambio de código. Los aciertos de caché cuestan $0.50 por millón, una décima parte de la tarifa base de entrada. La API por lotes reduce todo a la mitad para el trabajo que puede esperar. Y la sobrecarga del prompt del sistema para el uso de herramientas es ligeramente más barata que la de 4.8, con 286 tokens para la elección de herramientas auto o none, frente a 290 en Opus 4.8 y 675 en Opus 4.7.
Dos detalles de costos que suelen sorprender. El modo rápido duplica la tarifa a $10 y $50 a cambio de aproximadamente 2.5 veces la velocidad de salida, y solo se ejecuta en la API de primera parte: no en Bedrock, no en Google Cloud, no en Microsoft Foundry y no con la API por lotes. Por separado, establecer inference_geo: "us" aplica un multiplicador de 1.1x en cada categoría de tokens, por lo que la inferencia anclada en EE. UU. es un recargo del 10% en entrada, salida, escrituras en caché y aciertos de caché por igual.
El desglose completo de precios presenta ejemplos de costos por tarea, y si ya estás reduciendo gastos, las palancas en cómo reducir tu factura de API de Claude siguen siendo aplicables. La página de precios de Anthropic es la tabla autorizada.
Lo que Anthropic dice que muestran los benchmarks
Cada número a continuación es propio de Anthropic, publicado con el lanzamiento. A partir del 25 de julio de 2026, ninguno de ellos ha sido reproducido de forma independiente. Léelos como afirmaciones del proveedor, no como mediciones neutrales, y planifica ejecutar tus propias evaluaciones antes de comprometer una carga de trabajo de producción.
| Benchmark | Afirmación de Anthropic |
|---|---|
| Frontier-Bench v0.1 | Supera a todos los demás modelos y más que duplica la puntuación de Opus 4.8, a un menor costo por tarea |
| ARC-AGI 3 | Aproximadamente 3 veces la puntuación del siguiente mejor modelo |
| OSWorld 2.0 (uso de computadora) | Supera a Fable 5 a un tercio del costo |
| CursorBench 3.2 (codificación agentiva) | Dentro del 0.5% del pico de Fable 5, a mitad de precio |
| Zapier AutomationBench | Tasa de aprobación aproximadamente 1.5 veces mayor que la del siguiente mejor modelo |
| Química orgánica | +10.2 puntos sobre Opus 4.8 |
| Análisis de proteínas | +7.7 puntos sobre Opus 4.8 |
La forma de las afirmaciones es consistente: grandes saltos en evaluaciones agentivas y dirigidas por herramientas, y un argumento de costo por tarea adjunto a casi todas. Los resultados de CursorBench y OSWorld son los dos que más importan para la decisión de compra, porque son los que indican que puedes pasar de Fable 5 a Opus 5 sin perder mucho.
También son los dos que más necesitan tu propia verificación. Una diferencia de medio por ciento en un benchmark de codificación elegido por un proveedor está dentro del rango donde tu base de código, tu prompt y tus definiciones de herramientas deciden el resultado. La exploración profunda de benchmarks cubre lo que cada evaluación mide realmente y qué probar por ti mismo.
El límite honesto
Opus 5 no es la cima de la pila de Claude, y Anthropic no afirma que lo sea.
Fable 5 mantiene la designación de “modelo más capaz ampliamente lanzado”. Y en dos capacidades de investigación específicas, la explotación de ciberseguridad y la investigación biológica autónoma, Opus 5 todavía está por detrás de Mythos 5. Anthropic lo afirma directamente en su propio material de lanzamiento, lo cual es digno de mención dada la forma en que la cobertura general enmarcó el lanzamiento.
Así que el resumen preciso es más estrecho que los titulares: capacidad de clase fronteriza a la mitad del precio de frontera, con dos capacidades nombradas donde un modelo superior aún gana. Para la mayoría de la codificación agentiva y la automatización empresarial, ese límite nunca surge. Para la investigación de seguridad o el trabajo científico autónomo, sí. Los antecedentes sobre el nivel de investigación se encuentran en el explicador del modelo de clase Mythos y en Fable 5 vs Mythos 5.
Dos cambios que rompen el código de Opus 4.8
Intercambiar el ID del modelo no es suficiente. Dos cambios te afectarán en tu primera solicitud.
El pensamiento está activado por defecto. En Opus 4.8, una solicitud sin el campo thinking se ejecutaba sin pensar. En Opus 5, esa misma solicitud ejecuta pensamiento adaptativo. Dado que max_tokens sigue limitando los tokens de pensamiento más el texto de respuesta juntos, una carga de trabajo que dimensionó max_tokens ajustadamente alrededor de su salida esperada ahora puede truncarse a mitad de respuesta. No hay errores. La salida simplemente se corta, lo cual es el peor tipo de regresión para depurar.
Deshabilitar el pensamiento está limitado a un esfuerzo alto. Enviar thinking: {type: "disabled"} junto con un esfuerzo xhigh o max devuelve un error 400, aplicado por solicitud. Si trasladó una configuración que desactivaba el pensamiento y aumentaba el esfuerzo, cada llamada fallará inmediatamente.
Hay más en la superficie de migración: los niveles de esfuerzo fueron recalibrados, por lo que tus antiguos resultados de barrido ya no se transfieren, el encabezado beta de la ventana de contexto ha desaparecido, ahora se aceptan mensajes del sistema a mitad de conversación donde 4.8 los rechazaba con un 400, y el Nivel de Prioridad desapareció. La guía de migración de Opus 4.8 a Opus 5 tiene los fragmentos de antes y después para cada uno, y la guía de migración de Anthropic es la referencia principal. Si todavía estás en la generación anterior, el recorrido de la API de Opus 4.8 muestra de qué estás migrando.
El parámetro de esfuerzo, no un interruptor
La mayoría de la cobertura de lanzamiento describió a Opus 5 como un modelo que permite a los usuarios alternar entre costo y capacidad. Esa descripción apunta a un parámetro real de la API: output_config.effort.
El esfuerzo tiene cinco niveles, desde bajo hasta máximo, y por defecto es alto. Controla cuánto piensa el modelo antes de responder, lo que a su vez controla lo que gastas. Las interfaces de usuario lo exponen como un selector de esfuerzo en lugar de un parámetro bruto, pero es el mismo control subyacente.
Dos cosas cambiaron en esta generación. Los niveles fueron recalibrados, por lo que Anthropic recomienda explícitamente ejecutar un nuevo barrido de esfuerzo en lugar de trasladar la configuración de Opus 4.8. Y los niveles bajo y medio son significativamente más fuertes en Opus 5 que en cualquier modelo Opus anterior, lo que los hace utilizables para trabajo real por primera vez en lugar de ser configuraciones que se evitan. Para la codificación y los bucles agentivos, muy alto sigue siendo el punto de partida recomendado.
La guía del parámetro de esfuerzo cubre los cinco niveles, cómo ejecutar un barrido contra tus propias evaluaciones y la interacción con max_tokens.
Cómo se comporta Opus 5 de manera diferente
La guía de prompting de Anthropic para Opus 5 documenta cambios de comportamiento que modificarán tus resultados incluso cuando tu código sea idéntico byte a byte.
- Verifica su propio trabajo sin ser solicitado. Las instrucciones heredadas de “revisa tu respuesta” ahora causan una sobreverificación y queman tokens sin motivo. El consejo de Anthropic es eliminarlas.
- Las respuestas predeterminadas y los entregables escritos son más largos que los de Opus 4.8. Reducir el esfuerzo disminuye el pensamiento, no la longitud de la salida visible, así que pide concisión explícitamente si la necesitas.
- Delega a subagentes con mayor facilidad. Limita o acota la delegación en cargas de trabajo sensibles al costo.
- Expande el alcance de la tarea y narra sus correcciones con mayor frecuencia. Limita las tareas específicas en el prompt.
Existe un modo de fallo que vale la pena conocer. Con el pensamiento desactivado, ocasionalmente aparecen dos artefactos: llamadas a herramientas escritas como texto plano que nunca se ejecutan, y etiquetas XML internas que aparecen en la salida visible. En un bucle agentivo, el texto filtrado puede "envenenar" turnos posteriores. La propia mitigación de Anthropic es mantener el pensamiento activado y controlar el costo con un nivel de esfuerzo más bajo en su lugar. La exploración profunda de prompting tiene fragmentos de copiar y pegar para cada cambio, y la guía de Claude Code los aplica a los flujos de trabajo del editor.
Dónde puedes ejecutarlo
| Plataforma | Estado |
|---|---|
| API de Claude | Disponible, ID de modelo claude-opus-5 |
| claude.ai | Disponible; predeterminado para Max, modelo superior para Pro |
| Claude Code | Disponible |
| Claude Cowork | Disponible |
| Amazon Bedrock | Disponible como anthropic.claude-opus-5 |
| Plataforma Claude en AWS | Disponible, ID de primera parte |
| Google Cloud | Disponible como claude-opus-5 |
| Microsoft Foundry | Disponible |
| GitHub Copilot | Disponible |
El modo rápido es la excepción a esa matriz. Se ejecuta solo en la API de primera parte, por lo que una implementación en Bedrock o Google Cloud no puede acceder a él.
Probando solicitudes de Opus 5 en Apidog
Llamar a Opus 5 significa acceder a un endpoint HTTP con encabezados de autenticación, un cuerpo JSON, respuestas de streaming y errores que necesitas reproducir. Apidog se encarga de eso: envía la solicitud, guárdala en una colección, mantén tu clave API en una variable de entorno en lugar de pegarla en un cuerpo, y lee la respuesta campo por campo.

Una configuración práctica para este modelo:
- Almacena
ANTHROPIC_API_KEYcomo una variable de entorno para que la clave nunca termine en una colección compartida. - Guarda una solicitud de Mensajes de referencia, luego duplícala por nivel de esfuerzo para que puedas comparar
bajo,altoymuy altolado a lado con el mismo prompt. - Observa directamente el stream SSE cuando habilites la transmisión, para que puedas ver dónde se detuvo realmente una respuesta truncada.
- Lee el bloque
usageen cada respuesta para confirmar que los aciertos de caché se están produciendo y para ver cuántos tokens de pensamiento consumió la solicitud.
Aquí tienes la solicitud de referencia:
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-opus-5",
"max_tokens": 8192,
"messages": [
{"role": "user", "content": "Refactor this handler and explain the tradeoffs."}
]
}'
Esa solicitud ejecuta pensamiento adaptativo, porque el pensamiento está activado por defecto y no hay ningún campo thinking presente. Dale a max_tokens suficiente espacio: 1,024 estaba bien en Opus 4.8 y aquí se truncará. Para seguir el ejemplo, Descarga Apidog e importa la solicitud. La guía paso a paso de la API cubre streaming, uso de herramientas y la lectura completa de usage.
Quién debería usar Claude Opus 5
Opta por Opus 5 cuando:
- Construyes agentes o flujos de trabajo intensivos en herramientas. Esta es la carga de trabajo para la que Anthropic optimizó y donde sus afirmaciones de benchmark son más sólidas.
- Estás usando Fable 5 y la factura duele. La mitad del precio por una supuesta diferencia de medio por ciento en codificación agentiva merece una evaluación real. La comparación Opus 5 vs Fable 5 enmarca esa decisión.
- Actualmente usas Opus 4.8. Mismo precio, números supuestamente mejores, fecha de corte de conocimiento más reciente. El único costo es el trabajo de migración.
- Necesitas conocimiento reciente. Mayo de 2026 supera a cualquier otro modelo Claude actual por unos cuatro meses.
Quédate donde estás cuando:
- El Nivel de Prioridad es crítico. Opus 4.8 lo mantiene y Opus 5 no, así que verifica los precios y niveles de Opus 4.8 antes de cambiar.
- Tu carga de trabajo es económica y de alto volumen. Sonnet 5 cuesta menos y podría ser suficiente. La comparación Opus 5 vs Sonnet 5 cubre dónde el premium de 2.5x justifica su costo.
- Realizas explotación de ciberseguridad o investigación biológica autónoma. Mythos 5 sigue liderando en esos campos.
Preguntas frecuentes
¿Cuál es el ID del modelo para Claude Opus 5? Es la cadena exacta claude-opus-5, sin sufijo de fecha. En Amazon Bedrock usa anthropic.claude-opus-5; Google Cloud y Claude Platform en AWS usan claude-opus-5.
¿Cuánto cuesta Claude Opus 5? $5 por millón de tokens de entrada y $25 por millón de tokens de salida, idéntico a Opus 4.8 y la mitad de los $10 y $50 de Fable 5. La API por lotes lo reduce a la mitad de nuevo a $2.50 y $12.50. El modo rápido lo duplica a $10 y $50.
¿Es Claude Opus 5 mejor que Fable 5? Según los propios números de Anthropic, está cerca, no por delante. Anthropic informa que Opus 5 está dentro del 0.5% de Fable 5 en CursorBench 3.2 y por delante en OSWorld 2.0 a un tercio del costo, pero Fable 5 mantiene la designación de “modelo más capaz ampliamente lanzado”. Esos son resultados ejecutados por el proveedor sin reproducción independiente todavía.
¿Cuál es la ventana de contexto de Claude Opus 5? 1,000,000 de tokens, como predeterminada y máxima, sin encabezado beta y sin prima de precio por contexto largo. La salida máxima es de 128,000 tokens en la API de Mensajes, o 300,000 en la API por lotes con el encabezado beta output-300k-2026-03-24.
¿Necesito cambiar mi código para actualizar de Opus 4.8? Más allá del ID del modelo, sí. El pensamiento ahora se ejecuta por defecto, así que revisa max_tokens o te arriesgas a un truncamiento silencioso. Y thinking: {type: "disabled"} combinado con un esfuerzo xhigh o max devuelve un error 400. Vuelve a ejecutar tu barrido de esfuerzo también, ya que los niveles fueron recalibrados.
¿Cuál es la fecha de corte de conocimiento de Claude Opus 5? Mayo de 2026 tanto para el conocimiento fiable como para los datos de entrenamiento, la más reciente de cualquier modelo Claude actual.
