Anthropic lanzó Claude Opus 5 el 24 de julio de 2026, y Claude Sonnet 5 el 30 de junio de 2026. Ambos son de generación actual. Ambos tienen una ventana de contexto de 1M y una salida máxima de 128k. Ambos ejecutan pensamiento adaptativo por defecto y exponen un parámetro de esfuerzo. Desde fuera, parecen el mismo modelo a dos precios, lo que convierte la elección en una cuestión puramente de gasto.
Esa pregunta tiene una fecha límite. Sonnet 5 todavía está en su tarifa de introducción de $2 por millón de tokens de entrada y $10 por millón de tokens de salida. El 1 de septiembre de 2026, pasará a la tarifa estándar de $3 / $15. Opus 5 se mantiene en $5 / $25 y no está programado para cambiar. Así, la brecha entre los niveles es 2.5x hoy y aproximadamente 1.67x a partir de septiembre, y ese cambio es lo suficientemente grande como para alterar decisiones reales. Si está presupuestando una carga de trabajo que se entregará en el cuarto trimestre, presupuéstela con los números de septiembre, no con los de hoy.

Esta guía compara ambos en especificaciones, coste real por tarea (no coste por token, lo que aquí es engañoso), dónde la ventaja de codificación agéntica de Opus 5 vale la pena pagar, y dónde Sonnet 5 es claramente suficiente. Si desea medir la diferencia usted mismo en lugar de confiar en una tabla, puede ejecutar ambos modelos lado a lado en Apidog y leer los campos usage.
El panorama de precios y la fecha en que cambia
Aquí están las tarifas base publicadas de la página de precios de Anthropic.
| Modelo | Entrada / MTok | Salida / MTok | Estado |
|---|---|---|---|
| Claude Opus 5 | $5.00 | $25.00 | Estándar |
| Claude Sonnet 5 (hasta el 31 de agosto de 2026) | $2.00 | $10.00 | Introductorio |
| Claude Sonnet 5 (a partir del 1 de septiembre de 2026) | $3.00 | $15.00 | Estándar |
Opus 5 también tiene tarifas que vale la pena conocer antes de modelar cualquier cosa: almacenamiento en caché de prompts a $6.25 por MTok para una escritura de 5 minutos, $10 para una escritura de 1 hora y $0.50 para aciertos de caché; la API de Batch a $2.50 / $12.50, un descuento fijo del 50%; modo rápido a $10 / $50 para una velocidad de salida 2.5x (vista previa de investigación, solo API de primera parte, no combinable con batch); y un multiplicador de 1.1x en cada categoría de token cuando se establece inference_geo: "us". El desglose completo con ejemplos resueltos se encuentra en la guía de precios de Opus 5, y el lado de Sonnet está cubierto en el desglose de precios de Sonnet 5.
Un detalle que sorprende a la gente: Opus 5 cuesta exactamente lo mismo que costaba Opus 4.8. Anthropic no subió el precio de Opus por un salto generacional. Así que la decisión Opus versus Sonnet que tomaste en julio de 2026 es la misma aritmética que hacías en junio, con un Opus mejor en un lado de la ecuación.
Especificaciones: carcasas casi idénticas
| Especificación | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|
| ID del modelo | claude-opus-5 |
claude-sonnet-5 |
| Ventana de contexto | 1M tokens (predeterminado y máximo) | 1M tokens (predeterminado y máximo) |
| Salida máxima | 128k (300k en API de Batch con cabecera beta) | 128k |
| Pensamiento adaptativo | Activado por defecto | Activado por defecto |
| Niveles de esfuerzo | Cinco, hasta max, por defecto high |
low / medium / high / xhigh |
| Fecha de corte de conocimiento | Mayo de 2026 | Enero de 2026 |
| Nivel de prioridad | No compatible | No disponible |
| Caché de prompt, uso de herramientas, batch, visión | Compatible | Compatible |
| Tokenizador | Tokenizador de generación 4.7 | Tokenizador de generación 4.7 |
Tres de esas filas realizan un trabajo real.
La brecha en la fecha de corte de conocimiento es de cuatro meses. Opus 5 está entrenado hasta mayo de 2026, la fecha de corte más reciente de cualquier modelo Claude actual; Sonnet 5 se detiene en enero de 2026. Si su carga de trabajo toca versiones de librerías o cambios de API de la primavera de 2026, Opus 5 los conoce. Eso es un argumento de actualidad más que de capacidad, y la recuperación de información lo cierra para cualquiera de los modelos.
Ningún nivel le ofrece el Nivel de Prioridad. Esto confunde a los equipos que migran desde Opus 4.8, que sí lo admite. Si usted depende del Nivel de Prioridad para garantías de latencia, ninguno de los modelos de generación actual es un reemplazo directo. La guía de migración de Opus 4.8 a Opus 5 cubre el resto de los cambios importantes.
La fila del tokenizador no es una diferencia, y vale la pena saberlo. Es la fila que la gente espera que sea relevante aquí, y no lo es.
Por qué el coste por token sigue siendo engañoso aquí
Comencemos aclarando una confusión común. Anthropic documenta que los modelos Claude 4.7 y posteriores utilizan un tokenizador más nuevo que produce aproximadamente un 30% más de tokens para el mismo texto que el anterior. Tanto Opus 5 como Sonnet 5 están en ese grupo. La cifra del 30% se mide contra Sonnet 4.6 y versiones anteriores, no entre estos dos.
Así, Opus 5 y Sonnet 5 cuentan su texto de la misma manera. Un documento de 4,000 palabras tiene el mismo número de tokens de entrada facturables en ambos, y los precios por token publicados son directamente comparables. Si está migrando de Sonnet 4.6, presupueste el aumento del 30%; si está eligiendo entre estos dos, ignórelo.
Lo que sí mueve el coste por tarea es el volumen de salida. La propia guía de prompting de Anthropic para Opus 5 indica que sus respuestas visibles predeterminadas y entregables escritos son más largos que los modelos Opus anteriores, y que reducir el esfuerzo disminuye el pensamiento sin acortar de manera fiable la respuesta visible. Los tokens de salida cuestan cinco veces lo que cuestan los tokens de entrada en ambos modelos. Una solicitud a Opus 5 que escribe un 30% más de prosa de lo que usted pidió es un elemento de coste real, y la solución está del lado del prompt, no del precio. La guía de prompting de Opus 5 cubre las instrucciones de concisión que lo reducen.
El endpoint de conteo de tokens de Anthropic le proporciona recuentos exactos de entrada para ambos modelos en su propio texto en un par de minutos. Mida la salida en una muestra real de su carga de trabajo en lugar de asumir.
Así es como se ve la aritmética en una carga de trabajo diaria concreta: 500k tokens de entrada y 40k tokens de salida.
| Escenario | Coste diario | Ratio vs Sonnet 5 |
|---|---|---|
| Opus 5 | $3.50 | línea de base |
| Sonnet 5, introductorio ($2/$10) | $1.40 | Opus es 2.5x |
| Sonnet 5, estándar desde el 1 de septiembre ($3/$15) | $2.10 | Opus es 1.67x |
| Opus 5 escribiendo un 30% más de salida de lo solicitado | $3.80 | Opus es 1.81x |
Esa última fila es en la que hay que detenerse. La verbosidad que no solicitó puede costar más que la diferencia de nivel por la que se preocupó, y es lo más barato de solucionar en esta página.
Y luego está el cálculo de reintentos, que es donde generalmente se decide toda la comparación. Con precios estándar, una ejecución de Opus 5 cuesta $3.50 y una de Sonnet 5 cuesta $2.10. Si Sonnet 5 necesita un segundo intento en una tarea que Opus 5 completa en uno, las dos ejecuciones cuestan $4.20 y Sonnet se convierte ahora en la opción cara. Los reintentos del modelo y el tiempo de revisión humana, no solo los tokens. Las palancas generales para ambos modelos se encuentran en nuestra guía para reducir su factura de la API de Claude.
Dónde Opus 5 se gana el premium
Los números de lanzamiento de Anthropic para Opus 5 son agresivos. Para ser claros sobre su estado: estos son resultados ejecutados por el proveedor publicados por Anthropic, y a fecha del 25 de julio de 2026, ninguno de ellos ha sido reproducido de forma independiente. Léalos como afirmaciones con una fuente, no como mediciones neutrales.
- Frontier-Bench v0.1: Opus 5 supera a todos los demás modelos y más que duplica la puntuación de Opus 4.8, a un menor coste por tarea.
- ARC-AGI 3: aproximadamente 3 veces la puntuación del siguiente mejor modelo.
- OSWorld 2.0: supera a Fable 5 a aproximadamente un tercio del coste.
- CursorBench 3.2: dentro del 0.5% del pico de Fable 5, a la mitad de precio.
- Zapier AutomationBench: tasa de aprobación alrededor de 1.5 veces la del siguiente mejor modelo.
- Ciencia: química orgánica sube 10.2 puntos y análisis de proteínas sube 7.7 puntos sobre Opus 4.8.
Los propios números de lanzamiento de Sonnet 5 quedaron por debajo de Opus 4.8: SWE-bench Pro 63.2% frente a 69.2%, Terminal-Bench 2.1 en 80.4% frente a 82.7%, y OSWorld-Verified 81.2% frente a 83.4%. La historia de Sonnet 5 era que se situaba a pocos puntos de Opus 4.8 en trabajos agénticos y de uso de herramientas, costando mucho menos, lo que era una historia sólida en junio. Opus 5 cambia el panorama: el nivel por encima de Sonnet ahora es materialmente mejor que el Opus 4.8 con el que se hicieron esas comparaciones de Sonnet. La atribución completa y las advertencias se encuentran en el desglose de benchmarks de Opus 5 y en la publicación de benchmarks de Sonnet 5.
En la práctica, Opus 5 toma la delantera cuando la tarea tiene una o más de estas propiedades:
- Codificación agéntica de largo alcance. Refactorizaciones multifichero, migraciones y bucles que se ejecutan durante docenas de llamadas a herramientas. Los errores se acumulan en los bucles de agente, y un modelo que falla con menos frecuencia por paso vale más de lo que sugiere su diferencia de precio.
- La tarea es costosa si se equivoca. Migraciones de producción, código relacionado con la seguridad, cualquier cosa que un humano tenga que revisar cuidadosamente. El tiempo de revisión cuesta más por hora que lo que cualquiera de los modelos cuesta por día.
- Uso de computadoras y automatización de escritorio. OSWorld 2.0 es el benchmark en el que Anthropic se apoyó más aquí.
- Razonamiento científico y analítico complejo, donde los deltas de química y análisis de proteínas son las ganancias más claras en el conjunto de lanzamiento, o trabajo que necesita conocimiento de mayo de 2026 que no puede proporcionar a través de la recuperación de información.
Donde Sonnet 5 es claramente suficiente
La respuesta honesta para la mayoría del tráfico de producción es Sonnet 5. Que Opus 5 sea mejor no hace que Sonnet 5 sea insuficiente, y pagar por una capacidad que no se puede detectar en la salida no es una estrategia.
Sonnet 5 es la elección correcta cuando:
- El volumen es alto y cada llamada es pequeña. Clasificación, extracción, resumen, etiquetado, enrutamiento. El techo de calidad en estas tareas es lo suficientemente bajo como para que ambos modelos lo alcancen.
- La salida se valida automáticamente de todos modos. Si una comprobación de esquema o una suite de pruebas detecta fallos de forma económica, una tasa de fallos ligeramente más alta es una tasa de fallos económica.
- La latencia importa más que la profundidad, o aún está prototipando. Construya sobre Sonnet 5, luego mida si Opus 5 cambia algo antes de pagar por él.
También hay una vía gratuita que vale la pena conocer: Sonnet 5 es el modelo predeterminado en el plan gratuito de Claude, por lo que puede verificar su salida con sus prompts reales antes de escribir una línea de código. Opus 5 es ahora el modelo de mayor rendimiento disponible para suscriptores Pro y el predeterminado para Max, por lo que los niveles de consumo también lo alcanzan. Nuestra guía de acceso gratuito a Opus 5 muestra los caminos honestos.
Tabla de decisión por carga de trabajo
| Carga de trabajo | Elegir | Por qué |
|---|---|---|
| Refactorización multifichero o migración en un bucle de agente | Opus 5 | Los errores acumulados hacen que la fiabilidad paso a paso sea el coste dominante |
| Clasificación o extracción de alto volumen | Sonnet 5 | Ambos alcanzan el techo de calidad; el precio es decisivo |
| Chat de atención al cliente con recuperación de información | Sonnet 5 | La recuperación cierra la brecha de la fecha de corte; la latencia importa |
| Uso de computadoras o automatización de escritorio | Opus 5 | La brecha de OSWorld 2.0 de Anthropic es la afirmación agéntica más clara |
| Procesamiento de documentos por lotes durante la noche | Sonnet 5, o Opus 5 en la API de Batch | El Batch con un 50% de descuento puede acercar a Opus 5 a la tarifa estándar de Sonnet |
| Revisión de seguridad o código crítico para producción | Opus 5 | El coste de un error minimiza la diferencia de tokens |
| Análisis científico o cuantitativo | Opus 5 | Los deltas de química y análisis de proteínas son las ganancias más fuertes |
| Prototipado y herramientas internas | Sonnet 5 | Mida antes de actualizar |
| Cualquier cosa que necesite conocimiento de primavera de 2026 sin recuperación | Opus 5 | Fecha de corte de mayo de 2026 versus enero de 2026 |
| UX interactiva sensible a la latencia | Sonnet 5 | O Opus 5 en modo rápido a $10/$50 si la profundidad no es negociable |
Observe la fila de la API de Batch. Opus 5 en batch es $2.50 / $12.50, lo que lo sitúa por debajo de la tarifa estándar de septiembre de Sonnet 5 de $3 / $15 en la entrada y ligeramente por encima en la salida. Si su trabajo tolera el procesamiento asíncrono, la cuestión del nivel puede desaparecer por completo.
Lo que ninguno de los modelos es
Opus 5 no es la cima de la pila de Claude, y vale la pena decirlo claramente en lugar de dejar que la cobertura de lanzamiento implique lo contrario. Fable 5 sigue siendo el modelo más capaz y ampliamente lanzado de Anthropic, a $10 / $50. Y Opus 5 todavía va por detrás de Mythos 5 en explotación de ciberseguridad e investigación biológica autónoma, lo cual es una declaración de Anthropic, no una crítica externa.
El encuadre preciso para Opus 5 es una capacidad de clase fronteriza a la mitad del precio fronterizo, con un techo nombrado por encima. Si su carga de trabajo se encuentra en ese techo, la comparación real no es en absoluto Opus 5 contra Sonnet 5; vea Opus 5 vs Fable 5 en su lugar.
Haga la comparación usted mismo en Apidog
Los benchmarks son la carga de trabajo de otra persona. La comparación que importa son sus prompts, sus herramientas, sus criterios de aceptación. Ambos modelos se encuentran detrás del mismo endpoint de Mensajes, por lo que probarlos uno contra otro es cuestión de cambiar una cadena.

Configúrelo en Apidog así:
- Cree una solicitud al endpoint de Mensajes de Anthropic y almacene la clave API como una variable de entorno en lugar de pegarla en el cuerpo.
- Guarde dos variantes que compartan el mismo prompt, una con
"model": "claude-opus-5"y otra con"model": "claude-sonnet-5". - Lea el objeto
usageen cada respuesta. Los recuentos reales de tokens de entrada, salida y en caché por modelo son la única entrada fiable para un modelo de costes. - Añada aserciones sobre la forma de la respuesta para que un rechazo o una respuesta truncada falle ruidosamente en lugar de silenciosamente.
- Repita la solicitud de Opus 5 con diferentes niveles de
output_config.efforty compare el coste con la calidad. Opus 5 por defecto eshigh, y sus niveleslowymediumson significativamente más fuertes que en modelos Opus anteriores, por lo que una revisión a menudo encuentra una configuración más económica que aún funciona. La guía del parámetro de esfuerzo cubre el método.
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-opus-5",
"max_tokens": 4096,
"messages": [
{"role": "user", "content": "Refactor this handler to use async I/O."}
]
}'
Dos consideraciones mientras prueba. El pensamiento adaptativo está activado por defecto en ambos modelos, y max_tokens limita el pensamiento más la respuesta en conjunto, por lo que un presupuesto que funcionaba en un modelo anterior puede truncar. Y en Opus 5, combinar thinking: {type: "disabled"} con un esfuerzo xhigh o max devuelve un error 400. Descargue Apidog para ejecutar el par lado a lado, y vea el tutorial de la API de Opus 5 para el flujo de solicitud completo.
Preguntas frecuentes
¿Vale Claude Opus 5 2.5 veces el precio de Sonnet 5? Para codificación agéntica de largo alcance, uso de computadoras y trabajo en el que es costoso equivocarse, sí. Para clasificación, extracción y chat de alto volumen, generalmente no. Y el múltiplo es solo 2.5x hasta el 1 de septiembre de 2026, después de lo cual la tarifa estándar de Sonnet 5 de $3 / $15 lo convierte en aproximadamente 1.67x.
¿Cuándo cambia el precio de Claude Sonnet 5? La tarifa introductoria de $2 / $10 se mantiene hasta el 31 de agosto de 2026. A partir del 1 de septiembre de 2026, pasará a $3 / $15. Opus 5 se mantiene en $5 / $25.
¿Opus 5 y Sonnet 5 tokenizan el texto de forma diferente? No. Ambos utilizan el tokenizador de generación 4.7, por lo que un texto idéntico produce recuentos de tokens de entrada idénticos y los precios por token se comparan directamente. El aumento de aproximadamente el 30% en los tokens que documenta Anthropic se mide contra Sonnet 4.6 y modelos anteriores, lo que importa si está actualizando desde uno de esos, no si está eligiendo entre estos dos. Compare el coste por tarea completada de todos modos, ya que la longitud de la salida y los reintentos influyen más en la factura que la diferencia de precio inicial.
¿Puedo cambiar entre Opus 5 y Sonnet 5 sin cambios en el código? En su mayoría sí. Ambos adoptan el pensamiento adaptativo por defecto y rechazan los parámetros de muestreo no predeterminados. Las diferencias a observar son los niveles de esfuerzo (Opus 5 expone un nivel max y por defecto es high) y el error 400 específico de Opus cuando el pensamiento se desactiva en xhigh o max.
¿Qué modelo recomienda Anthropic por defecto? La propia documentación de Anthropic ahora indica que debe comenzar con Claude Opus 5 si no está seguro. Eso es una recomendación, no un análisis de costes. Comience allí, luego mida si Sonnet 5 le da el mismo resultado por menos. La comparación anterior de Sonnet 5 vs Opus 4.8 sigue siendo un trasfondo útil sobre cómo se comportan los niveles entre sí.
Para las especificaciones completas, atribuciones de benchmarks y matriz de disponibilidad, comience en qué es Claude Opus 5, y lea la publicación de lanzamiento de Opus 5 y la visión general de modelos de Anthropic para las fuentes primarias.
