Anthropic lanzó Claude Opus 5 el 24 de julio de 2026, y la respuesta honesta a "¿puedo usarlo gratis?" tiene dos partes. A través de las aplicaciones Claude, sí, si tienes una suscripción de pago: Opus 5 es el nuevo modelo predeterminado para los suscriptores Max y el modelo de mayor rendimiento disponible para los usuarios Pro. A través de la API, no. No existe una ruta API gratuita ilimitada para claude-opus-5, y cualquiera que te diga lo contrario está tratando de venderte algo.
Eso no son malas noticias, porque la mitad más barata de este artículo es donde está el verdadero ahorro. Opus 5 cuesta $5 por millón de tokens de entrada y $25 por millón de tokens de salida, lo mismo que Opus 4.8 y la mitad de los $10 / $50 de Fable 5. Además de esa tarifa base, existen varias palancas legítimas que pueden reducir una factura real en más de la mitad. Esta guía cubre primero las rutas gratuitas honestas, luego el camino de pago más económico. Cuando empieces a llamar a la API, Apidog es donde envías, guardas y comparas esas solicitudes.
Para la imagen completa de las especificaciones, consulta qué es Claude Opus 5. La publicación de lanzamiento de Opus 5 de Anthropic tiene el anuncio, y la descripción general de los modelos contiene la tabla de ID y disponibilidad. Una distinción a tener en cuenta en todo momento: "gratis" dentro de las aplicaciones Claude significa que tu suscripción lo cubre, sujeto a límites de uso. "Gratis" a través de la API significa créditos de prueba o promocionales con un saldo que disminuye y luego se agota.
Ruta gratuita 1: Niveles de suscripción de Claude
Los materiales de lanzamiento de Anthropic nombran dos niveles de consumidor para Opus 5:
- Max. Opus 5 se convierte en el modelo predeterminado. Lo obtienes sin cambiar nada.
- Pro. Opus 5 es ahora el modelo de mayor rendimiento disponible en el plan. Ese es el cambio notable: el nivel superior de Opus solía estar por encima de Pro, y ahora no lo está.
Esos materiales no nombran el plan gratuito de Claude como una superficie de Opus 5, así que trata el acceso del plan gratuito como no confirmado en lugar de asumir que funciona. [VERIFICAR] Comprueba tu selector de modelos antes de planificar en torno a él.
Opus 5 también está en Claude Code, Claude Cowork y GitHub Copilot, por lo que una suscripción que ya pagas puede incluirlo. El uso allí se mide, y Opus 5 tiene hábitos que agotan el saldo más rápido que 4.8: el pensamiento está activado por defecto, las respuestas son más largas y el modelo delega en subagentes con más facilidad. Cómo usar Claude Opus 5 en Claude Code cubre cómo controlarlo, y cómo usar Claude Opus 4.8 gratis tiene las rutas equivalentes para la generación anterior.
Ruta gratuita 2: Prueba de API y créditos promocionales en la nube
El ID del modelo en la API de Claude es exactamente claude-opus-5, sin sufijo de fecha. La API es de pago por uso, pero dos rutas honestas te permiten empezar sin pagar por adelantado.
- Créditos para nuevas cuentas de la API de Anthropic. Las cuentas nuevas suelen comenzar con un pequeño saldo de créditos, suficiente para confirmar que tu integración funciona y medir los recuentos de tokens reales antes de asociar una tarjeta.
- Créditos promocionales de la plataforma en la nube. Opus 5 está en Amazon Bedrock (como
anthropic.claude-opus-5), Claude Platform en AWS, Google Cloud y Microsoft Foundry. Las cuentas nuevas allí a menudo incluyen créditos promocionales que puedes gastar en el uso de Claude. Lee directamente la oferta actual de cada plataforma; los montos y los términos cambian con la suficiente frecuencia como para que cualquier número impreso aquí quede obsoleto.
Gasta esos créditos en mediciones, no en tráfico de producción. Ejecuta tus avisos reales, registra el bloque usage de cada respuesta, y sabrás tu costo por tarea antes de comprometerte. La documentación de precios de Anthropic tiene la tabla de tarifas actual.
Una advertencia es más importante en Opus 5 que en cualquier modelo anterior: el pensamiento está activado por defecto ahora. En Opus 4.8, una solicitud sin el campo thinking se ejecutaba sin pensar. En Opus 5, la misma solicitud ejecuta un pensamiento adaptativo, y los tokens de pensamiento se facturan como salida a $25 por millón. Un conjunto de pruebas trasladado de 4.8 sin cambios agotará los créditos de prueba más rápido de lo que lo hizo el mes pasado. La lista completa de estas trampas está en migrando de Opus 4.8 a Opus 5.
No hay una ruta API gratuita ilimitada
Vale la pena decirlo claramente, porque esta pregunta atrae respuestas deshonestas. Ningún nivel gratuito de la API de Claude te da llamadas claude-opus-5 sin límite, y ningún proxy, pool de claves o revendedor garantiza legítimamente el acceso gratuito a modelos de frontera. Esos esquemas violan los términos de Anthropic, son revocados y dirigen tus solicitudes a una infraestructura que no controlas. Una vez que tus créditos de prueba o promocionales se agotan, pagas por token o te detienes. El resto de este artículo trata sobre cómo pagar lo menos posible.
La ruta de pago más económica
La tarifa base es de $5 por entrada y $25 por salida por millón de tokens. Aquí se explica qué es lo que realmente mueve esa cifra, aproximadamente en orden de impacto.
Palanca 1: la API por lotes, 50% de descuento
Cualquier cosa que no necesite una respuesta en los próximos segundos debería pasar por la API por lotes. Se ejecuta de forma asíncrona y cuesta $2.50 de entrada / $12.50 de salida por millón de tokens, exactamente la mitad de las tarifas estándar. No hay diferencia de calidad; el mismo modelo ejecuta la misma solicitud.
Esto se adapta a más cargas de trabajo de lo que la gente espera: ejecuciones de evaluación nocturnas, procesamiento masivo de documentos, clasificación de rellenos, suites de regresión, pipelines de contenido. La API por lotes también admite hasta 300,000 tokens de salida por solicitud con el encabezado beta output-300k-2026-03-24, frente a los 128,000 de la API estándar de Mensajes, por lo que la generación de formato largo es más barata y menos restringida allí. La desventaja es la latencia, además de una nota de compatibilidad: el modo rápido no funciona con la API por lotes.
Palanca 2: esfuerzo low, la verdadera palanca de costes ahora
Opus 5 expone output_config.effort, que es a lo que se refería la prensa con un "selector entre coste y capacidad". Por defecto, es high. Un esfuerzo más bajo significa menos tokens de pensamiento, y los tokens de pensamiento se facturan a la tarifa de salida, por lo que el esfuerzo se relaciona casi directamente con el gasto.
Lo que cambió con Opus 5 es que los niveles fueron recalibrados. Anthropic dice que low y medium son significativamente más fuertes aquí que en los modelos Opus anteriores, lo que es la primera vez que bajar a low es una opción seria en lugar de una degradación. Si mantuviste la configuración de esfuerzo de 4.8, realiza una nueva revisión de tus propias evaluaciones. Dos notas prácticas:
- Reducir el esfuerzo recorta el pensamiento, no la longitud de la salida visible. Las respuestas de Opus 5 son más largas que las de 4.8, independientemente del esfuerzo. Si quieres respuestas más cortas, pídelas explícitamente en el prompt. Eso es un ahorro aparte.
- No desactives el pensamiento para ahorrar dinero. Combinar
thinking: {type: "disabled"}con un esfuerzoxhighomaxdevuelve un error 400 directamente. La propia guía de prompts de Anthropic para Opus 5 es mantener el pensamiento activado y controlar el costo con un esfuerzo menor en su lugar, porque el pensamiento desactivado ocasionalmente produce llamadas a herramientas escritas como texto plano y etiquetas XML internas que se filtran en la salida visible.
El desglose completo de los cinco niveles se encuentra en el parámetro de esfuerzo de Claude Opus 5.
Palanca 3: Almacenamiento en caché de prompts, ahora desde 512 tokens
Los aciertos de caché cuestan $0.50 por millón de tokens, una décima parte de la tarifa de entrada estándar. Una escritura en caché de 5 minutos cuesta $6.25 por millón; una escritura de 1 hora cuesta $10 por millón.
El cambio de Opus 5 que merece la pena aplicar: el prefijo mínimo cacheable se redujo a 512 tokens, frente a los 1.024 de Opus 4.8. Los prompts que antes eran demasiado cortos para cachear, ahora se cachean sin necesidad de cambios en el código, más allá de añadir el punto de interrupción.
La matemática se amortiza inmediatamente. Toma una solicitud con un prefijo estable de 40.000 tokens (prompt del sistema más documentos de referencia) y 10.000 tokens de entrada variable:
- Sin caché: 50.000 tokens de entrada a $5 por millón son $0.25.
- Escritura en caché: el prefijo de 40.000 tokens a $6.25 por millón es $0.25, frente a $0.20 sin caché, por lo que la escritura cuesta cinco centavos extra, una sola vez.
- Cada acierto posterior: 40.000 tokens almacenados en caché a $0.50 por millón son $0.02, más 10.000 tokens nuevos a $0.05. La entrada baja de $0.25 a $0.07.
El primer acierto ya paga la escritura. Confirma que funciona leyendo cache_read_input_tokens en el bloque usage de la respuesta.
Palanca 4: omitir el modo rápido
El modo rápido cuesta $10 de entrada / $50 de salida por millón de tokens, exactamente el doble de la tarifa base, a cambio de una velocidad de salida aproximadamente 2.5 veces mayor. Es una vista previa de investigación, solo API de primera parte (no en Bedrock, Google Cloud o Microsoft Foundry), y no está disponible con la API por lotes. Si estás optimizando el costo, esto es lo más fácil de desactivar. Paga el doble solo para interfaces interactivas donde un usuario está viendo aparecer los tokens.
Palanca 5: deja inference_geo en paz a menos que lo necesites
Configurar inference_geo: "us" aplica un multiplicador de 1.1x en cada categoría de tokens, un recargo del 10% sobre la factura total. Existe por requisitos de residencia de datos; si no tienes uno, no lo configures.
Una victoria menor: la sobrecarga del prompt del sistema de uso de herramientas de Opus 5 es de 286 tokens con tool_choice configurado en auto o none, por debajo de los 290 de Opus 4.8 y muy por debajo de los 675 de Opus 4.7. No es una palanca que se accione, pero migrar desde 4.7 reduce su umbral por solicitud por sí mismo. Para ahorros que se aplican a toda la línea de Claude, reduce tu factura de la API de Claude abarca más.
Comparativa de costes de un vistazo
| Configuración | Entrada / MTok | Salida / MTok | Ideal para |
|---|---|---|---|
Estándar, esfuerzo high |
$5.00 | $25.00 | Valor predeterminado interactivo |
| API por lotes | $2.50 | $12.50 | Cualquier cosa asíncrona |
| Aciertos de caché en un prefijo estable | $0.50 | n/a | Llamadas repetidas de contexto largo |
| Modo rápido | $10.00 | $50.00 | Solo crítico para la latencia |
inference_geo: "us" |
1.1x todas las categorías | 1.1x todas las categorías | Requisitos de residencia de datos |
El descuento del 50% por lotes se aplica a las tarifas estándar de los tokens; verifica en tu propia factura cómo interactúa con las tarifas de los tokens en caché antes de modelar un ahorro combinado. Ejemplos completos y resueltos se encuentran en precios de Claude Opus 5.
Probando las rutas baratas en Apidog
Cada palanca mencionada anteriormente es verificable en una única respuesta HTTP, lo que convierte a un cliente API en la forma más rápida de confirmar que realmente estás ahorrando dinero. Aquí hay una llamada base de Opus 5:
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-opus-5",
"max_tokens": 4096,
"output_config": {"effort": "low"},
"messages": [
{"role": "user", "content": "Summarize this OpenAPI spec in three sentences."}
]
}'
En Apidog, construye eso como una solicitud POST guardada con tu clave almacenada como una variable de entorno en lugar de pegarla en el cuerpo, para que nunca se confirme. Luego:
- Compara los niveles de esfuerzo lado a lado. Duplica la solicitud, cambia
effortalow,mediumyhigh, y leeusage.output_tokensen cada una. Verás la diferencia de costo directamente en lugar de adivinar. - Confirma los aciertos de caché. Envía la misma solicitud de prefijo largo dos veces y verifica que
cache_read_input_tokensno sea cero en la segunda llamada. Si permanece en cero, tu punto de interrupción está en el lugar equivocado. - Observa el truncamiento de
max_tokens. El pensamiento y la respuesta ahora comparten el presupuesto demax_tokens, por lo questop_reason: "max_tokens"significa que pagaste por una salida que nunca pudiste usar. Agrega una aserción para ello. - Inspecciona el streaming y las llamadas a herramientas. Las respuestas SSE y las cargas útiles de las llamadas a herramientas son legibles por completo, lo que importa cuando un bucle agéntico está gastando más de lo esperado.
Descarga Apidog para seguir el proceso, y consulta cómo usar la API de Claude Opus 5 para ver el tutorial de integración completo.
¿Es Opus 5 el modelo adecuado para optimizar?
A veces, el camino más barato es un modelo diferente. Sonnet 5 funciona a tarifas introductorias de $2 / $10, aumentando a $3 / $15 el 1 de septiembre de 2026, y comparte la misma ventana de contexto de 1M de tokens. Si tu carga de trabajo no es de codificación agéntica o de razonamiento complejo de varios pasos, prueba esa brecha antes de optimizar la factura de Opus 5. Claude Opus 5 vs Sonnet 5 explica dónde se justifica la prima, y cómo usar Claude Sonnet 5 gratis cubre las rutas gratuitas de Sonnet.
También hay que tener claro qué es lo que se obtiene con la prima. Las afirmaciones de Anthropic sitúan a Opus 5 en más del doble de la puntuación de Frontier-Bench de Opus 4.8, dentro del 0.5% de Fable 5 en CursorBench 3.2 a la mitad de precio, y por delante de Fable 5 en OSWorld 2.0 a un tercio del coste. Estas son cifras publicadas por Anthropic, no reproducidas de forma independiente a 25 de julio de 2026. Trátalas como afirmaciones a probar.
Opus 5 tampoco es la cima de la pila de Claude. Fable 5 sigue siendo el modelo más capaz de Anthropic ampliamente lanzado, y Opus 5 todavía va a la zaga de Mythos 5 en explotación de ciberseguridad e investigación autónoma en biología. La formulación honesta es capacidad de clase fronteriza a la mitad del precio fronterizo, con un techo nombrado por encima. Consulta qué es Claude Fable 5 si tu carga de trabajo se encuentra cerca de ese techo.
Qué camino te conviene
| Objetivo | Ruta | El inconveniente |
|---|---|---|
| Chat, escritura, investigación | Suscripción Claude Pro o Max | Límites medidos; Opus 5 los consume más rápido que 4.8 |
| Codificación agéntica | Claude Code en un plan de pago | Los valores predeterminados más largos y la delegación de subagentes consumen el saldo |
| Prototipar una integración | Créditos de prueba de API o promocionales en la nube | El saldo se agota, luego se paga por token |
| API de producción más económica | Lotes más caché más esfuerzo low |
Los lotes añaden latencia; la caché necesita un prefijo estable |
| API interactiva más económica | Tarifas estándar, caché, esfuerzo por tarea | No hay descuento por lotes disponible |
Preguntas frecuentes
¿Es Claude Opus 5 gratis? No a través de la API. A través de las aplicaciones de Claude, viene con suscripciones de pago: por defecto para Max, y el modelo de mayor rendimiento disponible para Pro. Los materiales de lanzamiento de Anthropic no nombran el plan gratuito como una superficie de Opus 5.
¿Puedo obtener acceso gratuito a la API de Claude Opus 5? Solo a través de créditos de prueba de nuevas cuentas o créditos promocionales en Amazon Bedrock, Google Cloud o Microsoft Foundry, todos los cuales tienen un saldo limitado. No existe un nivel de API gratuito ilimitado, y ningún tercero legítimo puede concederlo.
¿Cuál es la forma legítima más económica de ejecutar Opus 5 en volumen? La API por lotes a $2.50 / $12.50, más el almacenamiento en caché de prompts en cualquier prefijo estable de más de 512 tokens, más el esfuerzo low o medium donde tus evaluaciones lo permitan. Deja el modo rápido desactivado y no configures inference_geo sin un requisito de residencia.
¿Debo deshabilitar el pensamiento para ahorrar tokens? No. La combinación de pensamiento deshabilitado con un esfuerzo xhigh o max devuelve un error 400, y la guía de Anthropic es mantener el pensamiento activado y reducir el esfuerzo en su lugar. Con el pensamiento deshabilitado, Opus 5 ocasionalmente escribe llamadas a herramientas como texto plano que nunca se ejecutan y filtra etiquetas XML internas en la salida visible. Verifica lo que tus configuraciones realmente cuestan leyendo el bloque usage; una solicitud guardada en Apidog con una aserción sobre esos campos detecta regresiones automáticamente.
