El precio de Claude Fable 5 comienza en $10 por millón de tokens de entrada y $50 por millón de tokens de salida en la API de Anthropic. Esa es toda la historia para la mayoría de las personas que solo quieren un número, pero el panorama completo tiene algunas partes móviles que vale la pena conocer antes de integrar el modelo en producción. Fable 5 se lanzó el 9 de junio de 2026, y Anthropic lo posiciona como un costo "menos de la mitad del precio de Claude Mythos Preview". Esta guía explica cada factor de costo: las tarifas de la API, lo que pagas en los planes Pro y Max, tres ejemplos prácticos con aritmética real, y cómo Fable 5 se compara con modelos más económicos como Claude Opus 4.8. Si solo necesitas una verificación rápida del costo, la siguiente sección la tiene.
TL;DR
Claude Fable 5 cuesta $10 por millón de tokens de entrada y $50 por millón de tokens de salida en la API. Desde el 9 de junio hasta el 22 de junio de 2026, está incluido gratis en los planes Pro, Max, Team y Enterprise basados en asientos. A partir del 23 de junio de 2026, el uso en esos planes consumirá créditos de uso medido a las mismas tarifas de tokens de $10/$50.
Precios de Claude Fable 5 de un vistazo
Aquí están los números principales en una tabla. La columna "por 1K tokens" es el mismo precio expresado en una unidad más pequeña, lo cual es útil cuando se calcula el costo de una sola solicitud.
| Tipo de token | Precio por 1M de tokens | Precio por 1K de tokens | Notas |
|---|---|---|---|
| Entrada | $10.00 | $0.01 | Todo lo que envías: prompt, mensaje del sistema, contexto, definiciones de herramientas |
| Salida | $50.00 | $0.05 | Todo lo que genera el modelo, incluyendo el razonamiento y las llamadas a herramientas |
El ID del modelo de la API es claude-fable-5. Los tokens de salida cuestan 5 veces más que los tokens de entrada, lo cual es normal para los modelos de vanguardia de Anthropic y da forma a la mayoría de los consejos de optimización posteriores en esta publicación. Puedes confirmar las tarifas actuales en cualquier momento en la página de precios de Anthropic y en la documentación de modelos y precios.
Lo que pagas en la API
Anthropic factura dos cosas por separado, y pagas por ambas.
Los tokens de entrada son todo lo que envías al modelo en una solicitud. Esto incluye el texto de tu prompt, el mensaje del sistema, cualquier conversación anterior que vuelvas a usar para el contexto, documentos recuperados y el JSON para cualquier herramienta que definas. Estos se contabilizan a $10 por millón, o un centavo por mil.

Los tokens de salida son todo lo que el modelo genera de vuelta. Esa es la respuesta visible más cualquier razonamiento interno que el modelo produzca y cualquier argumento de llamada a herramienta que escriba. Estos se contabilizan a $50 por millón, o cinco centavos por mil.
Así, una única solicitud que envía 2.000 tokens de entrada y recibe 600 tokens de salida te cuesta 2.000 tokens de entrada más 600 tokens de salida, facturados a sus tarifas separadas. No hay una tarifa plana por solicitud adicional. Tu factura es puramente la suma de los tokens de entrada y salida en cada llamada que realizas.
Anthropic describe Fable 5 como "menos de la mitad del precio de Claude Mythos Preview", que es el posicionamiento del modelo frente al nivel de vanguardia de vista previa anterior. El modelo hermano restringido, Claude Mythos 5, tiene la misma tarifa de entrada de $10 y salida de $50, por lo que cambiar entre ambos no modifica el costo por token. Si deseas el trasfondo conceptual del modelo en sí antes de presupuestarlo, qué es Claude Fable 5 cubre el lado de las capacidades.
Inclusión en el plan vs. créditos de uso
Los precios en la API son una cosa. Lo que pagas dentro de un plan de suscripción de Claude sigue un cronograma diferente, y las fechas importan.
Desde el 9 de junio hasta el 22 de junio de 2026, Claude Fable 5 está incluido sin costo adicional en los planes Pro, Max, Team y Enterprise basados en asientos. Durante esta ventana, puedes usar el modelo en esos planes sin que cuente para ningún saldo medido. Esta es una promoción de período de lanzamiento, no el estado permanente.
El 23 de junio de 2026, Fable 5 se elimina del conjunto incluido en esos planes. Después de esa fecha, el uso de Fable 5 en Pro, Max, Team o Enterprise basado en asientos consumirá créditos de uso, lo que significa que se medirá a las mismas tarifas de $10 de entrada y $50 de salida por millón de tokens que pagarías en la API pura. Anthropic ha dicho que planea restaurar cierto acceso estándar a los planes cuando la capacidad lo permita, por lo que el estado posterior al 23 de junio podría suavizarse más adelante, pero el comportamiento de créditos medidos es lo que debes presupuestar ahora mismo.
Los planes empresariales basados en el consumo son diferentes. Fable 5 está totalmente disponible desde el lanzamiento sin necesidad de preocuparse por la ventana de inclusión, ya que esos planes facturan por uso desde el principio. Si tu pregunta de acceso es más amplia que la facturación, cómo acceder a Claude Fable 5 describe cada punto de entrada.
La conclusión práctica: si estás desarrollando prototipos en un puesto Pro o Max esta semana, tienes rienda suelta hasta el 22 de junio. Planifica tus experimentos más pesados en consecuencia, y si esperas un tráfico de producción sostenido, modela tus costos según las tarifas de la API de $10/$50 en lugar de la ventana gratuita, porque ese será tu estado final.
Ejemplos prácticos: cuánto cuesta una carga de trabajo real
Los números por millón de tokens son abstractos. Aquí hay tres cargas de trabajo concretas con la aritmética desglosada, para que puedas mapear tu propio uso en ellas.
La fórmula es la misma siempre: (tokens de entrada / 1,000,000) * $10 más (tokens de salida / 1,000,000) * $50.
Ejemplo 1: un turno de chatbot de soporte
Un turno típico de soporte al cliente lleva algunas instrucciones del sistema y un breve historial de conversación, luego devuelve una respuesta enfocada. Digamos 1.500 tokens de entrada y 500 tokens de salida.
- Entrada: 1,500 / 1,000,000 * $10 = $0.015
- Salida: 500 / 1,000,000 * $50 = $0.025
- Total: $0.04 por turno
Cuatro centavos por turno. Si ese chatbot maneja 1,000 turnos al día, estás hablando de aproximadamente $40/día, o alrededor de $1,200/mes, antes de cualquiera de los factores de costo de la siguiente sección. Eso es una verificación útil: las cargas de trabajo de estilo chat en Fable 5 siguen siendo baratas por llamada, pero se suman en volumen.
Ejemplo 2: una solicitud de generación de código
La generación de código suele enviar más contexto: el archivo que estás editando, fragmentos relacionados e instrucciones. Digamos 8.000 tokens de entrada y 3.000 tokens de salida para una función generada sustancial con explicación.
- Entrada: 8,000 / 1,000,000 * $10 = $0.08
- Salida: 3,000 / 1,000,000 * $50 = $0.15
- Total: $0.23 por solicitud
Observa que, aunque enviaste casi 3 veces más entrada que salida, la salida sigue dominando la factura con $0.15 de los $0.23. Esa relación de precios de salida a entrada de 5:1 es la razón por la que recortar generaciones prolijas ahorra dinero real.
Ejemplo 3: una ejecución de agente de largo horizonte
Las ejecuciones de agentes que leen grandes bases de código o documentos y dan muchos pasos aumentan mucho la entrada. Digamos 300,000 tokens de entrada (mucho contexto recuperado reproducido a lo largo de los pasos) y 50,000 tokens de salida.
- Entrada: 300,000 / 1,000,000 * $10 = $3.00
- Salida: 50,000 / 1,000,000 * $50 = $2.50
- Total: $5.50 por ejecución
Una única ejecución profunda de un agente cuesta alrededor de cinco dólares y medio. Si lo ejecutas 200 veces al día en un equipo, estás en $1,100/día. Este es exactamente el tipo de carga de trabajo donde el almacenamiento en caché de prompts vale la pena, porque los agentes reproducen el mismo contexto grande repetidamente. Cuantificaremos eso a continuación.
Cómo reducir tu factura de Claude Fable 5
Una vez que hayas decidido que Fable 5 es el modelo adecuado, estas son las características estándar de la API de Anthropic que reducen el costo. Ninguna de ellas requiere acceso especial.
- Almacenamiento en caché de prompts. Las lecturas de caché cuestan aproximadamente 0.1x el precio de entrada, por lo que la entrada en caché cuesta alrededor de $1 por millón en lugar de $10. Las escrituras en caché cuestan aproximadamente 1.25x la entrada (alrededor de $12.50 por millón para un TTL de 5 minutos), por lo que el almacenamiento en caché vale la pena cuando reutilizas el mismo contexto en muchas solicitudes. Toma la ejecución del agente del Ejemplo 3: si 250,000 de los 300,000 tokens de entrada son contexto estable servido desde la caché, esa entrada baja de $3.00 a aproximadamente $0.25 (250K lecturas en caché a $1/M = $0.25, más 50K de entrada nueva a $10/M = $0.50). La ejecución completa cae de $5.50 a aproximadamente $3.25. Para agentes y chatbots que reproducen un prompt de sistema grande, el almacenamiento en caché es el cambio de costo más grande que puedes hacer.
- API de lotes. Para trabajos que no necesitan una respuesta inmediata, como el procesamiento de documentos durante la noche o la clasificación masiva, la API de lotes funciona con un descuento de aproximadamente el 50%. Eso convierte las tarifas de $10/$50 en aproximadamente $5/$25, que es un precio de nivel Opus para una salida de nivel Fable. Si tu trabajo tolera un retraso, esto es casi dinero gratis.
- Ajusta el tamaño del modelo. No todas las solicitudes necesitan Fable 5. Dirige el razonamiento difícil y novedoso a Fable y envía el tráfico rutinario a Opus 4.8, Sonnet 4.6 o Haiku 4.5. Un enrutador escalonado que envía el 80% de las llamadas a un modelo más barato puede reducir una factura en más de la mitad por sí solo.
- Recorta max_tokens. La salida es el lado caro a $50 por millón. Establece
max_tokensa lo que la tarea realmente necesita en lugar de dejarlo abierto, y pide respuestas concisas en el prompt. Cortar una generación de 3,000 tokens a 1,500 tokens reduce a la mitad el costo de salida de esa llamada. - Transmite respuestas. La transmisión no cambia el precio por token, pero te permite detener la generación antes una vez que tienes lo que necesitas, y mejora la latencia percibida, por lo que estás menos tentado a solicitar en exceso. Combinado con un
max_tokensajustado, mantiene el gasto de salida honesto.
Rastrea el gasto de Claude Fable 5 con Apidog
La forma más limpia de mantener visibles los costos de los tokens mientras construyes es observarlos en cada solicitud, no al final del mes cuando llega la factura. Apidog es un cliente de API que puedes usar para enviar solicitudes a la API de Anthropic e inspeccionar exactamente lo que regresa.

Cuando llamas a claude-fable-5 a través de Apidog, el cuerpo de la respuesta incluye un objeto usage con input_tokens y output_tokens para esa solicitud. La lectura de esos dos números te indica el costo preciso de la llamada: multiplica los tokens de entrada por $0.00001 y los tokens de salida por $0.00005, súmalos, y tendrás la factura de esa solicitud hasta la fracción de un centavo. Hacer esto mientras iteras en los prompts te muestra inmediatamente cuándo un cambio dispara tu recuento de tokens, mucho antes de que aparezca en producción.
Un flujo de trabajo práctico: configura la solicitud de finalización de chat de Anthropic en Apidog, guarda algunos prompts representativos como ejemplos y compara los números de usage entre las variaciones de prompt. Verás rápidamente qué ediciones de mensajes del sistema añaden cientos de tokens de entrada y qué cambios de formato de respuesta inflan la salida. Esa retroalimentación es difícil de obtener solo desde el panel de control. Descarga Apidog para configurarlo y combínalo con la guía de la API de Claude Fable 5 para la estructura de la solicitud. Si estás siguiendo de cerca el presupuesto, cómo usar Claude Fable 5 gratis cubre las rutas sin costo durante la ventana de inclusión.
Apidog también mantiene un historial de solicitudes, por lo que puedes revisar llamadas anteriores y sus recuentos de tokens al estimar el costo de una nueva característica. Tratar a Apidog como tu capa de inspección de costos durante el desarrollo significa que no habrá sorpresas con los tokens cuando el tráfico aumente.
El precio de Claude Fable 5 se reduce a un par de números simples, $10 de entrada y $50 de salida por millón de tokens, con una ventana de plan gratuito hasta el 22 de junio y créditos medidos después del 23 de junio. El resto es matemática de carga de trabajo y algunos factores de costo: almacena en caché tu contexto estable, agrupa lo que no sea urgente y baja a Opus 4.8 o Sonnet 4.6 cuando la tarea no necesite el nivel de vanguardia. Tu siguiente paso es conectar una sola solicitud de claude-fable-5 y leer el objeto usage para que tus estimaciones se basen en recuentos reales de tokens. Descarga Apidog para enviar esa primera solicitud y observar el costo en tiempo real.
