Claude Fable 5.1 Precios: El desglose completo de costos (2026)

Precios de Claude Fable 5.1: $10/$50 por MTok, $0.25 por lecturas de caché (75% por debajo de Fable 5), tarifas por lotes y los cálculos de costos detallados que respaldan las afirmaciones de ahorro del 25% y 45%.

INEZA Felin-Michel

INEZA Felin-Michel

2 September 2026

Claude Fable 5.1 Precios: El desglose completo de costos (2026)

Apidog para empresas

Despliegue local

SSO & RBAC

Conforme con SOC 2

Explorar Apidog Enterprise

Claude Fable 5.1 cuesta $10 por millón de tokens de entrada y $50 por millón de tokens de salida, exactamente lo que cobraba Fable 5. El número que cambió son las lecturas de caché de prompt: $0.25 por millón de tokens, una reducción de $1 con Fable 5 y la mitad de los $0.50 de Opus 5. Anthropic estima que esto hace que las cargas de trabajo típicas sean aproximadamente un 25% más baratas que con Fable 5 y las altamente basadas en agentes hasta un 45% más baratas.

Esta guía detalla cada tarifa en la página oficial de precios, reproduce las afirmaciones del 25% y 45% para que pueda aplicar su propia proporción de aciertos de caché, presenta tres ejemplos reales de costo por tarea y enumera las palancas que afectan la factura. Si desea una descripción general del modelo primero, lea qué es Claude Fable 5.1.

Tabla de precios de Claude Fable 5.1

Tarifa Claude Fable 5.1
Entrada base $10 por millón de tokens
Salida $50 por millón de tokens
Escritura de caché de 5 minutos $12.50 por millón (1.25x entrada)
Escritura de caché de 1 hora $20 por millón (2x entrada)
Lectura de caché (acierto o actualización) $0.25 por millón (0.025x entrada)
Entrada API por lotes $5 por millón
Salida API por lotes $25 por millón
Premium por contexto largo Ninguno; la ventana completa de 1M se factura a tarifas estándar
inference_geo: "us" 1.1x en cada categoría de token
Modo rápido No disponible (solo Opus 5 y Opus 4.8)
Nivel de prioridad No compatible
Búsqueda web $10 por 1,000 búsquedas, más tokens

Claude Mythos 5.1 tiene las mismas tarifas. El descuento por lotes y los multiplicadores de caché se apilan, por lo que una lectura de caché por lotes cuesta $0.125 por millón.

Comparación del precio de lectura de caché

Modelo Entrada base Lectura de caché Lectura de caché como porcentaje de la entrada
Claude Fable 5.1 $10 $0.25 2.5%
Claude Fable 5 $10 $1.00 10%
Claude Opus 5 $5 $0.50 10%
Claude Opus 4.8 $5 $0.50 10%
Claude Sonnet 5 $2 $0.20 10%
Claude Haiku 4.5 $1 $0.10 10%

Todos los demás modelos de Claude valoran un acierto de caché en el 10% de la entrada base. Fable 5.1 lo valora en el 2.5%. El efecto práctico: un acierto de caché de Fable 5.1 es más barato que un acierto de caché de Opus 5, aunque la entrada no almacenada en caché de Fable 5.1 sea el doble de cara. Para una carga de trabajo donde la mayoría de los tokens de entrada son prefijos almacenados en caché, la tasa de entrada efectiva en Fable 5.1 puede caer por debajo de la de Opus 5.

Una nota sobre Sonnet 5, ya que la comparación Opus 5 vs Sonnet 5 había señalado un aumento de precio en septiembre: Anthropic lo canceló. Sonnet 5 se mantiene en $2 y $10.

Reproducción de las afirmaciones del 25% y 45%

Anthropic no publicó la combinación de cargas de trabajo detrás de esas estimaciones, por lo que esto debe considerarse como una reconstrucción que muestra la relación de aciertos de caché que implican, no como su modelo exacto.

Sea una solicitud con U tokens de entrada no almacenados en caché, C tokens de entrada almacenados en caché y O tokens de salida. El costo por millón en Fable 5 es 10U + 1.0C + 50O; en Fable 5.1 es 10U + 0.25C + 50O. El ahorro es 0.75C, y el ahorro porcentual es 0.75C / (10U + C + 50O).

Una carga de trabajo típica estilo chat. Digamos 20,000 tokens en caché, 2,000 tokens de entrada no almacenados en caché y 1,500 tokens de salida por solicitud. Fable 5: 10(0.002) + 1.0(0.02) + 50(0.0015) = $0.02 + $0.02 + $0.075 = $0.115. Fable 5.1: $0.02 + $0.005 + $0.075 = $0.100. Ahorro: 13%. Para alcanzar el 25% de Anthropic, la proporción en caché tiene que ser mayor en relación con la salida, por ejemplo, 60,000 tokens en caché frente a los mismos 1,500 tokens de salida, lo que da $0.155 frente a $0.110, un ahorro del 29%.

Un bucle basado en agentes. Un agente que relee un prefijo de 150,000 tokens almacenados en caché en cada uno de 40 turnos de llamadas a herramientas, añade 1,000 tokens no almacenados en caché por turno y produce 800 tokens de salida por turno. Por turno en Fable 5: 10(0.001) + 1.0(0.15) + 50(0.0008) = $0.01 + $0.15 + $0.04 = $0.20. En Fable 5.1: $0.01 + $0.0375 + $0.04 = $0.0875. Ahorro: 56% por turno, antes de la escritura única en caché. En 40 turnos eso es $8.00 frente a $3.50. El "hasta 45%" de Anthropic se encuentra cómodamente dentro de este rango una vez que se añaden las escrituras de caché y los turnos sin caché que tiene todo agente real.

La regla que se desprende: el ahorro escala con la relación de entrada en caché a salida. Las cargas de trabajo que son intensivas en salida (generaciones largas a partir de prompts cortos) apenas notan el cambio. Las cargas de trabajo que son intensivas en prefijos (agentes, RAG con un contexto estable grande, bots de soporte multi-turno) ven el efecto completo.

Tres ejemplos resueltos de costo por tarea

Los tres ejemplos asumen Fable 5.1 a las tarifas estándar, con la escritura de caché de 5 minutos pagada una sola vez.

1. Una única revisión de código. 30,000 tokens de entrada (el diff más un prompt del sistema), 4,000 tokens de salida, sin caché. Entrada $0.30, salida $0.20. Total: $0.50. La misma revisión en Opus 5 cuesta $0.25. Este es el caso en que Fable 5.1 es simplemente el doble de caro, porque nada está en caché.

2. Una conversación de soporte de 25 turnos. Un prompt del sistema estable de 12,000 tokens almacenado en caché una vez ($0.15 por la escritura), luego 25 turnos, cada uno añadiendo 300 tokens de entrada no almacenados en caché y 250 tokens de salida, con el prefijo servido desde la caché. Entrada no almacenada en caché a lo largo de la conversación: 7,500 tokens = $0.075. Lecturas de caché: 25 x 12,000 = 300,000 tokens = $0.075. Salida: 6,250 tokens = $0.3125. Total: aproximadamente $0.61. En Fable 5, solo las lecturas de caché costarían $0.30, para un total cercano a $0.84.

3. Una construcción basada en agentes de dos horas. 120 turnos de llamadas a herramientas contra un prefijo que crece de 20,000 a 200,000 tokens (promedio 110,000 en caché), 1,500 tokens no almacenados en caché por turno, 1,200 tokens de salida por turno y aproximadamente seis actualizaciones de caché a medida que crece el prefijo. Lecturas de caché: 120 x 110,000 = 13.2M tokens = $3.30. Entrada no almacenada en caché: 180,000 tokens = $1.80. Salida: 144,000 tokens = $7.20. Escrituras de caché: aproximadamente 660,000 tokens a $12.50 = $8.25. Total: aproximadamente $20.55. En Fable 5, las lecturas de caché costarían $13.20 en lugar de $3.30, para un total cercano a $30.45. Eso es un ahorro del 33% en una ejecución donde la salida sigue siendo el elemento de mayor costo.

Observe en el ejemplo 3 que las escrituras de caché son ahora el segundo costo más grande. Esa es la otra cara de las lecturas baratas: un fallo es 40 veces un acierto, por lo que cualquier cosa que reinicie la caché a mitad de sesión (reconstruir el prompt del sistema, editar un turno anterior, cambiar el array de herramientas) cuesta mucho más en relación con el estado estacionario de lo que lo hacía en Fable 5.

Las palancas que afectan la factura

Esfuerzo. output_config.effort es la palanca individual más grande en los tokens de salida, y la salida cuesta $50 por millón. La guía de Anthropic para Fable 5.1 es comenzar en high, y su afirmación es que medium iguala aproximadamente la calidad de Fable 5 a un costo menor, mientras que low a menudo es competitivo con Opus y Sonnet en costo por tarea. Realice la evaluación en sus propias pruebas. La versión beta de esfuerzo por mensaje le permite bajar a low para turnos rutinarios y subirlo para los difíciles sin reiniciar la caché.

Mantener la caché caliente. El almacenamiento en caché de prompts es el descuento. Con lecturas a $0.25 y escrituras a $12.50, el punto de equilibrio para el TTL de 5 minutos es un acierto. Para los lapsos de inactividad entre cinco y sesenta minutos, un reenvío de max_tokens: 0 de mantenimiento de actividad con el TTL de 5 minutos suele ser más barato que pagar la escritura 2x para el TTL de 1 hora. Y la misma disciplina de solo añadir que preserva los bloques de pensamiento en este modelo, preserva la caché: nunca reconstruya system o tools a mitad de sesión, use mensajes del sistema a mitad de conversación para los cambios, y use mensajes con alcance de turno para los recordatorios por turno.

Procese por lotes lo que pueda esperar. La API por lotes reduce todo a la mitad, por lo que una solicitud por lotes de Fable 5.1 cuesta $5 y $25, lo mismo que el precio síncrono de Opus 5. Las evaluaciones, las recargas y el procesamiento nocturno de documentos pertenecen aquí. Tenga en cuenta que fallbacks se rechaza en los lotes, por lo que los elementos rechazados necesitan un reenvío manual.

Elija el nivel por ruta. La propia documentación de Anthropic dice que debe empezar con Opus 5 y pasar a Fable 5.1 cuando Opus 5 con mayor esfuerzo aún no sea suficiente. Para las rutas donde Opus 5 pasa sus evaluaciones, está pagando el doble por nada. La comparación Fable 5.1 vs Opus 5 detalla la decisión por carga de trabajo.

Vigile el overhead de las herramientas. Cada solicitud con herramientas lleva un prompt del sistema de uso de herramientas oculto. Anthropic publica el recuento para Opus 5 (286 tokens) pero aún no ha publicado una cifra para Fable 5.1, así que mírelo con el endpoint de conteo de tokens. Un conjunto de herramientas de navegador añade alrededor de 6,600 tokens por solicitud y el conjunto de herramientas de computadora unos 4,500, todos almacenados en caché después del primer envío.

Las negativas son gratuitas, los reintentos no. Una negativa del clasificador antes de cualquier salida no se factura. Un fallback del lado del servidor factura las tarifas del modelo de fallback para el reintento, y el crédito de fallback de Anthropic reembolsa el costo de caché del cambio. Instrumente las negativas como su propia métrica para saber cuánto de su gasto en Fable 5.1 está siendo atendido por Opus 5.

La mayoría de las técnicas generales de nuestra guía para reducir la factura de la API de Claude siguen siendo aplicables, con el cálculo de lectura de caché a favor de Fable 5.1.

Lo que no puede comprar en Fable 5.1

El modo rápido solo está disponible para Opus 5 y Opus 4.8, a $10 y $50. No hay forma de pagar por una salida más rápida de Fable 5.1. El nivel de prioridad no es compatible con Fable 5.1 o Mythos 5.1, mientras que Fable 5 lo mantiene, por lo que la planificación de capacidad empresarial que depende de él debe permanecer en Fable 5 o pasar a Opus 5. Y la retención cero de datos no está disponible a menos que Anthropic lo autorice expresamente; una organización ZDR recibe un error 400 en cada solicitud.

Verificando su gasto real en Apidog

La única forma fiable de saber cuánto cuesta una solicitud es el objeto usage, y la forma más rápida de leerlo es una colección de prueba. En Apidog, guarde su prompt del sistema de producción como una solicitud con cache_control activado, envíelo dos veces y añada aserciones en usage.cache_creation_input_tokens para el primer envío y usage.cache_read_input_tokens para el segundo. Luego añada un script post-respuesta que multiplique cada campo por su tarifa y registre un costo por solicitud. Ejecute la colección cada vez que cambie un prompt o una definición de herramienta, y detectará una edición que rompa la caché antes de que afecte la factura. Descargue Apidog para construirlo; la guía de la API muestra las solicitudes exactas.

Precios de Fable 5.1 en las aplicaciones de Claude

El precio de la API es por token. En las aplicaciones de Claude, Fable 5.1 se mide por plan. Los planes Max incluyen modelos Fable hasta el 50% del límite de uso semanal sin costo adicional, y luego continúan con créditos de uso. Los puestos Pro y Team estándar miden Fable 5.1 a través de créditos de uso desde el primer mensaje. Los puestos Enterprise estándar necesitan tener créditos de uso habilitados para su uso más allá de los límites del plan, y las facturas de Enterprise basadas en uso se cobran a tarifas de API estándar. Las solicitudes que las salvaguardas redirigen a otro modelo no se cobran a precios de Fable. La guía de rutas gratuitas y más baratas cubre lo que esto significa en la práctica.

Preguntas Frecuentes

¿Cuánto cuesta Claude Fable 5.1 por millón de tokens? $10 de entrada y $50 de salida, sin cambios desde Fable 5. Las lecturas de caché cuestan $0.25 por millón, las escrituras de caché son $12.50 (5 minutos) y $20 (1 hora), y la API por lotes es $5 y $25.

¿Es Claude Fable 5.1 más barato que Fable 5? Por token, no. En la práctica, sí para cualquier cosa que utilice el almacenamiento en caché de prompts, porque las lecturas de caché bajaron de $1 a $0.25 por millón. Anthropic estima un 25% más barato en cargas de trabajo típicas y hasta un 45% en las basadas en agentes. Las cargas de trabajo con mucha salida ven pocos cambios.

¿Es Claude Fable 5.1 más barato que Opus 5? Sin caché, no: es exactamente el doble de caro. Con caché, la situación cambia: un acierto de caché de Fable 5.1 ($0.25) cuesta la mitad que un acierto de caché de Opus 5 ($0.50). La salida sigue siendo $50 frente a $25, por lo que Opus 5 gana en cualquier ruta con mucha salida.

¿Tiene Claude Fable 5.1 modo rápido o nivel de prioridad? No a ambos. El modo rápido es solo para Opus 5 y Opus 4.8. El nivel de prioridad es compatible con Fable 5 pero no con Fable 5.1.

¿Hay un premium por contexto largo en Claude Fable 5.1? No. La ventana completa de 1M de tokens se factura a tarifas estándar, y los descuentos por caché y por lotes se aplican en toda ella.

¿Cuánto cuesta Claude Fable 5.1 en Bedrock o Google Cloud? Esas plataformas establecen sus propios precios y añaden un 10% de recargo para endpoints regionales. Claude Platform en AWS y Microsoft Foundry facturan a las tarifas estándar de la API a través de Unidades de Consumo de Claude. Nuestra guía de disponibilidad en la nube cubre la configuración en cada una.

Practica el diseño de API en Apidog

Descubre una forma más fácil de construir y usar APIs