Claude Fable 5.1 vs Fable 5: ¿Qué cambió y vale la pena actualizar?

Claude Fable 5.1 vs Fable 5: mismo precio, lecturas de caché reducidas a 0.25 $, cada delta de benchmark, 3 cambios disruptivos, perdió el Nivel Prioritario y una regla de decisión por carga de trabajo.

INEZA Felin-Michel

INEZA Felin-Michel

2 September 2026

Claude Fable 5.1 vs Fable 5: ¿Qué cambió y vale la pena actualizar?

Apidog para empresas

Despliegue local

SSO & RBAC

Conforme con SOC 2

Explorar Apidog Enterprise

Claude Fable 5.1 reemplazó a Fable 5 el 1 de septiembre de 2026, con los mismos $10 y $50 por millón de tokens, con las lecturas de caché reducidas de $1 a $0.25 por millón y mejores cifras en cada benchmark publicado por Anthropic. Fable 5 sigue en servicio, y la página del modelo Fable 5 de Anthropic se compromete a mantenerlo hasta al menos el 9 de junio de 2027. Así que la pregunta no es si Fable 5.1 es mejor sobre el papel. Es si la actualización justifica su coste de migración para su carga de trabajo, y si alguno de los tres cambios disruptivos le afecta.

Esta comparación analiza lo que es idéntico, lo que mejoró, lo que se volvió más caro o difícil, y una regla de decisión por carga de trabajo. Las fuentes son la publicación de lanzamiento de Anthropic y Novedades de Claude Fable 5.1. Para la hoja de especificaciones completa, consulte qué es Claude Fable 5.1.

Comparación

Claude Fable 5.1 Claude Fable 5
ID de modelo claude-fable-5-1 claude-fable-5
Lanzamiento 1 de septiembre de 2026 9 de junio de 2026 (suspendido el 12 de junio, de vuelta el 1 de julio)
Retirada No antes del 1 de septiembre de 2027 No antes del 9 de junio de 2027
Contexto / salida máxima 1M / 128K 1M / 128K
Fecha de corte del conocimiento Junio de 2026 Enero de 2026
Precio entrada / salida $10 / $50 $10 / $50
Lectura de caché $0.25 por millón $1.00 por millón
Escrituras de caché $12.50 (5m), $20 (1h) Igual
Procesamiento por lotes $5 / $25 Igual
Tokenizador Igual (generación Opus 4.7) Igual
Pensamiento Adaptativo, siempre activo Adaptativo, siempre activo
tool_choice forzado 400 Aceptado
Bloques de pensamiento legibles por modelos anteriores No Sí
Verificación de edición de historial Sí (aplicado para cuentas creadas a partir del 31-08-2026) No
Nivel de prioridad No compatible Compatible
Esfuerzo por mensaje Sí (beta) No
Mensajes del sistema con ámbito de turno Sí (beta) No
thinking.display: "updates" Sí (beta) Sí (beta)
Procedencia del contenido Marca de agua de texto + C2PA en medios Marca de agua de texto
Retención de datos 30 días requeridos, Modelo Cubierto Igual
Categorías de rechazo Las mismas cinco Las mismas cinco

Qué es idéntico

Más de lo que cabría esperar. La superficie de la API, la ventana de contexto de 1M, el límite de salida de 128K, los precios por token, el tokenizador, el mínimo de caché de 512 tokens, el pensamiento adaptativo siempre activo, el valor predeterminado "omitted" para thinking.display, la prohibición de precarga, la prohibición de parámetros de muestreo, los mensajes del sistema a mitad de conversación, y el conjunto completo de categorías de rechazo y mecanismos de respaldo se mantienen sin cambios. Anthropic afirma que los prompts existentes de Fable 5 deberían funcionar bien en Fable 5.1 sin necesidad de modificaciones.

Esto significa que la mayor parte de lo que escribimos sobre Fable 5 sigue siendo aplicable: la guía de límites de tasa (los dos modelos incluso comparten un mismo pool de límites de tasa), la explicación de salvaguardas, y la guía de disponibilidad en la nube.

Qué mejoró

Los benchmarks, según los números de Anthropic. Cada fila publicada mejoró a favor de Fable 5.1. Sin embargo, las diferencias no son uniformes.

Benchmark Fable 5.1 Fable 5 Delta
Terminal-Bench-Science 0.1 52.6% 24.7% +27.9
AutomationBench 31.4% 17.1% +14.3
Terminal-Bench 4.0 55.8% 42.0% +13.8
GDPval-AA v2 1853 1723 +130 Elo
OSWorld 2.0 (estricto) 41.7% 36.1% +5.6
OSWorld 2.0 (parcial) 77.9% 72.9% +5.0
El Último Examen de la Humanidad (sin herramientas) 60.9% 57.8% +3.1
CursorBench 3.2.0 73.4% 70.5% +2.9
El Último Examen de la Humanidad (con herramientas) 65.0% 63.8% +1.2

El patrón: los mayores saltos se observan en benchmarks de agentes con horizontes largos (investigación científica en una terminal, automatización de flujos de trabajo empresariales, codificación agéntica). Los más pequeños se dan en tareas de conocimiento y codificación estilo IDE. Si su carga de trabajo se parece a la parte superior de esa tabla, la mejora es significativa. Si se parece a la parte inferior, son solo unos pocos puntos. Todos estos son resultados ejecutados por el proveedor sin reproducción independiente todavía; el desglose de los benchmarks va fila por fila.

Lecturas de caché a un cuarto del precio. Según la página de precios, este es el cambio que la mayoría de los usuarios de Fable 5 notarán primero. Una sesión agéntica larga que relee un prefijo de 150,000 tokens en cada turno pagaba $0.15 por turno en lecturas de caché en Fable 5 y paga $0.0375 en Fable 5.1. La estimación de Anthropic es que es un 25% más barato en cargas de trabajo típicas y hasta un 45% en las agénticas. El desglose de precios reproduce ese cálculo con tres ejemplos prácticos.

Menos falsos positivos de las salvaguardas. Los clasificadores de Fable 5 fueron la queja más común después de su regreso en julio. Anthropic informa que los clasificadores de biología se activan un 85% menos en solicitudes benignas de biología elemental y médicas que los de Fable 5 en su lanzamiento, y las salvaguardas cibernéticas causan alrededor de un 60% menos de intervenciones por sesión de Claude Code. Fable 5.1 también puede identificar vulnerabilidades en el código fuente, algo que Fable 5 rechazaba. El desarrollo de exploits sigue siendo rechazado.

Margen de esfuerzo. Anthropic afirma que medium en Fable 5.1 iguala aproximadamente a Fable 5 con un coste menor, y las ganancias sobre Fable 5 son mayores en xhigh y max. Prácticamente, una carga de trabajo de Fable 5 ejecutándose en high a menudo puede pasar a Fable 5.1 en medium para obtener la misma calidad y menos tokens de salida, o permanecer en high para una ganancia de calidad.

Fecha de corte del conocimiento. Junio de 2026 versus enero de 2026. Cinco meses adicionales de lanzamientos de frameworks, cambios de API y lanzamientos de modelos que el modelo conoce sin necesidad de ser informado.

Tres características del sistema. Cambios en el esfuerzo por mensaje sin restablecimiento de caché, mensajes del sistema con ámbito de turno para recordatorios por turno, y actualizaciones de progreso legibles entre llamadas a herramientas. Fable 5 tiene la última; las dos primeras son nuevas.

Qué se volvió más difícil

El uso forzado de herramientas ha desaparecido. tool_choice any y tool devuelven un error 400 en Fable 5.1. Si los usaba para garantizar JSON, pase a strict: true bajo auto o a salidas estructuradas. Si los usaba porque la aplicación requiere una llamada en un turno dado, añada un mensaje del sistema a mitad de conversación que lo indique. No es difícil, pero implica un cambio de código en cada sitio donde se llama a una herramienta forzada.

Los bloques de pensamiento son unidireccionales. Fable 5.1 lee los bloques de pensamiento de Fable 5, por lo que una conversación que avanza mantiene su razonamiento. Fable 5 no puede leer los de Fable 5.1. Durante una transición gradual en la que un enrutador podría enviar una conversación hacia abajo, la API descarta los bloques, sin facturar, y Fable 5 vuelve a planificar ese turno.

La verificación de edición del historial. Los bloques de pensamiento de Fable 5.1 son válidos solo en la conversación exacta que los produjo. Edite un turno anterior, reconstruya el prompt del sistema o cambie el array de herramientas, y la siguiente solicitud que reproduzca el bloque fallará en cuentas creadas a partir del 31 de agosto de 2026. Fable 5 nunca lo verificó. Si su sistema inyecta y elimina recordatorios por turno, actualiza la fecha en el prompt del sistema o compacta en el cliente mientras mantiene los turnos recientes textualmente, dedique tiempo real aquí. La guía de pensamiento preservado cubre la auditoría y las correcciones, y la guía de migración tiene la lista de verificación completa.

Nivel de prioridad. Fable 5 lo soporta; Fable 5.1 no. Para garantías de capacidad empresarial, esa es una razón para permanecer en Fable 5 hasta que Anthropic lo añada.

Comportamiento del bucle de agente. Tres cambios ajustables mediante prompts: Fable 5.1 puede emitir una llamada a herramienta por turno donde Fable 5 agrupaba varias, escribe menos actualizaciones de progreso y, con un esfuerzo low, responde más a menudo desde la memoria en lugar de buscar. Cada uno tiene una solución de una línea en la guía de prompts, pero cada uno es también un cambio que debe notar.

Regla de decisión por carga de trabajo

Actualice ahora si su trabajo es codificación agéntica de larga duración, investigación multifase o generación de documentos y hojas de cálculo. Ahí es donde se concentran las ganancias del benchmark, donde el precio de lectura de caché impacta más, y donde la reducción de falsos positivos de salvaguarda es más importante. Cognition dijo que estaba moviendo su tráfico de Devin a Fable 5.1 el día del lanzamiento, lo cual es la señal pública más clara de esa lógica.

Actualice después de la auditoría del sistema si su código construye el array messages por sí mismo y hace algo más allá de añadir turnos. Ejecute primero la verificación de edición de historial de tres pasos, corrija cada prefix_binding_mismatch y luego cambie. La verificación es barata; descubrirlo en producción no lo es.

Actualice a medium si Fable 5 en high estaba realizando bien el trabajo rutinario y desea la misma calidad por menos. Vuelva a ejecutar el barrido de esfuerzo en sus evaluaciones en lugar de asumir que los niveles se corresponden.

Manténgase en Fable 5 si el Nivel de Prioridad es fundamental, o si su carga de trabajo es intensiva en salida con poco prefijo en caché (donde el cambio de precio apenas se registra y el coste de migración es un puro gasto general). Fable 5 está comprometido hasta al menos el 9 de junio de 2027, así que aún no hay prisa.

Considere Opus 5 en su lugar si la respuesta honesta es que Fable 5 ya era más modelo de lo que necesitaba. La propia guía de Anthropic es comenzar con Opus 5 y solo subir cuando este se quede corto. La comparación Fable 5.1 vs Opus 5 aborda esto a la mitad de precio.

Probando ambos modelos entre sí en Apidog

La forma más clara de resolver esto para su propia carga de trabajo es una colección lado a lado. En Apidog, guarde sus diez prompts de producción más difíciles como solicitudes con model como variable de entorno, ejecute la colección una vez contra claude-fable-5 y otra vez contra claude-fable-5-1 con el mismo esfuerzo, y compare tres campos por solicitud: el texto, usage.output_tokens, y usage.cache_read_input_tokens en la segunda ejecución. Añada una solicitud más que utilice un tool_choice forzado, para que vea el error 400 antes que sus usuarios. Descargue Apidog para configurarlo; el tutorial de la API contiene los cuerpos de las solicitudes.

Preguntas frecuentes

¿Es Claude Fable 5.1 un nuevo modelo o una actualización de Fable 5? Es un nuevo modelo con su propio ID, claude-fable-5-1, y su propia fecha de retirada. Utiliza el mismo tokenizador y precios por token que Fable 5 y está entrenado con datos hasta junio de 2026.

¿Cuesta Fable 5.1 más que Fable 5? No. Mismos $10 y $50 por millón de tokens, las mismas escrituras en caché, las mismas tarifas por lotes. Las lecturas de caché son más baratas: $0.25 por millón frente a $1.

¿Funcionará mi código de Fable 5 en Fable 5.1? La mayor parte. El tool_choice forzado devuelve un error 400, y el código que edita el historial de conversación entre solicitudes invalidará los bloques de pensamiento en las cuentas creadas a partir del 31 de agosto de 2026. Todo lo demás se mantiene.

¿Se va a retirar Fable 5? Todavía no. El compromiso de Anthropic es que Fable 5 no se retirará antes del 9 de junio de 2027, en las plataformas operadas por Anthropic. Bedrock y Google Cloud establecen sus propias fechas.

¿Cuál es mejor en codificación, Fable 5.1 o Fable 5? Según los números de Anthropic, Fable 5.1: 55.8% vs 42.0% en Terminal-Bench 4.0 y 73.4% vs 70.5% en CursorBench 3.2.0. La brecha en terminales agénticos es grande; la brecha en estilo IDE es pequeña. Ambos son resultados ejecutados por el proveedor.

¿Fable 5.1 rechaza menos que Fable 5? Anthropic informa un 85% menos de falsos positivos en biología y alrededor de un 60% menos de intervenciones cibernéticas por sesión de Claude Code. Las categorías son las mismas, así que mantenga su manejo de rechazos y mecanismos de respaldo.

Practica el diseño de API en Apidog

Descubre una forma más fácil de construir y usar APIs