Prompts para Claude Fable 5.1: Todos los Cambios de Comportamiento y la Línea que los Soluciona

Guía de prompting para Claude Fable 5.1: cada cambio de comportamiento respecto a Fable 5 (agrupación de herramientas, actualizaciones de progreso, densidad, formato, reescrituras, alcance) con la solución exacta.

Ashley Innocent

Ashley Innocent

2 September 2026

Prompts para Claude Fable 5.1: Todos los Cambios de Comportamiento y la Línea que los Soluciona

Apidog para empresas

Despliegue local

SSO & RBAC

Conforme con SOC 2

Explorar Apidog Enterprise

Anthropic afirma que sus indicaciones existentes para Fable 5 deberían funcionar bien en Claude Fable 5.1 sin cambios. Eso es cierto para las respuestas. Es menos cierto para todo lo que las rodea: cuántas llamadas a herramientas el modelo agrupa por turno, cuánto narra, cuán densa es su prosa, cuánto formatea en el chat, si reescribe un archivo completo para cambiar una línea y si se detiene a pedir permiso para un trabajo que ya solicitaste. Cada uno de estos aspectos cambió entre Fable 5 y Fable 5.1, y cada uno tiene una solución específica en la guía de indicaciones de Anthropic para Claude Fable 5.1.

Esta guía recopila cada cambio con su solución, citando los fragmentos oficiales donde la redacción exacta importa, además de la regla de ubicación que importa más en este modelo que en cualquier otro anterior: dónde colocas una instrucción por turno ahora determina si invalida tus bloques de pensamiento y reinicia tu caché. Para la descripción general del modelo, consulta qué es Claude Fable 5.1.

Empieza con esfuerzo, no con indicaciones

El esfuerzo es el control principal para intercambiar inteligencia, latencia y costo en Fable 5.1, y debe ajustarse antes de cualquier cambio de indicación. Comienza en el valor predeterminado, high (alto), luego prueba los otros cuatro niveles con tus propias evaluaciones. Vuelve a ejecutar el barrido incluso si ejecutaste uno en Fable 5: los nombres de los niveles no corresponden a la misma cantidad de pensamiento entre modelos.

Afirmaciones de Anthropic a probar: en medium (medio), los resultados coinciden aproximadamente con Fable 5 a un costo menor; en low (bajo), Fable 5.1 a menudo es competitivo con Opus y Sonnet en costo por tarea mientras obtiene una puntuación más alta; las ganancias sobre Fable 5 son mayores en xhigh (muy alto) y max (máximo). En Fable 5.1 puedes cambiar el esfuerzo a mitad de conversación sin reiniciar el caché, usando un mensaje role: "system" con contenido vacío y output_config (encabezado beta mid-conversation-output-config-2026-07-01). El tutorial de la API muestra la forma de la solicitud.

La ubicación importa más que la redacción

Los bloques de pensamiento de Fable 5.1 son válidos solo en la conversación exacta que los produjo (pensamiento preservado). Inyectar un recordatorio en un turno anterior y eliminarlo en la siguiente solicitud es una edición del historial: reinicia el caché de indicaciones y, en cuentas creadas a partir del 31 de agosto de 2026, invalida cada bloque de pensamiento posterior.

Así que las instrucciones por turno van en uno de dos lugares. Con la beta mid-conversation-system-clear-at-2026-08-21, añádelas como un mensaje del sistema con alcance de turno: {"role": "system", "clear_at": "next_user_message", "content": "..."} después del mensaje de resultado de la herramienta, y deja cada copia anterior en el array. Una vez que existe un mensaje de usuario posterior, la API borra las copias anteriores, por lo que el modelo lee solo la más reciente, y las copias borradas no cuestan tokens. Sin la beta, coloca la oración en un bloque de texto después de los bloques tool_result en el mismo mensaje del usuario, manteniendo las copias anteriores. Nunca elimines ni reescribas una copia ya enviada. La guía de pensamiento preservado explica por qué.

Las instrucciones a nivel de sesión van en la indicación del sistema o en el primer turno del usuario. Anthropic señala que las instrucciones de estilo en el primer turno del usuario se mantienen mejor que el mismo texto en la indicación del sistema.

Una llamada a herramienta por turno en bucles de agente

El cambio. Cuando una solicitud nombra varias cosas a obtener, Fable 5.1 emite las llamadas en paralelo. En bucles de codificación y uso de computadora donde las siguientes lecturas independientes solo están implícitas, puede emitir una por turno donde Fable 5 agrupaba varias. Las respuestas no se ven afectadas; cada turno extra cuesta tokens, un viaje de ida y vuelta y tiempo real.

Mide primero. Rastrea la proporción de turnos del asistente con más de una llamada a herramienta, y añade la solución solo si esa proporción ha disminuido. La solución, añadida después de cada mensaje de resultado de herramienta como un mensaje del sistema con alcance de turno:

Primero, haz una lista privada de lo que necesitas a continuación; luego solicita cada elemento que no dependa del resultado de otro en esta única respuesta.

Mantén la palabra "privada". Sin ella, el modelo a veces responde al recordatorio en lugar de al usuario. Una oración cerca del final de la solicitud actual mueve el número mucho más que el mismo texto en la indicación del sistema.

Poco o ningún texto entre llamadas a herramientas

El cambio. Fable 5.1 escribe menos actualizaciones orientadas al usuario durante turnos largos de llamadas a herramientas que Fable 5, y más aún con mayor esfuerzo. Los usuarios ven al agente quedarse en silencio durante minutos, o un mensaje final que cubre solo el último paso.

Tres soluciones, en orden. Primero, verifica que recibas actualizaciones de progreso en absoluto: las notas del modelo entre herramientas regresan como bloques thinking que están vacíos bajo el display: "omitted" predeterminado. Establece display: "updates" (encabezado beta thinking-display-updates-2026-08-18) y renderiza cada bloque de pensamiento no vacío como una línea de estado. Segundo, elimina las líneas de indicación escritas para modelos más antiguos ansiosos por actualizaciones, como "guarda todos los hallazgos para la respuesta final". Tercero, si aún quieres más, añade una línea a la indicación del sistema:

Antes de empezar, di en una línea lo que vas a hacer; las actualizaciones breves mientras trabajas ayudan al usuario a seguir el progreso. Cierra con un breve resumen que se sostenga por sí mismo, cubriendo lo que encontraste, lo que hiciste y lo que sigue, para que un lector que solo vea el último mensaje tenga una imagen completa.

Si tu producto oculta la salida de la herramienta, díselo al modelo como un mensaje del sistema con alcance de turno, o puede ejecutar comandos para "mostrar" al usuario una salida que nunca ve: "Solo tú ves la salida de ese comando. Si el usuario necesita leer algo de ella, ponlo en tu respuesta."

El turno termina antes de que el trabajo esté hecho

El cambio. En cargas de trabajo asíncronas complejas, Fable 5.1 a veces describe lo que haría a continuación en lugar de hacerlo, o pide permiso para un paso que la solicitud ya cubría. Los usuarios tienen que responder "continuar", lo que limita la capacidad del modelo a largo plazo.

La solución es un bloque en la indicación del sistema cuya oración inicial tiene la mayor parte del efecto:

Estás operando de forma autónoma. El usuario no está observando en tiempo real y no puede responder preguntas a mitad de la tarea, por lo que preguntar '¿Quieres que yo...?' o '¿Debo yo...?' bloqueará el trabajo. Para acciones reversibles que se derivan de la solicitud original, procede sin preguntar. Detente solo para acciones destructivas o cambios de alcance genuinos que el usuario debe decidir. Ofrecer seguimientos después de que la tarea esté hecha está bien; pedir permiso antes de hacer el trabajo no lo está.

Antes de terminar tu turno, revisa tu último párrafo. Si es un plan, un análisis, una pregunta, una lista de los siguientes pasos o una promesa sobre un trabajo que no has hecho, haz ese trabajo ahora con llamadas a herramientas. Termina tu turno solo cuando la tarea esté completa o estés bloqueado en una entrada que solo el usuario puede proporcionar.

Anthropic lo combina con un segundo bloque que define la solicitud del usuario como el alcance del entregable: no lo restrinjas, amplíes o intercambies; termina cada parte que no esté bloqueada y di qué se omitió; trata algo que notaste pero no se te pidió como una sugerencia, no como un cambio. El par puede hacer que el modelo sea menos propenso a preguntar sobre solicitudes ambiguas, así que añade una línea enumerando las confirmaciones que aún deseas. Una diferencia con Opus 5: si tu indicación pide al modelo que revise su trabajo antes de informar, consérvala. El consejo de Opus 5 de eliminar las instrucciones de verificación no se aplica aquí.

Correcciones no solicitadas y archivos de prueba adicionales

El cambio. Cuando se le pide una característica abierta, Fable 5.1 la entrega y a veces más: correcciones cercanas, comportamiento extendido, más archivos de prueba comprometidos de los que justifica el cambio.

La solución, que Anthropic dice que redujo sustancialmente los extras sin cambios en el éxito de la tarea:

Si, mientras trabajas o pruebas, encuentras un error preexistente, un problema de rendimiento o un comportamiento que la tarea no menciona, no lo corrijas, optimices o extiendas en este cambio a menos que el comportamiento solicitado no pueda funcionar sin ello; repórtalo como un seguimiento en tu resumen. Verifica tu trabajo como desees; los scripts de prueba y las comprobaciones rápidas no necesitan ser conservados. Compromete pruebas solo cuando la tarea lo pida o este repositorio ya mantenga pruebas para este tipo de cambio, dimensionadas como los archivos de prueba vecinos. Esto se trata solo de extras: implementa cada comportamiento que la tarea pida, completamente.

Archivos completos reescritos para pequeños cambios

El cambio. Fable 5.1 es más propenso que Fable 5 a reescribir un archivo completo en lugar de hacer una edición específica. El mismo resultado, más tokens de salida.

La solución, en la indicación del sistema o en el primer mensaje del usuario:

El número de tokens utilizados para editar archivos debe minimizarse, si todo lo demás es igual. Por lo tanto, cuando no afecte el resultado final, intenta editar un archivo quirúrgicamente en lugar de reescribirlo por completo.

La prosa es larga y densa

El cambio. La escritura de Fable 5.1 es generalmente un paso adelante, con menos frases hechas, pero en algunos casos es más densa que la de Fable 5: oraciones más largas, menos saltos de párrafo.

La solución es definir el antipatrón. El fragmento de Anthropic describe la "prosa amanerada" como una escritura que sustituye la metáfora y el floreo por la declaración directa y existe para exhibir al escritor en lugar de transmitir la idea; la instrucción es decir lo que se quiere decir y usar la frase literal cuando esté disponible. La forma corta también funciona: "Por favor, elimina toda prosa amanerada."

Las respuestas del chat tienen menos estructura de la que el contenido necesita

El cambio. Los modelos anteriores abusaban de las viñetas y la negrita, por lo que muchas indicaciones contenían reglas anti-formato. Fable 5.1 se inclina hacia el otro lado: menos negrita, menos encabezados y listas. Esas reglas antiguas ahora suprimen la estructura que el contenido necesita.

La solución. Elimina el lenguaje anti-formato, o reemplázalo con una regla que diga cuándo el formato ayuda: usa listas cuando se te pida o cuando el contenido sea lo suficientemente multifacético como para que mejoren la claridad; respeta una solicitud explícita de formato mínimo; mantén la prosa sencilla en intercambios conversacionales o emocionales.

Los resúmenes reproducen la redacción de la fuente sin marcarla

El cambio. Al resumir documentos, Fable 5.1 es más propenso que Fable 5 a reproducir pasajes de la fuente sin marcarlos como citas.

La solución. Añade un ejemplo completo a la indicación del sistema: la solicitud del usuario, una respuesta correcta que transmita cada fuente en el propio discurso indirecto del asistente con como máximo una cita corta marcada, y una justificación de una oración que explique por qué es correcta. Reemplaza los marcadores de posición de llamada a herramienta en el ejemplo de Anthropic con el nombre de tu propia herramienta.

Respuestas de memoria en lugar de buscar con poco esfuerzo

El cambio. Con un esfuerzo low (bajo), Fable 5.1 llama a las herramientas de búsqueda y recuperación con menos frecuencia que Fable 5, de manera más visible para productos y modelos nombrados que reconoce pero de los que tiene conocimientos obsoletos.

Dos soluciones. Aumenta el esfuerzo para los turnos afectados con esfuerzo por mensaje. O dile al modelo en la indicación del sistema que reconocer un nombre de un área de rápido movimiento no es lo mismo que conocer su estado actual, que debe buscar antes de responder, y que debe incluir el nombre tal como lo escribió el usuario en al menos una consulta.

Los entregables largos en xhigh y max tardan demasiado

El cambio. En xhigh (muy alto) y especialmente en max (máximo), Fable 5.1 puede redactar gran parte de un entregable largo en su pensamiento y luego escribirlo de nuevo como respuesta, duplicando la espera y los tokens de salida.

Dos soluciones. Ejecuta esas solicitudes en high (alto) y sube de nivel solo donde hayas medido una ganancia. Si te quedas en xhigh o max, establece max_tokens para dejar espacio para el pensamiento y la respuesta, y añade una nota al mensaje del usuario diciendo que todo lo producido en una respuesta, incluido el razonamiento, cuenta para un solo límite de aproximadamente tu max_tokens real, y que componer el entregable completo como razonamiento y de nuevo como respuesta duplica el turno sin mejorarlo. Deja las copias anteriores de esa nota en su lugar en solicitudes posteriores.

Las solicitudes de codificación benignas devuelven una negativa

El cambio. Los clasificadores de Fable 5.1 producen menos falsos positivos que los de Fable 5 en su lanzamiento, y ahora se permite encontrar vulnerabilidades en el código fuente. Sin embargo, todavía ocurren falsos positivos.

Tres frases a cambiar. Pregunta "¿Hay algún error en este programa?" en lugar de "¿Este programa compila sin errores?". Dale al modelo documentación para lenguajes menos conocidos. Elimina las herramientas que devuelven datos codificados en base64 al contexto. Mantén los fallbacks configurados independientemente; la guía de manejo de negativas lo cubre.

Los resúmenes de compactación del lado del cliente omiten detalles

Fable 5.1 responde bien a que se le indique exactamente qué debe retener un resumen de compactación. La compactación del lado del servidor ya hace esto. Si realizas la compactación en el cliente, instruye al modelo para que resuma dentro de las etiquetas <summary> y conserve, en orden: las dificultades que surgieron y cómo se resolvieron; los enfoques planteados o descartados y por qué; cualquier cosa solicitada o decidida, declarada exactamente; la situación actual; cualquier cosa que aún esté abierta; y detalles difíciles de reconstruir como nombres, números y enlaces. Termina con "No uses ninguna herramienta al escribir este resumen; responde solo con texto", lo cual es importante cuando la solicitud de resumen todavía lleva las herramientas de la conversación.

Subagentes y visión

Dos soluciones son arquitectónicas en lugar de indicaciones. En tareas de codificación, deja que el agente principal siga trabajando mientras los subagentes se ejecutan: haz que la herramienta que inicia un subagente regrese inmediatamente, entrega cada resultado en un mensaje de usuario posterior y dale al principal una herramienta separada que pueda llamar cuando quiera esperar. Para gráficos densos y tablas anidadas, dale al modelo una herramienta de recorte que devuelva una región elegida ampliada, o un contenedor con bibliotecas de imágenes básicas; con un esfuerzo low (bajo) puede omitir el recorte, así que revisa los registros de la llamada.

Probando cambios de indicaciones en Apidog

Cada solución anterior es candidata para una prueba de antes y después. En Apidog, guarda los primeros tres turnos de tu bucle de agente como una secuencia de solicitud, parametrizar la indicación del sistema y ejecútala con y sin cada fragmento con el mismo esfuerzo. Afirma el recuento de bloques tool_use por turno de asistente para la solución de agrupación, en usage.output_tokens para las soluciones de edición y densidad dirigidas, y en la ausencia de un párrafo final que comience con "A continuación, yo" para la solución de autonomía. Descarga Apidog para construirlo; la guía de Claude Code muestra cuáles de estas líneas pertenecen a un archivo CLAUDE.md.

Preguntas frecuentes

¿Mis indicaciones de Fable 5 funcionan en Fable 5.1? Anthropic dice que deberían funcionar bien sin cambios. Las diferencias son de comportamiento: menos llamadas a herramientas agrupadas, menos actualizaciones de progreso, prosa más densa, menos formato en el chat, reescrituras de archivos completos y una expansión del alcance en tareas abiertas.

¿En qué nivel de esfuerzo debo indicar a Fable 5.1? Comienza en high (alto) y realiza un barrido. Anthropic dice que medium (medio) coincide aproximadamente con Fable 5 a un costo menor y low (bajo) a menudo es competitivo con Opus y Sonnet en costo por tarea.

¿Dónde coloco una instrucción por turno en Fable 5.1? Como un mensaje del sistema con alcance de turno con clear_at: "next_user_message" después de los resultados de la herramienta, dejando las copias anteriores en su lugar. Inyectar y eliminar texto de turnos anteriores invalida bloques de pensamiento posteriores y reinicia el caché.

¿Debo eliminar las instrucciones de "verificar tu trabajo" como en Opus 5? No. Esa guía era específica para la sobre-verificación de Opus 5. Consérvalas en Fable 5.1.

¿Cómo evito que Fable 5.1 reescriba archivos completos? Una línea en la indicación del sistema o en el primer mensaje del usuario: minimiza los tokens utilizados para editar archivos y edita quirúrgicamente en lugar de reescribir cuando no afecte el resultado.

Practica el diseño de API en Apidog

Descubre una forma más fácil de construir y usar APIs