Prompts für Claude Fable 5.1: Jede Verhaltensänderung und die korrigierende Zeile

Prompting für Claude Fable 5.1: jede Verhaltensänderung gegenüber Fable 5 (Werkzeug-Batching, Fortschrittsaktualisierungen, Dichte, Formatierung, Umschreibungen, Umfang) mit der exakten Behebung.

Ashley Innocent

Ashley Innocent

2 September 2026

Prompts für Claude Fable 5.1: Jede Verhaltensänderung und die korrigierende Zeile

Apidog für Unternehmen

On-Premises Bereitstellung

SSO & RBAC

SOC 2 konform

Apidog Enterprise entdecken

Anthropic sagt, dass Ihre bestehenden Fable 5 Prompts auf Claude Fable 5.1 ohne Änderungen gut funktionieren sollten. Das stimmt für die Antworten. Weniger wahr ist es für alles andere drumherum: wie viele Tool-Aufrufe das Modell pro Runde bündelt, wie viel es erzählt, wie dicht seine Prosa ist, wie viel es im Chat formatiert, ob es eine ganze Datei umschreibt, um eine Zeile zu ändern, und ob es anhält, um um Erlaubnis für bereits angeforderte Arbeit zu bitten. Jedes dieser Elemente hat sich zwischen Fable 5 und Fable 5.1 verschoben, und jedes hat eine spezifische Lösung in Anthropic's Anleitung zur Prompt-Erstellung für Claude Fable 5.1.

Diese Anleitung sammelt jede Verschiebung mit ihrer Lösung, zitiert die offiziellen Ausschnitte, wo die genaue Formulierung wichtig ist, sowie die Platzierungsregel, die bei diesem Modell wichtiger ist als bei jedem vorherigen: Wo Sie eine rundenbezogene Anweisung platzieren, bestimmt jetzt, ob sie Ihre Denkblöcke ungültig macht und Ihren Cache neu startet. Für einen Modellüberblick siehe was Claude Fable 5.1 ist.

Beginnen Sie mit Aufwand, nicht mit Prompts

Aufwand ist die primäre Steuerung für den Handel mit Intelligenz, Latenz und Kosten auf Fable 5.1 und sollte vor jeder Prompt-Änderung abgestimmt werden. Beginnen Sie mit dem Standardwert high und testen Sie dann die anderen vier Stufen anhand Ihrer eigenen Bewertungen. Führen Sie die Testreihe erneut durch, auch wenn Sie bereits eine auf Fable 5 durchgeführt haben: Die Stufenbezeichnungen entsprechen nicht derselben Denkmenge über alle Modelle hinweg.

Anthropic's Behauptungen zum Testen: bei medium entsprechen die Ergebnisse in etwa Fable 5 zu geringeren Kosten; bei low ist Fable 5.1 oft konkurrenzfähig mit Opus und Sonnet bei den Kosten pro Aufgabe, während es höher punktet; die größten Verbesserungen gegenüber Fable 5 sind bei xhigh und max zu verzeichnen. Auf Fable 5.1 können Sie den Aufwand mitten im Gespräch ohne Cache-Reset ändern, indem Sie eine leere role: "system" Nachricht mit output_config (Beta-Header mid-conversation-output-config-2026-07-01) verwenden. Die API-Anleitung zeigt das Anfrageformat.

Platzierung ist wichtiger als Formulierung

Fable 5.1 Denkblöcke sind nur in der genauen Konversation gültig, die sie produziert hat (gespeichertes Denken). Das Einfügen einer Erinnerung in eine frühere Runde und das Löschen dieser in der nächsten Anfrage ist eine Verlaufsbearbeitung: Es startet den Prompt-Cache neu und macht, bei Konten, die am oder nach dem 31. August 2026 erstellt wurden, jeden späteren Denkblock ungültig.

Rundenbezogene Anweisungen gehören also an eine von zwei Stellen. Mit der Beta mid-conversation-system-clear-at-2026-08-21 hängen Sie sie als rundenbezogene Systemnachricht an: {"role": "system", "clear_at": "next_user_message", "content": "..."} nach der Tool-Ergebnis-Nachricht und lassen jede frühere Kopie im Array. Sobald eine spätere Benutzernachricht existiert, löscht die API die früheren Kopien, sodass das Modell nur die neueste liest, und gelöschte Kopien kosten keine Token. Ohne die Beta platzieren Sie den Satz in einem Textblock nach den tool_result Blöcken in derselben Benutzernachricht, wobei frühere Kopien beibehalten werden. Löschen oder überschreiben Sie niemals eine bereits gesendete Kopie. Die Anleitung zum gespeicherten Denken erklärt, warum.

Anweisungen auf Session-Ebene gehören in den System-Prompt oder die erste Benutzerrunde. Anthropic merkt an, dass Stil-Anweisungen in der ersten Benutzerrunde besser halten als derselbe Text im System-Prompt.

Ein Tool-Aufruf pro Runde in Agenten-Schleifen

Die Verschiebung. Wenn eine Anfrage mehrere abzurufende Dinge nennt, führt Fable 5.1 die Aufrufe parallel aus. In Programmier- und Computernutzungsschleifen, wo die nächsten unabhängigen Lesezugriffe nur impliziert sind, kann es einen pro Runde ausgeben, wo Fable 5 mehrere gebündelt hat. Antworten sind unbeeinflusst; jede zusätzliche Runde kostet Token, einen Roundtrip und Echtzeit.

Zuerst messen. Verfolgen Sie den Anteil der Assistentenrunden mit mehr als einem Tool-Aufruf und fügen Sie die Lösung nur hinzu, wenn dieser Anteil gesunken ist. Die Lösung, angehängt nach jeder Tool-Ergebnis-Nachricht als rundenbezogene Systemnachricht:

Listen Sie zuerst privat auf, was Sie als Nächstes benötigen; fordern Sie dann in dieser einen Antwort jeden Eintrag an, der nicht vom Ergebnis eines anderen abhängt.

Behalten Sie das Wort „privat“ bei. Ohne es antwortet das Modell manchmal auf die Erinnerung statt auf den Benutzer. Ein Satz nahe dem Ende der aktuellen Anfrage bewegt die Zahl weit mehr als derselbe Text im System-Prompt.

Wenig oder kein Text zwischen Tool-Aufrufen

Die Verschiebung. Fable 5.1 schreibt weniger benutzergerichtete Updates während langer Tool-Aufruf-Runden als Fable 5, insbesondere bei höherem Aufwand. Benutzer sehen, wie der Agent minutenlang stumm bleibt oder eine abschließende Nachricht sendet, die nur den letzten Schritt abdeckt.

Drei Lösungen, der Reihe nach. Überprüfen Sie zunächst, ob Sie überhaupt Fortschritts-Updates erhalten: Die Zwischen-Tool-Notizen des Modells werden als thinking-Blöcke zurückgegeben, die unter dem Standard display: "omitted" leer sind. Setzen Sie display: "updates" (Beta-Header thinking-display-updates-2026-08-18) und rendern Sie jeden nicht leeren Denkblock als Statuszeile. Zweitens, entfernen Sie Prompt-Zeilen, die für Update-hungrige ältere Modelle geschrieben wurden, wie z.B. „halten Sie alle Ergebnisse für die endgültige Antwort zurück.“ Drittens, wenn Sie immer noch mehr wünschen, fügen Sie eine System-Prompt-Zeile hinzu:

Bevor Sie beginnen, sagen Sie in einer Zeile, was Sie tun werden; kurze Updates während Ihrer Arbeit helfen dem Benutzer, dem Geschehen zu folgen. Schließen Sie mit einer kurzen Zusammenfassung ab, die eigenständig ist und abdeckt, was Sie gefunden, was Sie getan haben und was als Nächstes kommt, damit ein Leser, der nur die letzte Nachricht sieht, das vollständige Bild hat.

Wenn Ihr Produkt die Tool-Ausgabe verbirgt, teilen Sie dies dem Modell als rundenbezogene Systemnachricht mit, andernfalls könnte es Befehle ausführen, um dem Benutzer Ausgaben zu „zeigen“, die er nie sieht: „Nur Sie sehen die Ausgabe dieses Befehls. Wenn der Benutzer etwas davon lesen muss, fügen Sie es Ihrer Antwort hinzu.“

Runde endet, bevor die Arbeit erledigt ist

Die Verschiebung. Bei komplexen asynchronen Arbeitslasten beschreibt Fable 5.1 manchmal, was es als Nächstes tun würde, anstatt es zu tun, oder bittet um Erlaubnis für einen Schritt, den die Anfrage bereits abgedeckt hat. Benutzer müssen mit „fortfahren“ antworten, was die Langzeitfähigkeit des Modells begrenzt.

Die Lösung ist ein System-Prompt-Block, dessen Eröffnungssatz den größten Teil der Wirkung trägt:

Sie agieren autonom. Der Benutzer schaut nicht in Echtzeit zu und kann während der Aufgabe keine Fragen beantworten, daher wird das Fragen "Soll ich...?" oder "Möchten Sie, dass ich...?" die Arbeit blockieren. Bei umkehrbaren Aktionen, die aus der ursprünglichen Anfrage folgen, fahren Sie ohne Nachfrage fort. Halten Sie nur bei destruktiven Aktionen oder echten Umfangsänderungen an, über die der Benutzer entscheiden muss. Das Anbieten von Nachfassaktionen nach Abschluss der Aufgabe ist in Ordnung; das Bitten um Erlaubnis, bevor die Arbeit erledigt wird, ist es nicht.

Bevor Sie Ihre Runde beenden, überprüfen Sie Ihren letzten Absatz. Wenn es ein Plan, eine Analyse, eine Frage, eine Liste nächster Schritte oder ein Versprechen bezüglich unerledigter Arbeit ist, erledigen Sie diese Arbeit jetzt mit Tool-Aufrufen. Beenden Sie Ihre Runde nur, wenn die Aufgabe abgeschlossen ist oder Sie auf eine Eingabe warten, die nur der Benutzer bereitstellen kann.

Anthropic kombiniert dies mit einem zweiten Block, der die Benutzeranfrage als Umfang des Lieferobjekts definiert: nicht eingrenzen, erweitern oder austauschen; jeden nicht blockierten Teil fertigstellen und sagen, was ausgelassen wurde; etwas, das Sie bemerkt, aber nicht angefragt haben, als Vorschlag behandeln, nicht als Änderung. Die Kombination kann das Modell weniger geneigt machen, Fragen zu mehrdeutigen Anfragen zu stellen, fügen Sie also eine Zeile hinzu, die die Bestätigungen auflistet, die Sie noch wünschen. Ein Unterschied zu Opus 5: Wenn Ihr Prompt das Modell auffordert, seine Arbeit vor der Berichterstattung zu überprüfen, behalten Sie dies bei. Der Opus 5 Ratschlag, Verifikationsanweisungen zu löschen, überträgt sich nicht.

Nicht angeforderte Korrekturen und zusätzliche Testdateien

Die Verschiebung. Auf eine offene Funktion angesprochen, liefert Fable 5.1 diese und manchmal mehr: nahegelegene Korrekturen, erweitertes Verhalten, mehr zugesicherte Testdateien, als die Änderung rechtfertigt.

Die Lösung, die laut Anthropic die Extras erheblich reduzierte, ohne den Aufgabenerfolg zu beeinträchtigen:

Wenn Sie während der Arbeit oder des Testens einen bestehenden Fehler, ein Leistungsproblem oder ein Verhalten feststellen, das die Aufgabe nicht erwähnt, beheben, optimieren oder erweitern Sie es in dieser Änderung nicht, es sei denn, das angeforderte Verhalten kann ohne es nicht funktionieren; melden Sie es als Follow-up in Ihrer Zusammenfassung. Überprüfen Sie Ihre Arbeit nach Belieben; Entwurfsskripte und Schnellprüfungen müssen nicht aufbewahrt werden. Führen Sie Tests nur dort durch, wo die Aufgabe dies verlangt oder dieses Repository bereits Tests für diese Art von Änderung enthält, die in der Größe den benachbarten Testdateien entsprechen. Hier geht es nur um Extras: implementieren Sie jedes angeforderte Verhalten vollständig.

Ganze Dateien für kleine Änderungen umgeschrieben

Die Verschiebung. Fable 5.1 neigt eher dazu, eine ganze Datei umzuschreiben, als eine gezielte Bearbeitung vorzunehmen. Gleiches Ergebnis, mehr Ausgabe-Token.

Die Lösung, im System-Prompt oder der ersten Benutzernachricht:

Die Anzahl der für die Bearbeitung von Dateien verwendeten Token sollte minimiert werden, wenn alles andere gleich ist. Versuchen Sie daher, eine Datei chirurgisch zu bearbeiten, anstatt das Ganze neu zu schreiben, wenn dies das Endergebnis nicht beeinflusst.

Prosa ist lang und dicht

Die Verschiebung. Der Schreibstil von Fable 5.1 ist im Allgemeinen besser, mit weniger Standardphrasen, aber in einigen Fällen ist er dichter als der von Fable 5: längere Sätze, weniger Absätze.

Die Lösung besteht darin, das Anti-Muster zu definieren. Anthropic's Snippet beschreibt "manierierte Prosa" als Schreibweise, die Metaphern und Ausschmückungen anstelle direkter Aussagen verwendet und dazu dient, den Autor zu präsentieren, anstatt die Idee zu vermitteln; die Anweisung ist, zu sagen, was man meint, und den wörtlichen Ausdruck zu verwenden, wenn einer verfügbar ist. Die Kurzform funktioniert auch: „Bitte entfernen Sie alle manierierte Prosa.“

Chat-Antworten haben weniger Struktur, als der Inhalt benötigt

Die Verschiebung. Frühere Modelle überstrapazierten Aufzählungszeichen und Fettdruck, daher enthalten viele Prompts Anti-Formatierungsregeln. Fable 5.1 geht in die andere Richtung: weniger Fettdruck, weniger Überschriften und Listen. Diese alten Regeln unterdrücken nun die Struktur, die der Inhalt benötigt.

Die Lösung. Entfernen Sie Anti-Formatierungs-Sprache oder ersetzen Sie sie durch eine Regel, die besagt, wann Formatierung hilft: Verwenden Sie Listen, wenn angefordert oder wenn der Inhalt vielschichtig genug ist, dass sie zur Klarheit beitragen; respektieren Sie eine explizite Anfrage nach minimaler Formatierung; bleiben Sie bei einfacher Prosa in konversationellen oder emotionalen Austauschen.

Zusammenfassungen reproduzieren den Originaltext ohne Kennzeichnung

Die Verschiebung. Beim Zusammenfassen von Dokumenten neigt Fable 5.1 eher dazu, Passagen der Quelle zu reproduzieren, ohne sie als Zitate zu kennzeichnen, als Fable 5.

Die Lösung. Fügen Sie dem System-Prompt ein vollständiges Beispiel hinzu: die Benutzeranfrage, eine korrekte Antwort, die jede Quelle in der eigenen indirekten Rede des Assistenten mit höchstens einem kurzen, gekennzeichneten Zitat wiedergibt, und eine einzeilige Begründung, warum dies korrekt ist. Ersetzen Sie die Tool-Aufruf-Platzhalter in Anthropic's Beispiel durch den Namen Ihres eigenen Tools.

Antworten aus dem Gedächtnis statt Suche bei geringem Aufwand

Die Verschiebung. Bei geringem Aufwand (low effort) ruft Fable 5.1 Such- und Abruftools seltener auf als Fable 5, am deutlichsten bei namentlich genannten Produkten und Modellen, die es erkennt, aber deren Wissen veraltet ist.

Zwei Lösungen. Erhöhen Sie den Aufwand für die betroffenen Runden mit anfragespezifischem Aufwand. Oder weisen Sie das Modell im System-Prompt darauf hin, dass das Erkennen eines Namens aus einem sich schnell entwickelnden Bereich nicht dasselbe ist wie das Kennen seines aktuellen Zustands, dass es vor dem Antworten suchen sollte und dass es den Namen, wie der Benutzer ihn geschrieben hat, in mindestens einer Abfrage verwenden sollte.

Lange Lieferobjekte bei xhigh und max dauern zu lange

Die Verschiebung. Bei xhigh und insbesondere max kann Fable 5.1 einen Großteil eines langen Lieferobjekts in seinem Denkprozess entwerfen und es dann noch einmal als Antwort schreiben, was die Wartezeit und die Ausgabe-Token verdoppelt.

Zwei Lösungen. Führen Sie diese Anfragen mit hohem Aufwand (high) aus und erhöhen Sie den Aufwand nur, wenn Sie einen Gewinn gemessen haben. Wenn Sie bei xhigh oder max bleiben, setzen Sie max_tokens so, dass Platz für Denkprozess und Antwort bleibt, und hängen Sie der Benutzernachricht eine Notiz an, dass alles, was in einer Antwort erzeugt wird, einschließlich der Begründung, zu einem einzigen Limit von etwa Ihren tatsächlichen max_tokens zählt, und dass das vollständige Verfassen des Lieferobjekts als Begründung und noch einmal als Antwort die Runde verdoppelt, ohne sie zu verbessern. Belassen Sie frühere Kopien dieser Notiz bei späteren Anfragen.

Harmlose Coding-Anfragen führen zu einer Ablehnung

Die Verschiebung. Die Klassifikatoren von Fable 5.1 produzieren weniger Fehlalarme als die von Fable 5 bei dessen Einführung, und das Finden von Schwachstellen in Quellcode ist jetzt erlaubt. Fehlalarme treten jedoch weiterhin auf.

Drei Formulierungen zum Ändern. Fragen Sie „Gibt es Fehler in diesem Programm?“ statt „Kompiliert dieses Programm fehlerfrei?“ Geben Sie dem Modell Dokumentationen für weniger bekannte Sprachen. Entfernen Sie Tools, die base64-kodierte Daten in den Kontext zurückgeben. Halten Sie fallbacks trotzdem konfiguriert; die Anleitung zur Ablehnungsbehandlung behandelt dies.

Client-seitige Kompaktierungszusammenfassungen lassen Details weg

Fable 5.1 reagiert gut darauf, wenn ihm genau gesagt wird, was eine Kompaktierungszusammenfassung beibehalten muss. Die serverseitige Kompaktierung macht dies bereits. Wenn Sie auf dem Client komprimieren, weisen Sie das Modell an, innerhalb von <summary>-Tags zusammenzufassen und in dieser Reihenfolge zu bewahren: aufgetretene Schwierigkeiten und wie sie gelöst wurden; Ansätze, die aufgegriffen oder verworfen wurden und warum; alles, was angefragt oder entschieden wurde, genau angegeben; wo die Dinge jetzt stehen; alles, was noch offen ist; und schwer zu rekonstruierende Details wie Namen, Zahlen und Links. Beenden Sie mit „Rufen Sie keine Tools auf, während Sie diese Zusammenfassung schreiben; antworten Sie nur mit Text“, was wichtig ist, wenn die Zusammenfassungsanfrage immer noch die Tools des Gesprächs enthält.

Subagenten und Vision

Zwei Lösungen sind architektonischer Natur statt Prompts. Bei Programmieraufgaben lassen Sie den leitenden Agenten weiterarbeiten, während Subagenten laufen: Lassen Sie das Tool, das einen Subagenten startet, sofort zurückkehren, liefern Sie jedes Ergebnis in einer späteren Benutzernachricht und geben Sie dem leitenden Agenten ein separates Tool, das er aufrufen kann, wenn er warten möchte. Für dichte Diagramme und verschachtelte Tabellen geben Sie dem Modell ein Zuschneidewerkzeug, das einen ausgewählten Bereich vergrößert zurückgibt, oder einen Container mit grundlegenden Bildbibliotheken; bei geringem Aufwand (low effort) kann es das Zuschneiden überspringen, überprüfen Sie daher die Protokolle auf den Aufruf.

Testen von Prompt-Änderungen in Apidog

Jede oben genannte Lösung ist ein Kandidat für einen Vorher-Nachher-Test. Speichern Sie in Apidog die ersten drei Runden Ihrer Agenten-Schleife als Anforderungssequenz, parametrisieren Sie den System-Prompt und führen Sie ihn mit und ohne jeden Schnipsel mit demselben Aufwand aus. Prüfen Sie die Anzahl der tool_use-Blöcke pro Assistentenrunde für die Batching-Lösung, die usage.output_tokens für die gezielte Bearbeitung und Dichte-Lösungen und das Fehlen eines letzten Absatzes, der mit „Als Nächstes werde ich“ beginnt, für die Autonomie-Lösung. Laden Sie Apidog herunter, um es zu erstellen; die Claude Code Anleitung zeigt, welche dieser Zeilen in eine CLAUDE.md gehören.

FAQ

Funktionieren meine Fable 5 Prompts auf Fable 5.1? Anthropic sagt, sie sollten ohne Änderungen gut funktionieren. Die Unterschiede sind verhaltensbezogen: weniger gebündelte Tool-Aufrufe, weniger Fortschritts-Updates, dichtere Prosa, weniger Chat-Formatierung, Umschreibungen ganzer Dateien und Scope Creep bei offenen Aufgaben.

Mit welchem Aufwand-Level sollte ich Fable 5.1 ansprechen? Beginnen Sie mit high und führen Sie eine Testreihe durch. Anthropic sagt, dass medium in etwa Fable 5 zu geringeren Kosten entspricht und low oft konkurrenzfähig mit Opus und Sonnet bei den Kosten pro Aufgabe ist.

Wo platziere ich eine rundenbezogene Anweisung auf Fable 5.1? Als rundenbezogene Systemnachricht mit clear_at: "next_user_message" nach den Tool-Ergebnissen, wobei frühere Kopien beibehalten werden. Das Einfügen und Löschen von Text aus früheren Runden macht spätere Denkblöcke ungültig und startet den Cache neu.

Sollte ich Anweisungen wie „Überprüfen Sie Ihre Arbeit“ wie bei Opus 5 entfernen? Nein. Diese Anleitung bezog sich auf die übermäßige Verifikation von Opus 5. Behalten Sie sie auf Fable 5.1 bei.

Wie verhindere ich, dass Fable 5.1 ganze Dateien umschreibt? Eine Zeile im System-Prompt oder der ersten Benutzernachricht: Minimieren Sie die zum Bearbeiten von Dateien verwendeten Token und bearbeiten Sie gezielt, anstatt neu zu schreiben, wenn dies das Ergebnis nicht beeinflusst.

Praktizieren Sie API Design-First in Apidog

Entdecken Sie eine einfachere Möglichkeit, APIs zu erstellen und zu nutzen