Claude Fable 5.1 Preise: Detaillierte Kostenübersicht (2026)

Claude Fable 5.1 Preisgestaltung: $10/$50 pro MTok, $0,25 für Cache-Lesevorgänge (75 % unter Fable 5), Batch-Raten und die durchgerechnete Kostenkalkulation hinter den 25 % und 45 % Einsparungsansprüchen.

INEZA Felin-Michel

INEZA Felin-Michel

2 September 2026

Claude Fable 5.1 Preise: Detaillierte Kostenübersicht (2026)

Apidog für Unternehmen

On-Premises Bereitstellung

SSO & RBAC

SOC 2 konform

Apidog Enterprise entdecken

Claude Fable 5.1 kostet 10 $ pro Million Eingabe-Tokens und 50 $ pro Million Ausgabe-Tokens, genau wie Fable 5. Die Zahl, die sich geändert hat, sind die prompt-Cache-Lesevorgänge: 0,25 $ pro Million Tokens, ein Rückgang von 1 $ bei Fable 5 und die Hälfte der 0,50 $ von Opus 5. Anthropic schätzt, dass dies typische Arbeitslasten um etwa 25 % günstiger macht als Fable 5 und hochgradig agentische Arbeitslasten um bis zu 45 % günstiger.

Dieser Leitfaden stellt jeden Tarif auf der offiziellen Preisgestaltungsseite dar, wiederholt die Behauptungen von 25 % und 45 %, damit Sie Ihre eigene Cache-Hit-Rate einsetzen können, zeigt drei Beispiele für tatsächliche Kosten pro Aufgabe und listet die Faktoren auf, die die Rechnung beeinflussen. Wenn Sie zuerst einen Modellüberblick wünschen, lesen Sie was Claude Fable 5.1 ist.

Claude Fable 5.1 Preistabelle

Tarif Claude Fable 5.1
Basiseingabe 10 $ pro Million Tokens
Ausgabe 50 $ pro Million Tokens
5-Minuten-Cache-Schreibvorgang 12,50 $ pro Million (1,25x Eingabe)
1-Stunden-Cache-Schreibvorgang 20 $ pro Million (2x Eingabe)
Cache-Lesevorgang (Treffer oder Aktualisierung) 0,25 $ pro Million (0,025x Eingabe)
Batch-API-Eingabe 5 $ pro Million
Batch-API-Ausgabe 25 $ pro Million
Long-Context-Premium Keine; das gesamte 1M-Fenster wird zu Standardtarifen abgerechnet
inference_geo: "us" 1,1x auf jede Token-Kategorie
Schnellmodus Nicht verfügbar (nur Opus 5 und Opus 4.8)
Prioritätsstufe Nicht unterstützt
Websuche 10 $ pro 1.000 Suchen, plus Tokens

Claude Mythos 5.1 hat die gleichen Tarife. Der Batch-Rabatt und die Cache-Multiplikatoren addieren sich, sodass ein Batch-Cache-Lesevorgang 0,125 $ pro Million kostet.

Wie sich der Cache-Lese-Preis vergleicht

Modell Basiseingabe Cache-Lesevorgang Cache-Lesevorgang als Anteil der Eingabe
Claude Fable 5.1 10 $ 0,25 $ 2,5%
Claude Fable 5 10 $ 1,00 $ 10%
Claude Opus 5 5 $ 0,50 $ 10%
Claude Opus 4.8 5 $ 0,50 $ 10%
Claude Sonnet 5 2 $ 0,20 $ 10%
Claude Haiku 4.5 1 $ 0,10 $ 10%

Jedes andere Claude-Modell bepreist einen Cache-Treffer mit 10 % der Basiseingabe. Fable 5.1 bepreist ihn mit 2,5 %. Der praktische Effekt: Ein Fable 5.1-Cache-Treffer ist günstiger als ein Opus 5-Cache-Treffer, obwohl die nicht gecachte Eingabe von Fable 5.1 doppelt so teuer ist. Bei einer Arbeitslast, bei der die meisten Eingabe-Tokens im Cache-Präfix liegen, kann der effektive Eingabepreis bei Fable 5.1 unter den von Opus 5 fallen.

Eine Anmerkung zu Sonnet 5, da der Vergleich von Opus 5 und Sonnet 5 auf eine Preiserhöhung im September hingewiesen hatte: Anthropic hat sie abgesagt. Sonnet 5 bleibt bei 2 $ und 10 $.

Reproduktion der 25 %- und 45 %-Behauptungen

Anthropic hat die Arbeitslastzusammensetzung hinter diesen Schätzungen nicht veröffentlicht, daher ist dies als eine Rekonstruktion zu betrachten, die zeigt, welche Cache-Hit-Rate sie implizieren, und nicht als deren exaktes Modell.

Eine Anfrage habe U nicht gecachte Eingabe-Tokens, C gecachte Eingabe-Tokens und O Ausgabe-Tokens. Die Kosten pro Million bei Fable 5 betragen 10U + 1.0C + 50O; bei Fable 5.1 betragen sie 10U + 0.25C + 50O. Die Ersparnis beträgt 0.75C, und die prozentuale Ersparnis ist 0.75C / (10U + C + 50O).

Eine typische Chat-Arbeitslast. Nehmen wir an: 20.000 gecachte Tokens, 2.000 nicht gecachte Eingabe-Tokens und 1.500 Ausgabe-Tokens pro Anfrage. Fable 5: 10(0.002) + 1.0(0.02) + 50(0.0015) = 0,02 $ + 0,02 $ + 0,075 $ = 0,115 $. Fable 5.1: 0,02 $ + 0,005 $ + 0,075 $ = 0,100 $. Ersparnis: 13 %. Um Anthropic’s 25 % zu erreichen, muss der gecachte Anteil relativ zur Ausgabe größer sein, zum Beispiel 60.000 gecachte Tokens gegenüber den gleichen 1.500 Ausgabe-Tokens, was 0,155 $ vs. 0,110 $ ergibt, eine Ersparnis von 29 %.

Ein agentischer Loop. Ein Agent, der auf jeder von 40 Tool-Call-Runden ein 150.000-Tokens großes gecachtes Präfix erneut liest, 1.000 nicht gecachte Tokens pro Runde hinzufügt und 800 Ausgabe-Tokens pro Runde produziert. Pro Runde bei Fable 5: 10(0.001) + 1.0(0.15) + 50(0.0008) = 0,01 $ + 0,15 $ + 0,04 $ = 0,20 $. Bei Fable 5.1: 0,01 $ + 0,0375 $ + 0,04 $ = 0,0875 $. Ersparnis: 56 % pro Runde, vor dem einmaligen Cache-Schreibvorgang. Über 40 Runden sind das 8,00 $ vs. 3,50 $. Anthropic’s „bis zu 45 %“ liegt komfortabel in diesem Bereich, wenn man die Cache-Schreibvorgänge und die nicht gecachten Runden hinzurechnet, die jeder echte Agent hat.

Die daraus resultierende Regel: Die Ersparnis skaliert mit dem Verhältnis von gecachtem Input zu Output. Arbeitslasten, die output-lastig sind (lange Generierungen aus kurzen Prompts), bemerken die Änderung kaum. Arbeitslasten, die präfix-lastig sind (Agenten, RAG mit großem stabilem Kontext, mehrstufige Support-Bots), sehen den vollen Effekt.

Drei durchgerechnete Kosten-pro-Aufgabe-Beispiele

Alle drei gehen von Fable 5.1 zu den Standardtarifen aus, wobei der 5-Minuten-Cache-Schreibvorgang einmalig bezahlt wird.

1. Eine einzelne Code-Überprüfung. 30.000 Eingabe-Tokens (der Diff plus ein System-Prompt), 4.000 Ausgabe-Tokens, kein Cache. Eingabe 0,30 $, Ausgabe 0,20 $. Gesamt: **0,50 $**. Die gleiche Überprüfung auf Opus 5 kostet 0,25 $. Dies ist der Fall, in dem Fable 5.1 einfach doppelt so teuer ist, da nichts gecacht wird.

2. Ein Support-Gespräch mit 25 Runden. Ein 12.000-Tokens umfassender stabiler System-Prompt, einmal gecacht (0,15 $ für den Schreibvorgang), dann 25 Runden, die jeweils 300 nicht gecachte Eingabe-Tokens und 250 Ausgabe-Tokens hinzufügen, wobei das Präfix aus dem Cache geliefert wird. Nicht gecachte Eingabe über das gesamte Gespräch: 7.500 Tokens = 0,075 $. Cache-Lesevorgänge: 25 x 12.000 = 300.000 Tokens = 0,075 $. Ausgabe: 6.250 Tokens = 0,3125 $. Gesamt: **ca. 0,61 $**. Bei Fable 5 würden allein die Cache-Lesevorgänge 0,30 $ betragen, für ein Gesamt von fast 0,84 $.

3. Ein zweistündiger agentischer Build. 120 Tool-Call-Runden gegen ein Präfix, das von 20.000 auf 200.000 Tokens anwächst (Durchschnitt 110.000 gecacht), 1.500 nicht gecachte Tokens pro Runde, 1.200 Ausgabe-Tokens pro Runde und etwa sechs Cache-Aktualisierungen, wenn das Präfix wächst. Cache-Lesevorgänge: 120 x 110.000 = 13,2 Mio. Tokens = 3,30 $. Nicht gecachte Eingabe: 180.000 Tokens = 1,80 $. Ausgabe: 144.000 Tokens = 7,20 $. Cache-Schreibvorgänge: ungefähr 660.000 Tokens zu 12,50 $ = 8,25 $. Gesamt: **ungefähr 20,55 $**. Bei Fable 5 würden die Cache-Lesevorgänge 13,20 $ statt 3,30 $ betragen, für ein Gesamt von fast 30,45 $. Das ist eine Ersparnis von 33 % bei einem Lauf, bei dem die Ausgabe immer noch der größte Posten ist.

Beachten Sie in Beispiel 3, dass Cache-Schreibvorgänge jetzt die zweitgrößten Kosten sind. Das ist die Kehrseite günstiger Lesevorgänge: Ein Fehlschlag ist 40-mal so teuer wie ein Treffer, sodass alles, was den Cache mitten in der Sitzung zurücksetzt (Wiederaufbau des System-Prompts, Bearbeiten einer früheren Runde, Ändern des Tool-Arrays), im Verhältnis zum stabilen Zustand weit mehr kostet als bei Fable 5.

Die Hebel, die die Rechnung beeinflussen

Aufwand (Effort). output_config.effort ist der größte einzelne Hebel für Ausgabe-Tokens, und die Ausgabe kostet 50 $ pro Million. Anthropic empfiehlt für Fable 5.1, mit high zu beginnen, und behauptet, dass medium in etwa der Qualität von Fable 5 zu geringeren Kosten entspricht, während low oft mit Opus und Sonnet bei den Kosten pro Aufgabe konkurrenzfähig ist. Führen Sie den Vergleich (sweep) auf Ihren eigenen Bewertungen (evals) durch. Die Beta-Funktion für den Aufwand pro Nachricht (per-message effort beta) ermöglicht es Ihnen, für routinemäßige Runden auf low zu wechseln und für schwierige Runden zu erhöhen, ohne den Cache zurückzusetzen.

Halten Sie den Cache warm. Prompt-Caching ist der Rabatt. Bei Lesevorgängen zu 0,25 $ und Schreibvorgängen zu 12,50 $ liegt der Break-Even-Punkt für die 5-Minuten-TTL bei einem Treffer. Für Leerlaufzeiten zwischen fünf und sechzig Minuten ist ein max_tokens: 0 Keep-Alive-erneuter-Sendeversuch bei der 5-Minuten-TTL in der Regel günstiger, als das 2-fache für den Schreibvorgang für die 1-Stunden-TTL zu zahlen. Und dieselbe "append-only"-Disziplin, die Denkblöcke bei diesem Modell bewahrt, bewahrt den Cache: niemals system oder tools mitten in der Sitzung neu aufbauen, Systemnachrichten während des Gesprächs für Änderungen verwenden und rundenbezogene Nachrichten für rundenbezogene Erinnerungen nutzen.

Stapeln (Batch) Sie, was warten kann. Die Batch-API halbiert alles, sodass eine Fable 5.1 Batch-Anfrage 5 $ und 25 $ kostet, derselbe Preis wie Opus 5’s synchroner Preis. Bewertungen (Evals), Nacherfassungen (Backfills) und nächtliche Dokumentenverarbeitung gehören dorthin. Beachten Sie, dass fallbacks bei Batches abgelehnt werden, sodass abgelehnte Elemente manuell erneut eingereicht werden müssen.

Wählen Sie die Stufe pro Route. Anthropic’s eigene Dokumentation besagt, dass man mit Opus 5 beginnen und zu Fable 5.1 wechseln sollte, wenn Opus 5 bei höherem Aufwand immer noch nicht ausreicht. Für Routen, bei denen Opus 5 Ihre Bewertungen (evals) besteht, zahlen Sie das Doppelte für nichts. Der Vergleich von Fable 5.1 und Opus 5 erläutert die Entscheidung nach Arbeitslast.

Achten Sie auf den Tool-Overhead. Jede Anfrage mit Tools enthält einen versteckten System-Prompt für die Tool-Nutzung. Anthropic veröffentlicht die Anzahl für Opus 5 (286 Tokens), hat aber noch keine Fable 5.1-Zahl veröffentlicht, also messen Sie sie mit dem Token-Zähl-Endpunkt. Ein Browser-Toolset fügt etwa 6.600 Tokens pro Anfrage hinzu und das Computer-Toolset etwa 4.500, alle nach dem ersten Senden gecacht.

Ablehnungen sind kostenlos, Wiederholungen nicht. Eine Klassifizierer-Ablehnung vor jeder Ausgabe wird nicht abgerechnet. Ein serverseitiger Fallback berechnet die Tarife des Fallback-Modells für den erneuten Versuch, und Anthropic’s Fallback-Guthaben erstattet die Cache-Kosten des Wechsels. Erfassen Sie Ablehnungen als eigene Metrik, damit Sie wissen, wie viel Ihrer Fable 5.1-Ausgaben von Opus 5 bedient werden.

Die meisten der allgemeinen Techniken in unserem Leitfaden zur Reduzierung einer Claude API-Rechnung gelten weiterhin, wobei die Cache-Lese-Berechnung zugunsten von Fable 5.1 verschoben wurde.

Was Sie bei Fable 5.1 nicht kaufen können

Der Schnellmodus (Fast mode) ist nur für Opus 5 und Opus 4.8 verfügbar, zu 10 $ und 50 $. Es gibt keine Möglichkeit, für eine schnellere Fable 5.1-Ausgabe zu bezahlen. Der Prioritäts-Tier (Priority Tier) wird auf Fable 5.1 oder Mythos 5.1 nicht unterstützt, während Fable 5 ihn beibehält, sodass die Kapazitätsplanung von Unternehmen, die davon abhängt, bei Fable 5 bleiben oder zu Opus 5 wechseln muss. Und die Null-Daten-Aufbewahrung (zero data retention) ist nicht verfügbar, es sei denn, Anthropic genehmigt sie ausdrücklich; eine ZDR-Organisation erhält bei jeder Anfrage einen 400er-Fehler.

Überprüfen Ihrer tatsächlichen Ausgaben in Apidog

Die einzige zuverlässige Methode, um die Kosten einer Anfrage zu erfahren, ist das usage-Objekt, und der schnellste Weg, es zu lesen, ist eine Testsammlung. Speichern Sie in Apidog Ihren Produktionssystem-Prompt als Anfrage mit cache_control, senden Sie ihn zweimal und fügen Sie Zusicherungen (assertions) für usage.cache_creation_input_tokens beim ersten Senden und usage.cache_read_input_tokens beim zweiten hinzu. Fügen Sie dann ein Post-Response-Skript hinzu, das jedes Feld mit seinem Tarif multipliziert und die Kosten pro Anfrage protokolliert. Führen Sie die Sammlung immer dann aus, wenn Sie einen Prompt oder eine Tool-Definition ändern, und Sie werden eine Cache-invalidierende Änderung erkennen, bevor sie sich auf die Rechnung auswirkt. Laden Sie Apidog herunter, um dies zu erstellen; die API-Anleitung zeigt die genauen Anfragen.

Fable 5.1 Preisgestaltung in den Claude Apps

API-Preise sind pro Token. In den Claude-Apps wird Fable 5.1 nach Plan abgerechnet. Max-Pläne beinhalten Fable-Modelle für bis zu 50 % des wöchentlichen Nutzungslimits ohne zusätzliche Kosten, danach wird mit Nutzungsguthaben fortgefahren. Pro- und Standard-Team-Plätze rechnen Fable 5.1 ab der ersten Nachricht über Nutzungsguthaben ab. Für Enterprise-Standard-Plätze müssen Nutzungsguthaben für die Nutzung über die Plan-Limits hinaus aktiviert werden, und nutzungsbasierte Enterprise-Rechnungen erfolgen zu Standard-API-Tarifen. Anfragen, die die Schutzmaßnahmen (safeguards) an ein anderes Modell umleiten, werden nicht zu Fable-Preisen berechnet. Der Leitfaden für kostenlose und günstigste Wege erklärt, was das in der Praxis bedeutet.

FAQ

Wie viel kostet Claude Fable 5.1 pro Million Tokens? 10 $ Eingabe und 50 $ Ausgabe, unverändert gegenüber Fable 5. Cache-Lesevorgänge kosten 0,25 $ pro Million, Cache-Schreibvorgänge 12,50 $ (5 Minuten) und 20 $ (1 Stunde), und die Batch-API kostet 5 $ und 25 $.

Ist Claude Fable 5.1 günstiger als Fable 5? Pro Token, nein. In der Praxis ja, für alles, was Prompt-Caching verwendet, da die Cache-Lesevorgänge von 1 $ auf 0,25 $ pro Million gesunken sind. Anthropic schätzt, dass es bei typischen Arbeitslasten um 25 % günstiger ist und bei agentischen Arbeitslasten um bis zu 45 %. Output-lastige Arbeitslasten sehen kaum Veränderungen.

Ist Claude Fable 5.1 günstiger als Opus 5? Ohne Cache, nein: Es ist genau doppelt so teuer. Mit Cache kehrt sich das Bild um: Ein Fable 5.1-Cache-Treffer (0,25 $) kostet die Hälfte eines Opus 5-Cache-Treffers (0,50 $). Die Ausgabe beträgt immer noch 50 $ vs. 25 $, daher gewinnt Opus 5 bei jeder output-lastigen Route.

Hat Claude Fable 5.1 einen Schnellmodus oder einen Prioritäts-Tier? Nein, beides nicht. Der Schnellmodus ist nur für Opus 5 und Opus 4.8. Der Prioritäts-Tier wird auf Fable 5, aber nicht auf Fable 5.1 unterstützt.

Gibt es eine Long-Context-Premium auf Claude Fable 5.1? Nein. Das volle 1M-Token-Fenster wird zu Standardtarifen abgerechnet, und Cache- sowie Batch-Rabatte gelten dafür.

Was kostet Claude Fable 5.1 auf Bedrock oder Google Cloud? Diese Plattformen legen ihre eigenen Preise fest und fügen einen 10 %igen Aufschlag für regionale Endpunkte hinzu. Claude Platform auf AWS und Microsoft Foundry rechnen zu den Standard-API-Tarifen über Claude Consumption Units ab. Unser Leitfaden zur Cloud-Verfügbarkeit behandelt die Einrichtung auf jeder Plattform.

Praktizieren Sie API Design-First in Apidog

Entdecken Sie eine einfachere Möglichkeit, APIs zu erstellen und zu nutzen