Anthropic hat Claude Fable 5 am 9. Juni 2026 veröffentlicht, und es kam mit einem Preisschild, das eine echte Entscheidung erfordert: Die Frage Claude Fable 5 vs. Opus 4.8 ist im Kern eine Geldfrage. Fable 5 kostet pro Token genau doppelt so viel wie Opus 4.8. Die Eingabe kostet 10 US-Dollar pro Million Token gegenüber 5 US-Dollar für Opus 4.8, und die Ausgabe kostet 50 US-Dollar pro Million gegenüber 25 US-Dollar. Bevor Sie also eine einzige Benchmark-Behauptung lesen, steht die Rechnung fest: derselbe Anbieter, dieselbe Messages API und ein 2-facher Aufpreis für das neuere Modell. Der interessante Teil ist herauszufinden, wann sich dieser Aufpreis bezahlt macht und wann Sie Geld zum Fenster hinauswerfen. Wenn Sie zuerst den vollständigen Hintergrund zum älteren Modell wünschen, deckt unser Leitfaden zu Claude Opus 4.8 ab, was es ist und wo es sich im Sortiment befindet.
TL;DR
Claude Fable 5 und Opus 4.8 gehören derselben Familie an. Fable 5 kostet pro Token genau das Doppelte von Opus 4.8 (10 $/50 $ vs. 5 $/25 $). Für die meisten Chat-, Code-Generierungs- und Retrieval-Aufgaben ist Opus 4.8 die intelligentere Wahl. Greifen Sie zu Fable 5, wenn Sie sehr langfristige, autonome Arbeit benötigen, die über Millionen von Token kohärent bleibt. Andernfalls sparen Sie das Geld.

Claude Fable 5 vs. Opus 4.8 auf einen Blick
Hier ist der Direktvergleich, damit Sie den Kompromiss auf einen Blick sehen können.
| Dimension | Claude Fable 5 | Claude Opus 4.8 |
|---|---|---|
| API-Modell-ID | claude-fable-5 |
claude-opus-4-8 |
| Eingabepreis (pro 1 Mio. Token) | $10.00 | $5.00 |
| Ausgabepreis (pro 1 Mio. Token) | $50.00 | $25.00 |
| Relative Kosten | 2x Opus 4.8 | Basislinie |
| Kontext | Arbeitet über Millionen von Token; keine veröffentlichte feste Zahl | 1M-Token-Kontextfenster |
| Denken und Aufwand | Adaptives Denken | Adaptives Denken + Aufwand (niedrig/mittel/hoch/sehr hoch/maximal) |
| Positionierung | Ein Modell der Mythos-Klasse, sicher für den allgemeinen Gebrauch gemacht; das leistungsfähigste von Anthropic allgemein verfügbare Modell | Sehr leistungsfähig; war vor Fable 5 das leistungsfähigste von Anthropic allgemein verfügbare Modell |
| Am besten geeignet für | Sehr langfristige autonome Arbeit, riesige Migrationen, mehrstündige Agenten | Die meisten Chat-, Code-Generierungs-, RAG- und interaktiven Workloads |
Ein Hinweis zum Kontext: Anthropic hat keine genaue Kontextfenster-Zahl für Fable 5 veröffentlicht. Das Unternehmen beschreibt es als über Millionen von Token hinweg fokussiert bleibend, daher sollte sein Langkontext-Verhalten eher als qualitative Stärke denn als eine Spezifikation behandelt werden, die Sie genau festlegen können. Opus 4.8 hingegen hat ein dokumentiertes 1M-Token-Fenster. Wenn Ihre Entscheidung von einer präzisen Kontextzahl abhängt, ist Opus 4.8 das Modell mit einer Zahl, die Sie in einem Design-Dokument zitieren können; Anthropic’s Modellübersichts-Dokumente listen die veröffentlichten Spezifikationen für das Sortiment auf. Für eine Einführung in einfacher Sprache zum neuen Modell deckt unser Erklärer zu Claude Fable 5 die Grundlagen ab, und unsere Aufschlüsselung der Opus 4.8-Preise geht tiefer auf die Kostenseite ein.
Preis: Fable 5 kostet genau doppelt so viel
Dies ist die klarste Tatsache im gesamten Vergleich, also beginnen Sie hier.
Fable 5 berechnet 10 $ pro Million Eingabe-Token und 50 $ pro Million Ausgabe-Token. Opus 4.8 berechnet 5 $ pro Million Eingabe-Token und 25 $ pro Million Ausgabe-Token. Das Doppelte des Eingabepreises, das Doppelte des Ausgabepreises. Es gibt keinen Sternchenhinweis, keinen gestaffelten Rabatt, der das Verhältnis ändert, und keinen Langkontext-Zuschlag, der es verschiebt. Fable 5 ist durchweg 2x Opus 4.8. Die aktuellen Preise können Sie auf der Preisseite von Anthropic einsehen.
Pro 1.000 Token ergibt sich dies wie folgt:
- Fable 5: 0,010 $ Eingabe, 0,050 $ Ausgabe
- Opus 4.8: 0,005 $ Eingabe, 0,025 $ Ausgabe
Diese Zahlen wirken isoliert winzig, und genau so entgleiten Budgets den Teams. Das Verhältnis ist entscheidend, sobald Volumen ins Spiel kommt.
Betrachten Sie ein realistisches monatliches Beispiel. Angenommen, eine Produktionsfunktion verarbeitet 200 Millionen Eingabe-Token und generiert 40 Millionen Ausgabe-Token in einem Monat. Bei Opus 4.8 sind das 200 x 5 $ + 40 x 25 $, also 1.000 $ + 1.000 $ = 2.000 $. Bei Fable 5 beträgt dieselbe Arbeitslast 200 x 10 $ + 40 x 50 $, also 2.000 $ + 2.000 $ = 4.000 $. Dieselben Token, dieselbe Arbeit, 2.000 $ gegenüber 4.000 $. Der Aufpreis skaliert linear mit der Nutzung, so dass eine Arbeitslast, die den ganzen Tag, jeden Tag läuft, ihre Modellkosten verdoppelt, sobald Sie die Modellzeichenfolge austauschen.
Dieser Rahmen ist wichtig, da die Upgrade-Entscheidung nicht lautet: „Ist Fable 5 besser?“. Das ist es fast immer. Die Entscheidung lautet: „Ist Fable 5 gut genug, um die Verdopplung dieses spezifischen Postens zu rechtfertigen?“. Für ein internes Tool mit geringem Volumen könnten 2.000 $ extra pro Monat unerheblich sein. Für einen kundenorientierten Endpunkt mit hohem Volumen kann es den Unterschied zwischen einer gesunden und einer roten Marge ausmachen. Preisgestalten Sie die Arbeitslast, nicht das Modell. Wenn Sie eine tiefere Kostenanalyse der günstigeren Option wünschen, lesen Sie unsere Opus 4.8-Preisanalyse; speziell für die Preisliste des neuen Modells enthält unser Claude Fable 5-Preisleitfaden die Details.
Fähigkeit: Wo Fable 5 die Nase vorn hat
Fable 5 ist keine Marketing-Umgestaltung von Opus 4.8. Es ist ein wirklich leistungsfähigeres Modell, und der Unterschied zeigt sich am deutlichsten bei langer, autonomer Arbeit.
In seiner Claude Fable 5-Ankündigung beschreibt Anthropic Fable 5 als ein Modell der Mythos-Klasse, das für den allgemeinen Gebrauch sicher gemacht wurde, das leistungsfähigste Modell, das das Unternehmen allgemein verfügbar gemacht hat. Es wurde für sehr langfristige autonome Arbeit entwickelt und bleibt über Millionen von Token hinweg fokussiert. Diese letzte Phrase ist die gesamte Verkaufsstrategie. Viele Modelle können eine gute Funktion schreiben oder eine Frage beantworten. Weitaus weniger können stundenlang laufen, einen kohärenten Plan über eine enorme Menge an Kontext aufrechterhalten und am Ende immer noch gute Entscheidungen treffen.
Die klarste Demonstration ist das Stripe-Ergebnis. Fable 5 führte in einem einzigen Tag eine Migration einer 50 Millionen Zeilen umfassenden Ruby-Codebasis für Stripe durch, eine Arbeit, die das Team auf zwei Monate oder länger geschätzt hatte. Das ist keine Benchmark-Abstraktion. Es ist eine echte Migration einer echten Codebasis in einem Maßstab, bei dem der Engpass die anhaltende Kohärenz ist, nicht die reine Qualität pro Token. Ein Modell, das nach einigen Hunderttausend Token abschweift oder den Faden verliert, kann diese Aufgabe zu keinem Preis erledigen. Dies ist die Arbeitslast, für die Fable 5 entwickelt wurde.
Der Speicher verstärkt den Unterschied. In einem Slay the Spire-Test führte die Zuweisung von persistentem Dateispeicher zu Fable 5 zu einer 3-fachen Verbesserung gegenüber Opus 4.8. Die Lehre lässt sich gut über ein Kartenspiel hinaus verallgemeinern: Wenn eine Aufgabe viele Schritte umfasst und das Modell Notizen an sich selbst schreiben und zurücklesen kann, verstärkt Fable 5 diesen Speicher zu deutlich besseren Ergebnissen über lange Laufzeiten. Wenn Ihr Agent ein Scratchpad, eine Plandatei oder einen strukturierten Speicher über eine lange Sitzung hinweg pflegt, ist das genau die Konfiguration, in der die langfristige Stärke von Fable 5 zu messbaren Erfolgen führt.
Bei Benchmarks erreichte Fable 5 in fast allen Fällen State-of-the-Art-Platzierungen. Es übertraf unter anderem FrontierCode und FrontierBench von Cognition, CursorBench und Hebbias Finance Benchmark. Anthropic hat keine öffentlichen Ergebnisse dafür veröffentlicht, daher sollten die Platzierungen eher als richtungsweisend denn als zitierbare Zahlen betrachtet werden. Das Muster ist konsistent: Fable 5 führt bei Code-, Agenten- und finanzbezogenen Bewertungen. Die Erkenntnis ist kein Leaderboard-Delta; es ist vielmehr, dass das Modell bei den Arten von schwierigen, mehrstufigen Aufgaben, die sich auf kostspielige reale Arbeit übertragen lassen, an oder nahe der Spitze liegt.
Noch etwas Wissenswertes für einen fairen Vergleich: Fable 5 verfügt über Schutzmechanismen, die bestimmte sensible Abfragen, Cybersicherheit, Biologie und Chemie sowie Modell-Destillationsanfragen an Opus 4.8 weiterleiten, anstatt direkt zu antworten. Anthropic gibt an, dass dies in weniger als 5 % der Sitzungen auftritt, so dass es den normalen Gebrauch selten beeinträchtigt, aber es ist ein echter Verhaltensunterschied. Bei den meisten Arbeitslasten werden Sie ihn nie sehen. Für einen direkten Vergleich mit anderen Anbietern stellen unser Opus 4.8 versus GPT-5.5 und Gemini 3.5 Vergleich und der passende Fable 5 versus GPT-5.5 und Gemini 3.5 Artikel jedes Modell dem breiteren Feld gegenüber.
Wo Opus 4.8 die intelligentere Wahl ist
Dies ist der Teil, den die Startankündigungen gerne überspringen: Für einen Großteil der Produktionsarbeit ist Opus 4.8 die wirtschaftlich bessere Wahl, und das bei weitem.
Opus 4.8 war vor der Einführung von Fable 5 das leistungsfähigste, allgemein verfügbare Modell von Anthropic. Es wurde nicht schlechter an dem Tag, an dem Fable 5 veröffentlicht wurde. Es ist immer noch ein starkes Modell der Frontier-Klasse mit einem dokumentierten 1M-Token-Kontextfenster, adaptivem Denken und dem vollen Aufwandsbereich von niedrig bis maximal. Für die meisten Chat-Schnittstellen, die meisten Code-Generierungen und die meisten Retrieval-Augmented Generations liefert Opus 4.8 hervorragende Ergebnisse zum halben Token-Preis. Wenn die Aufgabe bequem in eine Million Token passt und in einer Runde oder einer kurzen Schleife gelöst wird, zahlen Sie sehr wahrscheinlich doppelt für Spielraum, den Sie bei der Wahl von Fable 5 nicht nutzen werden.
Drei Arten von Arbeitslasten tendieren stark zu Opus 4.8:
- Interaktiver Chat und Assistenten, bei denen jeder Zug kurz ist, Latenz wichtig ist und das Modell selten einen mehrstündigen Plan aufrechterhalten muss.
- Code-Generierung und -Überprüfung auf Funktions-, Datei- oder Pull-Request-Ebene, wo der Kontext begrenzt ist und die Aufgabe schnell abgeschlossen wird.
- RAG und Dokumenten-Q&A, wo Sie relevanten Kontext in ein 1M-Token-Fenster packen und eine fokussierte Frage stellen. Das Fenster ist hier der Trumpf, und Opus 4.8 hat ein dokumentiertes.
Es gibt auch ein stillschweigend überzeugendes Argument, das im Design von Fable 5 selbst verborgen liegt. Wenn Fable 5 eine seiner Schutzmechanismen-Kategorien erreicht, leitet es die Abfrage an Opus 4.8 weiter. Das neuere Modell greift bei sensiblen Fällen buchstäblich auf das ältere zurück. Das ist ein starkes Signal dafür, dass Opus 4.8 vertrauenswürdig, leistungsfähig und gut genug ist, um bei echtem Traffic als Flaggschiff zu fungieren. Wenn es das Sicherheitsnetz unter dem teuersten Modell ist, das Anthropic verkauft, ist es mehr als ausreichend für den Großteil Ihrer alltäglichen Anfragen.
Der kostensensible Standard ist daher unkompliziert: Beginnen Sie mit Opus 4.8, messen Sie und aktualisieren Sie nur die spezifischen Arbeitslasten, die eine langfristige Autonomie benötigen. Wenn selbst Opus 4.8 mehr ist, als eine Arbeitslast benötigt, liegt Claude Sonnet 4.6 darunter mit 3 $ Eingabe und 15 $ Ausgabe und bewältigt hochvolumige, einfachere Aufgaben zu einem Bruchteil der Kosten. Für Setup-Details zu den günstigeren Claude-Stufen führt unser Opus 4.8 API-Leitfaden durch die Aufrufe.
Ein Entscheidungsrahmen: Welches sollten Sie wählen?
Ignorieren Sie das Bauchgefühl und entscheiden Sie nach Arbeitslast. Diese Regeln decken die meisten realen Fälle ab.
- Kurze, einmalige Aufgaben (Chat, Klassifizierung, Extraktion, ein kurzes Code-Snippet): Verwenden Sie Opus 4.8. Der 2-fache Aufpreis bringt Ihnen hier nichts, da die Aufgabe den langfristigen Vorteil von Fable 5 niemals ausnutzt.
- Begrenzte Code-Generierung und -Überprüfung (eine Funktion, eine Datei, ein PR): Verwenden Sie Opus 4.8. Starke Ergebnisse, halbe Kosten, und der Kontext passt.
- RAG, Dokumenten-Q&A und Analyse innerhalb eines 1M-Token-Fensters: Verwenden Sie Opus 4.8. Das dokumentierte Millionen-Token-Fenster ist das Feature, für das Sie bezahlen, und Opus 4.8 hat es.
- Mehrstündige autonome Agenten, die über eine sehr lange Laufzeit kohärent bleiben müssen: Verwenden Sie Fable 5. Dies ist die Arbeitslast, für die es entwickelt wurde, und der Kohärenz-Vorsprung rechtfertigt den Preis.
- Riesige Migrationen und Refaktorierungen, die eine enorme Codebasis auf einmal umfassen: Verwenden Sie Fable 5. Die 50-Millionen-Zeilen-Migration von Stripe ist das Vorbild. In diesem Maßstab ist anhaltende Konzentration der Engpass, und Fable 5 beseitigt ihn.
- Langlaufende Agenten mit persistentem Speicher: Verwenden Sie Fable 5. Das 3-fache Speicherergebnis zeigt, dass der kumulative Nutzen über lange Sitzungen real ist.
- Kosten sind die harte Beschränkung: Verwenden Sie Opus 4.8, oder wechseln Sie zu Sonnet 4.6 für hochvolumige, einfache Arbeiten. Reservieren Sie Fable 5 für die wenigen Aufgaben, die es wirklich benötigen.
Die Metaregel: Standardmäßig Opus 4.8 verwenden, und dann einzelne Arbeitslasten nur dann auf Fable 5 hochstufen, wenn sie einen Bedarf an langfristiger Autonomie zeigen. Die Verdopplung der Kosten auf breiter Front, weil eine einzige Aufgabe davon profitiert, ist der häufigste Weg, wie Teams bei einem Flaggschiff-Modell zu viel ausgeben.
Wechsel zwischen ihnen im Code
Die gute Nachricht für alle, die diese Entscheidung abwägen: Der Wechsel ist trivial. Beide Modelle befinden sich hinter derselben Messages API. Es gibt keine SDK-Migration, keinen neuen Authentifizierungsablauf, keinen umgestalteten Request-Body. Sie ändern die Modell-ID-Zeichenfolge und nichts anderes. claude-fable-5 für das neue Modell, claude-opus-4-8 für das günstigere.
import anthropic
client = anthropic.Anthropic()
# Günstiger, Frontier-Tier-Standard
response = client.messages.create(
model="claude-opus-4-8", # für das Flaggschiff auf "claude-fable-5" wechseln
max_tokens=16000,
thinking={"type": "adaptive"},
messages=[{"role": "user", "content": "Summarize this design doc and list open questions."}],
)
for block in response.content:
if block.type == "text":
print(block.text)
Da der einzige Unterschied die Modellzeichenfolge ist, können Sie pro Anfrage routen. Senden Sie den alltäglichen Traffic an claude-opus-4-8 und ändern Sie die Zeichenfolge auf claude-fable-5 für die wenigen Aufgaben, die langfristige Autonomie erfordern, alles vom selben Client und demselben Codepfad aus. Das macht eine standardmäßig günstige, bei Bedarf aufrüstbare Strategie einfach umzusetzen: Ein einzelner Konfigurationswert oder eine einzeilige Bedingung entscheidet, welches Modell eine bestimmte Anfrage verarbeitet. Für die vollständige Anfrageschnittstelle des älteren Modells lesen Sie unseren Opus 4.8 API-Walkthrough; der passende Fable 5 API-Leitfaden behandelt das neue Modell.
Vergleichen Sie sie selbst mit Apidog
Preistabellen und Benchmark-Behauptungen bringen Sie nur bedingt weiter. Der ehrlichste Weg, die Frage Claude Fable 5 vs. Opus 4.8 für Ihre Arbeitslast zu klären, ist, denselben Prompt an beide Modell-IDs zu senden und zu sehen, was zurückkommt. Das ist eine Aufgabe, die Apidog sauber erledigt.
Richten Sie eine Anfrage an die Anthropic Messages API ein, duplizieren Sie diese dann und ändern Sie nur das Modellfeld, claude-fable-5 in der einen, claude-opus-4-8 in der anderen. Senden Sie beide mit einem Prompt, der tatsächlich Ihrem Produktionstraffic ähnelt, nicht einer Spielzeugfrage. Vergleichen Sie dann die beiden Antworten nebeneinander: Welche Antwort ist korrekter, welche vollständiger, und ob der Qualitätsunterschied groß genug ist, um für Ihren Anwendungsfall relevant zu sein.
Apidog zeigt auch die Zahlen an, die die Kostenentscheidung beeinflussen. Sie können die Latenz bei jedem Aufruf beobachten und die Token-Nutzung direkt aus jeder Antwort ablesen, einschließlich der Eingabe- und Ausgabezahlen, die bestimmen, was Sie tatsächlich bezahlen werden. Legen Sie die Nutzung beider Modelle neben den Qualitätsunterschied, und der 2-fache Aufpreis ist nicht mehr abstrakt. Sie können für Ihren echten Prompt sehen, ob die Ausgabe von Fable 5 die zusätzlichen Token und Dollars wert ist oder ob Opus 4.8 die Aufgabe bereits erledigt. Speichern Sie die beiden Anfragen als kleine Sammlung, und Sie haben ein wiederholbares A/B-Harness, das Sie jederzeit erneut ausführen können, wenn sich Ihre Prompts ändern oder ein neues Modell erscheint. Wenn Sie es ausprobieren möchten, Laden Sie Apidog herunter und erstellen Sie die beiden Anfragen in wenigen Minuten. Es ist ein schnellerer Weg zu einer sicheren Antwort, als ein weiteres Datenblatt zu lesen, und Apidog hält den gesamten Vergleich an einem Ort.

