Claude Opus 5 ist Anthropic's neuestes Modell der Opus-Tier-Klasse, das am 24. Juli 2026 veröffentlicht wurde. Anthropic positioniert es für komplexes agentisches Coding und Unternehmensaufgaben, und die Dokumentation nennt es nun den Standard-Startpunkt: Wenn Sie unsicher sind, welches Modell Sie verwenden sollen, beginnen Sie mit Claude Opus 5. Die entscheidende Zahl ist der Preis. Opus 5 kostet 5 US-Dollar pro Million Input-Tokens und 25 US-Dollar pro Million Output-Tokens, der gleiche Tarif wie Opus 4.8 und die Hälfte dessen, was Fable 5 verlangt.
Dieser Leitfaden behandelt die Spezifikationen, das Preis-Leistungs-Verhältnis, die Launch-Benchmarks von Anthropic und welches Gewicht man ihnen beimessen sollte, die zwei API-Änderungen, die bestehenden Opus 4.8-Code unterbrechen, wo Sie das Modell ausführen können, und die Grenzen, die Anthropic offen kommuniziert. Wenn Sie das Modell über HTTP aufrufen, können Sie diese Anfragen in Apidog senden und prüfen, während Sie arbeiten.
Claude Opus 5 auf einen Blick
| Spezifikation | Wert |
|---|---|
| API-Modell-ID | claude-opus-5 (ohne Datumssuffix) |
| Veröffentlicht | 24. Juli 2026 |
| Kontextfenster | 1.000.000 Tokens, Standard und Maximum |
| Maximale Ausgabe | 128.000 Tokens über die Messages API; 300.000 über die Batch API mit dem Beta-Header output-300k-2026-03-24 |
| Basispreise | 5 $ pro Million Input-Tokens, 25 $ pro Million Output-Tokens |
| Wissensstichtag | Mai 2026 |
| Adaptives Denken | Standardmäßig aktiviert |
| Aufwandsstufen | low, medium, high, xhigh, max; Standard ist high |
| Priority Tier | Nicht unterstützt |
| Verfügbarkeit | Claude API, claude.ai, Claude Code, Claude Cowork, Amazon Bedrock, Claude Platform auf AWS, Google Cloud, Microsoft Foundry, GitHub Copilot |
Drei dieser Zeilen verdienen einen zweiten Blick.
Das 1M Kontextfenster ist sowohl Standard als auch Maximum und benötigt keinen Beta-Header. Es gibt auch keinen Preisaufschlag für lange Kontexte, sodass ein 900.000-Token-Prompt zum gleichen Token-Tarif wie ein 900-Token-Prompt abgerechnet wird.
Der Wissensstichtag Mai 2026 ist der aktuellste aller aktuellen Claude-Modelle. Fable 5 und Sonnet 5 liegen beide bei Januar 2026, sodass Opus 5 etwa vier zusätzliche Monate an Bibliotheken, Releases und API-Änderungen kennt, ohne dass Sie diese selbst einfügen müssen.
Priority Tier ist das einzige Feature, das sich zurückentwickelt hat. Opus 4.8 unterstützt es; Opus 5 nicht. Wenn Ihre Unternehmenskapazitätsplanung vom Priority Tier abhängt, ist dies eine echte Einschränkung und wird im Migrationsleitfaden behandelt.
Für die vollständige Modellübersicht und jedes Feld wortwörtlich ist Anthropic’s Modellübersicht die maßgebliche Quelle.
Was Claude Opus 5 ist
Opus 5 ist der Nachfolger von Claude Opus 4.8. Die API-Modell-ID ist die exakte Zeichenfolge claude-opus-5. Auf Amazon Bedrock lautet die ID anthropic.claude-opus-5, und auf Google Cloud ist es wieder claude-opus-5. Claude Platform auf AWS verwendet die hauseigene ID.

Die Opus-Klasse war schon immer Anthropic's leistungsstarke Reihe, die über Sonnet und unter den Forschungs-Frontier-Modellen Fable und Mythos angesiedelt ist. Was sich bei Opus 5 geändert hat, ist, dass diese Klasse nicht mehr die teure Option ist, auf die man nur im Notfall umsteigt. Anthropic's Dokumentation empfiehlt nun, hier zu beginnen, was eine andere Haltung ist als bei der 4.x-Generation, wo Sonnet der Standard und Opus das Upgrade war.
Das Modell wird auch zum Standard für Max-Abonnenten und zum leistungsstärksten Modell, das für Pro-Nutzer verfügbar ist, was das erste Mal ist, dass ein Modell der Opus-Klasse die Obergrenze für einen mittelpreisigen Verbrauchertarif darstellt. Der Artikel „Kostenlose und günstigste kostenpflichtige Wege“ erklärt, was Sie damit tatsächlich erhalten.
Das Preis-Leistungs-Verhältnis
Dies ist der Teil, mit dem jeder Launch-Artikel begann, und er hält stand, wenn man die Preisseite betrachtet.
| Tarif | Input (pro M Tokens) | Output (pro M Tokens) |
|---|---|---|
| Standard | 5,00 $ | 25,00 $ |
| Batch API (50 % Rabatt) | 2,50 $ | 12,50 $ |
| Fast mode (Forschungsvorschau) | 10,00 $ | 50,00 $ |
| Cache-Schreiben, 5 Minuten TTL | 6,25 $ | n.a. |
| Cache-Schreiben, 1 Stunde TTL | 10,00 $ | n.a. |
| Cache-Treffer und Aktualisierungen | 0,50 $ | n.a. |
Claude Fable 5 berechnet 10 $ und 50 $. Opus 5 berechnet 5 $ und 25 $ für ein Modell, von dem Anthropic behauptet, dass es beim agentischen Coding innerhalb eines halben Prozents an Fable 5 heranreicht. Das ist das gesamte Verkaufsargument: Spitzenleistung zum halben Spitzenpreis.
Einige weniger offensichtliche Hebel befinden sich in dieser Tabelle. Das Minimum für das Prompt-Caching wurde von 1.024 bei Opus 4.8 auf 512 Tokens gesenkt, sodass System-Prompts, die zuvor zu kurz zum Cachen waren, nun ohne Codeänderung gecached werden können. Cache-Treffer kosten 0,50 $ pro Million, ein Zehntel des Basis-Input-Tarifs. Die Batch API halbiert alles für Arbeiten, die warten können. Und der Overhead für System-Prompts bei der Werkzeugnutzung ist mit 286 Tokens für auto oder none Tool-Wahl etwas günstiger als bei 4.8, im Vergleich zu 290 bei Opus 4.8 und 675 bei Opus 4.7.
Zwei Kostendetails überraschen die Leute. Der Fast mode verdoppelt den Tarif auf 10 $ und 50 $ im Austausch für eine etwa 2,5-fache Ausgabegeschwindigkeit und läuft nur auf der hauseigenen API: nicht auf Bedrock, nicht auf Google Cloud, nicht auf Microsoft Foundry und nicht mit der Batch API. Separat angewendet, setzt die Einstellung inference_geo: "us" einen 1,1-fachen Multiplikator für jede Token-Kategorie an, sodass die Inferenz mit US-Standortbindung einen 10%igen Aufschlag auf Input, Output, Cache-Schreibvorgänge und Cache-Treffer gleichermaßen bedeutet.
Die vollständige Preisübersicht führt Kosten-pro-Aufgabe-Beispiele auf, und wenn Sie bereits Ausgaben reduzieren, gelten die Hebel im Artikel „Ihre Claude API-Rechnung reduzieren“ weiterhin. Anthropic's Preisseite ist die maßgebliche Tabelle.
Was Anthropic über die Benchmarks sagt
Jede der folgenden Zahlen stammt von Anthropic selbst und wurde mit dem Launch veröffentlicht. Stand 25. Juli 2026 wurde keine davon unabhängig reproduziert. Lesen Sie sie als Anbieterangaben, nicht als neutrale Messungen, und planen Sie, Ihre eigenen Evaluierungen durchzuführen, bevor Sie eine Produktions-Workload festlegen.
| Benchmark | Anthropic's Anspruch |
|---|---|
| Frontier-Bench v0.1 | Übertrifft alle anderen Modelle und verdoppelt die Punktzahl von Opus 4.8 bei geringeren Kosten pro Aufgabe |
| ARC-AGI 3 | Etwa 3x die Punktzahl des nächstbesten Modells |
| OSWorld 2.0 (Computernutzung) | Übertrifft Fable 5 zu einem Drittel der Kosten |
| CursorBench 3.2 (agentisches Coding) | Innerhalb von 0,5 % des Höchstwertes von Fable 5, zum halben Preis |
| Zapier AutomationBench | Erfolgsrate etwa 1,5x höher als beim nächstbesten Modell |
| Organische Chemie | +10,2 Punkte gegenüber Opus 4.8 |
| Proteinanalyse | +7,7 Punkte gegenüber Opus 4.8 |
Die Form der Behauptungen ist konsistent: große Sprünge bei agentischen und werkzeugbasierten Evaluierungen, und ein Kosten-pro-Aufgabe-Argument, das fast jeder Behauptung beigefügt ist. Die CursorBench- und OSWorld-Ergebnisse sind die beiden, die für die Kaufentscheidung am wichtigsten sind, da sie aussagen, dass man von Fable 5 zu Opus 5 wechseln kann, ohne viel zu verlieren.
Sie sind auch die beiden, die am meisten Ihre eigene Überprüfung benötigen. Eine halbe Prozentlücke bei einem vom Anbieter gewählten Coding-Benchmark liegt gut innerhalb des Bereichs, in dem Ihre Codebasis, Ihr Prompt und Ihre Werkzeugdefinitionen das Ergebnis bestimmen. Die detaillierte Analyse der Benchmarks behandelt, was jede Evaluierung tatsächlich misst und was Sie selbst testen sollten.
Die ehrliche Obergrenze
Opus 5 ist nicht die Spitze des Claude-Stacks, und Anthropic behauptet auch nicht, dass es das ist.
Fable 5 behält die Bezeichnung „leistungsfähigstes, breit veröffentlichtes Modell“. Und bei zwei spezifischen Forschungsfähigkeiten, der Cybersicherheitsausbeutung und der autonomen Biologieforschung, hinkt Opus 5 immer noch Mythos 5 hinterher. Anthropic erklärt dies direkt in seinen eigenen Launch-Materialien, was angesichts der Art und Weise, wie die Mainstream-Berichterstattung die Veröffentlichung darstellte, bemerkenswert ist.
Die genaue Zusammenfassung ist also enger als die Schlagzeilen: Spitzenleistung zum halben Spitzenpreis, mit zwei genannten Fähigkeiten, bei denen ein darüber liegendes Modell immer noch gewinnt. Für die meisten agentischen Codings und die Unternehmensautomatisierung kommt diese Obergrenze nie zur Sprache. Für die Sicherheitsforschung oder autonome wissenschaftliche Arbeit hingegen schon. Hintergrund zur Forschungsebene finden Sie im Mythos-Klasse-Modell-Erklärer und unter Fable 5 vs. Mythos 5.
Zwei Änderungen, die den Opus 4.8-Code unterbrechen
Der Austausch der Modell-ID reicht nicht aus. Zwei Änderungen werden bei Ihrer ersten Anfrage zu Problemen führen.
- Denken ist standardmäßig aktiviert. Bei Opus 4.8 wurde eine Anfrage ohne `thinking`-Feld ohne Denkprozess ausgeführt. Bei Opus 5 führt dieselbe Anfrage adaptives Denken aus. Da
max_tokensimmer noch Denk-Tokens plus Antworttext zusammen begrenzt, kann eine Workload, diemax_tokensgenau auf die erwartete Ausgabe zugeschnitten hat, nun mitten in der Antwort abgeschnitten werden. Es treten keine Fehler auf. Die Ausgabe wird einfach abgeschnitten, was die schlimmste Art von Regression ist, die man debuggen kann. - Das Deaktivieren des Denkprozesses ist auf `high` Effort begrenzt. Das Senden von
thinking: {type: "disabled"}zusammen mit dem Effortxhighodermaxführt zu einem 400er-Fehler, der pro Anfrage erzwungen wird. Wenn Sie eine Konfiguration übernommen haben, die das Denken deaktiviert und den Aufwand erhöht hat, schlägt jeder Aufruf sofort fehl.
Es gibt weitere Aspekte im Migrationsbereich: Die Aufwandsstufen wurden neu kalibriert, sodass Ihre alten Sweep-Ergebnisse nicht mehr übertragen werden können, der Kontextfenster-Beta-Header ist entfallen, Systemnachrichten mitten im Gespräch werden nun akzeptiert, wo 4.8 sie mit einem 400er-Fehler abgelehnt hat, und Priority Tier ist entfallen. Der Migrationsleitfaden von Opus 4.8 zu Opus 5 enthält die Vorher-Nachher-Codebeispiele für jede dieser Änderungen, und Anthropic’s Migrationsleitfaden ist die primäre Referenz. Wenn Sie noch die vorherige Generation verwenden, zeigt die Opus 4.8 API-Anleitung, wovon Sie migrieren.
Der Aufwandsparameter, kein Schalter
Die meisten Berichte zur Einführung beschrieben Opus 5 so, dass Benutzer zwischen Kosten und Leistung wechseln können. Diese Darstellung deutet auf einen echten API-Parameter hin: output_config.effort.
Effort hat fünf Stufen, von low bis max, und ist standardmäßig auf high eingestellt. Es steuert, wie viel das Modell denkt, bevor es antwortet, was wiederum Ihre Ausgaben beeinflusst. Die Benutzeroberflächen für Endverbraucher zeigen es als Aufwandswähler an und nicht als Rohparameter, aber es ist derselbe zugrunde liegende Mechanismus.
Zwei Dinge haben sich in dieser Generation geändert. Die Stufen wurden neu kalibriert, daher empfiehlt Anthropic ausdrücklich, einen neuen Aufwands-Sweep durchzuführen, anstatt Ihre Opus 4.8-Einstellungen zu übernehmen. Und low und medium sind bei Opus 5 deutlich leistungsfähiger als bei jedem früheren Opus-Modell, was sie erstmals für echte Arbeit nutzbar macht, anstatt Einstellungen zu sein, die man meidet. Für Coding und Agenten-Schleifen bleibt xhigh der empfohlene Ausgangspunkt.
Der Leitfaden zum Aufwandsparameter behandelt alle fünf Stufen, wie man einen Sweep gegen eigene Evaluierungen durchführt und die Interaktion mit max_tokens.
Wie sich Opus 5 anders verhält
Anthropic’s Prompting-Leitfaden für Opus 5 dokumentiert Verhaltensänderungen, die Ihre Ergebnisse verändern werden, selbst wenn Ihr Code byte-identisch ist.
- Es überprüft seine eigene Arbeit unaufgefordert. Übernommene Anweisungen wie „Überprüfen Sie Ihre Antwort doppelt“ führen nun zu übermäßiger Überprüfung und verbrennen Tokens umsonst. Anthropic's Rat ist, sie zu löschen.
- Standardantworten und schriftliche Lieferergebnisse sind länger als die von Opus 4.8. Ein geringerer Aufwand reduziert das Denken, nicht die sichtbare Ausgabelänge, fordern Sie also explizit Prägnanz an, wenn Sie diese benötigen.
- Es delegiert leichter an Subagenten. Begrenzen oder definieren Sie die Delegierung bei kostensensiblen Workloads.
- Es erweitert den Aufgabenbereich und erzählt mehr über seine Korrekturen. Begrenzen Sie enge Aufgaben im Prompt.
Es gibt einen Fehlermodus, den man kennen sollte. Bei deaktiviertem Denken treten gelegentlich zwei Artefakte auf: Tool-Aufrufe, die als Klartext geschrieben sind, aber nie ausgeführt werden, und interne XML-Tags, die in der sichtbaren Ausgabe erscheinen. In einer Agenten-Schleife kann der geleakte Text spätere Schritte beeinträchtigen. Anthropic's eigene Abhilfemaßnahme besteht darin, das Denken aktiviert zu lassen und die Kosten stattdessen mit einem niedrigeren Aufwandsniveau zu kontrollieren. Die detaillierte Analyse des Promptings enthält Copy-Paste-Codebeispiele für jede Änderung, und der Claude Code-Leitfaden wendet sie auf Editor-Workflows an.
Wo Sie es ausführen können
| Plattform | Status |
|---|---|
| Claude API | Verfügbar, Modell-ID claude-opus-5 |
| claude.ai | Verfügbar; Standard für Max, Top-Modell für Pro |
| Claude Code | Verfügbar |
| Claude Cowork | Verfügbar |
| Amazon Bedrock | Verfügbar als anthropic.claude-opus-5 |
| Claude Platform auf AWS | Verfügbar, eigene ID |
| Google Cloud | Verfügbar als claude-opus-5 |
| Microsoft Foundry | Verfügbar |
| GitHub Copilot | Verfügbar |
Der Fast mode ist die Ausnahme von dieser Matrix. Er läuft nur auf der hauseigenen API, sodass eine Bedrock- oder Google Cloud-Bereitstellung ihn nicht erreichen kann.
Opus 5-Anfragen in Apidog testen
Das Aufrufen von Opus 5 bedeutet, einen HTTP-Endpunkt mit Authentifizierungs-Headern, einem JSON-Body, Streaming-Antworten und Fehlern, die Sie reproduzieren müssen, anzusprechen. Apidog übernimmt diesen Bereich: Senden Sie die Anfrage, speichern Sie sie in einer Sammlung, bewahren Sie Ihren API-Schlüssel in einer Umgebungsvariablen auf, anstatt ihn in einen Body einzufügen, und lesen Sie die Antwort Feld für Feld aus.

Ein praktisches Setup für dieses Modell:
- Speichern Sie
ANTHROPIC_API_KEYals Umgebungsvariable, damit der Schlüssel niemals in einer geteilten Sammlung landet. - Speichern Sie eine Baseline-Messages-Anfrage und duplizieren Sie diese dann pro Aufwandsstufe, damit Sie
low,highundxhighnebeneinander mit demselben Prompt vergleichen können. - Beobachten Sie den SSE-Stream direkt, wenn Sie Streaming aktivieren, damit Sie sehen können, wo eine abgeschnittene Antwort tatsächlich endete.
- Lesen Sie den
usage-Block in jeder Antwort, um zu bestätigen, dass Cache-Treffer erzielt werden und um zu sehen, wie viele Denk-Tokens die Anfrage verbraucht hat.
Hier ist die Baseline-Anfrage:
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-opus-5",
"max_tokens": 8192,
"messages": [
{"role": "user", "content": "Refaktorieren Sie diesen Handler und erläutern Sie die Kompromisse."}
]
}'
Diese Anfrage führt adaptives Denken aus, da das Denken standardmäßig aktiviert ist und kein thinking-Feld vorhanden ist. Geben Sie max_tokens ausreichend Spielraum: 1.024 war bei Opus 4.8 ausreichend und wird hier abgeschnitten. Um mitzumachen, laden Sie Apidog herunter und importieren Sie die Anfrage. Der Schritt-für-Schritt-API-Leitfaden behandelt Streaming, Werkzeugnutzung und das vollständige Auslesen von usage.
Wer sollte Claude Opus 5 verwenden
Greifen Sie zu Opus 5, wenn:
- Sie Agenten oder werkzeugintensive Workflows erstellen. Dies ist die Workload, für die Anthropic optimiert hat und bei der seine Benchmark-Ansprüche am stärksten sind.
- Sie Fable 5 nutzen und die Rechnung wehtut. Der halbe Preis für eine beanspruchte halbe Prozentlücke beim agentischen Coding ist eine echte Evaluierung wert. Der Vergleich von Opus 5 vs. Fable 5 rahmt diese Entscheidung ein.
- Sie heute noch Opus 4.8 verwenden. Gleicher Preis, bessere beanspruchte Zahlen, aktuellerer Wissensstichtag. Die einzigen Kosten sind die Migrationsarbeit.
- Sie aktuelles Wissen benötigen. Mai 2026 übertrifft jedes andere aktuelle Claude-Modell um etwa vier Monate.
Bleiben Sie dabei, wenn:
- Priority Tier geschäftskritisch ist. Opus 4.8 behält es und Opus 5 nicht, prüfen Sie also die Preise und Tarife von Opus 4.8, bevor Sie wechseln.
- Ihre Workload günstig und volumensstark ist. Sonnet 5 kostet weniger und ist möglicherweise ausreichend. Der Vergleich von Opus 5 vs. Sonnet 5 behandelt, wo sich die 2,5-fache Prämie bezahlt macht.
- Sie Cybersicherheitsausbeutung oder autonome Biologieforschung betreiben. Mythos 5 ist dort immer noch führend.
Häufig gestellte Fragen (FAQ)
Wie lautet die Modell-ID für Claude Opus 5? Es ist die exakte Zeichenfolge claude-opus-5, ohne Datumssuffix. Auf Amazon Bedrock verwenden Sie anthropic.claude-opus-5; Google Cloud und Claude Platform auf AWS verwenden claude-opus-5.
Wie viel kostet Claude Opus 5? 5 $ pro Million Input-Tokens und 25 $ pro Million Output-Tokens, identisch mit Opus 4.8 und die Hälfte von Fable 5’s 10 $ und 50 $. Die Batch API halbiert es erneut auf 2,50 $ und 12,50 $. Der Fast mode verdoppelt es auf 10 $ und 50 $.
Ist Claude Opus 5 besser als Fable 5? Nach Anthropic's eigenen Zahlen ist es nah dran, nicht überlegen. Anthropic berichtet, dass Opus 5 bei CursorBench 3.2 innerhalb von 0,5 % von Fable 5 liegt und bei OSWorld 2.0 zu einem Drittel der Kosten überlegen ist, aber Fable 5 behält die Bezeichnung „leistungsfähigstes, breit veröffentlichtes Modell“. Dies sind vom Anbieter durchgeführte Ergebnisse ohne unabhängige Reproduktion bisher.
Wie groß ist das Kontextfenster von Claude Opus 5? 1.000.000 Tokens, sowohl als Standard als auch als Maximum, ohne Beta-Header und ohne Preisaufschlag für lange Kontexte. Die maximale Ausgabe beträgt 128.000 Tokens über die Messages API oder 300.000 über die Batch API mit dem Beta-Header output-300k-2026-03-24.
Muss ich meinen Code ändern, um von Opus 4.8 zu aktualisieren? Jenseits der Modell-ID: Ja. Das Denken läuft jetzt standardmäßig, überprüfen Sie also max_tokens oder riskieren Sie eine stille Kürzung. Und thinking: {type: "disabled"} in Kombination mit dem Aufwand xhigh oder max führt zu einem 400er-Fehler. Führen Sie auch Ihren Aufwands-Sweep erneut durch, da die Stufen neu kalibriert wurden.
Wie ist der Wissensstand von Claude Opus 5? Mai 2026 für zuverlässiges Wissen und Trainingsdaten, der aktuellste unter allen aktuellen Claude-Modellen.
