Was ist Claude Opus 5? Spezifikationen, Benchmarks und Preise

Claude Opus 5 erklärte: den Start im Juli 2026, die Modell-ID, den 1M-Kontext, den Cutoff vom Mai 2026, die Preisgestaltung von 5 $/25 $ im Vergleich zu Fable 5, Anthropic's Benchmark-Behauptungen und die ehrliche Obergrenze.

Ashley Innocent

Ashley Innocent

25 July 2026

Was ist Claude Opus 5? Spezifikationen, Benchmarks und Preise

Apidog für Unternehmen

On-Premises Bereitstellung

SSO & RBAC

SOC 2 konform

Apidog Enterprise entdecken

Claude Opus 5 ist Anthropic's neuestes Modell der Opus-Tier-Klasse, das am 24. Juli 2026 veröffentlicht wurde. Anthropic positioniert es für komplexes agentisches Coding und Unternehmensaufgaben, und die Dokumentation nennt es nun den Standard-Startpunkt: Wenn Sie unsicher sind, welches Modell Sie verwenden sollen, beginnen Sie mit Claude Opus 5. Die entscheidende Zahl ist der Preis. Opus 5 kostet 5 US-Dollar pro Million Input-Tokens und 25 US-Dollar pro Million Output-Tokens, der gleiche Tarif wie Opus 4.8 und die Hälfte dessen, was Fable 5 verlangt.

Dieser Leitfaden behandelt die Spezifikationen, das Preis-Leistungs-Verhältnis, die Launch-Benchmarks von Anthropic und welches Gewicht man ihnen beimessen sollte, die zwei API-Änderungen, die bestehenden Opus 4.8-Code unterbrechen, wo Sie das Modell ausführen können, und die Grenzen, die Anthropic offen kommuniziert. Wenn Sie das Modell über HTTP aufrufen, können Sie diese Anfragen in Apidog senden und prüfen, während Sie arbeiten.

Button

Claude Opus 5 auf einen Blick

Spezifikation Wert
API-Modell-ID claude-opus-5 (ohne Datumssuffix)
Veröffentlicht 24. Juli 2026
Kontextfenster 1.000.000 Tokens, Standard und Maximum
Maximale Ausgabe 128.000 Tokens über die Messages API; 300.000 über die Batch API mit dem Beta-Header output-300k-2026-03-24
Basispreise 5 $ pro Million Input-Tokens, 25 $ pro Million Output-Tokens
Wissensstichtag Mai 2026
Adaptives Denken Standardmäßig aktiviert
Aufwandsstufen low, medium, high, xhigh, max; Standard ist high
Priority Tier Nicht unterstützt
Verfügbarkeit Claude API, claude.ai, Claude Code, Claude Cowork, Amazon Bedrock, Claude Platform auf AWS, Google Cloud, Microsoft Foundry, GitHub Copilot

Drei dieser Zeilen verdienen einen zweiten Blick.

Das 1M Kontextfenster ist sowohl Standard als auch Maximum und benötigt keinen Beta-Header. Es gibt auch keinen Preisaufschlag für lange Kontexte, sodass ein 900.000-Token-Prompt zum gleichen Token-Tarif wie ein 900-Token-Prompt abgerechnet wird.

Der Wissensstichtag Mai 2026 ist der aktuellste aller aktuellen Claude-Modelle. Fable 5 und Sonnet 5 liegen beide bei Januar 2026, sodass Opus 5 etwa vier zusätzliche Monate an Bibliotheken, Releases und API-Änderungen kennt, ohne dass Sie diese selbst einfügen müssen.

Priority Tier ist das einzige Feature, das sich zurückentwickelt hat. Opus 4.8 unterstützt es; Opus 5 nicht. Wenn Ihre Unternehmenskapazitätsplanung vom Priority Tier abhängt, ist dies eine echte Einschränkung und wird im Migrationsleitfaden behandelt.

Für die vollständige Modellübersicht und jedes Feld wortwörtlich ist Anthropic’s Modellübersicht die maßgebliche Quelle.

Was Claude Opus 5 ist

Opus 5 ist der Nachfolger von Claude Opus 4.8. Die API-Modell-ID ist die exakte Zeichenfolge claude-opus-5. Auf Amazon Bedrock lautet die ID anthropic.claude-opus-5, und auf Google Cloud ist es wieder claude-opus-5. Claude Platform auf AWS verwendet die hauseigene ID.

Visualisierung von Claude Opus 5

Die Opus-Klasse war schon immer Anthropic's leistungsstarke Reihe, die über Sonnet und unter den Forschungs-Frontier-Modellen Fable und Mythos angesiedelt ist. Was sich bei Opus 5 geändert hat, ist, dass diese Klasse nicht mehr die teure Option ist, auf die man nur im Notfall umsteigt. Anthropic's Dokumentation empfiehlt nun, hier zu beginnen, was eine andere Haltung ist als bei der 4.x-Generation, wo Sonnet der Standard und Opus das Upgrade war.

Das Modell wird auch zum Standard für Max-Abonnenten und zum leistungsstärksten Modell, das für Pro-Nutzer verfügbar ist, was das erste Mal ist, dass ein Modell der Opus-Klasse die Obergrenze für einen mittelpreisigen Verbrauchertarif darstellt. Der Artikel „Kostenlose und günstigste kostenpflichtige Wege“ erklärt, was Sie damit tatsächlich erhalten.

Das Preis-Leistungs-Verhältnis

Dies ist der Teil, mit dem jeder Launch-Artikel begann, und er hält stand, wenn man die Preisseite betrachtet.

Tarif Input (pro M Tokens) Output (pro M Tokens)
Standard 5,00 $ 25,00 $
Batch API (50 % Rabatt) 2,50 $ 12,50 $
Fast mode (Forschungsvorschau) 10,00 $ 50,00 $
Cache-Schreiben, 5 Minuten TTL 6,25 $ n.a.
Cache-Schreiben, 1 Stunde TTL 10,00 $ n.a.
Cache-Treffer und Aktualisierungen 0,50 $ n.a.

Claude Fable 5 berechnet 10 $ und 50 $. Opus 5 berechnet 5 $ und 25 $ für ein Modell, von dem Anthropic behauptet, dass es beim agentischen Coding innerhalb eines halben Prozents an Fable 5 heranreicht. Das ist das gesamte Verkaufsargument: Spitzenleistung zum halben Spitzenpreis.

Einige weniger offensichtliche Hebel befinden sich in dieser Tabelle. Das Minimum für das Prompt-Caching wurde von 1.024 bei Opus 4.8 auf 512 Tokens gesenkt, sodass System-Prompts, die zuvor zu kurz zum Cachen waren, nun ohne Codeänderung gecached werden können. Cache-Treffer kosten 0,50 $ pro Million, ein Zehntel des Basis-Input-Tarifs. Die Batch API halbiert alles für Arbeiten, die warten können. Und der Overhead für System-Prompts bei der Werkzeugnutzung ist mit 286 Tokens für auto oder none Tool-Wahl etwas günstiger als bei 4.8, im Vergleich zu 290 bei Opus 4.8 und 675 bei Opus 4.7.

Zwei Kostendetails überraschen die Leute. Der Fast mode verdoppelt den Tarif auf 10 $ und 50 $ im Austausch für eine etwa 2,5-fache Ausgabegeschwindigkeit und läuft nur auf der hauseigenen API: nicht auf Bedrock, nicht auf Google Cloud, nicht auf Microsoft Foundry und nicht mit der Batch API. Separat angewendet, setzt die Einstellung inference_geo: "us" einen 1,1-fachen Multiplikator für jede Token-Kategorie an, sodass die Inferenz mit US-Standortbindung einen 10%igen Aufschlag auf Input, Output, Cache-Schreibvorgänge und Cache-Treffer gleichermaßen bedeutet.

Die vollständige Preisübersicht führt Kosten-pro-Aufgabe-Beispiele auf, und wenn Sie bereits Ausgaben reduzieren, gelten die Hebel im Artikel „Ihre Claude API-Rechnung reduzieren“ weiterhin. Anthropic's Preisseite ist die maßgebliche Tabelle.

Was Anthropic über die Benchmarks sagt

Jede der folgenden Zahlen stammt von Anthropic selbst und wurde mit dem Launch veröffentlicht. Stand 25. Juli 2026 wurde keine davon unabhängig reproduziert. Lesen Sie sie als Anbieterangaben, nicht als neutrale Messungen, und planen Sie, Ihre eigenen Evaluierungen durchzuführen, bevor Sie eine Produktions-Workload festlegen.

Benchmark Anthropic's Anspruch
Frontier-Bench v0.1 Übertrifft alle anderen Modelle und verdoppelt die Punktzahl von Opus 4.8 bei geringeren Kosten pro Aufgabe
ARC-AGI 3 Etwa 3x die Punktzahl des nächstbesten Modells
OSWorld 2.0 (Computernutzung) Übertrifft Fable 5 zu einem Drittel der Kosten
CursorBench 3.2 (agentisches Coding) Innerhalb von 0,5 % des Höchstwertes von Fable 5, zum halben Preis
Zapier AutomationBench Erfolgsrate etwa 1,5x höher als beim nächstbesten Modell
Organische Chemie +10,2 Punkte gegenüber Opus 4.8
Proteinanalyse +7,7 Punkte gegenüber Opus 4.8

Die Form der Behauptungen ist konsistent: große Sprünge bei agentischen und werkzeugbasierten Evaluierungen, und ein Kosten-pro-Aufgabe-Argument, das fast jeder Behauptung beigefügt ist. Die CursorBench- und OSWorld-Ergebnisse sind die beiden, die für die Kaufentscheidung am wichtigsten sind, da sie aussagen, dass man von Fable 5 zu Opus 5 wechseln kann, ohne viel zu verlieren.

Sie sind auch die beiden, die am meisten Ihre eigene Überprüfung benötigen. Eine halbe Prozentlücke bei einem vom Anbieter gewählten Coding-Benchmark liegt gut innerhalb des Bereichs, in dem Ihre Codebasis, Ihr Prompt und Ihre Werkzeugdefinitionen das Ergebnis bestimmen. Die detaillierte Analyse der Benchmarks behandelt, was jede Evaluierung tatsächlich misst und was Sie selbst testen sollten.

Die ehrliche Obergrenze

Opus 5 ist nicht die Spitze des Claude-Stacks, und Anthropic behauptet auch nicht, dass es das ist.

Fable 5 behält die Bezeichnung „leistungsfähigstes, breit veröffentlichtes Modell“. Und bei zwei spezifischen Forschungsfähigkeiten, der Cybersicherheitsausbeutung und der autonomen Biologieforschung, hinkt Opus 5 immer noch Mythos 5 hinterher. Anthropic erklärt dies direkt in seinen eigenen Launch-Materialien, was angesichts der Art und Weise, wie die Mainstream-Berichterstattung die Veröffentlichung darstellte, bemerkenswert ist.

Die genaue Zusammenfassung ist also enger als die Schlagzeilen: Spitzenleistung zum halben Spitzenpreis, mit zwei genannten Fähigkeiten, bei denen ein darüber liegendes Modell immer noch gewinnt. Für die meisten agentischen Codings und die Unternehmensautomatisierung kommt diese Obergrenze nie zur Sprache. Für die Sicherheitsforschung oder autonome wissenschaftliche Arbeit hingegen schon. Hintergrund zur Forschungsebene finden Sie im Mythos-Klasse-Modell-Erklärer und unter Fable 5 vs. Mythos 5.

Zwei Änderungen, die den Opus 4.8-Code unterbrechen

Der Austausch der Modell-ID reicht nicht aus. Zwei Änderungen werden bei Ihrer ersten Anfrage zu Problemen führen.

Es gibt weitere Aspekte im Migrationsbereich: Die Aufwandsstufen wurden neu kalibriert, sodass Ihre alten Sweep-Ergebnisse nicht mehr übertragen werden können, der Kontextfenster-Beta-Header ist entfallen, Systemnachrichten mitten im Gespräch werden nun akzeptiert, wo 4.8 sie mit einem 400er-Fehler abgelehnt hat, und Priority Tier ist entfallen. Der Migrationsleitfaden von Opus 4.8 zu Opus 5 enthält die Vorher-Nachher-Codebeispiele für jede dieser Änderungen, und Anthropic’s Migrationsleitfaden ist die primäre Referenz. Wenn Sie noch die vorherige Generation verwenden, zeigt die Opus 4.8 API-Anleitung, wovon Sie migrieren.

Der Aufwandsparameter, kein Schalter

Die meisten Berichte zur Einführung beschrieben Opus 5 so, dass Benutzer zwischen Kosten und Leistung wechseln können. Diese Darstellung deutet auf einen echten API-Parameter hin: output_config.effort.

Effort hat fünf Stufen, von low bis max, und ist standardmäßig auf high eingestellt. Es steuert, wie viel das Modell denkt, bevor es antwortet, was wiederum Ihre Ausgaben beeinflusst. Die Benutzeroberflächen für Endverbraucher zeigen es als Aufwandswähler an und nicht als Rohparameter, aber es ist derselbe zugrunde liegende Mechanismus.

Zwei Dinge haben sich in dieser Generation geändert. Die Stufen wurden neu kalibriert, daher empfiehlt Anthropic ausdrücklich, einen neuen Aufwands-Sweep durchzuführen, anstatt Ihre Opus 4.8-Einstellungen zu übernehmen. Und low und medium sind bei Opus 5 deutlich leistungsfähiger als bei jedem früheren Opus-Modell, was sie erstmals für echte Arbeit nutzbar macht, anstatt Einstellungen zu sein, die man meidet. Für Coding und Agenten-Schleifen bleibt xhigh der empfohlene Ausgangspunkt.

Der Leitfaden zum Aufwandsparameter behandelt alle fünf Stufen, wie man einen Sweep gegen eigene Evaluierungen durchführt und die Interaktion mit max_tokens.

Wie sich Opus 5 anders verhält

Anthropic’s Prompting-Leitfaden für Opus 5 dokumentiert Verhaltensänderungen, die Ihre Ergebnisse verändern werden, selbst wenn Ihr Code byte-identisch ist.

Es gibt einen Fehlermodus, den man kennen sollte. Bei deaktiviertem Denken treten gelegentlich zwei Artefakte auf: Tool-Aufrufe, die als Klartext geschrieben sind, aber nie ausgeführt werden, und interne XML-Tags, die in der sichtbaren Ausgabe erscheinen. In einer Agenten-Schleife kann der geleakte Text spätere Schritte beeinträchtigen. Anthropic's eigene Abhilfemaßnahme besteht darin, das Denken aktiviert zu lassen und die Kosten stattdessen mit einem niedrigeren Aufwandsniveau zu kontrollieren. Die detaillierte Analyse des Promptings enthält Copy-Paste-Codebeispiele für jede Änderung, und der Claude Code-Leitfaden wendet sie auf Editor-Workflows an.

Wo Sie es ausführen können

Plattform Status
Claude API Verfügbar, Modell-ID claude-opus-5
claude.ai Verfügbar; Standard für Max, Top-Modell für Pro
Claude Code Verfügbar
Claude Cowork Verfügbar
Amazon Bedrock Verfügbar als anthropic.claude-opus-5
Claude Platform auf AWS Verfügbar, eigene ID
Google Cloud Verfügbar als claude-opus-5
Microsoft Foundry Verfügbar
GitHub Copilot Verfügbar

Der Fast mode ist die Ausnahme von dieser Matrix. Er läuft nur auf der hauseigenen API, sodass eine Bedrock- oder Google Cloud-Bereitstellung ihn nicht erreichen kann.

Opus 5-Anfragen in Apidog testen

Das Aufrufen von Opus 5 bedeutet, einen HTTP-Endpunkt mit Authentifizierungs-Headern, einem JSON-Body, Streaming-Antworten und Fehlern, die Sie reproduzieren müssen, anzusprechen. Apidog übernimmt diesen Bereich: Senden Sie die Anfrage, speichern Sie sie in einer Sammlung, bewahren Sie Ihren API-Schlüssel in einer Umgebungsvariablen auf, anstatt ihn in einen Body einzufügen, und lesen Sie die Antwort Feld für Feld aus.

Apidog-Schnittstelle zur Visualisierung von API-Anfragen und -Antworten

Ein praktisches Setup für dieses Modell:

  1. Speichern Sie ANTHROPIC_API_KEY als Umgebungsvariable, damit der Schlüssel niemals in einer geteilten Sammlung landet.
  2. Speichern Sie eine Baseline-Messages-Anfrage und duplizieren Sie diese dann pro Aufwandsstufe, damit Sie low, high und xhigh nebeneinander mit demselben Prompt vergleichen können.
  3. Beobachten Sie den SSE-Stream direkt, wenn Sie Streaming aktivieren, damit Sie sehen können, wo eine abgeschnittene Antwort tatsächlich endete.
  4. Lesen Sie den usage-Block in jeder Antwort, um zu bestätigen, dass Cache-Treffer erzielt werden und um zu sehen, wie viele Denk-Tokens die Anfrage verbraucht hat.

Hier ist die Baseline-Anfrage:

curl https://api.anthropic.com/v1/messages \
  --header "x-api-key: $ANTHROPIC_API_KEY" \
  --header "anthropic-version: 2023-06-01" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-opus-5",
    "max_tokens": 8192,
    "messages": [
      {"role": "user", "content": "Refaktorieren Sie diesen Handler und erläutern Sie die Kompromisse."}
    ]
  }'

Diese Anfrage führt adaptives Denken aus, da das Denken standardmäßig aktiviert ist und kein thinking-Feld vorhanden ist. Geben Sie max_tokens ausreichend Spielraum: 1.024 war bei Opus 4.8 ausreichend und wird hier abgeschnitten. Um mitzumachen, laden Sie Apidog herunter und importieren Sie die Anfrage. Der Schritt-für-Schritt-API-Leitfaden behandelt Streaming, Werkzeugnutzung und das vollständige Auslesen von usage.

Wer sollte Claude Opus 5 verwenden

Greifen Sie zu Opus 5, wenn:

Bleiben Sie dabei, wenn:

Häufig gestellte Fragen (FAQ)

Wie lautet die Modell-ID für Claude Opus 5? Es ist die exakte Zeichenfolge claude-opus-5, ohne Datumssuffix. Auf Amazon Bedrock verwenden Sie anthropic.claude-opus-5; Google Cloud und Claude Platform auf AWS verwenden claude-opus-5.

Wie viel kostet Claude Opus 5? 5 $ pro Million Input-Tokens und 25 $ pro Million Output-Tokens, identisch mit Opus 4.8 und die Hälfte von Fable 5’s 10 $ und 50 $. Die Batch API halbiert es erneut auf 2,50 $ und 12,50 $. Der Fast mode verdoppelt es auf 10 $ und 50 $.

Ist Claude Opus 5 besser als Fable 5? Nach Anthropic's eigenen Zahlen ist es nah dran, nicht überlegen. Anthropic berichtet, dass Opus 5 bei CursorBench 3.2 innerhalb von 0,5 % von Fable 5 liegt und bei OSWorld 2.0 zu einem Drittel der Kosten überlegen ist, aber Fable 5 behält die Bezeichnung „leistungsfähigstes, breit veröffentlichtes Modell“. Dies sind vom Anbieter durchgeführte Ergebnisse ohne unabhängige Reproduktion bisher.

Wie groß ist das Kontextfenster von Claude Opus 5? 1.000.000 Tokens, sowohl als Standard als auch als Maximum, ohne Beta-Header und ohne Preisaufschlag für lange Kontexte. Die maximale Ausgabe beträgt 128.000 Tokens über die Messages API oder 300.000 über die Batch API mit dem Beta-Header output-300k-2026-03-24.

Muss ich meinen Code ändern, um von Opus 4.8 zu aktualisieren? Jenseits der Modell-ID: Ja. Das Denken läuft jetzt standardmäßig, überprüfen Sie also max_tokens oder riskieren Sie eine stille Kürzung. Und thinking: {type: "disabled"} in Kombination mit dem Aufwand xhigh oder max führt zu einem 400er-Fehler. Führen Sie auch Ihren Aufwands-Sweep erneut durch, da die Stufen neu kalibriert wurden.

Wie ist der Wissensstand von Claude Opus 5? Mai 2026 für zuverlässiges Wissen und Trainingsdaten, der aktuellste unter allen aktuellen Claude-Modellen.

Praktizieren Sie API Design-First in Apidog

Entdecken Sie eine einfachere Möglichkeit, APIs zu erstellen und zu nutzen