Anthropic hat Claude Opus 5 am 24. Juli 2026 veröffentlicht, und die ehrliche Antwort auf die Frage „Kann ich es kostenlos nutzen?“ hat zwei Seiten. Über die Claude-Apps: Ja, wenn Sie ein kostenpflichtiges Abonnement haben: Opus 5 ist der neue Standard für Max-Abonnenten und das leistungsstärkste Modell, das Pro-Benutzern zur Verfügung steht. Über die API: Nein. Es gibt keinen kostenlosen unbegrenzten API-Pfad zu claude-opus-5, und wer Ihnen etwas anderes erzählt, will Ihnen etwas verkaufen.
Das sind keine schlechten Nachrichten, denn die günstigere Hälfte dieses Artikels ist das, wo das wahre Potenzial liegt. Opus 5 kostet 5 $ pro Million Eingabe-Tokens und 25 $ pro Million Ausgabe-Tokens, genau wie Opus 4.8 und die Hälfte von Fable 5s 10 $ / 50 $. Zusätzlich zu dieser Basis gibt es mehrere legitime Hebel, die eine tatsächliche Rechnung um mehr als die Hälfte senken können. Dieser Leitfaden behandelt zuerst die ehrlichen kostenlosen Wege, dann den günstigsten kostenpflichtigen Pfad. Wenn Sie beginnen, die API aufzurufen, ist Apidog der Ort, an dem Sie diese Anfragen senden, speichern und vergleichen.
Für das vollständige Spektrum siehe was ist Claude Opus 5. Der Launch-Beitrag von Anthropic zu Opus 5 enthält die Ankündigung, und die Modellübersicht enthält die ID- und Verfügbarkeitstabelle. Eine Unterscheidung, die man sich merken sollte: Kostenlos innerhalb der Claude-Apps bedeutet, dass Ihr Abonnement es abdeckt, vorbehaltlich Nutzungslimits. Kostenlos über die API bedeutet Test- oder Aktionsguthaben mit einem Guthaben, das sich verringert und dann aufhört.
Kostenloser Pfad 1: Claude-Abonnementstufen
Die Launch-Materialien von Anthropic nennen zwei Verbraucher-Stufen für Opus 5:
- Max. Opus 5 wird zum Standardmodell. Sie erhalten es, ohne etwas zu ändern.
- Pro. Opus 5 ist jetzt das leistungsstärkste Modell, das im Tarif verfügbar ist. Das ist die bemerkenswerte Änderung: Die oberste Opus-Stufe lag früher über Pro, und jetzt ist das nicht mehr der Fall.
Diese Materialien nennen den kostenlosen Claude-Plan nicht als Opus 5-Oberfläche, daher sollten Sie den Zugriff über den kostenlosen Plan als unbestätigt betrachten, anstatt davon auszugehen, dass er funktioniert. [ÜBERPRÜFEN] Überprüfen Sie Ihren Modell-Picker, bevor Sie damit planen.
Opus 5 ist auch in Claude Code, Claude Cowork und GitHub Copilot verfügbar, sodass ein Abonnement, das Sie bereits bezahlen, es möglicherweise beinhaltet. Die Nutzung dort ist kostenpflichtig, und Opus 5 hat Gewohnheiten, die ein Guthaben schneller verbrauchen als 4.8: Denken ist standardmäßig aktiviert, Antworten sind länger, und das Modell delegiert leichter an Sub-Agents. Wie man Claude Opus 5 in Claude Code verwendet erklärt, wie man dies einschränkt, und wie man Claude Opus 4.8 kostenlos nutzt bietet die entsprechenden Wege für die vorherige Generation.
Kostenloser Pfad 2: API-Test- und Cloud-Aktionsguthaben
Die Modell-ID in der Claude-API ist genau claude-opus-5, ohne Datumsanhang. Die API ist Pay-as-you-go, aber zwei ehrliche Wege ermöglichen es Ihnen, ohne Vorauszahlung zu beginnen.
- Guthaben für neue Anthropic API-Konten. Neue Konten beginnen in der Regel mit einem kleinen Guthaben, das ausreicht, um zu bestätigen, dass Ihre Integration funktioniert und die tatsächliche Token-Anzahl zu messen, bevor Sie eine Karte hinterlegen.
- Aktionsguthaben von Cloud-Plattformen. Opus 5 ist auf Amazon Bedrock (als
anthropic.claude-opus-5), der Claude Platform auf AWS, Google Cloud und Microsoft Foundry verfügbar. Neue Konten dort enthalten oft Aktionsguthaben, die Sie für die Claude-Nutzung verwenden können. Lesen Sie das aktuelle Angebot jeder Plattform direkt; Beträge und Bedingungen ändern sich so oft, dass jede hier gedruckte Zahl veraltet wäre.
Verwenden Sie diese Guthaben für Messungen, nicht für den Produktionsverkehr. Führen Sie Ihre echten Prompts aus, zeichnen Sie den usage-Block jeder Antwort auf, und Sie werden Ihre Kosten pro Aufgabe kennen, bevor Sie sich festlegen. Die Preisdokumentation von Anthropic enthält die aktuelle Preisliste.
Eine Warnung ist bei Opus 5 wichtiger als bei jedem früheren Modell: Denken ist jetzt standardmäßig aktiviert. Bei Opus 4.8 wurde eine Anfrage ohne thinking-Feld ohne Denken ausgeführt. Bei Opus 5 führt dieselbe Anfrage adaptives Denken aus, und Denk-Tokens werden als Output mit 25 $ pro Million abgerechnet. Eine unveränderte Testsuite, die von 4.8 übernommen wurde, wird Testguthaben schneller verbrauchen als noch im letzten Monat. Die vollständige Liste dieser Fallstricke finden Sie unter Migration von Opus 4.8 zu Opus 5.
Es gibt keinen kostenlosen unbegrenzten API-Pfad
Es ist wichtig, dies klarzustellen, da diese Frage unehrliche Antworten hervorruft. Keine kostenlose Stufe der Claude API bietet Ihnen unbegrenzte claude-opus-5-Aufrufe, und kein Proxy, Schlüsselpool oder Wiederverkäufer gewährt legitim kostenlosen Zugriff auf Frontier-Modelle. Diese Schemata verstoßen gegen die Bedingungen von Anthropic, werden widerrufen und leiten Ihre Prompts über eine Infrastruktur, die Sie nicht kontrollieren. Sobald Ihre Test- oder Aktionsguthaben aufgebraucht sind, zahlen Sie pro Token oder Sie hören auf. Der Rest dieses Artikels handelt davon, so wenig wie möglich zu bezahlen.
Der günstigste kostenpflichtige Pfad
Der Basistarif beträgt 5 $ für Eingabe- und 25 $ für Ausgabe-Tokens pro Million Tokens. Hier ist, was diese Zahl tatsächlich beeinflusst, ungefähr in der Reihenfolge der Auswirkung.
Hebel 1: Die Batch-API, 50% Rabatt
Alles, was nicht innerhalb der nächsten Sekunden eine Antwort benötigt, sollte über die Batch-API laufen. Sie läuft asynchron und kostet 2,50 $ Eingabe / 12,50 $ Ausgabe pro Million Tokens, genau die Hälfte der Standardpreise. Kein Qualitätsunterschied; dasselbe Modell führt dieselbe Anfrage aus.
Dies passt zu mehr Arbeitslasten, als man erwartet: nächtliche Auswertungsdurchläufe, Massen-Dokumentenverarbeitung, Nachfüllen von Klassifizierungen, Regressionstests, Content-Pipelines. Batch unterstützt auch bis zu 300.000 Ausgabe-Tokens pro Anfrage mit dem output-300k-2026-03-24 Beta-Header, gegenüber 128.000 bei der Standard-Messages-API, sodass die Generierung langer Inhalte dort sowohl günstiger als auch weniger eingeschränkt ist. Der Haken ist die Latenz, plus ein Kompatibilitätshinweis: Der schnelle Modus funktioniert nicht mit der Batch-API.
Hebel 2: Aufwand low, der echte Kostenhebel jetzt
Opus 5 bietet output_config.effort, was die Presseberichterstattung mit einem „Umschalter zwischen Kosten und Fähigkeiten“ meinte. Er ist standardmäßig auf high eingestellt. Geringerer Aufwand bedeutet weniger Denk-Tokens, und Denk-Tokens werden zum Ausgabetarif abgerechnet, sodass der Aufwand fast direkt mit den Ausgaben korreliert.
Was sich bei Opus 5 geändert hat, ist, dass die Stufen neu kalibriert wurden. Anthropic sagt, dass low und medium hier deutlich stärker sind als bei früheren Opus-Modellen, was das erste Mal ist, dass das Herabstufen auf low eine ernsthafte Option und keine Verschlechterung darstellt. Wenn Sie die Aufwandseinstellungen von 4.8 übernommen haben, führen Sie eine neue Überprüfung Ihrer eigenen Bewertungen durch. Zwei praktische Hinweise:
- Geringerer Aufwand reduziert das Denken, nicht die sichtbare Ausgabelänge. Die Antworten von Opus 5 sind unabhängig vom Aufwand länger als die von 4.8. Wenn Sie kürzere Antworten wünschen, fordern Sie diese explizit im Prompt an. Das ist eine separate Einsparung.
- Deaktivieren Sie das Denken nicht, um Geld zu sparen. Die Kombination von
thinking: {type: "disabled"}mit dem Aufwandxhighodermaxführt direkt zu einem 400-Fehler. Die Prompting-Anleitung von Anthropic für Opus 5 besagt, dass man das Denken eingeschaltet lassen und die Kosten stattdessen durch geringeren Aufwand kontrollieren sollte, da deaktiviertes Denken gelegentlich Tool-Aufrufe als Klartext und interne XML-Tags, die in der sichtbaren Ausgabe erscheinen, erzeugt.
Die vollständige Aufschlüsselung aller fünf Stufen finden Sie im Opus 5 Aufwandsparameter von Claude.
Hebel 3: Prompt-Caching, jetzt ab 512 Tokens
Cache-Treffer kosten 0,50 $ pro Million Tokens, ein Zehntel des Standard-Eingabetarifs. Ein 5-minütiger Cache-Schreibvorgang kostet 6,25 $ pro Million; ein 1-stündiger Schreibvorgang kostet 10 $ pro Million.
Die Änderung bei Opus 5, die es wert ist, beachtet zu werden: Der minimale cache-fähige Präfix ist auf 512 Tokens gesunken, von 1.024 bei Opus 4.8. Prompts, die zuvor zu kurz zum Caching waren, werden jetzt ohne Codeänderung außer dem Hinzufügen des Breakpoints gecacht.
Die Rechnung zahlt sich sofort aus. Nehmen Sie eine Anfrage mit einem stabilen Präfix von 40.000 Tokens (System-Prompt plus Referenzdokumente) und 10.000 Tokens variabler Eingabe:
- Nicht gecacht: 50.000 Eingabe-Tokens zu 5 $ pro Million sind 0,25 $.
- Cache-Schreibvorgang: Der 40.000 Tokens Präfix zu 6,25 $ pro Million sind 0,25 $, gegenüber 0,20 $ ungecacht, sodass der Schreibvorgang einmalig fünf Cent zusätzlich kostet.
- Jeder nachfolgende Treffer: 40.000 gecachte Tokens zu 0,50 $ pro Million sind 0,02 $, plus 10.000 neue Tokens zu 0,05 $. Die Eingabe sinkt von 0,25 $ auf 0,07 $.
Der erste Treffer amortisiert bereits den Schreibvorgang. Bestätigen Sie die Funktion, indem Sie cache_read_input_tokens im usage-Block der Antwort lesen.
Hebel 4: Schnellen Modus überspringen
Der schnelle Modus kostet 10 $ Eingabe / 50 $ Ausgabe pro Million Tokens, genau das Doppelte des Basistarifs, im Austausch für etwa die 2,5-fache Ausgabegeschwindigkeit. Es handelt sich um eine Forschungsvorschau, nur für die Erstanbieter-API (nicht auf Bedrock, Google Cloud oder Microsoft Foundry), und nicht mit der Batch-API verfügbar. Wenn Sie auf Kosten optimieren, ist dies das Einfachste, was Sie weglassen können. Zahlen Sie das Doppelte nur für interaktive Oberflächen, bei denen ein Benutzer zuschaut, wie Tokens erscheinen.
Hebel 5: inference_geo in Ruhe lassen, es sei denn, Sie brauchen es
Das Festlegen von inference_geo: "us" wendet einen 1,1-fachen Multiplikator auf jede Token-Kategorie an, einen 10%igen Aufschlag auf die gesamte Rechnung. Dies dient den Anforderungen an die Datenresidenz; wenn Sie keine solche Anforderung haben, stellen Sie es nicht ein.
Ein kleinerer Gewinn: Der Overhead des System-Prompts für die Tool-Nutzung von Opus 5 beträgt 286 Tokens, wenn tool_choice auf auto oder none gesetzt ist, gegenüber 290 bei Opus 4.8 und weit unter den 675 von Opus 4.7. Dies ist kein Hebel, den Sie selbst betätigen, aber die Migration von 4.7 senkt Ihre Pro-Anfrage-Untergrenze von selbst. Für Einsparungen, die für die gesamte Claude-Produktlinie gelten, bietet Ihre Claude API-Rechnung reduzieren einen breiteren Ansatz.
Kostenvergleich auf einen Blick
| Konfiguration | Eingabe / MTok | Ausgabe / MTok | Am besten für |
|---|---|---|---|
Standard, Aufwand high |
$5.00 | $25.00 | Interaktiver Standard |
| Batch-API | $2.50 | $12.50 | Alles Asynchrone |
| Cache-Treffer auf einem stabilen Präfix | $0.50 | n.v. | Wiederholte Aufrufe mit langem Kontext |
| Schneller Modus | $10.00 | $50.00 | Nur für latenzkritische Anwendungen |
inference_geo: "us" |
1,1x alle Kategorien | 1,1x alle Kategorien | Anforderungen an die Datenresidenz |
Der 50%ige Batch-Rabatt gilt für Standard-Token-Tarife; überprüfen Sie auf Ihrer eigenen Rechnung, wie er mit den Tarifen für gecachte Tokens interagiert, bevor Sie eine kombinierte Einsparung modellieren. Vollständige Beispiele finden Sie unter Claude Opus 5 Preise.
Die günstigen Pfade in Apidog testen
Jeder oben genannte Hebel ist in einer einzigen HTTP-Antwort überprüfbar, was einen API-Client zum schnellsten Weg macht, um zu bestätigen, dass Sie tatsächlich Geld sparen. Hier ist ein Basisaufruf von Opus 5:
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-opus-5",
"max_tokens": 4096,
"output_config": {"effort": "low"},
"messages": [
{"role": "user", "content": "Summarize this OpenAPI spec in three sentences."}
]
}'
In Apidog erstellen Sie dies als gespeicherte POST-Anfrage, wobei Ihr Schlüssel als Umgebungsvariable gespeichert wird, anstatt ihn in den Body einzufügen, damit er niemals festgeschrieben wird. Dann:
- Vergleichen Sie die Aufwandsstufen nebeneinander. Duplizieren Sie die Anfrage, ändern Sie
effortauflow,mediumundhighund lesen Sieusage.output_tokensbei jeder. Sie sehen den Kostenunterschied direkt, anstatt zu raten. - Bestätigen Sie Cache-Treffer. Senden Sie dieselbe Anfrage mit langem Präfix zweimal und überprüfen Sie, ob
cache_read_input_tokensbeim zweiten Aufruf nicht Null ist. Wenn es bei Null bleibt, befindet sich Ihr Breakpoint an der falschen Stelle. - Beachten Sie die
max_tokens-Abschneidung. Denken und Antwort teilen sich jetzt dasmax_tokens-Budget, sodassstop_reason: "max_tokens"bedeutet, dass Sie für eine Ausgabe bezahlt haben, die Sie nie nutzen konnten. Fügen Sie eine Assertion dafür hinzu. - Überprüfen Sie Streaming- und Tool-Aufrufe. SSE-Antworten und Tool-Call-Payloads sind vollständig lesbar, was wichtig ist, wenn eine agentische Schleife mehr als erwartet ausgibt.
Laden Sie Apidog herunter, um mitzumachen, und sehen Sie unter wie man die Claude Opus 5 API verwendet für die vollständige Integrationsanleitung.
Ist Opus 5 das richtige Modell zum Optimieren?
Manchmal ist der günstigste Weg ein anderes Modell. Sonnet 5 läuft zu Einführungspreisen von 2 $ / 10 $, steigt am 1. September 2026 auf 3 $ / 15 $ und teilt sich dasselbe 1M-Token-Kontextfenster. Wenn Ihre Arbeitslast kein agentisches Codieren oder komplexes mehrstufiges Denken ist, testen Sie diese Lücke, bevor Sie die Opus 5-Rechnung optimieren. Claude Opus 5 vs. Sonnet 5 erklärt, wo der Aufpreis gerechtfertigt ist, und wie man Claude Sonnet 5 kostenlos nutzt behandelt Sonnets kostenlose Wege.
Seien Sie sich auch darüber im Klaren, was der Premium-Preis wirklich bringt. Laut Angaben von Anthropic übertrifft Opus 5 den Frontier-Bench-Score von Opus 4.8 um mehr als das Doppelte, liegt bei CursorBench 3.2 innerhalb von 0,5 % von Fable 5 zum halben Preis und liegt bei OSWorld 2.0 vor Fable 5 zu einem Drittel der Kosten. Dies sind von Anbietern veröffentlichte Zahlen von Anthropic, die mit Stand vom 25. Juli 2026 nicht unabhängig reproduziert wurden. Behandeln Sie sie als Behauptungen, die Sie testen sollten.
Opus 5 ist auch nicht die Spitze des Claude-Stacks. Fable 5 bleibt Anthropic’s fähigstes weit verbreitetes Modell, und Opus 5 hinkt Mythos 5 bei Cyber-Sicherheitsausnutzung und autonomer Biologieforschung immer noch hinterher. Die ehrliche Darstellung ist: Fähigkeit der Frontier-Klasse zum halben Frontier-Preis, mit einer benannten Obergrenze darüber. Sehen Sie sich was ist Claude Fable 5 an, wenn Ihre Arbeitslast nahe dieser Obergrenze liegt.
Welcher Pfad passt zu Ihnen
| Ziel | Pfad | Der Haken |
|---|---|---|
| Chat, Schreiben, Recherche | Claude Pro- oder Max-Abonnement | Verbrauchsabhängige Limits; Opus 5 verbraucht sie schneller als 4.8 |
| Agentisches Codieren | Claude Code mit einem kostenpflichtigen Plan | Längere Standardeinstellungen und Subagent-Delegation verbrauchen Guthaben |
| Prototyping einer Integration | API-Test oder Cloud-Aktionsguthaben | Guthaben läuft ab, dann pro Token bezahlen |
| Günstigste Produktions-API | Batch plus Caching plus Aufwand low |
Batch erhöht Latenz; Caching benötigt einen stabilen Präfix |
| Günstigste interaktive API | Standardtarife, Caching, Aufwand pro Aufgabe | Kein Batch-Rabatt verfügbar |
FAQ
Ist Claude Opus 5 kostenlos? Nicht über die API. Über die Claude-Apps ist es in kostenpflichtigen Abonnements enthalten: Standard für Max und das leistungsstärkste Modell, das Pro-Benutzern zur Verfügung steht. Die Launch-Materialien von Anthropic nennen den kostenlosen Plan nicht als Opus 5-Oberfläche.
Kann ich kostenlosen Claude Opus 5 API-Zugang erhalten? Nur über Testguthaben für neue Konten oder Aktionsguthaben auf Amazon Bedrock, Google Cloud oder Microsoft Foundry, die alle ein endliches Guthaben haben. Es gibt keine kostenlose unbegrenzte API-Stufe, und kein legitimer Dritter kann eine solche gewähren.
Was ist der günstigste legitime Weg, Opus 5 in großem Umfang zu betreiben? Die Batch-API zu 2,50 $ / 12,50 $, plus Prompt-Caching bei jedem stabilen Präfix über 512 Tokens, plus Aufwand low oder medium, wo Ihre Bewertungen dies zulassen. Lassen Sie den schnellen Modus ausgeschaltet und legen Sie inference_geo nicht fest, wenn keine Residenzanforderung besteht.
Sollte ich das Denken deaktivieren, um Tokens zu sparen? Nein. Die Kombination von deaktiviertem Denken mit Aufwand xhigh oder max führt zu einem 400-Fehler, und Anthropic empfiehlt, das Denken eingeschaltet zu lassen und stattdessen den Aufwand zu reduzieren. Wenn das Denken deaktiviert ist, schreibt Opus 5 gelegentlich Tool-Aufrufe als Klartext, die nie ausgeführt werden, und lässt interne XML-Tags in die sichtbare Ausgabe gelangen. Überprüfen Sie die tatsächlichen Kosten Ihrer Einstellungen, indem Sie den usage-Block lesen; eine gespeicherte Anfrage in Apidog mit einer Assertion für diese Felder fängt Regressionen automatisch ab.
