Anthropic hat Claude Opus 4.8 am 28. Mai 2026 veröffentlicht und es am selben Tag über die Claude API, Claude Apps, Claude Code und die großen Cloud-Plattformen verfügbar gemacht. Es ist das leistungsfähigste Modell der Claude-Familie, entwickelt für komplexe Schlussfolgerungen, langfristige agentische Codierung und hochautonome Arbeit. Die API-Modell-ID lautet claude-opus-4-8.
Wenn Sie bereits mit Opus 4.7 arbeiten, ist das Upgrade ein Modelltausch in einer Zeile. Die wichtigste Änderung ist weder eine neue Preisstufe noch ein größeres Kontextfenster; beides bleibt gleich. Es ist die Qualität. Laut der Ankündigung von Anthropic ist es bei Opus 4.8 etwa viermal unwahrscheinlicher als bei 4.7, dass ein Fehler im Code unbemerkt bleibt, und es ist ehrlicher in Bezug auf das, was es nicht weiß. Dieser Leitfaden behandelt, was sich geändert hat, wie Sie darauf zugreifen und ob sich ein Wechsel lohnt.
Die Kurzfassung
Drei Fakten sind am ersten Tag wichtig:
- Modell-ID
claude-opus-4-8: jetzt live auf der Claude API, AWS, Vertex AI und Microsoft Foundry - Gleicher Preis wie Opus 4.7: 5 $ pro Million Eingabe-Tokens, 25 $ pro Million Ausgabe-Tokens im Standardmodus
- 1 Mio. Token Kontext, 128K Token Ausgabe: unverändert gegenüber 4.7, sodass Ihre Token-Budgets übernommen werden
Was Sie zusätzlich erhalten:
- Ein neuer
effort-Parameter, der Gründlichkeit gegen Token-Effizienz über die gesamte Antwort hinweg eintauscht - Adaptives Denken, bei dem das Modell entscheidet, wie viel es pro Anfrage denken soll
- Dynamische Workflows in Claude Code, die Hunderte von parallelen Sub-Agenten in einer Sitzung starten können
- Bessere Ehrlichkeit, weniger durchrutschende Codefehler und effizientere Tool-Aufrufe
Für die vollständige Token-Berechnung und Kostenszenarien siehe die Opus 4.8 Preisübersicht. Um mit dem Bauen zu beginnen, springen Sie zum Opus 4.8 API-Leitfaden.
Was ist wirklich neu in Opus 4.8
Opus 4.8 behält die Spezifikationen von 4.7 bei und verbessert das zugrunde liegende Modell. Die Verbesserungen konzentrieren sich auf vier Bereiche.
Codequalität. Das Modell erkennt seine eigenen Fehler häufiger. Anthropic berichtet über einen Rückgang von etwa dem Vierfachen an Fehlern, die im Vergleich zu 4.7 unbemerkt die Überprüfung passieren. Für die agentische Codierung bedeutet das weniger stillschweigende Fehler in generierten Diffs.

Ehrlichkeit und Alignment. Opus 4.8 kennzeichnet Unsicherheiten leichter und macht weniger unbegründete Behauptungen. Anthropic berichtet auch über geringere Raten von Täuschung und Kooperation bei Missbrauch als 4.7. Wenn Sie Agenten unbeaufsichtigt laufen lassen, ist dieses Urteilsvermögen wichtiger als ein Benchmark-Punkt.
Tool-Aufruf. Das Modell wählt Tools effizienter aus und verschwendet weniger Aufrufe, was sowohl die Latenz als auch den Token-Verbrauch in Agenten-Schleifen reduziert.
Aufwandssteuerung. Dies ist die größte API-sichtbare Änderung und verdient einen eigenen Abschnitt.
Aufwandssteuerung: ein Modell, fünf Gänge
Der effort-Parameter lässt Sie einstellen, wie eifrig Claude Tokens ausgibt. Er befindet sich in output_config und akzeptiert fünf Stufen: low, medium, high, xhigh und max. Der Standardwert ist high auf jeder Oberfläche, einschließlich der API und Claude Code.
{
"model": "claude-opus-4-8",
"max_tokens": 4096,
"messages": [{"role": "user", "content": "Refactor this module."}],
"output_config": { "effort": "xhigh" }
}
Das entscheidende Detail: Der Aufwand beeinflusst alle Tokens, nicht nur die Argumentation. Das umfasst Text, Tool-Aufrufe und Funktionsargumente. Geringerer Aufwand bedeutet, dass Claude weniger Tool-Aufrufe tätigt und prägnantere Antworten schreibt. Höherer Aufwand bedeutet tiefere Analyse und gründlichere Arbeit.
Anthropic empfiehlt für Opus 4.8, bei Codierungs- und Agentenaufgaben mit xhigh zu beginnen, high als Untergrenze für die meisten rechenintensiven Arbeiten beizubehalten und erst dann auf medium oder low zu wechseln, wenn Ihre Evaluierungen bestätigen, dass die niedrigere Stufe die Qualität beibehält. Alle Details finden Sie in Anthropics Effort-Dokumentation.
Adaptives Denken ersetzt manuelle Budgets
Opus 4.8 verwendet adaptives Denken. Sie setzen thinking: {type: "adaptive"} und das Modell entscheidet, wann und wie viel es pro Anfrage denken soll. Bei den Aufwandsstufen high, xhigh und max denkt es fast immer tiefgründig. Auf niedrigeren Stufen kann es bei einfachen Problemen das Denken überspringen.
Eine Sache, die Sie vor der Migration wissen sollten: Manuelles erweitertes Denken mit budget_tokens wird in Opus 4.8 nicht unterstützt und führt zu einem 400-Fehler. Wenn Sie dieses Muster von einem älteren Opus übernommen haben, wechseln Sie zu adaptivem Denken plus dem Aufwandsparameter. Wir gehen die genaue Form der Anfrage im Opus 4.8 API-Leitfaden durch.
Dynamische Workflows in Claude Code
Das auffälligste neue Feature ist in Claude Code enthalten. Dynamische Workflows ermöglichen es einer einzelnen Sitzung, Hunderte von parallelen Sub-Agenten zu starten, um große, verzweigte Aufgaben zu bearbeiten. Im Hintergrund ist dies die xhigh-Aufwandsstufe, gepaart mit Systemnachrichten mitten im Gespräch – dieselbe Messages API-Aktualisierung, die jetzt Systemeingaben auch mitten im Gespräch und nicht nur am Anfang akzeptiert.
Diese Fähigkeit zur Kommunikation mitten im Gespräch gibt einem Orchestrator-Agenten die ständige Erlaubnis, Worker zu erstellen, während die Aufgabe sich entfaltet. Wenn Sie die Mechanismen und den Aufbau eines ähnlichen Orchestrierungsmodus über die Raw API erfahren möchten, lesen Sie den Claude Code Dynamic Workflows Deep-Dive. Hintergrundinformationen zur Strukturierung von Agentenläufen in Claude Code finden Sie in unserer Claude Code Agent Harness Aufschlüsselung.
Benchmark-Highlights
Anthropic's Schlagzeilen-Zahlen konzentrieren sich auf agentische Arbeit:
- Schlägt GPT-5.5 beim Super-Agent-Benchmark, der Suite, die die End-to-End-Aufgabenerfüllung misst
- Führt den Legal Agent Benchmark an und ist das erste Modell, das insgesamt 10% darauf überschreitet
- 84% bei Online-Mind2Web, einem Web-Navigations-Agenten-Test
Dies sind Agenten-Scores, keine Chat-Scores, was Ihnen zeigt, worauf Opus 4.8 abzielt. Für einen direkten Vergleich mit anderen führenden Modellen lesen Sie Opus 4.8 vs. GPT-5.5 vs. Gemini 3.5. Der ältere Vergleich Gemini 3.5 vs. GPT-5.5 vs. Opus 4.7 gilt weiterhin für die 4.7-Baseline.
Opus 4.8 vs. Opus 4.7 auf einen Blick
| Attribut | Opus 4.7 | Opus 4.8 |
|---|---|---|
| API-ID | claude-opus-4-7 |
claude-opus-4-8 |
| Eingabepreis | 5 $ / 1 Mio. Tokens | 5 $ / 1 Mio. Tokens |
| Ausgabepreis | 25 $ / 1 Mio. Tokens | 25 $ / 1 Mio. Tokens |
| Kontextfenster | 1 Mio. Tokens | 1 Mio. Tokens |
| Max. Ausgabe | 128K Tokens | 128K Tokens |
| Aufwandsstufen | niedrig bis max | niedrig bis max |
| Unerkannte Codefehler | Baseline | ~4x weniger |
| Ehrlichkeit / Alignment | Baseline | verbessert |
| Wissensstand | Jan 2026 | Jan 2026 |
Die Spezifikationen sind absichtlich identisch. Sie zahlen den gleichen Preis für ein Modell, das weniger Fehler macht, daher ist die Migration für die meisten Teams risikoarm. Testen Sie Ihre Tool-Schemata und Evaluierungen nach dem Austausch und stellen Sie dann bereit.
So greifen Sie auf Claude Opus 4.8 zu
Sie haben vier Zugänge:
- Claude API: Verwenden Sie die Modell-ID
claude-opus-4-8mit dem Messages-Endpunkt. Beginnen Sie mit dem Opus 4.8 API-Leitfaden. - Claude Apps: Es ist das standardmäßige High-End-Modell auf claude.ai für kostenpflichtige Pläne, mit begrenztem Zugriff im kostenlosen Plan.
- Claude Code: Als Top-Modell verfügbar, mit dynamischen Workflows, wenn Sie den High-Effort-Modus wählen.
- Cloud-Plattformen: AWS (
anthropic.claude-opus-4-8auf Bedrock), Vertex AI (claude-opus-4-8) und Microsoft Foundry, wo das Kontextfenster auf 200K Tokens begrenzt ist.
Wenn Sie es zuerst ohne kostenpflichtigen API-Plan ausprobieren möchten, beschreibt der Leitfaden wie Sie Opus 4.8 kostenlos nutzen können die legitimen kostengünstigen Wege.
Wer sollte Opus 4.8 verwenden
Opus 4.8 wurde für das anspruchsvolle Ende des Arbeitslastspektrums entwickelt. Greifen Sie darauf zurück, wenn:
- Sie lange agentische Codierungssitzungen durchführen, bei denen ein stiller Fehler teuer ist
- Sie einen Agenten benötigen, der unbeaufsichtigt fundierte Urteile fällt
- Sie mehrstufige Tool-Nutzung orchestrieren und weniger verschwendete Aufrufe möchten
- Die Aufgabe wirklich Spitzen-Reasoning erfordert, nicht eine schnelle Klassifizierung
Für hochvolumige, latenzempfindliche oder einfache Arbeiten ist ein kleineres Modell oder eine niedrigere Aufwandsstufe besser geeignet und kostengünstiger. Der Sinn der Aufwandssteuerung ist, dass Sie nicht mehr die Modelle wechseln müssen, um die Gänge zu wechseln.
Opus 4.8 testen, bevor Sie es bereitstellen
Ein Modelltausch ist leicht zu schreiben und leicht falsch zu machen. Streaming-Chunks, Tool-Aufruf-Validierung, die neue output_config-Form und adaptive Denkantworten ändern alle die Payloads, die Ihr Code parsen muss. Bevor Sie claude-opus-4-8 in Produktion nehmen, spielen Sie Ihre echten Anfragen dagegen ab und vergleichen Sie die Ausgabe.

Apidog verwaltet die gesamte Messages API-Oberfläche in einem Arbeitsbereich:
- Speichern Sie den Opus 4.8 Endpunkt als Anfrage, fügen Sie Ihren
x-api-keyhinzu und klicken Sie auf Senden - Tauschen Sie
claude-opus-4-7gegenclaude-opus-4-8in derselben Anfrage aus und vergleichen Sie die Antworten - Beobachten Sie, wie gestreamte Chunks inline mit Timing pro Chunk gerendert werden
- Fügen Sie Assertions hinzu, die Schemaabweichungen erfassen, wenn Sie die
effort-Stufen ändern - Mocken Sie den Endpunkt, damit Sie nachgelagerten Code testen können, ohne Credits zu verbrauchen
Laden Sie Apidog herunter, richten Sie eine Anfrage an den Messages-Endpunkt und fügen Sie das cURL-Snippet aus dem API-Leitfaden ein. Die Einrichtung dauert etwa zwei Minuten.
FAQ
Ist Claude Opus 4.8 besser als Opus 4.7? Ja, in Bezug auf die Qualität. Es fängt etwa viermal mehr Codefehler ab, ist ehrlicher bei Unsicherheiten und ruft Tools effizienter auf. Preise, Kontextfenster und maximale Ausgabe sind identisch, daher gibt es kaum einen Grund, bei 4.7 zu bleiben.
Wie viel kostet Opus 4.8? 5 $ pro Million Eingabe-Tokens und 25 $ pro Million Ausgabe-Tokens im Standardmodus. Der schnelle Modus kostet 10 $ und 50 $ für eine 2,5-mal schnellere Ausgabe. Die vollständige Berechnung finden Sie in der Preisübersicht.
Was ist das Kontextfenster für Opus 4.8? 1 Mio. Eingabe-Tokens und bis zu 128K Ausgabe-Tokens über die synchrone Messages API. Die Batch API unterstützt bis zu 300K Ausgabe-Tokens mit einem Beta-Header. Auf Microsoft Foundry beträgt das Kontextfenster 200K Tokens.
Unterstützt Opus 4.8 erweitertes Denken? Es verwendet adaptives Denken (thinking: {type: "adaptive"}), bei dem das Modell entscheidet, wie viel es denken soll. Manuelles Denken mit budget_tokens wird nicht unterstützt und führt zu einem 400-Fehler.
Was ist der effort-Parameter? Eine Einstellung innerhalb von output_config, die steuert, wie viele Tokens Claude für Text, Tool-Aufrufe und Schlussfolgerungen aufwendet. Die Stufen sind low, medium, high (Standard), xhigh und max.
Kann ich Opus 4.8 kostenlos nutzen? Es gibt keine kostenlose API-Stufe, aber Sie können es im kostenlosen Plan unter claude.ai mit Einschränkungen oder über Testguthaben ausprobieren. Siehe den Leitfaden zum kostenlosen Zugang.
Was sind Dynamische Workflows? Eine Claude Code-Funktion, die viele parallele Sub-Agenten in einer Sitzung startet, angetrieben durch xhigh Aufwand und Systemnachrichten mitten im Gespräch. Details im Leitfaden zu Dynamischen Workflows.
