Claude Sonnet 5.5 vs Sonnet 5: Was sich geändert hat und Breaking Changes vor dem Umstieg

Sonnet 5.5 im Vergleich zu Sonnet 5: gleicher Preis von 2$/10$, viel höhere Bewertungen und fünf Breaking Changes, die 400er zurückgeben. Exakte Fehler und Vorher/Nachher-JSON-Korrekturen.

Medy Evrard

29 September 2026

Claude Sonnet 5.5 vs Sonnet 5: Was sich geändert hat und Breaking Changes vor dem Umstieg

Apidog für Unternehmen

On-Premises Bereitstellung

SSO & RBAC

SOC 2 konform

Apidog Enterprise entdecken

Claude Sonnet 5.5 (claude-sonnet-5-5, veröffentlicht am 28. September 2026) kostet dasselbe wie Sonnet 5, 2 $ pro Million Input-Tokens und 10 $ pro Million Output, und verwendet denselben Tokenizer. Es ist weitaus leistungsfähiger, und Anthropic gibt an, dass es über 30 % schneller ist. Auf der Starttabelle steigt Terminal-Bench 4.0 von 10,3 % auf 70,6 %, CursorBench 4.0 von 34,1 % auf 55,5 % und OSWorld 2.1 von 57,0 % auf 80,1 %. Der Haken ist die API. Fünf Anfrage-Formate, die mit Sonnet 5 funktionierten, geben jetzt einen 400er-Fehler zurück, und eine Änderung passt das Antwortformat ohne Fehler an. Fazit: Upgrade durchführen, aber zuerst diese sechs Dinge beheben.

Unten: jede breaking change mit dem genauen Fehler und Vorher/Nachher-JSON, dann eine Checkliste. Spezifikationen finden Sie unter was ist Claude Sonnet 5.5; für den vorherigen Sprung, Claude Sonnet 5 vs Sonnet 4.6. Apidog hält alte und neue Anfragen während des Tests nebeneinander.

Sonnet 5 vs. Sonnet 5.5 auf einen Blick

Claude Sonnet 5 Claude Sonnet 5.5
Preis pro MTok (Input / Output / Cache-Lesen) $2 / $10 / $0.20 $2 / $10 / $0.20
Kontext und Output 1M Kontext 1M Kontext, 128K Output
Akzeptierter thinking.type adaptive, disabled adaptive, between_tools
Standard display omitted omitted
Aufwand low bis max Gleiche Stufen, neu kalibriert; API-Standard high
Minimaler cachefähiger Prompt 1.024 Tokens 512 Tokens
Aufwand pro Nachricht, Systemnachrichten während des Gesprächs Nein Ja
Erzwungene tool_choice Unterstützt 400er Fehler
Cyber-Schutzmaßnahmen im Opus-Stil Nein Ja; Cyber mit hohem Risiko fällt auf Sonnet 5 zurück
Denkblöcke Keine Gesprächsprüfung An Modell, Gespräch und Konto gebunden
Terminal-Bench 4.0 10.3% 70.6%
CursorBench 4.0 34.1% 55.5%
FrontierCode 1.1 (Main) 42.4% 46.2% (max), 52.1% (xhigh)
GDPval-AA v2.1 (Elo) 1449 1844
OSWorld 2.1 (partial) 57.0% 80.1%
HLE (mit Tools) 54.9% 64.5%
Einstellung Wird weiterhin als Cyber-Fallback verwendet Nicht vor dem 28. September 2027

Anthropic führte Terminal-Bench, HLE und OSWorld durch; Cursor führte CursorBench, Cognition FrontierCode und Artificial Analysis GDPval-AA durch. Die eigene Terminal-Bench-Ausführung von Artificial Analysis ergibt 63,6 % vs. 14,1 %, der Unterschied bleibt also bestehen. FrontierCode hat zwei 5.5-Werte, da es bei max häufiger Überprüfungs-Subagenten einsetzte und der Benchmark Bearbeitungen außerhalb des Geltungsbereichs bestraft. Siehe Claude Sonnet 5.5 Benchmarks.

Die fünf Breaking Changes

Jede gibt einen 400 invalid_request_error für Code zurück, der auf Sonnet 5 einwandfrei läuft.

1. thinking: disabled ist nicht mehr vorhanden; between_tools senden

Sonnet 5.5 lehnt thinking: {"type": "disabled"} ab:

"thinking.type.disabled" wird für dieses Modell nicht unterstützt. Verwenden Sie "thinking.type.between_tools" für die niedrigste Denkeinstellung, oder "thinking.type.adaptive" und "output_config.effort", um das Denkverhalten zu steuern.

Senden Sie between_tools, die niedrigste Einstellung. Es überspringt das initiale Denken; Fortschrittsnotizen zwischen Tool-Aufrufen kommen weiterhin als thinking-Blöcke an, die Sie unverändert zurückgeben. Es funktioniert nur bei low, medium oder high Aufwand, akzeptiert keine anderen Felder (display, budget_tokens oder block_binding geben einen 400er-Fehler zurück) und sperrt den Aufwand für das Gespräch.

// Vorher (claude-sonnet-5)
{"model": "claude-sonnet-5", "max_tokens": 16000,
 "thinking": {"type": "disabled"},
 "output_config": {"effort": "xhigh"}}

// Nachher (claude-sonnet-5-5)
{"model": "claude-sonnet-5-5", "max_tokens": 16000,
 "thinking": {"type": "between_tools"},
 "output_config": {"effort": "high"}}

Wenn Sie xhigh oder max benötigen, lassen Sie thinking weg, damit adaptives Denken ausgeführt wird.

2. Erzwingen von tool_choice gibt einen 400er-Fehler zurück

Eine tool_choice von any oder tool schlägt fehl, auch am Token-Zähl-Endpunkt:

tool_choice: Typ "tool" und "any" werden für dieses Modell nicht unterstützt.

Senden Sie auto, markieren Sie das Tool mit strict: true (jedes Objekt benötigt additionalProperties: false) und geben Sie im Prompt an, wann es verwendet werden soll. Das Modell kann nun stattdessen in Text antworten, behandeln Sie also Runden ohne Tool-Aufruf.

// Vorher (claude-sonnet-5)
"tool_choice": {"type": "tool", "name": "get_weather"}

// Nachher (claude-sonnet-5-5)
"tools": [{"name": "get_weather",
  "input_schema": {"type": "object",
    "properties": {"location": {"type": "string"}},
    "required": ["location"], "additionalProperties": false},
  "strict": true}],
"tool_choice": {"type": "auto"},
"messages": [{"role": "user",
  "content": "Wie ist das Wetter in Paris? Verwenden Sie das get_weather Tool."}]

Die Obergrenze liegt bei 20 strikten Tools pro Anfrage. Auf Amazon Bedrock sind strikte Tools für Sonnet 5.5 nicht verfügbar: Senden Sie auto ohne strict und validieren Sie den Input in Ihrem Code.

3. Denkblöcke sind an das Modell, das Gespräch und das Konto gebunden

Jeder Sonnet 5.5 Denkblock ist über alles, was davor liegt, signiert: system, tools und frühere Nachrichten. Für Konten, die am oder nach dem 31. August 2026 (00:00 UTC) erstellt wurden, gibt das Wiedergeben eines Blocks nach einer Bearbeitung einen 400er-Fehler in der Claude API, Bedrock und Google Cloud zurück:

messages.1.content.0: Ungültige `signature` im `thinking`-Block. Der Block ist an ein anderes Gespräch gebunden. Entfernen Sie den Block oder setzen Sie `thinking.block_binding.prefix_mismatch_behavior` auf "drop_block".

Ältere Konten erzwingen dies standardmäßig nicht, daher beweist ein sauberer Durchlauf mit einem alten Schlüssel nichts. Halten Sie Gespräche append-only und ändern Sie Anweisungen oder Tools mit Systemnachrichten während des Gesprächs. Wenn Sie bearbeiten müssen, senden Sie anthropic-beta: thinking-binding-controls-2026-08-01 und lassen Sie nicht übereinstimmende Blöcke fallen:

"thinking": {"type": "adaptive",
  "block_binding": {"prefix_mismatch_behavior": "drop_block"}}

Das funktioniert nur mit adaptivem Denken; mit between_tools entfernen Sie Denkblöcke ab der bearbeiteten Runde. Sonnet 5.5 liest Blöcke von Sonnet 5, Opus 4.8, Haiku 4.5 und früheren Versionen; es verwirft Opus 5, Opus 5.5, Fable und Mythos Blöcke sowie Sonnet 5.5 Blöcke von einem anderen Konto, ohne die Anfrage fehlschlagen zu lassen. Kein anderes Modell liest seine Blöcke. Siehe Claude Fable 5.1 preserved thinking.

4. computer_20251124 schlägt bei der Claude API und Google Cloud fehl

Dort erfordert die Computernutzung das neue Toolset. Der Fehler beginnt:

'claude-sonnet-5-5' unterstützt keine Tool-Typen: computer_20251124.
// Vorher (claude-sonnet-5)
"tools": [{"type": "computer_20251124", ...}]

// Nachher (claude-sonnet-5-5, Claude API und Google Cloud)
"tools": [{"type": "computer_toolset_20260801"}]

Entfernen Sie den alten Beta-Header für die Computernutzung und aktualisieren Sie Ihre Schleife für tool_use-Blöcke, gebündelte Aktionen und toolset_name bei den Ergebnissen. Bedrock akzeptiert weiterhin computer_20251124; computer_20250124 schlägt überall fehl.

5. Einige Advisor-Paarungen werden abgelehnt

Mit dem Advisor-Tool (Beta) akzeptiert ein Sonnet 5.5 Executor nur Opus 5, Opus 5.5, Sonnet 5.5, Fable 5, Fable 5.1, Mythos 5 oder Mythos 5.1 als Advisor. Sonnet 5, Opus 4.8 und Opus 4.7 Advisors geben nun einen 400er-Fehler zurück. Ratschläge kommen auch verschlüsselt als advisor_redacted_result-Block an, sodass Code, der Rattext parst, nichts erhält.

Die stille Änderung: Text zwischen Tool-Aufrufen wandert in Denkblöcke

Diese Änderung führt zu keinem Fehler. Auf Sonnet 5 kamen Notizen zwischen Tool-Aufrufen als text zurück. Auf Sonnet 5.5 kommt alles, was länger als ein oder zwei Sätze ist, als thinking-Block für Fortschrittsaktualisierungen an, der unter dem Standard display: "omitted" leer ist. Eine Agent-Benutzeroberfläche, die diese Notizen streamt, wird still, ohne Fehler. Drei Lösungen:

// Header: anthropic-beta: thinking-display-updates-2026-08-18
"thinking": {"type": "adaptive", "display": "updates"}

Verhaltensänderungen ohne Codeänderung

Diese führen nicht zu fehlerhaften Anfragen, aber sie ändern Ausgabe und Kosten. Der Prompting Guide enthält Korrekturen.

Kosten pro Aufgabe: gleicher Preis, weniger Dollar pro Ergebnis

Anthropic’s Launch-Post besagt, dass Sonnet 5.5 in seinen Tests „bis zu 30 % weniger pro Aufgabe kostet als sein Vorgänger“. Die Preise sind identisch, daher resultiert die Einsparung aus weniger Tokens und Schritten. Seine Pro-Aufwands-Diagramme zeigen, dass ein geringerer Aufwand bei 5.5 den besten Lauf von Sonnet 5 übertrifft:

Benchmark (Anthropic-Diagramme) Sonnet 5.5 Sonnet 5, bester Lauf
Terminal-Bench 4.0 28.8% bei medium, $0.83 10.3% bei max, $11.62
FrontierCode 1.1 49.4% bei high, $0.42 42.7% bei xhigh, $10.07
CursorBench 4.0 35.8% bei low, $0.50 34.1% bei max, $7.17

CursorBench-Kosten sind Anthropic’s Schätzungen zu Listenpreisen. Die Kehrseite ist max: Laut OfficeChai’s Bericht über Daten von Artificial Analysis verwendet Sonnet 5.5 bei max etwa 193.000 Output-Tokens pro Indexaufgabe, und die Kosten pro Aufgabe liegen etwa 50 % über denen von Sonnet 5. Die Einsparungen liegen bei high und darunter; siehe Claude Sonnet 5.5 Preisgestaltung.

Migrations-Checkliste

Tauschen Sie claude-sonnet-5 gegen claude-sonnet-5-5 aus und führen Sie dann die sechs Prüfungen aus Anthropic’s Migrationsleitfaden durch:

  1. Ersetzen Sie disabled durch between_tools bei high Aufwand oder darunter.
  2. Ersetzen Sie erzwungenes tool_choice durch auto, strict: true und eine Prompt-Zeile (auf Bedrock im Code validieren).
  3. Halten Sie den Verlauf append-only; verwenden Sie Systemnachrichten während des Gesprächs für Änderungen.
  4. Verschieben Sie die Computernutzung auf computer_toolset_20260801 in der Claude API und Google Cloud.
  5. Wählen Sie einen unterstützten Advisor und hören Sie auf, den Beratungstext zu parsen.
  6. Setzen Sie thinking.display, wenn Ihre Benutzeroberfläche Text zwischen Tool-Aufrufen anzeigt.

Führen Sie dann Ihren Aufwands-Sweep erneut aus. Claude Code kann die Migration automatisieren:

/claude-api migriere dieses Projekt zu claude-sonnet-5-5

Das Opus-Äquivalent ist Claude Opus 5.5 vs. Opus 5 Migration.

Verwandeln Sie die Migration in einen Regressionstest in Apidog

In Apidog speichern Sie drei Anfragen an https://api.anthropic.com/v1/messages in einem Projekt, alle in derselben Umgebung:

  1. Baseline: Ihr aktueller Sonnet 5 Body.
  2. Alter Body, neues Modell: nur model auf claude-sonnet-5-5 geändert. Bestätigen Sie den Status 400 und eine Fehlermeldung, die between_tools oder tool_choice erwähnt.
  3. Migriert: der korrigierte Body. Bestätigen Sie den Status 200, einen stop_reason, der nicht refusal oder max_tokens ist, und einen tool_use-Block für Tool-Anfragen.

Behalten Sie ANTHROPIC_API_KEY in der Umgebung und referenzieren Sie es als {{ANTHROPIC_API_KEY}} im x-api-key-Header. Vergleichen Sie usage.output_tokens über verschiedene Aufwandsebenen hinweg für Ihre eigene Kosten-pro-Aufgabe-Zahl. Als Testszenario gespeichert, führt eine Regression zu disabled zum Fehlschlagen des Laufs anstatt der Produktion. Anfrage-Grundlagen: wie man die Claude Sonnet 5.5 API verwendet.

FAQ

Ist Claude Sonnet 5.5 teurer als Sonnet 5? Nein. Beide kosten 2 $ / 10 $ pro Million Tokens mit 0,20 $ für Cache-Lesevorgänge, und der Tokenizer ist derselbe.

Warum erhalte ich „thinking.type.disabled is not supported“ auf Sonnet 5.5? disabled wurde entfernt. Senden Sie thinking: {"type": "between_tools"} mit low, medium oder high Aufwand, ohne andere thinking-Felder.

Werden Sonnet 5 Konversationen auf Sonnet 5.5 übertragen? Ja. Sonnet 5.5 liest Sonnet 5 Denkblöcke. Ein Zurückwechseln führt zum Verlust dieser Blöcke: kein anderes Modell liest Sonnet 5.5 Blöcke.

Sollte ich alles auf Sonnet 5.5 umstellen? Für die meisten Workloads ja. Beachten Sie Cyber-nahe Arbeiten, die möglicherweise auf Sonnet 5 zurückfallen, und Bedrock-Tool-Aufrufe, die den strikten Modus verlieren. Unser Claude Sonnet 5 Leitfaden behandelt das Modell, das Sie verlassen.

Ihr nächster Schritt

Speichern Sie Ihre Sonnet 5 Anfrage und ihr 5.5-Gegenstück nebeneinander, bestätigen Sie den 400er-Fehler, beheben Sie ihn und leiten Sie den Traffic um, sobald die Korrektur erfolgreich ist. Laden Sie Apidog herunter, um diesen Test zu erstellen.

Praktizieren Sie API Design-First in Apidog

Entdecken Sie eine einfachere Möglichkeit, APIs zu erstellen und zu nutzen