Claude Haiku 5.5 (claude-haiku-5-5, veröffentlicht am 7. Oktober 2026) kostet 90 % weniger als Haiku 4.5 für Prompts bis zu 100.000 Tokens (0,10 $ / 0,50 $ pro Million Eingabe-/Ausgabe-Tokens gegenüber 1 $ / 5 $), verfügt über ein 1M-Token-Kontextfenster anstelle von 200K und erzielt bei jedem Start-Benchmark, der beide Modelle auflistet, deutlich höhere Werte. Der Haken: Fünf Anfrageformen, die unter 4.5 funktionierten, geben jetzt einen 400er-Fehler zurück, und einige weitere Änderungen modifizieren Antworten und Kosten ohne Fehler.
Unten: eine Seite-an-Seite-Tabelle, jede bahnbrechende Änderung mit Vorher-/Nachher-JSON, die stillen Änderungen und ein Testplan für Apidog. Für das vollständige Datenblatt lesen Sie was ist Claude Haiku 5.5. Wenn Sie immer noch das ältere Modell verwenden, deckt unser Claude Haiku 4.5 API-Leitfaden dies ab.
Haiku 4.5 vs Haiku 5.5 im Überblick
| Claude Haiku 4.5 | Claude Haiku 5.5 | |
|---|---|---|
| Modell-ID (Claude API) | claude-haiku-4-5-20251001 |
claude-haiku-5-5 |
| Kontext / maximale Ausgabe | 200K / 64K | 1M / 128K |
| Eingabe / Ausgabe pro MTok | 1 $ / 5 $ | 0,10 $ / 0,50 $ für Prompts bis zu 100.000 Tokens; 0,50 $ / 2,50 $ darüber |
| Cache-Lesen / 5m-Schreiben pro MTok | 0,10 $ / 1,25 $ | 0,01 $ / 0,125 $ bis zu 100.000; 0,05 $ / 0,625 $ darüber |
| Batch-Eingabe / -Ausgabe pro MTok | 0,50 $ / 2,50 $ | 0,05 $ / 0,25 $ bis zu 100.000; 0,25 $ / 1,25 $ darüber |
| Denken (Thinking) | Manuelles budget_tokens |
Nur adaptiv, standardmäßig aktiviert |
| Anstrengungsstufen (Effort levels) | Keine | niedrig, mittel (Standard), hoch, xhoch, max |
| Minimaler cachefähiger Prompt | 4.096 Tokens | 512 Tokens |
| Tokenisierer | Älter | Etwa 30 % mehr Tokens für denselben Text |
| Nicht-Standard-Sampling-Parameter, Vorbefüllung | Akzeptiert | 400er Fehler |
| Prioritätsstufe (Priority Tier) | Unterstützt | Nicht unterstützt |
| Status | Aktiv, Außerbetriebnahme nicht vor dem 15. Okt 2026 | Aktiv, Außerbetriebnahme nicht vor dem 7. Okt 2027 |
Haiku 4.5 ist nicht veraltet. Die Modell-Veraltungs-Seite listet es als aktiv ohne Verfallsdatum, sodass Sie nach Ihrem eigenen Zeitplan migrieren können. Die Ratenbegrenzungen sind bei beiden gleich.
Die fünf bahnbrechenden Änderungen
Jede gibt einen 400er-Fehler auf Haiku 5.5 für einen Body zurück, der unter 4.5 funktioniert. Der Haiku 5.5 Migrationsleitfaden listet sie alle auf.
1. Manuelles Denken (Thinking) mit budget_tokens
Haiku 5.5 verwendet nur adaptives Denken (Thinking). Ein festes Budget wird abgelehnt.
// Vorher (Haiku 4.5)
{
"model": "claude-haiku-4-5-20251001",
"max_tokens": 16000,
"thinking": { "type": "enabled", "budget_tokens": 8000 },
"messages": [{ "role": "user", "content": "Dieses Ticket klassifizieren." }]
}
// Nachher (Haiku 5.5)
{
"model": "claude-haiku-5-5",
"max_tokens": 16000,
"thinking": { "type": "adaptive" },
"output_config": { "effort": "medium" },
"messages": [{ "role": "user", "content": "Dieses Ticket klassifizieren." }]
}
Effort (Anstrengung) ist jetzt der Hebel: Wo 4.5 ein kleines Budget verwendete, wählen Sie eine geringere Anstrengung. Sie können weiterhin thinking: {"type": "disabled"} senden, aber nur bei `high` Effort oder darunter; bei `xhigh` oder `max` ist das ebenfalls ein 400er-Fehler.
2. Sampling-Parameter
Entfernen Sie temperature, top_p und top_k. Die einzigen akzeptierten Werte sind temperature: 1 und top_p: 0.99. Jeder andere Wert führt zu einem 400er-Fehler, einschließlich top_p: 1, jeglichem top_k und dem gleichzeitigen Senden von temperature und top_p.
// Vorher (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
"temperature": 0.2, "top_k": 40,
"messages": [{ "role": "user", "content": "Die Bestell-ID extrahieren." }] }
// Nachher (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
"messages": [{ "role": "user", "content": "Die Bestell-ID extrahieren." }] }
Wenn Sie eine niedrige Temperatur für konsistente Ausgabe verwendet haben, verschieben Sie diese Absicht in den Prompt.
3. Assistenten-Vorbefüllung
Eine letzte Assistenten-Runde, die das Modell fortsetzen soll, wird abgelehnt, selbst wenn das Denken (Thinking) ausgeschaltet ist. Beenden Sie messages mit einer Benutzer-Runde.
// Vorher (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
"messages": [
{ "role": "user", "content": "Das Sentiment als JSON zurückgeben." },
{ "role": "assistant", "content": "{\"sentiment\": \"" }
] }
// Nachher (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
"system": "Antworten Sie nur mit einem JSON-Objekt. Keine Präambel.",
"messages": [
{ "role": "user", "content": "Das Sentiment als JSON zurückgeben." }
] }
Für strikte Formate verweist der Migrationsleitfaden auf strukturierte Ausgaben oder ein Tool mit Enum-Feldern für die Klassifizierung.
4. Computernutzung (Computer use): computer_20250124 zu computer_toolset_20260801
Auf der Claude API und in Google Cloud unterstützt Haiku 5.5 die Computernutzung (Computer use) nur über das neue Toolset. Entfernen Sie den Beta-Header `computer-use-2025-01-24` und `fine-grained-tool-streaming-2025-05-14`, falls Sie ihn senden, da dies zusammen mit einem Toolset einen 400er-Fehler verursacht.
// Vorher (Haiku 4.5, Header anthropic-beta: computer-use-2025-01-24)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 4096,
"tools": [{ "type": "computer_20250124", "name": "computer",
"display_width_px": 1280, "display_height_px": 800 }],
"messages": [{ "role": "user", "content": "Die Einstellungen-Seite öffnen." }] }
// Nachher (Haiku 5.5, kein Beta-Header)
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"tools": [{ "type": "computer_toolset_20260801" }],
"messages": [{ "role": "user", "content": "Die Einstellungen-Seite öffnen." }] }
Auch Ihre Agenten-Schleife ändert sich: Dispatch auf `name` und `toolset_name` jedes `tool_use`-Blocks anstelle von `input.action`, und `toolset_name` bei Ergebnissen zurückgeben. Haiku 5.5 erhält auch das Browser-Nutzungs-Tool (`browser_toolset_20260801`), das Haiku 4.5 nicht unterstützt. Sehen Sie Claude Code Computernutzung für das Gesamtbild.
5. Bearbeiten früherer Züge vor einem Thinking-Block
Ein Haiku 5.5 Thinking-Block bleibt nur gültig, solange alles, was davor gesendet wurde, unverändert ist. Ändern Sie `system`, `tools` oder eine frühere Nachricht und senden Sie den Block zurück, erhalten Sie einen 400er-Fehler. Haiku 4.5 führte diese Prüfung nie durch. Hier sendete Zug 1 `"system": "You are a billing agent."` und Zug 2 bearbeitet ihn.
// Vorher: bearbeitetes System + wiederholter Thinking-Block = 400
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"system": "Sie sind ein Abrechnungsagent. Fassen Sie sich kurz.",
"messages": [
{ "role": "user", "content": "Warum wurde mir doppelt berechnet?" },
{ "role": "assistant", "content": [
{ "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
{ "type": "text", "text": "Überprüfung." } ] },
{ "role": "user", "content": "Bestellung 4412." }
] }
// Nachher: frühere Züge unverändert, neue Anweisung angehängt
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"system": "Sie sind ein Abrechnungsagent.",
"messages": [
{ "role": "user", "content": "Warum wurde mir doppelt berechnet?" },
{ "role": "assistant", "content": [
{ "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
{ "type": "text", "text": "Überprüfung." } ] },
{ "role": "user", "content": "Bestellung 4412. Fassen Sie sich kurz." }
] }
Bei Konten, die vor dem 31. August 2026, 00:00 UTC, erstellt wurden, tritt der Fehler nur bei Anfragen auf, die thinking.block_binding.prefix_mismatch_behavior setzen.
Stille Änderungen, die keinen Fehler auslösen werden
- Standardmäßig leeres Thinking-Feld. Jeder
thinking-Block kommt mit einem leerenthinking-Feld und nur einersignaturezurück. Haiku 4.5 gab zusammenfassendes Denken (Thinking) zurück. Setzen Siethinking: {"type": "adaptive", "display": "summarized"}, wenn Sie es protokollieren oder anzeigen. - Antworten können mit Thinking beginnen. Adaptives Denken (Thinking) ist aktiviert, auch wenn Sie es nicht einstellen, also wählen Sie Inhaltsblöcke nach
type, nicht nach Index. - Etwa 30 % mehr Tokens. Der neue Tokenisierer zählt denselben Text als etwa 30 % mehr Tokens. Zählen Sie Prompts neu, und denken Sie daran, dass Thinking-Tokens auf
max_tokensangerechnet werden, sodass ein kleines Limit mitstop_reason: "max_tokens"stoppen kann, bevor Text ausgegeben wird. - Erzwungene
tool_choiceüberspringt Thinking.anyoder ein benanntes Tool funktioniert weiterhin, aber die Antwort beginnt mit dem Tool-Aufruf und ohnethinking-Block. Verwenden Sietool_choice: {"type": "auto"}und teilen Sie dem Modell mit, wann es das Tool aufrufen soll, wenn Sie möchten, dass es zuerst überlegt. - Neue Ablehnungen, kein Fallback. Haiku 5.5 verwendet Sicherheitsklassifikatoren (
cyber,frontier_llm,bio,general_harms), diestop_reason: "refusal"zurückgeben können. Es gibt kein serverseitiges Fallback, und ein erneuter Versuch führt normalerweise wieder zu einer Ablehnung. - Prioritätsstufe (Priority Tier) ist weggefallen. Wenn Sie eine Prioritätsstufe-Verpflichtung für Haiku 4.5 haben, planen Sie die Kapazität separat.
- Thinking-Blöcke sind konto-gebunden. Sie funktionieren nur in dem Konto, das sie erstellt hat, oder einem verknüpften Konto. Das erneute Abspielen gespeicherter Konversationen über ein anderes Konto führt zum Verlust dieser Argumentation.
- Günstigeres Caching beginnt früher. Der minimale cachefähige Prompt fällt von 4.096 auf 512 Tokens, sodass kurze Systemprompts, die unter 4.5 nie gecached wurden, dies jetzt tun.
Was wurde besser
Dies sind von Anthropic gemeldete Zahlen mit Haiku 5.5 bei maximaler Anstrengung; Artificial Analysis führte GDPval-AA und AA-Briefcase unabhängig voneinander durch.
| Benchmark | Haiku 4.5 | Haiku 5.5 |
|---|---|---|
| GDPval-AA v2.1 (Elo) | 735 | 1620 |
| AA-Briefcase v1.1 (Elo) | 614 | 1578 |
| OSWorld 2.1, Offline-Subset | 15,7% | 72,4% |
| Humanity’s Last Exam, mit Tools | 18,7% | 57,4% |
| Terminal-Bench 4.0 | 0,0% | 39,2% |
| SWE-bench Multilingual | 67,4% | 83,7% |
| Chartography, ohne Tools | 6,4% | 46,4% |
Der Terminal-Bench-Lauf von Haiku 4.5 verwendete ein festes Thinking-Budget von 63.999 Tokens. Beim Standard-medium Effort erzielte Haiku 5.5 1277 auf GDPval-AA, immer noch deutlich über 4.5. Box meldete Ergebnisse, die 11 Punkte höher lagen als Haiku 4.5 bei etwa der Hälfte der Latenz. Vollständige Tabellen finden Sie in den Claude Haiku 5.5 Benchmarks.
Anthropic positioniert Sonnet 5.5 und Opus 5.5 weiterhin als bessere Wahl für komplexe agentische Kodierung. Haiku 5.5 zielt auf Klassifizierung, Extraktion, Zusammenfassung, Kompaktierung, Subagenten und Browsernutzung ab.
Hinsichtlich der Kosten sagt Anthropic, dass Haiku 5.5 im Durchschnitt etwa 75 % billiger ist. Diese Zahl berücksichtigt die 90 % niedrigeren Preise bis zu 100.000 Tokens und 50 % niedrigere Preise darüber, und sie berücksichtigt bereits die zusätzlichen Tokens des neuen Tokenisierers. Der System-Prompt für die Tool-Nutzung schrumpfte ebenfalls von 496 auf 286 Tokens bei auto Tool-Auswahl. Ausgearbeitete Beispiele finden Sie in Claude Haiku 5.5 Preisgestaltung.
Testen Sie die Migration in Apidog
Erstellen Sie in Apidog ein Projekt mit drei gespeicherten Anfragen an https://api.anthropic.com/v1/messages:

- Baseline: Ihr aktueller Haiku 4.5 Body. Bestätigen Sie Status 200.
- Alter Body, neues Modell: Ändern Sie nur
modelzuclaude-haiku-5-5. Bestätigen Sie Status 400. Behalten Sie eine Kopie pro aufgetretener bahnbrechender Änderung. - Migriert: der korrigierte Body. Bestätigen Sie Status 200, einen
stop_reason, der wederrefusalnochmax_tokensist, und einen nachtypegefundenen Textblock.
Speichern Sie ANTHROPIC_API_KEY als Umgebungsvariable und referenzieren Sie es als {{ANTHROPIC_API_KEY}} im x-api-key-Header, mit anthropic-version: 2023-06-01. Vergleichen Sie usage.input_tokens zwischen den Baseline- und migrierten Anfragen, um die Tokenizer-Änderung bei Ihren eigenen Prompts zu sehen. Speichern Sie das Set als Testszenario, und ein Teamkollege, der temperature wieder einführt, lässt den Lauf statt der Produktion fehlschlagen. Die Grundlagen der Anfrage finden Sie unter wie man die Claude Haiku 5.5 API verwendet.
Wenn Sie in Claude Code arbeiten, wendet /claude-api migrate this project to claude-haiku-5-5 den Modell-ID-Tausch und die Parameterkorrekturen an und gibt Ihnen dann eine Checkliste. Beachten Sie, dass der Alias haiku nur auf der Anthropic API zu Haiku 5.5 aufgelöst wird; siehe Claude Haiku 5.5 in Claude Code.
FAQ
Ist Claude Haiku 4.5 veraltet? Nein. Es ist als aktiv ohne Verfallsdatum gelistet, und seine Außerbetriebnahme erfolgt nicht vor dem 15. Oktober 2026.
Warum gibt meine Haiku 4.5 Anfrage einen 400er-Fehler auf Haiku 5.5 zurück? Prüfen Sie auf budget_tokens, temperature/top_p/top_k, eine Assistenten-Vorbefüllung, computer_20250124 oder Bearbeitungen früherer Züge vor einem Thinking-Block. Das sind die fünf bahnbrechenden Änderungen.
Ist Haiku 5.5 günstiger als Haiku 4.5 für lange Prompts? Ja. Über 100.000 Tokens kostet es 0,50 $ / 2,50 $ pro Million, die Hälfte von Haiku 4.5's 1 $ / 5 $. Haiku 4.5 kann überhaupt keine Prompts über 200.000 Tokens verarbeiten.
Sollte ich alles auf Haiku 5.5 umstellen? Für Klassifizierung, Extraktion und Subagenten-Arbeit testen Sie es zuerst, dann wechseln Sie. Vergleichen Sie es mit seinem engsten Konkurrenten in Haiku 5.5 vs GPT-6 Luna.
Nächster Schritt
Speichern Sie Ihre Haiku 4.5 Anfrage neben ihrem Haiku 5.5 Zwilling, bestätigen Sie den 400er-Fehler, beheben Sie ihn und leiten Sie den Traffic um, sobald die migrierte Anfrage erfolgreich ist. Laden Sie Apidog herunter, um dieses Testpaar zu erstellen.
