Um Claude Haiku 5.5 in Claude Code zu verwenden, aktualisieren Sie auf v2.1.293 oder höher mit claude update, starten Sie dann eine Sitzung mit claude --model claude-haiku-5-5 oder führen Sie /model claude-haiku-5-5 in einer Sitzung aus. Der größere Vorteil für die meisten Leute ist, es als Subagenten auszuführen: Setzen Sie model: haiku in eine Subagenten-Datei und lassen Sie Sonnet 5.5 oder Opus 5.5 ihm die Suchanfragen, Testläufe und Zusammenfassungen übergeben. Mit einem API-Schlüssel kostet es 0,10 $/0,50 $ pro Million Eingabe-/Ausgabe-Tokens für Prompts bis zu 100K Tokens und 0,50 $/2,50 $ darüber.
Unten: Einrichtung, die haiku-Alias-Falle, Aufwand, Subagenten-Dateien, die 100K-Preisschwelle und wann Sonnet oder Opus die Führung übernehmen sollten. Für das Modell selbst lesen Sie was Claude Haiku 5.5 ist. Wenn Ihr Code APIs aufruft, enthält Apidog die Testszenarien, die ein Haiku-Subagent für Sie ausführen kann.

Claude Haiku 5.5 in Claude Code auf einen Blick
| Einstellung | Haiku 5.5 |
|---|---|
| Mindestversion | v2.1.293 (claude update) |
| Modell-ID | claude-haiku-5-5 |
haiku-Alias |
Nur Haiku 5.5 auf der Anthropic API |
| Kontext | 1M nativ in jedem Plan, kein [1m] Suffix |
| Auto-Komprimierung | Standardmäßig etwa 967K Tokens |
| Standard-Aufwand | medium (Stufen low bis max) |
| Denken | Immer an; kann nicht ausgeschaltet werden |
| API-Preis | 0,10 $/0,50 $ fĂĽr Prompts bis zu 100K Tokens; 0,50 $/2,50 $ ĂĽber 100K |
| Pläne | Pro, Max, Team, Enterprise oder ein API-Schlüssel; nicht kostenlos |
Schritt 1: Claude Code aktualisieren
Haiku 5.5 benötigt Claude Code v2.1.293 oder höher. Der Changelog-Eintrag bezeichnet es als „jetzt das Standard-Haiku-Modell auf der Anthropic API“.
claude update
Claude Code ist nicht im kostenlosen Plan enthalten. Kostenlose Benutzer können Haiku 5.5 in den Claude.ai Apps auswählen, aber Claude Code benötigt Pro, Max, Team, Enterprise oder einen Anthropic API-Schlüssel. Gemäß claude.com/pricing kostet Pro 17 $ pro Monat bei jährlicher Abrechnung oder 20 $ monatlich, und Max beginnt bei 100 $.
Schritt 2: Haiku 5.5 als Ihr Hauptmodell auswählen
claude --model claude-haiku-5-5
Innerhalb einer laufenden Sitzung bewirkt /model claude-haiku-5-5 dasselbe. Wenn Ihre gespeicherte model-Einstellung haiku ist, wird eine auf Haiku 4.5 gespeicherte Sitzung auf Haiku 5.5 fortgesetzt.
Der haiku-Alias bedeutet nur Haiku 5.5 auf der Anthropic API
| Anbieter | haiku löst auf zu |
|---|---|
| Anthropic API | Haiku 5.5 |
| Claude Plattform auf AWS | Haiku 4.5 |
| Amazon Bedrock, Google Cloud’s Agent Platform | Haiku 4.5 |
| Microsoft Foundry | Haiku 4.5 |
Bei jedem Cloud-Anbieter führen /model haiku und model: haiku in einer Subagenten-Datei zu Haiku 4.5. Verwenden Sie stattdessen dort die vollständige ID: claude-haiku-5-5 auf Google Cloud und Claude Platform auf AWS, Ihren Bereitstellungsnamen auf Foundry und eine Inferenzprofil-ID wie us.anthropic.claude-haiku-5-5 auf Amazon Bedrock. Oder richten Sie den Alias darauf aus mit ANTHROPIC_DEFAULT_HAIKU_MODEL (Schritt 5).
Schritt 3: Wählen Sie eine Aufwandsstufe
Haiku 5.5 ist das erste Haiku mit Aufwandssteuerung: low, medium, high, xhigh und max, beginnend bei medium in Claude Code.
claude --model claude-haiku-5-5 --effort high
In einer Sitzung speichert /effort low eine Stufe für das aktuelle Modell. Anthropic's Prompting-Leitfaden empfiehlt low für kurze Tool-Aufgaben und hochvolumige Anfragen, medium für die meisten Arbeiten und high für längere Agenten-Aufgaben. Sparen Sie sich xhigh und max für Aufgaben, bei denen Ihre Bewertungen einen Gewinn zeigen.
Das Denken bleibt eingeschaltet. Sie können es bei Haiku 5.5 in Claude Code nicht ausschalten; alwaysThinkingEnabled: false und MAX_THINKING_TOKENS=0 haben keine Wirkung. (Die rohe Messages API kann es bei high oder darunter deaktivieren.) Senken Sie den Aufwand, wenn Sie weniger Denk-Tokens wünschen.
Schritt 4: Haiku 5.5 als Subagent ausfĂĽhren
Anthropic sagt, dass Haiku 5.5 „gut mit Opus 5.5 und Sonnet 5.5 als Subagent bei der Codierungsarbeit harmoniert“. Subagenten sind Markdown-Dateien mit YAML-Frontmatter in .claude/agents/ (Projekt) oder ~/.claude/agents/ (alle Projekte). Nur name und description sind erforderlich, und die Subagenten-Dokumentation akzeptiert sonnet, opus, haiku, fable, eine vollständige Modell-ID oder inherit für model. Unser Subagenten-Leitfaden behandelt Bereiche und Tools.
Ersetzen Sie Explore durch einen gĂĽnstigen Explorer
Der eingebaute Explore-Subagent läuft auf dem Modell der Hauptkonversation, nicht auf Haiku. In einer Opus 5.5-Sitzung läuft jede Explore-Suche auf Opus. Ein Benutzer- oder Projekt-Subagent namens Explore überschreibt den eingebauten und behält sein eigenes model:
---
name: Explore
description: Schnelle schreibgeschĂĽtzte Codebase-Suche. Verwenden Sie dies, um Dateien, Symbole und Aufrufstellen zu finden, ohne etwas zu bearbeiten.
tools: Read, Grep, Glob
model: haiku
effort: low
---
Sie durchsuchen die Codebasis und berichten, was Sie finden. Geben Sie Dateipfade mit Zeilennummern und eine kurze Zusammenfassung jeder Ăśbereinstimmung zurĂĽck. Bearbeiten Sie niemals Dateien.
Speichern Sie es als .claude/agents/Explore.md. Führen Sie /tasks aus, während es arbeitet, um das Modell zu bestätigen. Bei einem Cloud-Anbieter tauschen Sie haiku gegen die vollständige ID aus Schritt 2 aus.
Jeden Subagenten auf Haiku zwingen
Um jeden Subagenten, einschlieĂźlich Explore, auf Haiku auszufĂĽhren, setzen Sie beide Variablen im env-Block einer Einstellungsdatei:
{
"env": {
"CLAUDE_CODE_SUBAGENT_MODEL": "haiku",
"CLAUDE_CODE_SUBAGENT_MODEL_FORCE": "1"
}
}
CLAUDE_CODE_SUBAGENT_MODEL allein ist eine Standardeinstellung: Das eigene model-Feld eines Subagenten hat immer noch Vorrang, und Explore bewegt sich nicht.
Schritt 5: Hintergrundaufgaben auf Haiku 5.5 ausrichten
ANTHROPIC_DEFAULT_HAIKU_MODEL legt „das Modell fest, das für haiku oder Hintergrundfunktionen verwendet werden soll“, wie z. B. das Zusammenfassen vergangener Sitzungen für claude --resume. Das ältere ANTHROPIC_SMALL_FAST_MODEL ist veraltet, gemäß der Referenz der Umgebungsvariablen; ersetzen Sie es, wenn Ihr Shell-Profil es noch setzt.
Auf der Anthropic API müssen Sie nichts einstellen. Auf Google Cloud werden Hintergrundaufgaben standardmäßig auf Sonnet ausgeführt; auf Foundry auf das primäre Modell; auf Bedrock auf Sonnet oder das primäre Modell. Sobald Haiku 5.5 in Ihrem Konto aktiviert ist, fixieren Sie es:
# Google Cloud's Agent Platform
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-5-5
# Amazon Bedrock (Inferenzprofil-ID)
export ANTHROPIC_DEFAULT_HAIKU_MODEL=us.anthropic.claude-haiku-5-5
Die 100K-Preisschwelle in langen Sitzungen
Der Preis von Haiku 5.5 hängt von der Prompt-Länge ab, und Claude Code sendet die Konversation bei jeder Runde als Prompt. Sobald der Kontext einer Sitzung 100K Tokens überschreitet, wird jede Anfrage mit 0,50 $/2,50 $ statt 0,10 $/0,50 $ abgerechnet, dem fünffachen des Kurz-Prompt-Tarifs. Die Dokumentation sagt nicht, ob zwischengespeicherte Tokens auf diese Grenze angerechnet werden, also planen Sie, als ob sie es tun würden.
Auto-Komprimierung wird Sie nicht retten: Haiku 5.5 komprimiert standardmäßig bei etwa 967K Tokens, sodass eine Sitzung zuerst weit über die Preisschwelle hinauslaufen kann. Zwei Gewohnheiten helfen, wenn Sie pro Token bezahlen:
- FrĂĽher komprimieren.
/autocompact 100klegt das niedrigste Fenster fest, das Claude Code akzeptiert, sodass die Sitzung nahe der Grenze statt nahe 1M komprimiert wird. - Voluminöse Arbeit in Subagenten verlagern. Ein Subagent hat seinen eigenen Kontext, sodass Testprotokolle und Suchergebnisse außerhalb der Hauptkonversation bleiben.
Selbst über 100K sind 0,50 $/2,50 $ ein Viertel von Sonnet 5.5's 2 $/10 $. Bei einem kostenpflichtigen Plan nutzen Sitzungen stattdessen Nutzungslimits, und Anthropic hat nicht veröffentlicht, wie Haiku 5.5 darauf angerechnet wird. Unsere Aufschlüsselung der Haiku 5.5-Preise erklärt die Berechnung.
Max- und Team-Abonnenten: Die neuen monatlichen API-Guthaben (100 $ bei Max 5x, 200 $ bei Max 20x, bis zu 500 $ gebündelt im Team) decken interaktives Claude Code nicht ab, gemäß Anthropic's API-Guthaben-Dokumentation.
Wann Sonnet 5.5 oder Opus 5.5 die FĂĽhrung behalten sollte
Anthropic sagt, dass Sonnet 5.5 und Opus 5.5 „bessere Wahlmöglichkeiten für komplexe agentenbasierte Codierungsaufgaben bleiben“. Auf Terminal-Bench 4.0, das von Anthropic in Claude Code mit maximalem Aufwand ausgeführt wurde, erreichte Haiku 5.5 39,2% gegenüber Sonnet 5.5's 70,6%. Die Launch-Diagramme fügen Kosten pro Versuch hinzu:
| Aufwand | Haiku 5.5 | Sonnet 5.5 |
|---|---|---|
medium |
20,3% bei 0,68 $ | 28,8% bei 0,68 $ |
high |
24,8% bei 1,04 $ | 43% bei 1,46 $ |
max |
39,2% bei 2,64 $ | 70,6% bei 10,44 $ |
Bei medium kosten beide pro Versuch etwa gleich viel und Sonnet erzielt höhere Werte. Der Token-Preis von Haiku überträgt sich nicht auf lange Shell-Arbeiten, daher sollte es nicht die Führung für anspruchsvolle Coding-Sitzungen übernehmen.
Die Computernutzung erzählt eine andere Geschichte. Auf OSWorld 2.1 erreichte Haiku 5.5 bei medium 53,3% zu 0,13 $ pro Versuch, während Sonnet 5.5 bei low 57,9% zu 0,68 $ erreichte. Unsere Haiku 5.5 Benchmarks-Aufschlüsselung enthält jede Zeile, und der Sonnet 5.5 Claude Code-Leitfaden behandelt die Seite des führenden Modells.
Eine praktische Aufteilung: Sonnet 5.5 oder Opus 5.5 als Hauptmodell, Haiku 5.5 fĂĽr Explore, Testrunner, Log-Reader und Dokumenten-Abrufer.
Beispiel: Ein Haiku-Subagent, der Ihre Apidog-Tests ausfĂĽhrt
Testläufe sind ausführlich und repetitiv, was gut zu Haiku passt. Die Apidog CLI führt Ihre gespeicherten Apidog-Testszenarien vom Terminal aus aus, sodass ein Subagent sie ausführen und einen kurzen Bericht zurückgeben kann, während der Kontext des führenden Modells sauber bleibt.
---
name: api-test-runner
description: Führt die Apidog-Testszenarien des Projekts mit der Apidog CLI aus, nachdem ein API-Endpunkt geändert wurde, und meldet dann die Anzahl der bestandenen und fehlgeschlagenen Tests mit den fehlgeschlagenen Anfragen.
tools: Bash, Read
model: haiku
effort: low
---
Führen Sie den in der README dieses Repos dokumentierten Apidog CLI-Testbefehl für das Szenario aus, das den geänderten Endpunkt abdeckt. Melden Sie die Anzahl der bestandenen und fehlgeschlagenen Tests. Geben Sie für jeden Fehler den Anfragenamen, das erwartete Ergebnis und das tatsächliche Ergebnis an. Bearbeiten Sie keinen Code. Wiederholen Sie einen fehlgeschlagenen Lauf nicht mehr als einmal.
Die Einrichtung fĂĽr die CLI, einschlieĂźlich Authentifizierung und des AusfĂĽhrungsbefehls, finden Sie unter Apidog CLI in Claude Code. Laden Sie Apidog herunter, um die Szenarien zu erstellen, die der Subagent ausfĂĽhrt.
Migration einer App von Haiku 4.5
Wenn Ihre App Haiku 4.5 ĂĽber die API aufruft, kann Claude Code die Migration starten:
/claude-api migrate this project to claude-haiku-5-5
Erwarten Sie grundlegende Änderungen: manuelles budget_tokens Denken, nicht standardmäßige temperature oder top_p, jedes top_k und Assistant-Prefill führen alle zu einem 400-Fehler bei Haiku 5.5. Der Haiku 5.5 vs. Haiku 4.5 Leitfaden listet jede Korrektur auf. Speichern Sie nach der Bearbeitung die alte und neue Anfrage als Paar in Apidog, speichern Sie ANTHROPIC_API_KEY als Umgebungsvariable und überprüfen Sie stop_reason und usage, damit ein neuer refusal-Stop oder ein Token-Sprung einen Test fehlschlagen lässt, anstatt in Produktion zu gehen.
FAQ
Ist Haiku 5.5 das Standardmodell in Claude Code? Nein. Es ist das Standard-Haiku-Modell auf der Anthropic API, was bedeutet, dass der haiku-Alias darauf verweist. Wählen Sie es als Ihr Hauptmodell mit --model oder /model aus.
Kann ich Haiku 5.5 in Claude Code im kostenlosen Plan verwenden? Nein. Claude Code benötigt einen kostenpflichtigen Plan oder einen API-Schlüssel. Kostenlose Benutzer können Haiku 5.5 in den Claude.ai Apps auswählen; siehe wie man Claude Haiku 5.5 kostenlos nutzt.
Warum erhalte ich mit model: haiku Haiku 4.5? Sie verwenden Bedrock, Google Cloud, Foundry oder Claude Platform auf AWS, oder eine Version vor v2.1.293. Fixieren Sie die vollständige ID oder setzen Sie ANTHROPIC_DEFAULT_HAIKU_MODEL.
Kann ich das Denken ausschalten, um Tokens zu sparen? Nicht in Claude Code. Senken Sie stattdessen den Aufwand; low ist die gĂĽnstigste Einstellung.
Ihr nächster Schritt
FĂĽhren Sie claude update aus, fĂĽgen Sie die Haiku Explore-Ăśberschreibung hinzu und behalten Sie Ihr aktuelles Hauptmodell eine Woche lang bei. FĂĽgen Sie dann den Test-Runner-Subagenten hinzu, falls Ihr Projekt APIs hat. Um das Modell von Ihrem eigenen Code aus aufzurufen, beginnen Sie mit dem Haiku 5.5 API-Leitfaden. Apidog ist kostenlos zu starten und bietet dem Subagenten echte Tests zum AusfĂĽhren.
