Was ist Claude Haiku 5.5?

Was ist Claude Haiku 5.5? Anthropics Modell vom 7. Oktober 2026: 0,10 $/0,50 $ für Prompts von bis zu 100.000 Tokens, 1 Mio. Kontext, Benchmarks und Änderungen gegenüber Haiku 4.5.

Ashley Innocent

Ashley Innocent

8 October 2026

Was ist Claude Haiku 5.5?

Apidog für Unternehmen

On-Premises Bereitstellung

SSO & RBAC

SOC 2 konform

Apidog Enterprise entdecken

Claude Haiku 5.5 ist Anthropic's kleinstes und schnellstes aktuelles Modell, das am 7. Oktober 2026 veröffentlicht wurde und die API-ID claude-haiku-5-5 trägt. Es kostet $0,10 pro Million Eingabetokens und $0,50 pro Million Ausgabetokens für Prompts bis zu 100K Tokens, und $0,50/$2,50 für Prompts über 100K. In ihrem Launch-Post gibt Anthropic an, dass es im Durchschnitt „etwa 75 % weniger kostet“ als Haiku 4.5 und nennt es „unser schnellstes Modell bis heute“. Es ist auch das erste Haiku mit einer Aufwandseinstellung und bietet ein Kontextfenster von 1 Million Tokens.

Unten: Spezifikationen, der zweistufige Preis, Änderungen gegenüber Haiku 4.5, Benchmarks, wo es ausgeführt werden kann und wer wechseln sollte, mit Links zu tiefergehenden Anleitungen wie der Preisaufschlüsselung für Haiku 5.5. Um das Modell beim Lesen aufzurufen, kann Apidog die Messages-Anfrage senden, Ihren Schlüssel in einer Umgebungsvariable speichern und die Antwort neben der Token-Nutzung anzeigen.

button

Claude Haiku 5.5 Spezifikationen auf einen Blick

Spezifikation Claude Haiku 5.5
Veröffentlichungsdatum 7. Oktober 2026
Modell-ID (Claude API, Google Cloud, Microsoft Foundry, Claude Platform auf AWS) claude-haiku-5-5 (feste ID, kein Datumssuffix)
Modell-ID (Amazon Bedrock) anthropic.claude-haiku-5-5
Kontextfenster 1 Million Tokens (Haiku 4.5: 200K)
Maximale Ausgabe 128K (Haiku 4.5: 64K); 300K auf der Batch API mit dem Beta-Header output-300k-2026-03-24
Denken Nur adaptiv
Aufwandsstufen low, medium (Standard), high, xhigh, max
Wissensstand Juni 2026
Preis pro MTok, Prompts bis zu 100K Tokens $0,10 Eingabe, $0,50 Ausgabe
Preis pro MTok, Prompts über 100K Tokens $0,50 Eingabe, $2,50 Ausgabe
Außerbetriebnahme Nicht vor dem 7. Oktober 2027

Wo sich Haiku 5.5 in der Claude-Reihe positioniert

Modell Eingabe / Ausgabe pro MTok Standardaufwand Latenz
Claude Fable 5.1 $10 / $50 high Langsamer
Claude Opus 5.5 $4 / $20 medium Moderat
Claude Sonnet 5.5 $2 / $10 high Schnell
Claude Haiku 5.5 $0,10 / $0,50 für Prompts bis zu 100K Tokens medium Am schnellsten

Alle vier teilen sich ein Kontextfenster von 1 Million Tokens, eine maximale Ausgabe von 128K und einen Wissensstand vom Juni 2026. Anthropic entwickelte Haiku 5.5 „für aufgaben mit hohem Volumen und geringer Latenz wie Klassifizierung, Extraktion und Routing“, sowie für Zusammenfassungen, Live-Support, Browser-Nutzung und Subagenten-Arbeit unter Opus 5.5 oder Sonnet 5.5.

Die Geschwindigkeitsangabe hat eine Fußnote: am schnellsten „bei der Standardgeschwindigkeit jedes Modells“, aber langsamer als Opus im Fast Mode. Anthropic veröffentlicht keine Tokens-pro-Sekunde-Angabe.

Claude Haiku 5.5 Preise

Der Preis hängt von der Prompt-Länge ab. Ein Prompt über 100.000 Tokens wird zum höheren Satz abgerechnet.

Quelle: Claude API-Preise.

Die Angabe „rund 75 % weniger“ ist ein Durchschnitt: 90 % günstiger als Haiku 4.5 für Prompts bis zu 100K Tokens, 50 % günstiger darüber, wobei 90 % der Haiku 4.5-Anfragen unter dem Schwellenwert liegen. Dies berücksichtigt bereits den neuen Tokenizer, der etwa 30 % mehr Tokens für den gleichen Text erzeugt.

Die US-exklusive Inferenz (inference_geo) kostet 1,1x in jeder Token-Kategorie. Der minimale cachefähige Prompt sinkt von 4.096 auf 512 Tokens bei Haiku 4.5.

Unter 100K Tokens entspricht der Listenpreis exakt dem von GPT-6 Luna ($0,10 Eingabe, $0,50 Ausgabe, $0,01 Cache-Lesen, $0,125 Cache-Schreiben). Die Schwellenwerte unterscheiden sich: Lunas Aufschlag beginnt ab 272K Eingabetokens. Der Vergleich zwischen Haiku 5.5 und GPT-6 Luna behandelt diese Lücke, und der Preisleitfaden enthält durchgerechnete Kostenbeispiele.

Was sich gegenüber Haiku 4.5 geändert hat

Das Kontextfenster wächst um das Fünffache, die maximale Ausgabe verdoppelt sich, und Sie erhalten zum ersten Mal eine Aufwandskontrolle. Der Migrationsleitfaden warnt, dass für Haiku 4.5 geschriebener Code fehlschlagen kann. Fünf Änderungen führen zu einem 400-Fehler:

  1. Manuelle Denkbudgets. thinking: {"type": "enabled", "budget_tokens": N} schlägt fehl. Verwenden Sie {"type": "adaptive"} mit output_config.effort.
  2. Sampling-Parameter. Entfernen Sie temperature, top_p und top_k. Nicht-Standardwerte für temperature oder top_p schlagen fehl, ebenso wie jedes top_k oder das Senden von sowohl temperature als auch top_p.
  3. Assistenten-Vorausfüllung. Abgelehnt, selbst wenn das Denken deaktiviert ist.
  4. Altes Computer-Nutzungstool. Auf der Claude API und Google Cloud verwenden Sie computer_toolset_20260801; computer_20250124 schlägt fehl.
  5. Bearbeiteter Verlauf. Das Ändern von system, tools oder früheren Nachrichten vor einem zurückgegebenen Denkblock schlägt fehl. Halten Sie Konversationen nur anfügbar.

Andere Änderungen werden keinen Fehler auslösen, aber Ihre Ergebnisse verändern:

Das Denken kann in der API bei high Aufwand oder darunter deaktiviert werden; bei xhigh und max führt dies zu einem 400-Fehler. Haiku 4.5 ist nicht veraltet: Es wird weiterhin als aktiv gelistet. Der Haiku 5.5 vs Haiku 4.5 Leitfaden enthält Vorher-/Nachher-JSON für jede Korrektur.

Claude Haiku 5.5 Benchmarks

Haiku 5.5-Ergebnisse werden bei maximalem Aufwand erzielt, meist gemittelt über fünf Durchläufe. Artificial Analysis führte GDPval-AA und AA-Briefcase durch, Cognition führte FrontierCode durch, und Anthropic bewertete Chartography (einen Surge AI-Benchmark) mit seiner eigenen Implementierung.

Lesen Sie drei Zellen mit Vorsicht. FrontierCode setzt Haiku auf Max gegen Sonnet 5.5 auf xhigh; auf Max erzielte Sonnet 46,2 %, unter Haikus 46,4 %. Anthropic führte Lunas OSWorld-Score über OpenAIs API aus, während Lunas Terminal-Bench-Score vom öffentlichen Leaderboard (Codex CLI) stammt. Und beim Standardaufwand medium erzielte Haiku 5.5 1277 auf GDPval-AA und 1372 auf AA-Briefcase.

Anthropic sagt, dass Sonnet 5.5 und Opus 5.5 „bessere Optionen für komplexe agentische Codierungsaufgaben bleiben“. Keines der unabhängigen Leaderboards hatte am 8. Oktober 2026 ein Haiku 5.5-Ergebnis; Cursor meldet 48,4 % auf seinem eigenen CursorBench bei Max. Die detaillierte Benchmark-Analyse enthält die Ergebnisse und Kosten pro Aufwandsstufe.

Wo Sie Claude Haiku 5.5 verwenden können

Plattform Zugriff Hinweise
Claude API claude-haiku-5-5 Bezahlung pro Token
Amazon Bedrock anthropic.claude-haiku-5-5 Abrechnung über AWS Marketplace
Google Cloud, Microsoft Foundry, Claude Platform auf AWS claude-haiku-5-5 Gleiche ID wie die Claude API
Claude.ai (Web, iOS, Android) Modellauswahl Kostenlose, Pro-, Max-, Team- und Enterprise-Benutzer können es auswählen
Claude Code /model claude-haiku-5-5 v2.1.293 oder neuer; kostenpflichtige Pläne
Vercel AI Gateway anthropic/claude-haiku-5.5 Ab $0,10 / $0,50
Cursor claude-haiku-5-5 Pool „Andere Modelle“

Am 8. Oktober 2026 war es nicht auf OpenRouter oder für GitHub Copilot angekündigt.

Der Chat-Zugriff im Free-Plan ist kein API-Schlüssel, und die API wird jenseits des kleinen kostenlosen Guthabens, das Anthropic neuen Benutzern zum Testen gewährt, pro Nutzung abgerechnet. Max- und Team-Pläne beinhalten jetzt monatliche API-Guthaben ($100 bei Max 5x, $200 bei Max 20x, bis zu $500 gesammelt im Team), die Claude Code nicht abdecken. Der Leitfaden zum kostenlosen Zugang listet auf, was kostenlos ist und was nicht.

In Claude Code bedeutet der Alias haiku Haiku 5.5 nur auf der Anthropic API; andernorts bedeutet er immer noch Haiku 4.5. Siehe Haiku 5.5 in Claude Code für Subagenten-Setups.

Wer zu Haiku 5.5 wechseln sollte

In Anthropic's Launch-Post berichtet Asana von über 30 % geringerer Latenz bei Aufgabenabschlüssen, und Box verzeichnete eine um 11 Punkte höhere Bewertung als Haiku 4.5 bei etwa halber Latenz. Dies sind Kundenangaben, keine unabhängigen Tests.

Die Systemkarte weist darauf hin, dass es in Anthropic's automatisiertem Audit mehr Ablehnungen gab als bei jedem anderen Modell, daher sollten Sie die Ablehnungsraten mit Ihren eigenen Prompts testen.

Senden Sie Ihre erste Haiku 5.5 Anfrage

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 4000,
    "thinking": {"type": "adaptive", "display": "summarized"},
    "output_config": {"effort": "low"},
    "messages": [
      {"role": "user", "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error."}
    ]
  }'

Lassen Sie Sampling-Parameter und Vorausfüllung weg. Lesen Sie Inhaltsblöcke nach type, da die Antwort mit einem Denkblock beginnen kann.

In Apidog importieren Sie den Curl-Befehl als neue Anfrage und speichern den Schlüssel in einer Umgebungsvariablen ANTHROPIC_API_KEY. Fügen Sie Bestätigungen hinzu, dass stop_reason weder refusal noch max_tokens ist. Duplizieren Sie dann die Anfrage bei medium und vergleichen Sie die usage, um zu sehen, was jede Aufwandsstufe kostet. Der Haiku 5.5 API-Leitfaden behandelt Caching, Batch und Streaming, und der Anthropic API-Schlüssel-Leitfaden hilft, wenn Sie einen Schlüssel benötigen.

FAQ

Wann wurde Claude Haiku 5.5 veröffentlicht? Am 7. Oktober 2026, neun Tage nach Sonnet 5.5.

Ist Claude Haiku 5.5 kostenlos? In der Claude.ai Chat-App können kostenlose Nutzer es auswählen. Die API ist kostenpflichtig, abgesehen von kleinen Testguthaben für neue Nutzer. Siehe alle kostenlosen Wege.

Was ist das Claude Haiku 5.5 Kontextfenster? 1 Million Tokens, mit einer maximalen Ausgabe von 128K auf der Messages API.

Wird Haiku 4.5 eingestellt? Noch nicht. Es wird weiterhin als aktiv gelistet, eine Einstellung ist nicht vor dem 15. Oktober 2026 geplant.

Nächster Schritt

Wählen Sie eine Aufgabe mit hohem Volumen, die Sie heute ausführen, wie z.B. Ticket-Triage oder Dokumentenzusammenfassungen. Senden Sie sie an claude-haiku-5-5 bei low und medium, überprüfen Sie die Ausgabe und vergleichen Sie die usage mit Ihrem aktuellen Modell. Laden Sie Apidog herunter, um diese Anfragen und Bestätigungen in einem Projekt zu speichern, und verwenden Sie dann den Preisleitfaden, um die Token-Anzahl in eine Monatsrechnung umzuwandeln.

Praktizieren Sie API Design-First in Apidog

Entdecken Sie eine einfachere Möglichkeit, APIs zu erstellen und zu nutzen