Claude Haiku 5.5 kostet $0,10 pro Million Eingabetoken und $0,50 pro Million Ausgabetoken für Prompts bis zu 100K Token. Ein Prompt von über 100.000 Token zahlt höhere Preise: $0,50 Eingabe und $2,50 Ausgabe. Cache-Lesevorgänge beginnen bei $0,01, die Batch-API halbiert jeden Preis, und Anthropic sagt, das Modell sei im Durchschnitt „etwa 75 % günstiger im Betrieb“ als Haiku 4.5.
Dieser Leitfaden behandelt jeden Posten, die Mathematik hinter diesen 75 %, drei durchgerechnete Beispiele (eins über 100K), Kosten pro Aufwandsstufe und wie sich Haiku 5.5 mit Haiku 4.5, GPT-6 Luna und Sonnet 5.5 vergleicht. Neu im Modell? Beginnen Sie mit was Claude Haiku 5.5 ist. Um die Zahlen für Ihren eigenen Traffic zu überprüfen, senden Sie Anfragen von Apidog und lesen Sie den usage-Block jeder Antwort.
Claude Haiku 5.5 API-Preistabelle
Preise pro Million Token (MTok), aus Anthropecs Preisdokumentation:
| Posten | Prompts bis 100K Token | Prompts über 100K Token |
|---|---|---|
| Eingabe | $0.10 | $0.50 |
| Ausgabe | $0.50 | $2.50 |
| 5-Minuten Cache-Schreibvorgang | $0.125 | $0.625 |
| 1-Stunden Cache-Schreibvorgang | $0.20 | $1.00 |
| Cache-Lesevorgang (Treffer und Aktualisierungen) | $0.01 | $0.05 |
| Batch-Eingabe | $0.05 | $0.25 |
| Batch-Ausgabe | $0.25 | $1.25 |
Die Dokumentation formuliert es klar: „ein Prompt von über 100.000 Token zahlt höhere Preise.“ Andere Claude-Modelle ab 4.6 berechnen das gesamte 1M-Fenster zu einem einzigen Satz; Haiku 5.5 ist die Ausnahme. Beachten Sie auch:
- Inferenz nur in den USA. Das Routing nur über die USA via
inference_geokostet das 1,1-fache für jede Token-Kategorie auf der Claude API und der Claude-Plattform auf AWS: $0,11 Eingabe und $0,55 Ausgabe unter 100K. - Ein neuer Tokenizer. Derselbe Text erzeugt etwa 30 % mehr Token als bei Haiku 4.5.
- Geringerer Tool-Overhead. Der Tool-Use-System-Prompt beträgt 286 Token (auto/none), gegenüber 496 bei Haiku 4.5.
- Keine Prioritätsstufe und kein schneller Modus.
Woher die „etwa 75 % weniger“ kommen
Haiku 5.5 ist bis zu 100.000 Token 90 % günstiger als Haiku 4.5 und darüber 50 % günstiger; 90 % der Haiku 4.5-Anfragen lagen unter 100K; und die Zahl berücksichtigt den neuen Tokenizer. Eine grobe Rekonstruktion:
- Gewichtung nach Anfrageanzahl: 0,9 × 90 % + 0,1 × 50 % = 86 % weniger.
- Fügen Sie etwa 30 % mehr Token hinzu: die verbleibenden 14 % der Kosten werden zu 14 % × 1,3 = 18,2 %, sodass die Einsparung auf etwa 82 % sinkt.

Anthropic's Zahl ist noch niedriger. Es veröffentlicht die Gewichtung nicht, und lange Prompts verursachen wahrscheinlich mehr Ausgaben als Anfragen. Betrachten Sie 75 % als Durchschnitt; Ihre usage-Daten sind die wahre Antwort.
Kosten pro Versuch bei jeder Anstrengungsstufe
Haiku 5.5 ist das erste Haiku mit Anstrengungsstufen (low bis max; medium ist die API-Standardeinstellung), und der Aufwand beeinflusst Ihre Rechnung mehr als die Preisliste. Diese Zahlen stammen aus den Pro-Aufwand-Diagrammen des Launch-Posts. Anthropic führte OSWorld und Terminal-Bench durch; Artificial Analysis führte GDPval-AA durch:
| Aufwand | OSWorld 2.1 (Score, $/Versuch) | GDPval-AA v2.1 (Elo, $/Aufgabe) | Terminal-Bench 4.0 (Score, $/Versuch) |
|---|---|---|---|
| niedrig | 42.0%, $0.0695 | 1125, $0.0117 | 12.7%, $0.424 |
| mittel | 53.3%, $0.1257 | 1277, $0.0304 | 20.3%, $0.6798 |
| hoch | 61.3%, $0.1827 | 1420, $0.0894 | 24.8%, $1.0372 |
| xhoch | 67.6%, $0.2792 | 1513, $0.2673 | 31.5%, $1.7545 |
| max | 72.4%, $0.6111 | 1620, $0.8659 | 39.2%, $2.6433 |
Was auffällt:
- Max kostet auf OSWorld 4,9x so viel wie Medium ($0,6111 ÷ $0,1257) und auf GDPval-AA 28,5x so viel wie Medium ($0,86593 ÷ $0,03042).
- Die Scores der Starttabelle sind mit maximalem Aufwand erzielt. Bei der Standardeinstellung
mediumliegt GDPval-AA bei 1277, nicht bei 1620. - Für agentisches Coding prüfen Sie Sonnet. Auf Terminal-Bench erreichte Sonnet 5.5 bei
low(mit $0,10 Cache-Lesevorgängen) 20 % für $0,6205, gegenüber Haiku 5.5 beimediummit 20,3 % für $0,6798. Anthropic sagt, Sonnet und Opus „bleiben bessere Optionen für komplexe agentische Coding-Aufgaben.“ Unsere Benchmarks-Übersicht enthält jede Zeile.
Wie Haiku 5.5 preislich im Vergleich abschneidet
| Modell | Eingabe / Ausgabe pro MTok | Cache-Lesevorgang | 5-Minuten Cache-Schreibvorgang | Regel für lange Prompts |
|---|---|---|---|---|
| Claude Haiku 5.5 | $0.10 / $0.50 bis 100K | $0.01 | $0.125 | Über 100K: $0.50 / $2.50 |
| GPT-6 Luna | $0.10 / $0.50 | $0.01 | $0.125 | Über 272K Eingabe: 2x Eingabe und Cache, 1.5x Ausgabe ($0.20 / $0.75) |
| Claude Haiku 4.5 | $1 / $5 | $0.10 | $1.25 | Ein Preis (200K Kontext) |
| Claude Sonnet 5.5 | $2 / $10 | $0.10 | $2.50 | Ein Preis über 1M |
GPT-6 Luna entspricht Haiku 5.5 bis 100K; die Schwelle unterscheidet sich. Laut OpenAIs Modellseite beginnt der Luna-Zuschlag über 272K und gilt „für die gesamte Anfrage“. Der Aufruf von Beispiel 3 bleibt beim Basispreis von Luna: (150.000 × $0,10 + 2.000 × $0,50) ÷ 1.000.000 = $0,016, gegenüber $0,08 bei Haiku 5.5. Auch die Tokenizer unterscheiden sich: Ein Hacker News-Kommentator schätzte 100K Claude-Token auf etwa 60-65K GPT-Token. Auf Anthropic's OSWorld-Diagramm schlug Haiku 5.5 bei medium (53,3 %, $0,1257) Luna bei max (48,9 %, $0,205). Mehr unter Claude Haiku 5.5 vs GPT-6 Luna.
Sonnet 5.5 senkte am selben Tag die Kosten für Cache-Lesevorgänge von $0,20 auf $0,10, was laut Anthropic bei den meisten agentischen Arbeiten etwa 20 % günstiger ist. Unser Sonnet 5.5 Preisleitfaden stammt von vor der Senkung.
Haiku 4.5 ist nicht veraltet; Haiku 5.5 vs Haiku 4.5 listet die Breaking Changes auf, die zuerst behoben werden müssen.
API-Guthaben und Verbraucherpläne
Max und Team API-Guthaben. Max 5x erhält $100 pro Monat an Claude-Plattform-Guthaben, Max 20x $200 und Team $20 pro Standard-Platz und $100 pro Premium-Platz, zusammengelegt und auf $500 begrenzt. Kostenlos, Pro und Enterprise sind nicht berechtigt. Gemäß der API-Guthaben-Dokumentation decken sie die Claude API ab, nicht Claude Code oder die Clouds, und verfallen am Monatsende. Bei $0,10 pro MTok kaufen $100 1 Milliarde Eingabe-Token oder etwa 220.000 Anfragen von Beispiel 1 ($100 ÷ $0,000455).
Verbrauchertarife (claude.com/pricing): Kostenlose, Pro-, Max-, Team- und Enterprise-Benutzer können Haiku 5.5 auf Claude.ai im Web, unter iOS und Android auswählen. Pro kostet $17/Monat bei jährlicher Abrechnung oder $20 monatlich; Max beginnt bei $100/Monat. Kostenlos bietet keinen Claude Code, und ein Chat-Plan kann kein Skript oder keinen CI-Job antreiben. Wie man Claude Haiku 5.5 kostenlos nutzt behandelt den Rest.
Clouds. Bedrock, Google Cloud und Foundry berechnen Haiku 5.5 über ihre eigenen Preislisten.
Kosten pro Anfrage in Apidog verfolgen
Jede Nachrichtenantwort gibt ein usage-Objekt zurück, das ausreicht, um einen Aufruf in Apidog zu bepreisen:
- Speichern Sie Ihren Schlüssel als Umgebungsvariable
ANTHROPIC_API_KEY. - Speichern Sie diese Anfrage einmal pro Anstrengungsstufe (
low,medium,high) mit demselben Prompt:
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 4000,
"thinking": {"type": "adaptive"},
"output_config": {"effort": "medium"},
"messages": [{"role": "user", "content": "Classify this support ticket: ..."}]
}'
- Fügen Sie einen Post-Prozessor hinzu, der die Stufe wählt und den Aufruf bepreist. Er behandelt
input_tokensals Prompt-Länge, was ohne Caching gilt:
const body = pm.response.json();
const u = body.usage;
const long = u.input_tokens > 100000;
const rateIn = long ? 0.50 : 0.10;
const rateOut = long ? 2.50 : 0.50;
const cost = (u.input_tokens * rateIn + u.output_tokens * rateOut) / 1e6;
pm.environment.set("haiku_call_usd", cost.toFixed(6));
pm.test("not a refusal", () => pm.expect(body.stop_reason).to.not.eql("refusal"));
- Führen Sie alle drei aus und vergleichen Sie die Ausgabe-Token und Kosten nebeneinander.
Die Verweigerungsprüfung ist wichtig, da die Sicherheitsklassifikatoren von Haiku 5.5 keinen serverseitigen Fallback haben. Die vollständige Anleitung finden Sie unter wie man die Claude Haiku 5.5 API verwendet.
FAQ
Wie viel kostet Claude Haiku 5.5 pro Million Token? $0,10 Eingabe und $0,50 Ausgabe für Prompts bis 100K Token; $0,50 und $2,50 darüber.
Ist Haiku 5.5 günstiger als Haiku 4.5? Ja: 90 % günstiger pro Token bis 100K, 50 % darüber, und durchschnittlich etwa 75 % laut Anthropic.
Ist Haiku 5.5 preislich identisch mit GPT-6 Luna? Bis 100K ja. Darüber steigt Haiku 5.5 um das 5-fache; Luna bleibt bis 272K konstant. Unsere GPT-6 Luna Übersicht enthält die Details.
Funktionieren Max-Plan-Guthaben in Claude Code? Nein. Sie decken die Claude-Plattform-API ab, nicht Claude Code. Siehe Claude Haiku 5.5 in Claude Code für den Planzugriff dort.
Nächster Schritt: Bepreisen Sie Ihre eigene Arbeitslast
Ziehen Sie Ihre drei häufigsten Anfragetypen, prüfen Sie, wie viele davon 100K überschreiten, und führen Sie jede bei low und medium aus. Multiplizieren Sie die usage-Zahlen mit der obigen Tabelle, um Ihre tatsächliche Ersparnis zu ermitteln. Laden Sie Apidog herunter, um diese Anfragen und das Kostenskript in einem Projekt zu speichern.
