Claude Haiku 5.5 Preise

Preisgestaltung für Claude Haiku 5.5: $0,10/$0,50 pro Million Token für Prompts bis zu 100K, $0,50/$2,50 darüber hinaus. Beispiele für Caching, Batch-Verarbeitung und berechnete Kosten.

INEZA Felin-Michel

INEZA Felin-Michel

8 October 2026

Claude Haiku 5.5 Preise

Apidog für Unternehmen

On-Premises Bereitstellung

SSO & RBAC

SOC 2 konform

Apidog Enterprise entdecken

Claude Haiku 5.5 kostet $0,10 pro Million Eingabetoken und $0,50 pro Million Ausgabetoken für Prompts bis zu 100K Token. Ein Prompt von über 100.000 Token zahlt höhere Preise: $0,50 Eingabe und $2,50 Ausgabe. Cache-Lesevorgänge beginnen bei $0,01, die Batch-API halbiert jeden Preis, und Anthropic sagt, das Modell sei im Durchschnitt „etwa 75 % günstiger im Betrieb“ als Haiku 4.5.

Dieser Leitfaden behandelt jeden Posten, die Mathematik hinter diesen 75 %, drei durchgerechnete Beispiele (eins über 100K), Kosten pro Aufwandsstufe und wie sich Haiku 5.5 mit Haiku 4.5, GPT-6 Luna und Sonnet 5.5 vergleicht. Neu im Modell? Beginnen Sie mit was Claude Haiku 5.5 ist. Um die Zahlen für Ihren eigenen Traffic zu überprüfen, senden Sie Anfragen von Apidog und lesen Sie den usage-Block jeder Antwort.

Claude Haiku 5.5 API-Preistabelle

Preise pro Million Token (MTok), aus Anthropecs Preisdokumentation:

Posten Prompts bis 100K Token Prompts über 100K Token
Eingabe $0.10 $0.50
Ausgabe $0.50 $2.50
5-Minuten Cache-Schreibvorgang $0.125 $0.625
1-Stunden Cache-Schreibvorgang $0.20 $1.00
Cache-Lesevorgang (Treffer und Aktualisierungen) $0.01 $0.05
Batch-Eingabe $0.05 $0.25
Batch-Ausgabe $0.25 $1.25

Die Dokumentation formuliert es klar: „ein Prompt von über 100.000 Token zahlt höhere Preise.“ Andere Claude-Modelle ab 4.6 berechnen das gesamte 1M-Fenster zu einem einzigen Satz; Haiku 5.5 ist die Ausnahme. Beachten Sie auch:

Woher die „etwa 75 % weniger“ kommen

Haiku 5.5 ist bis zu 100.000 Token 90 % günstiger als Haiku 4.5 und darüber 50 % günstiger; 90 % der Haiku 4.5-Anfragen lagen unter 100K; und die Zahl berücksichtigt den neuen Tokenizer. Eine grobe Rekonstruktion:

  1. Gewichtung nach Anfrageanzahl: 0,9 × 90 % + 0,1 × 50 % = 86 % weniger.
  2. Fügen Sie etwa 30 % mehr Token hinzu: die verbleibenden 14 % der Kosten werden zu 14 % × 1,3 = 18,2 %, sodass die Einsparung auf etwa 82 % sinkt.

Anthropic's Zahl ist noch niedriger. Es veröffentlicht die Gewichtung nicht, und lange Prompts verursachen wahrscheinlich mehr Ausgaben als Anfragen. Betrachten Sie 75 % als Durchschnitt; Ihre usage-Daten sind die wahre Antwort.

Kosten pro Versuch bei jeder Anstrengungsstufe

Haiku 5.5 ist das erste Haiku mit Anstrengungsstufen (low bis max; medium ist die API-Standardeinstellung), und der Aufwand beeinflusst Ihre Rechnung mehr als die Preisliste. Diese Zahlen stammen aus den Pro-Aufwand-Diagrammen des Launch-Posts. Anthropic führte OSWorld und Terminal-Bench durch; Artificial Analysis führte GDPval-AA durch:

Aufwand OSWorld 2.1 (Score, $/Versuch) GDPval-AA v2.1 (Elo, $/Aufgabe) Terminal-Bench 4.0 (Score, $/Versuch)
niedrig 42.0%, $0.0695 1125, $0.0117 12.7%, $0.424
mittel 53.3%, $0.1257 1277, $0.0304 20.3%, $0.6798
hoch 61.3%, $0.1827 1420, $0.0894 24.8%, $1.0372
xhoch 67.6%, $0.2792 1513, $0.2673 31.5%, $1.7545
max 72.4%, $0.6111 1620, $0.8659 39.2%, $2.6433

Was auffällt:

Wie Haiku 5.5 preislich im Vergleich abschneidet

Modell Eingabe / Ausgabe pro MTok Cache-Lesevorgang 5-Minuten Cache-Schreibvorgang Regel für lange Prompts
Claude Haiku 5.5 $0.10 / $0.50 bis 100K $0.01 $0.125 Über 100K: $0.50 / $2.50
GPT-6 Luna $0.10 / $0.50 $0.01 $0.125 Über 272K Eingabe: 2x Eingabe und Cache, 1.5x Ausgabe ($0.20 / $0.75)
Claude Haiku 4.5 $1 / $5 $0.10 $1.25 Ein Preis (200K Kontext)
Claude Sonnet 5.5 $2 / $10 $0.10 $2.50 Ein Preis über 1M

GPT-6 Luna entspricht Haiku 5.5 bis 100K; die Schwelle unterscheidet sich. Laut OpenAIs Modellseite beginnt der Luna-Zuschlag über 272K und gilt „für die gesamte Anfrage“. Der Aufruf von Beispiel 3 bleibt beim Basispreis von Luna: (150.000 × $0,10 + 2.000 × $0,50) ÷ 1.000.000 = $0,016, gegenüber $0,08 bei Haiku 5.5. Auch die Tokenizer unterscheiden sich: Ein Hacker News-Kommentator schätzte 100K Claude-Token auf etwa 60-65K GPT-Token. Auf Anthropic's OSWorld-Diagramm schlug Haiku 5.5 bei medium (53,3 %, $0,1257) Luna bei max (48,9 %, $0,205). Mehr unter Claude Haiku 5.5 vs GPT-6 Luna.

Sonnet 5.5 senkte am selben Tag die Kosten für Cache-Lesevorgänge von $0,20 auf $0,10, was laut Anthropic bei den meisten agentischen Arbeiten etwa 20 % günstiger ist. Unser Sonnet 5.5 Preisleitfaden stammt von vor der Senkung.

Haiku 4.5 ist nicht veraltet; Haiku 5.5 vs Haiku 4.5 listet die Breaking Changes auf, die zuerst behoben werden müssen.

API-Guthaben und Verbraucherpläne

Max und Team API-Guthaben. Max 5x erhält $100 pro Monat an Claude-Plattform-Guthaben, Max 20x $200 und Team $20 pro Standard-Platz und $100 pro Premium-Platz, zusammengelegt und auf $500 begrenzt. Kostenlos, Pro und Enterprise sind nicht berechtigt. Gemäß der API-Guthaben-Dokumentation decken sie die Claude API ab, nicht Claude Code oder die Clouds, und verfallen am Monatsende. Bei $0,10 pro MTok kaufen $100 1 Milliarde Eingabe-Token oder etwa 220.000 Anfragen von Beispiel 1 ($100 ÷ $0,000455).

Verbrauchertarife (claude.com/pricing): Kostenlose, Pro-, Max-, Team- und Enterprise-Benutzer können Haiku 5.5 auf Claude.ai im Web, unter iOS und Android auswählen. Pro kostet $17/Monat bei jährlicher Abrechnung oder $20 monatlich; Max beginnt bei $100/Monat. Kostenlos bietet keinen Claude Code, und ein Chat-Plan kann kein Skript oder keinen CI-Job antreiben. Wie man Claude Haiku 5.5 kostenlos nutzt behandelt den Rest.

Clouds. Bedrock, Google Cloud und Foundry berechnen Haiku 5.5 über ihre eigenen Preislisten.

Kosten pro Anfrage in Apidog verfolgen

Jede Nachrichtenantwort gibt ein usage-Objekt zurück, das ausreicht, um einen Aufruf in Apidog zu bepreisen:

  1. Speichern Sie Ihren Schlüssel als Umgebungsvariable ANTHROPIC_API_KEY.
  2. Speichern Sie diese Anfrage einmal pro Anstrengungsstufe (low, medium, high) mit demselben Prompt:
curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 4000,
    "thinking": {"type": "adaptive"},
    "output_config": {"effort": "medium"},
    "messages": [{"role": "user", "content": "Classify this support ticket: ..."}]
  }'
  1. Fügen Sie einen Post-Prozessor hinzu, der die Stufe wählt und den Aufruf bepreist. Er behandelt input_tokens als Prompt-Länge, was ohne Caching gilt:
const body = pm.response.json();
const u = body.usage;
const long = u.input_tokens > 100000;
const rateIn = long ? 0.50 : 0.10;
const rateOut = long ? 2.50 : 0.50;
const cost = (u.input_tokens * rateIn + u.output_tokens * rateOut) / 1e6;
pm.environment.set("haiku_call_usd", cost.toFixed(6));
pm.test("not a refusal", () => pm.expect(body.stop_reason).to.not.eql("refusal"));
  1. Führen Sie alle drei aus und vergleichen Sie die Ausgabe-Token und Kosten nebeneinander.

Die Verweigerungsprüfung ist wichtig, da die Sicherheitsklassifikatoren von Haiku 5.5 keinen serverseitigen Fallback haben. Die vollständige Anleitung finden Sie unter wie man die Claude Haiku 5.5 API verwendet.

FAQ

Wie viel kostet Claude Haiku 5.5 pro Million Token? $0,10 Eingabe und $0,50 Ausgabe für Prompts bis 100K Token; $0,50 und $2,50 darüber.

Ist Haiku 5.5 günstiger als Haiku 4.5? Ja: 90 % günstiger pro Token bis 100K, 50 % darüber, und durchschnittlich etwa 75 % laut Anthropic.

Ist Haiku 5.5 preislich identisch mit GPT-6 Luna? Bis 100K ja. Darüber steigt Haiku 5.5 um das 5-fache; Luna bleibt bis 272K konstant. Unsere GPT-6 Luna Übersicht enthält die Details.

Funktionieren Max-Plan-Guthaben in Claude Code? Nein. Sie decken die Claude-Plattform-API ab, nicht Claude Code. Siehe Claude Haiku 5.5 in Claude Code für den Planzugriff dort.

Nächster Schritt: Bepreisen Sie Ihre eigene Arbeitslast

Ziehen Sie Ihre drei häufigsten Anfragetypen, prüfen Sie, wie viele davon 100K überschreiten, und führen Sie jede bei low und medium aus. Multiplizieren Sie die usage-Zahlen mit der obigen Tabelle, um Ihre tatsächliche Ersparnis zu ermitteln. Laden Sie Apidog herunter, um diese Anfragen und das Kostenskript in einem Projekt zu speichern.

Praktizieren Sie API Design-First in Apidog

Entdecken Sie eine einfachere Möglichkeit, APIs zu erstellen und zu nutzen