Untuk menggunakan API Claude Haiku 5.5, kirimkan permintaan POST ke https://api.anthropic.com/v1/messages dengan "model": "claude-haiku-5-5", kunci Anda di header x-api-key, dan anthropic-version: 2023-06-01. Biayanya $0,10/$0,50 per juta token input/output untuk prompt hingga 100K token ($0,50/$2,50 di atas itu), membaca hingga 1M token konteks, menulis hingga 128K, dan default ke upaya medium dengan pemikiran adaptif aktif.
Anthropic merilis Haiku 5.5 pada 7 Oktober 2026, dan ini adalah Haiku pertama dengan tingkat upaya (apa itu Claude Haiku 5.5 mencakup spesifikasi dan penempatannya). Panduan ini mencakup panggilan pertama di curl, Python, dan TypeScript, kemudian upaya, pemikiran, caching, batch, penolakan, dan toolset agen. Anda dapat menyimpan dan menegaskan setiap permintaan di bawah ini di Apidog.
tombol
Sekilas tentang API Claude Haiku 5.5
| Parameter | Perilaku Haiku 5.5 |
|---|---|
| ID Model | claude-haiku-5-5 (Bedrock: anthropic.claude-haiku-5-5); tanpa alias terpisah |
| Harga per MTok, prompt hingga 100K token | $0,10 input, $0,50 output, $0,01 baca cache |
| Harga per MTok, prompt di atas 100K token | $0,50 input, $2,50 output, $0,05 baca cache |
| Konteks / keluaran maks. | 1M / 128K; 300K pada Batch dengan header beta output-300k-2026-03-24 |
output_config.effort | low, medium (default), high, xhigh, max |
thinking | adaptive secara default; disabled hanya pada upaya high atau di bawahnya |
thinking.display | Bidang thinking kosong secara default; summarized mengembalikan teks yang mudah dibaca |
temperature, top_p, top_k | Nilai non-default mengembalikan 400 |
| Assistant prefill | Mengembalikan 400, bahkan dengan pemikiran dinonaktifkan |
| Prompt minimal yang dapat di-cache | 512 token (4.096 pada Haiku 4.5) |
Sumber: halaman model Haiku 5.5 dan dokumen harga API Claude.
Panggilan API Claude Haiku 5.5 pertama Anda
Buat kunci di Claude Console (panduan kunci API Anthropic menjelaskan caranya) dan ekspor sebagai ANTHROPIC_API_KEY. Jangan pernah menempelkan kunci ke dalam kode. Kemudian kirim ini:
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 4096,
"output_config": {"effort": "medium"},
"thinking": {"type": "adaptive", "display": "summarized"},
"messages": [{"role": "user", "content": "Classify this ticket as billing, bug, or feature request: The export button times out on large projects."}]
}'
SDK Python mengambil ANTHROPIC_API_KEY dari lingkungan:
import anthropic
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-haiku-5-5",
max_tokens=4096,
output_config={"effort": "medium"},
thinking={"type": "adaptive", "display": "summarized"},
messages=[{"role": "user", "content": "Classify this ticket as billing, bug, or feature request: The export button times out on large projects."}],
)
for block in response.content:
if block.type == "thinking":
print("[thinking]", block.thinking)
elif block.type == "text":
print(block.text)
print(response.stop_reason, response.usage)
TypeScript mengikuti bentuk yang sama:
import Anthropic from "@anthropic-ai/sdk";
const client = new Anthropic();
const response = await client.messages.create({
model: "claude-haiku-5-5",
max_tokens: 4096,
output_config: { effort: "medium" },
thinking: { type: "adaptive", display: "summarized" },
messages: [
{ role: "user", content: "Classify this ticket as billing, bug, or feature request: The export button times out on large projects." },
],
});
for (const block of response.content) {
if (block.type === "text") console.log(block.text);
}
console.log(response.stop_reason, response.usage);
Tiga kebiasaan membuat kode ini berfungsi. Pilih blok konten berdasarkan type, karena respons dapat dimulai dengan blok thinking dan content[0].text akan rusak. Sisakan ruang di max_tokens, karena token pemikiran dihitung ke dalamnya. Dan jaga agar body permintaan tetap bersih: tanpa temperature, top_p, top_k, budget_tokens, atau assistant prefill. Masing-masing akan mengembalikan 400 pada model ini. Jika Anda memindahkan kode lama, panduan Haiku 5.5 vs Haiku 4.5 mencantumkan setiap perubahan yang merusak dengan JSON sebelum/sesudah.
Pilih tingkat upaya
Upaya, yang diatur dalam output_config.effort, adalah pengatur utama untuk kualitas, latensi, dan biaya. Panduan prompt memberikan titik awal ini:
low: level termurah dan tercepat, untuk obrolan, tugas alat pendek, dan permintaan sederhana bervolume tinggi.medium: default. Mulai di sini untuk sebagian besar pekerjaan, termasuk pengkodean agentik.high: pekerjaan pengetahuan, tugas agen yang lebih panjang, dan kepatuhan instruksi yang ketat.xhighdanmax: hanya di mana evaluasi Anda menunjukkan keuntungan. Anthropic menyarankan untuk menjalankan evaluasi yang sama pada Claude Sonnet 5.5 dan membandingkannya.
Kurva biaya curam. Berikut adalah hasil uji OSWorld 2.1 (subset offline) milik Anthropic dari grafik peluncuran, dengan skor kredit parsial dan biaya per upaya:
| Upaya | Skor | Biaya per upaya |
|---|---|---|
low | 42.0% | $0.0695 |
medium | 53.3% | $0.1257 |
high | 61.3% | $0.1827 |
xhigh | 67.6% | $0.2792 |
max | 72.4% | $0.6111 |
Pergi dari xhigh ke max lebih dari dua kali lipat biayanya untuk kurang dari lima poin. Rincian benchmark Haiku 5.5 memiliki grafik per upaya lainnya.
Satu keanehan: pada xhigh dalam obrolan multi-giliran, model terkadang menulis seluruh jawabannya dalam pemikirannya dan mengakhiri giliran tanpa teks yang terlihat. Periksa balasan kosong sebelum menunjukkannya kepada pengguna.
Kontrol pemikiran
Pemikiran adaptif aktif secara default, dan dua hal berubah dari Haiku 4.5. Pertama, tampilan default menyembunyikan teks. Setiap blok thinking kembali dengan bidang thinking kosong dan hanya signature. Atur "display": "summarized" (seperti pada panggilan pertama) saat Anda menginginkan ringkasan yang mudah dibaca di log atau UI. Untuk mendapatkan lebih sedikit pemikiran, turunkan upaya; meminta model untuk menjawab secara langsung tidak menghentikannya dalam pengujian Anthropic.
Kedua, Anda dapat mematikan pemikiran, tetapi hanya pada upaya high atau di bawahnya:
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"thinking": {"type": "disabled"},
"output_config": {"effort": "low"},
"messages": [{"role": "user", "content": "Extract the invoice number from: INV-2291, due Nov 3."}]
}
Body yang sama pada xhigh atau max mengembalikan 400. tool_choice yang dipaksakan (any atau alat bernama) diterima, tetapi respons dimulai dengan panggilan alat dan tidak membawa blok pemikiran.
Untuk loop multi-giliran dan agen, kirim kembali setiap blok pemikiran tanpa perubahan dan pertahankan riwayat hanya tambah. Mengubah system, tools, atau messages sebelumnya sebelum blok pemikiran yang dikembalikan dapat mengembalikan 400, dan blok pemikiran hanya berfungsi di akun yang membuatnya (atau yang terhubung dengannya).
Cache prompt dan pekerjaan batch
Caching adalah tempat Haiku 5.5 menjadi murah. Untuk prompt hingga 100K token, pembacaan cache berharga $0,01 per juta token dibandingkan $0,10 untuk input baru, penulisan cache 5 menit berharga $0,125 dan penulisan 1 jam $0,20. Prompt minimal yang dapat di-cache adalah 512 token, turun dari 4.096 pada Haiku 4.5, sehingga prompt sistem pendek dan daftar alat sekarang memenuhi syarat. Tandai awalan stabil dengan cache_control:
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"system": [{
"type": "text",
"text": "You are a support triage assistant. <long, stable policy text here>",
"cache_control": {"type": "ephemeral"}
}],
"messages": [{"role": "user", "content": "Ticket: refund not received after 10 days."}]
}
Mengubah effort tingkat atas antar permintaan membatalkan cache; upaya per pesan (header beta mid-conversation-output-config-2026-07-01, Claude API dan Google Cloud) mempertahankannya. Dokumen caching prompt mencakup TTL, dan penjelasan caching prompt kami mencakup konsepnya.
Untuk pekerjaan yang dapat menunggu, API Message Batches memotong input dan output sebesar 50%: $0,05/$0,25 untuk prompt hingga 100K token dan $0,25/$1,25 di atas itu. Batch juga merupakan satu-satunya rute ke 300K token output, dengan header beta output-300k-2026-03-24.
Perhatikan batas 100K: "prompt di atas 100.000 token membayar harga yang lebih tinggi," dalam kata-kata Anthropic. Panduan harga Haiku 5.5 membahas contoh di kedua sisi.
Tangani stop_reason “refusal”
Haiku 5.5 menjalankan pengklasifikasi keamanan yang dapat menolak permintaan, dan tidak memiliki fallback sisi server. Permintaan yang ditolak akan kembali dengan stop_reason: "refusal", dan kategorinya adalah cyber, frontier_llm, bio, dan general_harms. Jika Anda beralih dari Haiku 4.5, penolakan ini baru. Mengirim permintaan yang sama lagi biasanya mengembalikan penolakan lain, jadi jangan coba lagi secara membabi buta:
def run(client, messages):
response = client.messages.create(
model="claude-haiku-5-5",
max_tokens=4096,
messages=messages,
)
if response.stop_reason == "refusal":
details = getattr(response, "stop_details", None)
category = getattr(details, "category", "unknown")
log_refusal(category, messages) # pencatatan Anda
return {"status": "refused", "category": category}
text = "".join(b.text for b in response.content if b.type == "text")
return {"status": "ok", "text": text}
Cabangkan pada stop_reason sebelum Anda membaca content, dan rutekan penolakan ke seseorang atau model lain dalam kode Anda sendiri. Tim yang melakukan pekerjaan keamanan atau ilmu hayat yang sah yang diblokir oleh pengklasifikasi cyber atau bio dapat mengajukan permohonan ke Program Verifikasi Cyber atau Program Verifikasi Ilmu Hayat Anthropic.
Penggunaan komputer dan penggunaan browser
Pada Claude API dan Google Cloud, Haiku 5.5 mendukung penggunaan komputer hanya melalui toolset computer_toolset_20260801, yang tidak memerlukan header beta; mendeklarasikan computer_20250124 mengembalikan 400. Penggunaan browser melalui browser_toolset_20260801, yang tidak didukung Haiku 4.5. SDK Python dan TypeScript menambahkan kelas beta untuk keduanya pada hari peluncuran. Lihat dokumen alat penggunaan komputer untuk alat anggotanya.
Batas laju
Haiku 5.5 memiliki batas laju yang sama dengan Haiku 4.5: 1.000 permintaan, 2M token input, dan 400K token output per menit pada tingkat Start, hingga 10.000 permintaan, 10M input, dan 2M output pada Scale. Tingkat Prioritas tidak didukung. Untuk penanganan 429, lihat panduan batas laju terlampaui.
Uji API Claude Haiku 5.5 di Apidog
Permintaan yang disimpan membuat perbandingan upaya dan debugging penolakan dapat diulang. Berikut adalah pengaturannya di Apidog:

- Buat lingkungan dan tambahkan
ANTHROPIC_API_KEYsebagai variabel rahasia. Referensikan sebagai{{ANTHROPIC_API_KEY}}di headerx-api-key, di sampinganthropic-version: 2023-06-01dancontent-type: application/json. - Buat permintaan POST ke
https://api.anthropic.com/v1/messages, tempel body panggilan pertama, dan simpan. - Tambahkan penegasan: status adalah 200,
$.stop_reasonsama denganend_turn,$.usage.output_tokenslebih besar dari 0, dan$.content[*].typeberisitext. Penolakan atau balasanxhighkosong sekarang akan menyebabkan pengujian gagal alih-alih lolos. - Duplikasikan permintaan empat kali dengan
low,high,xhigh, danmax, lalu jalankan foldernya. Anda akan mendapatkanusageuntuk setiap tingkat upaya pada prompt Anda sendiri. - Tambahkan varian prompt sistem yang di-cache dan tegaskan bahwa
$.usage.cache_read_input_tokenslebih besar dari 0 pada eksekusi kedua.
Untuk pola yang lebih luas, lihat menguji aplikasi LLM.
FAQ
Apa ID model Claude Haiku 5.5? claude-haiku-5-5, tanpa akhiran tanggal dan tanpa alias terpisah, pada Claude API, Google Cloud, Microsoft Foundry, dan Claude Platform di AWS. Pada Amazon Bedrock adalah anthropic.claude-haiku-5-5.
Apakah ada API Claude Haiku 5.5 gratis? Tidak ada tingkatan gratis yang berkelanjutan, tetapi pengguna API baru mendapatkan sejumlah kecil kredit gratis untuk menguji API. Pengguna Claude.ai gratis dapat memilih Haiku 5.5 dalam obrolan, tetapi itu bukan kunci API. Paket Max dan Team sekarang menyertakan kredit API bulanan. Panduan akses gratis mencakup apa yang dihitung dan apa yang tidak.
Mengapa permintaan Haiku 4.5 saya mengembalikan 400? Periksa budget_tokens, temperature atau top_p yang tidak default, top_k apa pun, assistant prefill, atau alat computer_20250124 lama. Itu adalah penyebab yang biasa.
Bisakah saya menggunakan Haiku 5.5 di Claude Code? Ya, mulai v2.1.293. Pada Anthropic API alias haiku merujuk ke Haiku 5.5. Lihat Claude Haiku 5.5 di Claude Code.
Haruskah saya menggunakan Haiku 5.5 atau Sonnet 5.5 untuk pengkodean agentik? Anthropic mengatakan Sonnet 5.5 dan Opus 5.5 "tetap merupakan pilihan yang lebih baik untuk tugas pengkodean agentik yang kompleks." Gunakan Haiku 5.5 untuk pekerjaan dengan ruang lingkup sempit: klasifikasi, ringkasan, pemadatan, sub-agen, dan penggunaan browser.
Langkah berikutnya
Kirim permintaan panggilan pertama pada `medium`, lalu jalankan kembali pada `low` dan `high` pada prompt dari beban kerja Anda sendiri dan bandingkan `usage.output_tokens` serta kualitas jawaban. Unduh Apidog untuk menyimpan ketiga eksekusi dengan penegasan, sehingga rilis model berikutnya hanya membutuhkan perubahan satu bidang.
tombol
