Claude Haiku 5.5 (claude-haiku-5-5, dirilis 7 Oktober 2026) berharga 90% lebih murah daripada Haiku 4.5 untuk prompt hingga 100K token ($0.10/$0.50 per juta token input/output vs $1/$5), memiliki jendela konteks 1M token alih-alih 200K, dan mencetak skor jauh lebih tinggi pada setiap tolok ukur peluncuran yang mencantumkan keduanya. Kendalanya: lima bentuk permintaan yang berfungsi di 4.5 kini mengembalikan 400, dan beberapa perubahan lainnya mengubah respons serta biaya tanpa kesalahan.
Di bawah: tabel perbandingan, setiap perubahan pemutusan dengan JSON sebelum/sesudah, perubahan senyap, dan rencana pengujian untuk Apidog. Untuk lembar spesifikasi lengkap, baca apa itu Claude Haiku 5.5. Jika Anda masih menjalankan model lama, panduan API Claude Haiku 4.5 kami membahasnya.
Haiku 4.5 vs Haiku 5.5 Sekilas
| Claude Haiku 4.5 | Claude Haiku 5.5 | |
|---|---|---|
| ID Model (API Claude) | claude-haiku-4-5-20251001 |
claude-haiku-5-5 |
| Konteks / output maks | 200K / 64K | 1M / 128K |
| Input / output per MTok | $1 / $5 | $0.10 / $0.50 untuk prompt hingga 100K token; $0.50 / $2.50 di atas itu |
| Baca cache / tulis 5m per MTok | $0.10 / $1.25 | $0.01 / $0.125 hingga 100K; $0.05 / $0.625 di atas itu |
| Input / output batch per MTok | $0.50 / $2.50 | $0.05 / $0.25 hingga 100K; $0.25 / $1.25 di atas itu |
| Berpikir | budget_tokens Manual |
Hanya adaptif, aktif secara default |
| Tingkat upaya | Tidak ada | rendah, sedang (default), tinggi, sangat tinggi, maksimal |
| Prompt minimum yang dapat di-cache | 4.096 token | 512 token |
| Tokenisasi | Lebih lama | Sekitar 30% lebih banyak token untuk teks yang sama |
| Parameter pengambilan sampel non-default, prefill | Diterima | Kesalahan 400 |
| Tingkat Prioritas | Didukung | Tidak didukung |
| Status | Aktif, pensiun tidak lebih cepat dari 15 Okt 2026 | Aktif, pensiun tidak lebih cepat dari 7 Okt 2027 |
Haiku 4.5 tidak usang. Halaman model usang mencantumkannya sebagai Aktif tanpa tanggal usang, sehingga Anda dapat bermigrasi sesuai jadwal Anda sendiri. Batas kecepatan sama pada keduanya.
Lima perubahan pemutusan
Masing-masing mengembalikan 400 pada Haiku 5.5 untuk isi yang berfungsi pada 4.5. Panduan migrasi Haiku 5.5 mencantumkan semuanya.
1. Pemikiran manual dengan budget_tokens
Haiku 5.5 hanya menjalankan pemikiran adaptif. Anggaran tetap ditolak.
// Sebelum (Haiku 4.5)
{
"model": "claude-haiku-4-5-20251001",
"max_tokens": 16000,
"thinking": { "type": "enabled", "budget_tokens": 8000 },
"messages": [{ "role": "user", "content": "Classify this ticket." }]
}
// Sesudah (Haiku 5.5)
{
"model": "claude-haiku-5-5",
"max_tokens": 16000,
"thinking": { "type": "adaptive" },
"output_config": { "effort": "medium" },
"messages": [{ "role": "user", "content": "Classify this ticket." }]
}
Upaya kini menjadi pengungkit: di mana 4.5 menggunakan anggaran kecil, pilih upaya yang lebih rendah. Anda masih dapat mengirim thinking: {"type": "disabled"}, tetapi hanya pada upaya high atau di bawahnya; pada xhigh atau max itu juga akan menghasilkan 400.
2. Parameter pengambilan sampel
Hapus temperature, top_p dan top_k. Nilai yang diterima hanya temperature: 1 dan top_p: 0.99. Nilai lain apa pun akan menghasilkan 400, termasuk top_p: 1, top_k apa pun, dan pengiriman temperature dan top_p secara bersamaan.
// Sebelum (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
"temperature": 0.2, "top_k": 40,
"messages": [{ "role": "user", "content": "Extract the order ID." }] }
// Sesudah (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
"messages": [{ "role": "user", "content": "Extract the order ID." }] }
Jika Anda menggunakan suhu rendah untuk output yang konsisten, pindahkan niat tersebut ke dalam prompt.
3. Prefill asisten
Giliran asisten terakhir agar model dapat melanjutkan ditolak, bahkan dengan pemikiran dimatikan. Akhiri messages dengan giliran pengguna.
// Sebelum (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
"messages": [
{ "role": "user", "content": "Return the sentiment as JSON." },
{ "role": "assistant", "content": "{\"sentiment\": \"" }
] }
// Sesudah (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
"system": "Reply with only a JSON object. No preamble.",
"messages": [
{ "role": "user", "content": "Return the sentiment as JSON." }
] }
Untuk format ketat, panduan migrasi menunjuk ke output terstruktur, atau alat dengan bidang enum untuk klasifikasi.
4. Penggunaan komputer: computer_20250124 ke computer_toolset_20260801
Pada API Claude dan Google Cloud, Haiku 5.5 hanya mendukung penggunaan komputer melalui toolset baru. Hapus header beta `computer-use-2025-01-24`, dan hapus `fine-grained-tool-streaming-2025-05-14` jika Anda mengirimnya, karena itu akan menghasilkan 400 bersama toolset.
// Sebelum (Haiku 4.5, header anthropic-beta: computer-use-2025-01-24)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 4096,
"tools": [{ "type": "computer_20250124", "name": "computer",
"display_width_px": 1280, "display_height_px": 800 }],
"messages": [{ "role": "user", "content": "Open the settings page." }] }
// Sesudah (Haiku 5.5, tanpa header beta)
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"tools": [{ "type": "computer_toolset_20260801" }],
"messages": [{ "role": "user", "content": "Open the settings page." }] }
Loop agen Anda juga berubah: kirimkan pada `name` dan `toolset_name` setiap blok `tool_use` alih-alih `input.action`, dan kembalikan `toolset_name` pada hasilnya. Haiku 5.5 juga mendapatkan alat penggunaan browser (`browser_toolset_20260801`), yang tidak didukung oleh Haiku 4.5. Lihat penggunaan komputer Claude Code untuk gambaran yang lebih luas.
5. Mengedit giliran sebelumnya sebelum blok pemikiran
Blok pemikiran Haiku 5.5 tetap valid hanya selama semua yang dikirim sebelumnya tidak berubah. Ubah `system`, `tools` atau pesan sebelumnya dan kirim kembali blok tersebut, dan Anda akan mendapatkan 400. Haiku 4.5 tidak pernah menjalankan pemeriksaan ini. Di sini, giliran 1 mengirim `\"system\": \"You are a billing agent.\"` dan giliran 2 mengeditnya.
// Sebelum: sistem diedit + blok pemikiran diputar ulang = 400
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"system": "You are a billing agent. Be brief.",
"messages": [
{ "role": "user", "content": "Why was I charged twice?" },
{ "role": "assistant", "content": [
{ "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
{ "type": "text", "text": "Checking." } ] },
{ "role": "user", "content": "Order 4412." }
] }
// Sesudah: giliran sebelumnya tidak berubah, instruksi baru ditambahkan
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"system": "You are a billing agent.",
"messages": [
{ "role": "user", "content": "Why was I charged twice?" },
{ "role": "assistant", "content": [
{ "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
{ "type": "text", "text": "Checking." } ] },
{ "role": "user", "content": "Order 4412. Be brief." }
] }
Pada akun yang dibuat sebelum 31 Agustus 2026, 00:00 UTC, kesalahan hanya muncul pada permintaan yang mengatur `thinking.block_binding.prefix_mismatch_behavior`.
Perubahan senyap yang tidak akan menimbulkan kesalahan
- Bidang pemikiran kosong secara default. Setiap blok
thinkingkembali dengan bidangthinkingyang kosong dan hanya sebuahsignature. Haiku 4.5 mengembalikan ringkasan pemikiran. Aturthinking: {"type": "adaptive", "display": "summarized"}jika Anda mencatat atau menampilkannya. - Respons dapat dimulai dengan pemikiran. Pemikiran adaptif aktif bahkan ketika Anda tidak mengaturnya, jadi pilih blok konten berdasarkan
type, bukan berdasarkan indeks. - Sekitar 30% lebih banyak token. Tokenisasi baru menghitung teks yang sama sebagai sekitar 30% lebih banyak token. Hitung ulang prompt, dan ingat bahwa token pemikiran dihitung ke dalam
max_tokens, sehingga batas kecil dapat berhenti denganstop_reason: "max_tokens"sebelum teks apa pun. tool_choiceyang dipaksakan melewatkan pemikiran.anyatau alat bernama masih berfungsi, tetapi respons dimulai dengan panggilan alat dan tanpa blokthinking. Gunakantool_choice: {"type": "auto"}dan beri tahu model kapan harus memanggil alat jika Anda ingin model tersebut bernalar terlebih dahulu.- Penolakan baru, tanpa fallback. Haiku 5.5 menjalankan pengklasifikasi keamanan (
cyber,frontier_llm,bio,general_harms) yang dapat mengembalikanstop_reason: "refusal". Tidak ada fallback sisi server, dan percobaan ulang biasanya menolak lagi. - Tingkat Prioritas telah dihapus. Jika Anda memiliki komitmen Tingkat Prioritas pada Haiku 4.5, rencanakan kapasitas secara terpisah.
- Blok pemikiran terikat akun. Mereka hanya berfungsi di akun yang membuatnya atau akun yang terhubung. Memutar ulang percakapan yang tersimpan melalui akun lain akan menghilangkan penalaran tersebut.
- Caching yang lebih murah dimulai lebih cepat. Prompt minimum yang dapat di-cache turun dari 4.096 menjadi 512 token, sehingga prompt sistem pendek yang tidak pernah di-cache pada 4.5 kini bisa di-cache.
Apa yang menjadi lebih baik
Ini adalah angka yang dilaporkan Anthropic dengan Haiku 5.5 pada upaya maksimal; Artificial Analysis menjalankan GDPval-AA dan AA-Briefcase secara independen.
| Tolok Ukur | Haiku 4.5 | Haiku 5.5 |
|---|---|---|
| GDPval-AA v2.1 (Elo) | 735 | 1620 |
| AA-Briefcase v1.1 (Elo) | 614 | 1578 |
| OSWorld 2.1, subset offline | 15.7% | 72.4% |
| Ujian Terakhir Manusia, dengan alat | 18.7% | 57.4% |
| Terminal-Bench 4.0 | 0.0% | 39.2% |
| SWE-bench Multibahasa | 67.4% | 83.7% |
| Kartografi, tanpa alat | 6.4% | 46.4% |
Jalur Terminal-Bench Haiku 4.5 menggunakan anggaran pemikiran tetap 63.999 token. Pada upaya medium default, Haiku 5.5 mencetak skor 1277 pada GDPval-AA, masih jauh di atas 4.5. Box melaporkan skor 11 poin lebih tinggi dari Haiku 4.5 dengan latensi sekitar separuhnya. Tabel lengkap ada di tolok ukur Claude Haiku 5.5.
Anthropic masih memposisikan Sonnet 5.5 dan Opus 5.5 sebagai pilihan yang lebih baik untuk pengodean agen yang kompleks. Haiku 5.5 menargetkan klasifikasi, ekstraksi, ringkasan, pemadatan, subagen, dan penggunaan browser.
Mengenai biaya, Anthropic mengatakan Haiku 5.5 beroperasi sekitar 75% lebih murah secara rata-rata. Angka tersebut menggabungkan harga 90% lebih rendah hingga 100K token dan 50% lebih rendah di atas itu, dan sudah memperhitungkan token ekstra dari tokenizer baru. Prompt sistem penggunaan alat juga menyusut, dari 496 menjadi 286 token dengan pilihan alat auto. Contoh-contoh yang dikerjakan ada di harga Claude Haiku 5.5.
Uji migrasi di Apidog
Di Apidog, buat satu proyek dengan tiga permintaan tersimpan ke https://api.anthropic.com/v1/messages:

- Dasar: isi Haiku 4.5 Anda saat ini. Nyatakan status 200.
- Isi lama, model baru: ubah hanya
modelmenjadiclaude-haiku-5-5. Nyatakan status 400. Simpan satu salinan untuk setiap perubahan pemutusan yang Anda temui. - Dimigrasikan: isi yang diperbaiki. Nyatakan status 200, sebuah
stop_reasonyang bukanrefusalataumax_tokens, dan blok teks yang ditemukan berdasarkantype.
Simpan `ANTHROPIC_API_KEY` sebagai variabel lingkungan dan rujuk sebagai `{{ANTHROPIC_API_KEY}}` di header `x-api-key`, dengan `anthropic-version: 2023-06-01`. Bandingkan `usage.input_tokens` antara permintaan dasar dan permintaan yang dimigrasikan untuk melihat perubahan tokenizer pada prompt Anda sendiri. Simpan set ini sebagai skenario pengujian, dan rekan tim yang memperkenalkan kembali `temperature` akan menggagalkan eksekusi alih-alih produksi. Dasar-dasar permintaan ada di cara menggunakan API Claude Haiku 5.5.
Jika Anda bekerja di Claude Code, `/claude-api migrate this project to claude-haiku-5-5` menerapkan pertukaran ID model dan perbaikan parameter, lalu memberi Anda daftar periksa. Perhatikan bahwa alias `haiku` hanya merujuk ke Haiku 5.5 pada API Anthropic; lihat Claude Haiku 5.5 di Claude Code.
FAQ
Apakah Claude Haiku 4.5 usang? Tidak. Ini terdaftar sebagai Aktif tanpa tanggal usang, dan pensiunnya tidak lebih cepat dari 15 Oktober 2026.
Mengapa permintaan Haiku 4.5 saya mengembalikan 400 di Haiku 5.5? Periksa budget_tokens, temperature/top_p/top_k, prefill asisten, computer_20250124, atau pengeditan giliran sebelumnya sebelum blok pemikiran. Itu adalah lima perubahan pemutusan.
Apakah Haiku 5.5 lebih murah daripada Haiku 4.5 untuk prompt panjang? Ya. Untuk lebih dari 100K token biayanya $0.50/$2.50 per juta, separuh dari $1/$5 Haiku 4.5. Haiku 4.5 sama sekali tidak dapat menerima prompt di atas 200K.
Haruskah saya mengalihkan semuanya ke Haiku 5.5? Untuk pekerjaan klasifikasi, ekstraksi, dan subagen, uji dulu, lalu pindah. Bandingkan dengan saingan terdekatnya di Haiku 5.5 vs GPT-6 Luna.
Langkah selanjutnya
Simpan permintaan Haiku 4.5 Anda di sebelah kembar Haiku 5.5-nya, konfirmasi 400, perbaiki, dan alihkan lalu lintas setelah permintaan yang dimigrasikan berhasil. Unduh Apidog untuk membangun pasangan pengujian tersebut.
