Claude Haiku 5.5 adalah model Anthropic terkecil dan tercepat saat ini, dirilis pada 7 Oktober 2026, dengan id API claude-haiku-5-5. Biayanya $0.10 per juta token input dan $0.50 per juta token output untuk prompt hingga 100 ribu token, dan $0.50/$2.50 untuk prompt di atas 100 ribu. Dalam posting peluncurannya, Anthropic mengatakan biayanya “sekitar 75% lebih murah untuk dijalankan” dibandingkan Haiku 4.5 secara rata-rata, dan menyebutnya “model tercepat kami hingga saat ini.” Ini juga Haiku pertama dengan pengaturan upaya, dan membawa jendela konteks 1 juta token.
Di bawah ini: spesifikasi, harga dua tingkat, perubahan dari Haiku 4.5, tolok ukur, tempat menjalankannya, dan siapa yang harus beralih, dengan tautan ke panduan yang lebih mendalam seperti rincian harga Haiku 5.5. Untuk memanggil model saat Anda membaca, Apidog dapat mengirimkan permintaan Pesan, menyimpan kunci Anda dalam variabel lingkungan, dan menampilkan respons di samping penggunaan tokennya.
Spesifikasi Claude Haiku 5.5 secara sekilas
| Spesifikasi | Claude Haiku 5.5 |
|---|---|
| Tanggal rilis | 7 Oktober 2026 |
| ID model (API Claude, Google Cloud, Microsoft Foundry, Platform Claude di AWS) | claude-haiku-5-5 (id tetap, tanpa sufiks tanggal) |
| ID model (Amazon Bedrock) | anthropic.claude-haiku-5-5 |
| Jendela konteks | 1 juta token (Haiku 4.5: 200 ribu) |
| Output maksimum | 128 ribu (Haiku 4.5: 64 ribu); 300 ribu pada Batch API dengan header beta output-300k-2026-03-24 |
| Pemikiran | Hanya adaptif |
| Tingkat upaya | low, medium (default), high, xhigh, max |
| Batas pengetahuan | Juni 2026 |
| Harga per MTok, prompt hingga 100 ribu token | $0.10 input, $0.50 output |
| Harga per MTok, prompt di atas 100 ribu token | $0.50 input, $2.50 output |
| Penghentian | Tidak lebih cepat dari 7 Oktober 2027 |
Posisi Haiku 5.5 dalam jajaran Claude
| Model | Input / output per MTok | Upaya default | Latensi |
|---|---|---|---|
| Claude Fable 5.1 | $10 / $50 | tinggi | Lebih lambat |
| Claude Opus 5.5 | $4 / $20 | sedang | Sedang |
| Claude Sonnet 5.5 | $2 / $10 | tinggi | Cepat |
| Claude Haiku 5.5 | $0.10 / $0.50 untuk prompt hingga 100 ribu token | sedang | Tercepat |
Keempatnya memiliki jendela konteks 1 juta, output maksimum 128 ribu, dan batas pengetahuan Juni 2026. Anthropic membangun Haiku 5.5 “untuk tugas-tugas bervolume tinggi dan sensitif terhadap latensi seperti klasifikasi, ekstraksi, dan perutean,” ditambah ringkasan, dukungan langsung, penggunaan browser, dan pekerjaan sub-agen di bawah Opus 5.5 atau Sonnet 5.5.
Klaim kecepatan memiliki catatan kaki: tercepat “pada kecepatan standar setiap model,” tetapi lebih lambat dari Opus dalam Mode Cepat. Anthropic tidak mempublikasikan angka token per detik.
Harga Claude Haiku 5.5
Harga tergantung pada panjang prompt. Prompt di atas 100.000 token membayar tarif yang lebih tinggi.

Sumber: Harga API Claude.
Angka “sekitar 75% lebih murah” adalah rata-rata: 90% lebih murah dari Haiku 4.5 untuk prompt hingga 100 ribu token, 50% lebih murah di atasnya, dengan 90% permintaan Haiku 4.5 di bawah ambang batas. Ini sudah menghitung tokenizer baru, yang menghasilkan sekitar 30% lebih banyak token untuk teks yang sama.
Inferensi khusus AS (inference_geo) berharga 1.1x pada setiap kategori token. Prompt minimal yang dapat di-cache turun menjadi 512 token, dari 4.096 pada Haiku 4.5.
Di bawah 100 ribu token, harga daftar sama persis dengan GPT-6 Luna ($0.10 input, $0.50 output, $0.01 baca cache, $0.125 tulis cache). Ambang batasnya berbeda: biaya tambahan Luna dimulai di atas 272 ribu token input. Perbandingan Haiku 5.5 vs GPT-6 Luna menjelaskan kesenjangan tersebut, dan panduan harga memiliki contoh biaya yang telah dihitung.
Apa yang berubah dari Haiku 4.5
Jendela konteks tumbuh lima kali lipat, output maksimum berlipat ganda, dan Anda mendapatkan kontrol upaya untuk pertama kalinya. Panduan migrasi memperingatkan bahwa kode yang ditulis untuk Haiku 4.5 dapat rusak. Lima perubahan mengembalikan error 400:
- Anggaran pemikiran manual.
thinking: {"type": "enabled", "budget_tokens": N}gagal. Gunakan{"type": "adaptive"}denganoutput_config.effort. - Parameter sampling. Hapus
temperature,top_p, dantop_k. Nilaitemperatureatautop_pnon-default gagal, demikian jugatop_kapa pun atau pengirimantemperaturedantop_psecara bersamaan. - Pra-isi Asisten. Ditolak, bahkan dengan pemikiran dimatikan.
- Alat penggunaan komputer lama. Pada API Claude dan Google Cloud, gunakan
computer_toolset_20260801;computer_20250124gagal. - Riwayat yang diedit. Mengubah
system,tools, atau pesan sebelumnya sebelum blok pemikiran yang dikembalikan akan gagal. Pertahankan percakapan hanya-tambah (append-only).
Perubahan lain tidak akan menimbulkan error tetapi akan mengubah hasil Anda:
- Tampilan pemikiran. Blok pemikiran secara default kembali kosong, hanya dengan tanda tangan. Setel
"display": "summarized"untuk membacanya. - Jumlah token. Sekitar 30% lebih banyak token untuk teks yang sama;
max_tokensjuga mencakup pemikiran. - Penggunaan alat paksa.
tool_choiceberupaanyatau alat bernama masih berfungsi, tetapi responsnya tidak memiliki blok pemikiran. - Penolakan. Klasifikator keamanan dapat mengembalikan
stop_reason: "refusal", tanpa fallback sisi server. - Tingkat Prioritas. Tidak didukung di Haiku 5.5.
Pemikiran dapat dinonaktifkan di API pada upaya high atau di bawahnya; pada xhigh dan max hal itu mengembalikan 400. Haiku 4.5 tidak usang: masih terdaftar sebagai aktif. Panduan Haiku 5.5 vs Haiku 4.5 memiliki JSON sebelum/sesudah untuk setiap perbaikan.
Tolok Ukur Claude Haiku 5.5
Skor Haiku 5.5 berada pada upaya maksimum, sebagian besar dirata-ratakan selama lima percobaan. Artificial Analysis menjalankan GDPval-AA dan AA-Briefcase, Cognition menjalankan FrontierCode, dan Anthropic menilai Chartography (tolok ukur Surge AI) dengan implementasinya sendiri.

Baca tiga sel dengan cermat. FrontierCode menempatkan Haiku pada upaya maksimum dibandingkan Sonnet 5.5 pada xhigh; pada upaya maksimum, Sonnet mencetak 46.2%, di bawah 46.4% milik Haiku. Anthropic menjalankan skor OSWorld Luna melalui API OpenAI, sementara skor Terminal-Bench Luna berasal dari papan peringkat publik (Codex CLI). Dan pada upaya medium default, Haiku 5.5 mencetak 1277 pada GDPval-AA dan 1372 pada AA-Briefcase.
Anthropic mengatakan Sonnet 5.5 dan Opus 5.5 “tetap merupakan pilihan yang lebih baik untuk tugas-tugas pengkodean agen yang kompleks.” Tidak ada papan peringkat independen yang memiliki hasil Haiku 5.5 per 8 Oktober 2026; Cursor melaporkan 48.4% pada CursorBench-nya sendiri pada upaya maksimum. Analisis mendalam tolok ukur memiliki skor dan biaya per upaya.
Di mana Anda dapat menggunakan Claude Haiku 5.5
| Platform | Akses | Catatan |
|---|---|---|
| API Claude | claude-haiku-5-5 |
Bayar per token |
| Amazon Bedrock | anthropic.claude-haiku-5-5 |
Ditagih melalui AWS Marketplace |
| Google Cloud, Microsoft Foundry, Platform Claude di AWS | claude-haiku-5-5 |
ID yang sama dengan API Claude |
| Claude.ai (web, iOS, Android) | Pemilih model | Pengguna Gratis, Pro, Max, Tim, dan Perusahaan dapat memilihnya |
| Claude Code | /model claude-haiku-5-5 |
v2.1.293 atau lebih baru; paket berbayar |
| Vercel AI Gateway | anthropic/claude-haiku-5.5 |
Mulai dari $0.10 / $0.50 |
| Cursor | claude-haiku-5-5 |
Kumpulan Model Lain |
Per 8 Oktober 2026, model ini belum tersedia di OpenRouter atau diumumkan untuk GitHub Copilot.
Akses chat pada paket Gratis bukanlah kunci API, dan API berbayar sesuai penggunaan di luar kredit gratis kecil yang diberikan Anthropic kepada pengguna baru untuk pengujian. Paket Max dan Tim sekarang mencakup kredit API bulanan ($100 di Max 5x, $200 di Max 20x, hingga $500 dikumpulkan di Tim), yang tidak mencakup Claude Code. Panduan akses gratis mencantumkan apa yang gratis dan apa yang tidak.
Di Claude Code, alias haiku berarti Haiku 5.5 hanya pada API Anthropic; di tempat lain masih berarti Haiku 4.5. Lihat Haiku 5.5 di Claude Code untuk pengaturan sub-agen.
Siapa yang harus beralih ke Haiku 5.5
- Anda menggunakan Haiku 4.5: beralihlah, setelah memperbaiki lima perubahan yang merusak. Haiku 5.5 mengalahkan Haiku 4.5 pada setiap baris tabel peluncuran di mana keduanya memiliki skor, dengan harga daftar yang lebih rendah.
- Anda menggunakan Sonnet atau Opus untuk pekerjaan sederhana dan berulang: uji Haiku 5.5 pada klasifikasi, ekstraksi, ringkasan, dan pekerjaan sub-agen. Pertahankan model yang lebih besar untuk pengkodean agen yang kompleks.
- Prompt Anda sering melebihi 100 ribu token: perhitungkan harga kedua tingkatan sebelum Anda berkomitmen. Di atas ambang batas, biaya input 5x lebih banyak per token.
- Anda melakukan pekerjaan keamanan: perlindungan siber Haiku 5.5 masih memblokir pengujian penetrasi.
Dalam posting peluncuran Anthropic, Asana melaporkan latensi 30% lebih rendah pada penyelesaian tugas, dan Box melihat skor 11 poin di atas Haiku 4.5 dengan latensi sekitar setengahnya. Ini adalah klaim pelanggan, bukan tes independen.
Kartu sistem mencatat bahwa model ini lebih banyak menolak daripada model lain dalam audit otomatis Anthropic, jadi ujilah tingkat penolakan pada prompt Anda sendiri.
Kirim permintaan Haiku 5.5 pertama Anda
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 4000,
"thinking": {"type": "adaptive", "display": "summarized"},
"output_config": {"effort": "low"},
"messages": [
{"role": "user", "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error."}
]
}'
Jangan sertakan parameter sampling dan pra-isi. Baca blok konten berdasarkan type, karena respons dapat dimulai dengan blok pemikiran.
Di Apidog, impor perintah curl sebagai permintaan baru dan simpan kunci di variabel lingkungan ANTHROPIC_API_KEY. Tambahkan pernyataan bahwa stop_reason bukan refusal atau max_tokens. Kemudian duplikat permintaan pada medium dan bandingkan usage untuk melihat biaya setiap tingkat upaya. Panduan API Haiku 5.5 mencakup caching, batch, dan streaming, dan panduan kunci API Anthropic membantu jika Anda membutuhkan kunci.
FAQ
Kapan Claude Haiku 5.5 dirilis? 7 Oktober 2026, sembilan hari setelah Sonnet 5.5.
Apakah Claude Haiku 5.5 gratis? Di aplikasi chat Claude.ai, pengguna Gratis dapat memilihnya. API berbayar, selain kredit uji coba kecil untuk pengguna baru. Lihat setiap rute gratis.
Berapa jendela konteks Claude Haiku 5.5? 1 juta token, dengan output maksimum 128 ribu pada API Messages.
Apakah Haiku 4.5 akan dihentikan? Belum. Masih terdaftar sebagai aktif, dengan penghentian tidak lebih cepat dari 15 Oktober 2026.
Langkah selanjutnya
Pilih satu pekerjaan bervolume tinggi yang Anda jalankan hari ini, seperti triase tiket atau ringkasan dokumen. Kirimkan ke claude-haiku-5-5 pada low dan medium, periksa outputnya, dan bandingkan usage dengan model Anda saat ini. Unduh Apidog untuk menyimpan permintaan dan pernyataan tersebut dalam satu proyek, lalu gunakan panduan harga untuk mengubah jumlah token menjadi tagihan bulanan.
