Apa Itu Claude Haiku 5.5

Apa itu Claude Haiku 5.5? Model Anthropic tanggal 7 Oktober 2026: $0,10/$0,50 untuk prompt hingga 100 ribu token, konteks 1 juta, tolok ukur, dan perubahan dari Haiku 4.5.

Ashley Innocent

Ashley Innocent

8 October 2026

Apa Itu Claude Haiku 5.5

Apidog untuk Perusahaan

Penerapan On-Premises

SSO & RBAC

Sesuai SOC 2

Jelajahi Apidog Enterprise

Claude Haiku 5.5 adalah model Anthropic terkecil dan tercepat saat ini, dirilis pada 7 Oktober 2026, dengan id API claude-haiku-5-5. Biayanya $0.10 per juta token input dan $0.50 per juta token output untuk prompt hingga 100 ribu token, dan $0.50/$2.50 untuk prompt di atas 100 ribu. Dalam posting peluncurannya, Anthropic mengatakan biayanya “sekitar 75% lebih murah untuk dijalankan” dibandingkan Haiku 4.5 secara rata-rata, dan menyebutnya “model tercepat kami hingga saat ini.” Ini juga Haiku pertama dengan pengaturan upaya, dan membawa jendela konteks 1 juta token.

Di bawah ini: spesifikasi, harga dua tingkat, perubahan dari Haiku 4.5, tolok ukur, tempat menjalankannya, dan siapa yang harus beralih, dengan tautan ke panduan yang lebih mendalam seperti rincian harga Haiku 5.5. Untuk memanggil model saat Anda membaca, Apidog dapat mengirimkan permintaan Pesan, menyimpan kunci Anda dalam variabel lingkungan, dan menampilkan respons di samping penggunaan tokennya.

tombol

Spesifikasi Claude Haiku 5.5 secara sekilas

Spesifikasi Claude Haiku 5.5
Tanggal rilis 7 Oktober 2026
ID model (API Claude, Google Cloud, Microsoft Foundry, Platform Claude di AWS) claude-haiku-5-5 (id tetap, tanpa sufiks tanggal)
ID model (Amazon Bedrock) anthropic.claude-haiku-5-5
Jendela konteks 1 juta token (Haiku 4.5: 200 ribu)
Output maksimum 128 ribu (Haiku 4.5: 64 ribu); 300 ribu pada Batch API dengan header beta output-300k-2026-03-24
Pemikiran Hanya adaptif
Tingkat upaya low, medium (default), high, xhigh, max
Batas pengetahuan Juni 2026
Harga per MTok, prompt hingga 100 ribu token $0.10 input, $0.50 output
Harga per MTok, prompt di atas 100 ribu token $0.50 input, $2.50 output
Penghentian Tidak lebih cepat dari 7 Oktober 2027

Posisi Haiku 5.5 dalam jajaran Claude

Model Input / output per MTok Upaya default Latensi
Claude Fable 5.1 $10 / $50 tinggi Lebih lambat
Claude Opus 5.5 $4 / $20 sedang Sedang
Claude Sonnet 5.5 $2 / $10 tinggi Cepat
Claude Haiku 5.5 $0.10 / $0.50 untuk prompt hingga 100 ribu token sedang Tercepat

Keempatnya memiliki jendela konteks 1 juta, output maksimum 128 ribu, dan batas pengetahuan Juni 2026. Anthropic membangun Haiku 5.5 “untuk tugas-tugas bervolume tinggi dan sensitif terhadap latensi seperti klasifikasi, ekstraksi, dan perutean,” ditambah ringkasan, dukungan langsung, penggunaan browser, dan pekerjaan sub-agen di bawah Opus 5.5 atau Sonnet 5.5.

Klaim kecepatan memiliki catatan kaki: tercepat “pada kecepatan standar setiap model,” tetapi lebih lambat dari Opus dalam Mode Cepat. Anthropic tidak mempublikasikan angka token per detik.

Harga Claude Haiku 5.5

Harga tergantung pada panjang prompt. Prompt di atas 100.000 token membayar tarif yang lebih tinggi.

Sumber: Harga API Claude.

Angka “sekitar 75% lebih murah” adalah rata-rata: 90% lebih murah dari Haiku 4.5 untuk prompt hingga 100 ribu token, 50% lebih murah di atasnya, dengan 90% permintaan Haiku 4.5 di bawah ambang batas. Ini sudah menghitung tokenizer baru, yang menghasilkan sekitar 30% lebih banyak token untuk teks yang sama.

Inferensi khusus AS (inference_geo) berharga 1.1x pada setiap kategori token. Prompt minimal yang dapat di-cache turun menjadi 512 token, dari 4.096 pada Haiku 4.5.

Di bawah 100 ribu token, harga daftar sama persis dengan GPT-6 Luna ($0.10 input, $0.50 output, $0.01 baca cache, $0.125 tulis cache). Ambang batasnya berbeda: biaya tambahan Luna dimulai di atas 272 ribu token input. Perbandingan Haiku 5.5 vs GPT-6 Luna menjelaskan kesenjangan tersebut, dan panduan harga memiliki contoh biaya yang telah dihitung.

Apa yang berubah dari Haiku 4.5

Jendela konteks tumbuh lima kali lipat, output maksimum berlipat ganda, dan Anda mendapatkan kontrol upaya untuk pertama kalinya. Panduan migrasi memperingatkan bahwa kode yang ditulis untuk Haiku 4.5 dapat rusak. Lima perubahan mengembalikan error 400:

  1. Anggaran pemikiran manual. thinking: {"type": "enabled", "budget_tokens": N} gagal. Gunakan {"type": "adaptive"} dengan output_config.effort.
  2. Parameter sampling. Hapus temperature, top_p, dan top_k. Nilai temperature atau top_p non-default gagal, demikian juga top_k apa pun atau pengiriman temperature dan top_p secara bersamaan.
  3. Pra-isi Asisten. Ditolak, bahkan dengan pemikiran dimatikan.
  4. Alat penggunaan komputer lama. Pada API Claude dan Google Cloud, gunakan computer_toolset_20260801; computer_20250124 gagal.
  5. Riwayat yang diedit. Mengubah system, tools, atau pesan sebelumnya sebelum blok pemikiran yang dikembalikan akan gagal. Pertahankan percakapan hanya-tambah (append-only).

Perubahan lain tidak akan menimbulkan error tetapi akan mengubah hasil Anda:

Pemikiran dapat dinonaktifkan di API pada upaya high atau di bawahnya; pada xhigh dan max hal itu mengembalikan 400. Haiku 4.5 tidak usang: masih terdaftar sebagai aktif. Panduan Haiku 5.5 vs Haiku 4.5 memiliki JSON sebelum/sesudah untuk setiap perbaikan.

Tolok Ukur Claude Haiku 5.5

Skor Haiku 5.5 berada pada upaya maksimum, sebagian besar dirata-ratakan selama lima percobaan. Artificial Analysis menjalankan GDPval-AA dan AA-Briefcase, Cognition menjalankan FrontierCode, dan Anthropic menilai Chartography (tolok ukur Surge AI) dengan implementasinya sendiri.

Baca tiga sel dengan cermat. FrontierCode menempatkan Haiku pada upaya maksimum dibandingkan Sonnet 5.5 pada xhigh; pada upaya maksimum, Sonnet mencetak 46.2%, di bawah 46.4% milik Haiku. Anthropic menjalankan skor OSWorld Luna melalui API OpenAI, sementara skor Terminal-Bench Luna berasal dari papan peringkat publik (Codex CLI). Dan pada upaya medium default, Haiku 5.5 mencetak 1277 pada GDPval-AA dan 1372 pada AA-Briefcase.

Anthropic mengatakan Sonnet 5.5 dan Opus 5.5 “tetap merupakan pilihan yang lebih baik untuk tugas-tugas pengkodean agen yang kompleks.” Tidak ada papan peringkat independen yang memiliki hasil Haiku 5.5 per 8 Oktober 2026; Cursor melaporkan 48.4% pada CursorBench-nya sendiri pada upaya maksimum. Analisis mendalam tolok ukur memiliki skor dan biaya per upaya.

Di mana Anda dapat menggunakan Claude Haiku 5.5

Platform Akses Catatan
API Claude claude-haiku-5-5 Bayar per token
Amazon Bedrock anthropic.claude-haiku-5-5 Ditagih melalui AWS Marketplace
Google Cloud, Microsoft Foundry, Platform Claude di AWS claude-haiku-5-5 ID yang sama dengan API Claude
Claude.ai (web, iOS, Android) Pemilih model Pengguna Gratis, Pro, Max, Tim, dan Perusahaan dapat memilihnya
Claude Code /model claude-haiku-5-5 v2.1.293 atau lebih baru; paket berbayar
Vercel AI Gateway anthropic/claude-haiku-5.5 Mulai dari $0.10 / $0.50
Cursor claude-haiku-5-5 Kumpulan Model Lain

Per 8 Oktober 2026, model ini belum tersedia di OpenRouter atau diumumkan untuk GitHub Copilot.

Akses chat pada paket Gratis bukanlah kunci API, dan API berbayar sesuai penggunaan di luar kredit gratis kecil yang diberikan Anthropic kepada pengguna baru untuk pengujian. Paket Max dan Tim sekarang mencakup kredit API bulanan ($100 di Max 5x, $200 di Max 20x, hingga $500 dikumpulkan di Tim), yang tidak mencakup Claude Code. Panduan akses gratis mencantumkan apa yang gratis dan apa yang tidak.

Di Claude Code, alias haiku berarti Haiku 5.5 hanya pada API Anthropic; di tempat lain masih berarti Haiku 4.5. Lihat Haiku 5.5 di Claude Code untuk pengaturan sub-agen.

Siapa yang harus beralih ke Haiku 5.5

Dalam posting peluncuran Anthropic, Asana melaporkan latensi 30% lebih rendah pada penyelesaian tugas, dan Box melihat skor 11 poin di atas Haiku 4.5 dengan latensi sekitar setengahnya. Ini adalah klaim pelanggan, bukan tes independen.

Kartu sistem mencatat bahwa model ini lebih banyak menolak daripada model lain dalam audit otomatis Anthropic, jadi ujilah tingkat penolakan pada prompt Anda sendiri.

Kirim permintaan Haiku 5.5 pertama Anda

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 4000,
    "thinking": {"type": "adaptive", "display": "summarized"},
    "output_config": {"effort": "low"},
    "messages": [
      {"role": "user", "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error."}
    ]
  }'

Jangan sertakan parameter sampling dan pra-isi. Baca blok konten berdasarkan type, karena respons dapat dimulai dengan blok pemikiran.

Di Apidog, impor perintah curl sebagai permintaan baru dan simpan kunci di variabel lingkungan ANTHROPIC_API_KEY. Tambahkan pernyataan bahwa stop_reason bukan refusal atau max_tokens. Kemudian duplikat permintaan pada medium dan bandingkan usage untuk melihat biaya setiap tingkat upaya. Panduan API Haiku 5.5 mencakup caching, batch, dan streaming, dan panduan kunci API Anthropic membantu jika Anda membutuhkan kunci.

FAQ

Kapan Claude Haiku 5.5 dirilis? 7 Oktober 2026, sembilan hari setelah Sonnet 5.5.

Apakah Claude Haiku 5.5 gratis? Di aplikasi chat Claude.ai, pengguna Gratis dapat memilihnya. API berbayar, selain kredit uji coba kecil untuk pengguna baru. Lihat setiap rute gratis.

Berapa jendela konteks Claude Haiku 5.5? 1 juta token, dengan output maksimum 128 ribu pada API Messages.

Apakah Haiku 4.5 akan dihentikan? Belum. Masih terdaftar sebagai aktif, dengan penghentian tidak lebih cepat dari 15 Oktober 2026.

Langkah selanjutnya

Pilih satu pekerjaan bervolume tinggi yang Anda jalankan hari ini, seperti triase tiket atau ringkasan dokumen. Kirimkan ke claude-haiku-5-5 pada low dan medium, periksa outputnya, dan bandingkan usage dengan model Anda saat ini. Unduh Apidog untuk menyimpan permintaan dan pernyataan tersebut dalam satu proyek, lalu gunakan panduan harga untuk mengubah jumlah token menjadi tagihan bulanan.

Mengembangkan API dengan Apidog

Apidog adalah alat pengembangan API yang membantu Anda mengembangkan API dengan lebih mudah dan efisien.