Claude Haiku 5.5 vs Haiku 4.5: Apa yang Berubah dan Perubahan Merusak yang Harus Diperbaiki Pertama

Haiku 5.5 vs Haiku 4.5: 90% lebih murah hingga 100 ribu token, konteks 1 juta, dan lima perubahan yang merusak yang mengembalikan kode 400. Termasuk perbaikan JSON sebelum/sesudah.

Medy Evrard

8 October 2026

Claude Haiku 5.5 vs Haiku 4.5: Apa yang Berubah dan Perubahan Merusak yang Harus Diperbaiki Pertama

Apidog untuk Perusahaan

Penerapan On-Premises

SSO & RBAC

Sesuai SOC 2

Jelajahi Apidog Enterprise

Claude Haiku 5.5 (claude-haiku-5-5, dirilis 7 Oktober 2026) berharga 90% lebih murah daripada Haiku 4.5 untuk prompt hingga 100K token ($0.10/$0.50 per juta token input/output vs $1/$5), memiliki jendela konteks 1M token alih-alih 200K, dan mencetak skor jauh lebih tinggi pada setiap tolok ukur peluncuran yang mencantumkan keduanya. Kendalanya: lima bentuk permintaan yang berfungsi di 4.5 kini mengembalikan 400, dan beberapa perubahan lainnya mengubah respons serta biaya tanpa kesalahan.

Di bawah: tabel perbandingan, setiap perubahan pemutusan dengan JSON sebelum/sesudah, perubahan senyap, dan rencana pengujian untuk Apidog. Untuk lembar spesifikasi lengkap, baca apa itu Claude Haiku 5.5. Jika Anda masih menjalankan model lama, panduan API Claude Haiku 4.5 kami membahasnya.

tombol

Haiku 4.5 vs Haiku 5.5 Sekilas

Claude Haiku 4.5 Claude Haiku 5.5
ID Model (API Claude) claude-haiku-4-5-20251001 claude-haiku-5-5
Konteks / output maks 200K / 64K 1M / 128K
Input / output per MTok $1 / $5 $0.10 / $0.50 untuk prompt hingga 100K token; $0.50 / $2.50 di atas itu
Baca cache / tulis 5m per MTok $0.10 / $1.25 $0.01 / $0.125 hingga 100K; $0.05 / $0.625 di atas itu
Input / output batch per MTok $0.50 / $2.50 $0.05 / $0.25 hingga 100K; $0.25 / $1.25 di atas itu
Berpikir budget_tokens Manual Hanya adaptif, aktif secara default
Tingkat upaya Tidak ada rendah, sedang (default), tinggi, sangat tinggi, maksimal
Prompt minimum yang dapat di-cache 4.096 token 512 token
Tokenisasi Lebih lama Sekitar 30% lebih banyak token untuk teks yang sama
Parameter pengambilan sampel non-default, prefill Diterima Kesalahan 400
Tingkat Prioritas Didukung Tidak didukung
Status Aktif, pensiun tidak lebih cepat dari 15 Okt 2026 Aktif, pensiun tidak lebih cepat dari 7 Okt 2027

Haiku 4.5 tidak usang. Halaman model usang mencantumkannya sebagai Aktif tanpa tanggal usang, sehingga Anda dapat bermigrasi sesuai jadwal Anda sendiri. Batas kecepatan sama pada keduanya.

Lima perubahan pemutusan

Masing-masing mengembalikan 400 pada Haiku 5.5 untuk isi yang berfungsi pada 4.5. Panduan migrasi Haiku 5.5 mencantumkan semuanya.

1. Pemikiran manual dengan budget_tokens

Haiku 5.5 hanya menjalankan pemikiran adaptif. Anggaran tetap ditolak.

// Sebelum (Haiku 4.5)
{
  "model": "claude-haiku-4-5-20251001",
  "max_tokens": 16000,
  "thinking": { "type": "enabled", "budget_tokens": 8000 },
  "messages": [{ "role": "user", "content": "Classify this ticket." }]
}

// Sesudah (Haiku 5.5)
{
  "model": "claude-haiku-5-5",
  "max_tokens": 16000,
  "thinking": { "type": "adaptive" },
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "Classify this ticket." }]
}

Upaya kini menjadi pengungkit: di mana 4.5 menggunakan anggaran kecil, pilih upaya yang lebih rendah. Anda masih dapat mengirim thinking: {"type": "disabled"}, tetapi hanya pada upaya high atau di bawahnya; pada xhigh atau max itu juga akan menghasilkan 400.

2. Parameter pengambilan sampel

Hapus temperature, top_p dan top_k. Nilai yang diterima hanya temperature: 1 dan top_p: 0.99. Nilai lain apa pun akan menghasilkan 400, termasuk top_p: 1, top_k apa pun, dan pengiriman temperature dan top_p secara bersamaan.

// Sebelum (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
  "temperature": 0.2, "top_k": 40,
  "messages": [{ "role": "user", "content": "Extract the order ID." }] }

// Sesudah (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
  "messages": [{ "role": "user", "content": "Extract the order ID." }] }

Jika Anda menggunakan suhu rendah untuk output yang konsisten, pindahkan niat tersebut ke dalam prompt.

3. Prefill asisten

Giliran asisten terakhir agar model dapat melanjutkan ditolak, bahkan dengan pemikiran dimatikan. Akhiri messages dengan giliran pengguna.

// Sebelum (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
  "messages": [
    { "role": "user", "content": "Return the sentiment as JSON." },
    { "role": "assistant", "content": "{\"sentiment\": \"" }
  ] }

// Sesudah (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
  "system": "Reply with only a JSON object. No preamble.",
  "messages": [
    { "role": "user", "content": "Return the sentiment as JSON." }
  ] }

Untuk format ketat, panduan migrasi menunjuk ke output terstruktur, atau alat dengan bidang enum untuk klasifikasi.

4. Penggunaan komputer: computer_20250124 ke computer_toolset_20260801

Pada API Claude dan Google Cloud, Haiku 5.5 hanya mendukung penggunaan komputer melalui toolset baru. Hapus header beta `computer-use-2025-01-24`, dan hapus `fine-grained-tool-streaming-2025-05-14` jika Anda mengirimnya, karena itu akan menghasilkan 400 bersama toolset.

// Sebelum (Haiku 4.5, header anthropic-beta: computer-use-2025-01-24)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 4096,
  "tools": [{ "type": "computer_20250124", "name": "computer",
              "display_width_px": 1280, "display_height_px": 800 }],
  "messages": [{ "role": "user", "content": "Open the settings page." }] }

// Sesudah (Haiku 5.5, tanpa header beta)
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "tools": [{ "type": "computer_toolset_20260801" }],
  "messages": [{ "role": "user", "content": "Open the settings page." }] }

Loop agen Anda juga berubah: kirimkan pada `name` dan `toolset_name` setiap blok `tool_use` alih-alih `input.action`, dan kembalikan `toolset_name` pada hasilnya. Haiku 5.5 juga mendapatkan alat penggunaan browser (`browser_toolset_20260801`), yang tidak didukung oleh Haiku 4.5. Lihat penggunaan komputer Claude Code untuk gambaran yang lebih luas.

5. Mengedit giliran sebelumnya sebelum blok pemikiran

Blok pemikiran Haiku 5.5 tetap valid hanya selama semua yang dikirim sebelumnya tidak berubah. Ubah `system`, `tools` atau pesan sebelumnya dan kirim kembali blok tersebut, dan Anda akan mendapatkan 400. Haiku 4.5 tidak pernah menjalankan pemeriksaan ini. Di sini, giliran 1 mengirim `\"system\": \"You are a billing agent.\"` dan giliran 2 mengeditnya.

// Sebelum: sistem diedit + blok pemikiran diputar ulang = 400
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "system": "You are a billing agent. Be brief.",
  "messages": [
    { "role": "user", "content": "Why was I charged twice?" },
    { "role": "assistant", "content": [
      { "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
      { "type": "text", "text": "Checking." } ] },
    { "role": "user", "content": "Order 4412." }
  ] }

// Sesudah: giliran sebelumnya tidak berubah, instruksi baru ditambahkan
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "system": "You are a billing agent.",
  "messages": [
    { "role": "user", "content": "Why was I charged twice?" },
    { "role": "assistant", "content": [
      { "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
      { "type": "text", "text": "Checking." } ] },
    { "role": "user", "content": "Order 4412. Be brief." }
  ] }

Pada akun yang dibuat sebelum 31 Agustus 2026, 00:00 UTC, kesalahan hanya muncul pada permintaan yang mengatur `thinking.block_binding.prefix_mismatch_behavior`.

Perubahan senyap yang tidak akan menimbulkan kesalahan

Apa yang menjadi lebih baik

Ini adalah angka yang dilaporkan Anthropic dengan Haiku 5.5 pada upaya maksimal; Artificial Analysis menjalankan GDPval-AA dan AA-Briefcase secara independen.

Tolok Ukur Haiku 4.5 Haiku 5.5
GDPval-AA v2.1 (Elo) 735 1620
AA-Briefcase v1.1 (Elo) 614 1578
OSWorld 2.1, subset offline 15.7% 72.4%
Ujian Terakhir Manusia, dengan alat 18.7% 57.4%
Terminal-Bench 4.0 0.0% 39.2%
SWE-bench Multibahasa 67.4% 83.7%
Kartografi, tanpa alat 6.4% 46.4%

Jalur Terminal-Bench Haiku 4.5 menggunakan anggaran pemikiran tetap 63.999 token. Pada upaya medium default, Haiku 5.5 mencetak skor 1277 pada GDPval-AA, masih jauh di atas 4.5. Box melaporkan skor 11 poin lebih tinggi dari Haiku 4.5 dengan latensi sekitar separuhnya. Tabel lengkap ada di tolok ukur Claude Haiku 5.5.

Anthropic masih memposisikan Sonnet 5.5 dan Opus 5.5 sebagai pilihan yang lebih baik untuk pengodean agen yang kompleks. Haiku 5.5 menargetkan klasifikasi, ekstraksi, ringkasan, pemadatan, subagen, dan penggunaan browser.

Mengenai biaya, Anthropic mengatakan Haiku 5.5 beroperasi sekitar 75% lebih murah secara rata-rata. Angka tersebut menggabungkan harga 90% lebih rendah hingga 100K token dan 50% lebih rendah di atas itu, dan sudah memperhitungkan token ekstra dari tokenizer baru. Prompt sistem penggunaan alat juga menyusut, dari 496 menjadi 286 token dengan pilihan alat auto. Contoh-contoh yang dikerjakan ada di harga Claude Haiku 5.5.

Uji migrasi di Apidog

Di Apidog, buat satu proyek dengan tiga permintaan tersimpan ke https://api.anthropic.com/v1/messages:

  1. Dasar: isi Haiku 4.5 Anda saat ini. Nyatakan status 200.
  2. Isi lama, model baru: ubah hanya model menjadi claude-haiku-5-5. Nyatakan status 400. Simpan satu salinan untuk setiap perubahan pemutusan yang Anda temui.
  3. Dimigrasikan: isi yang diperbaiki. Nyatakan status 200, sebuah stop_reason yang bukan refusal atau max_tokens, dan blok teks yang ditemukan berdasarkan type.

Simpan `ANTHROPIC_API_KEY` sebagai variabel lingkungan dan rujuk sebagai `{{ANTHROPIC_API_KEY}}` di header `x-api-key`, dengan `anthropic-version: 2023-06-01`. Bandingkan `usage.input_tokens` antara permintaan dasar dan permintaan yang dimigrasikan untuk melihat perubahan tokenizer pada prompt Anda sendiri. Simpan set ini sebagai skenario pengujian, dan rekan tim yang memperkenalkan kembali `temperature` akan menggagalkan eksekusi alih-alih produksi. Dasar-dasar permintaan ada di cara menggunakan API Claude Haiku 5.5.

Jika Anda bekerja di Claude Code, `/claude-api migrate this project to claude-haiku-5-5` menerapkan pertukaran ID model dan perbaikan parameter, lalu memberi Anda daftar periksa. Perhatikan bahwa alias `haiku` hanya merujuk ke Haiku 5.5 pada API Anthropic; lihat Claude Haiku 5.5 di Claude Code.

FAQ

Apakah Claude Haiku 4.5 usang? Tidak. Ini terdaftar sebagai Aktif tanpa tanggal usang, dan pensiunnya tidak lebih cepat dari 15 Oktober 2026.

Mengapa permintaan Haiku 4.5 saya mengembalikan 400 di Haiku 5.5? Periksa budget_tokens, temperature/top_p/top_k, prefill asisten, computer_20250124, atau pengeditan giliran sebelumnya sebelum blok pemikiran. Itu adalah lima perubahan pemutusan.

Apakah Haiku 5.5 lebih murah daripada Haiku 4.5 untuk prompt panjang? Ya. Untuk lebih dari 100K token biayanya $0.50/$2.50 per juta, separuh dari $1/$5 Haiku 4.5. Haiku 4.5 sama sekali tidak dapat menerima prompt di atas 200K.

Haruskah saya mengalihkan semuanya ke Haiku 5.5? Untuk pekerjaan klasifikasi, ekstraksi, dan subagen, uji dulu, lalu pindah. Bandingkan dengan saingan terdekatnya di Haiku 5.5 vs GPT-6 Luna.

Langkah selanjutnya

Simpan permintaan Haiku 4.5 Anda di sebelah kembar Haiku 5.5-nya, konfirmasi 400, perbaiki, dan alihkan lalu lintas setelah permintaan yang dimigrasikan berhasil. Unduh Apidog untuk membangun pasangan pengujian tersebut.

Mengembangkan API dengan Apidog

Apidog adalah alat pengembangan API yang membantu Anda mengembangkan API dengan lebih mudah dan efisien.