Cara Menggunakan Claude Haiku 5.5 API

Panduan API Claude Haiku 5.5: panggilan pertama dengan claude-haiku-5-5 di curl, Python, dan TypeScript, ditambah upaya, pemikiran, caching, batch, dan penolakan.

INEZA Felin-Michel

INEZA Felin-Michel

8 October 2026

Cara Menggunakan Claude Haiku 5.5 API

Apidog untuk Perusahaan

Penerapan On-Premises

SSO & RBAC

Sesuai SOC 2

Jelajahi Apidog Enterprise

Untuk menggunakan API Claude Haiku 5.5, kirimkan permintaan POST ke https://api.anthropic.com/v1/messages dengan "model": "claude-haiku-5-5", kunci Anda di header x-api-key, dan anthropic-version: 2023-06-01. Biayanya $0,10/$0,50 per juta token input/output untuk prompt hingga 100K token ($0,50/$2,50 di atas itu), membaca hingga 1M token konteks, menulis hingga 128K, dan default ke upaya medium dengan pemikiran adaptif aktif.

Anthropic merilis Haiku 5.5 pada 7 Oktober 2026, dan ini adalah Haiku pertama dengan tingkat upaya (apa itu Claude Haiku 5.5 mencakup spesifikasi dan penempatannya). Panduan ini mencakup panggilan pertama di curl, Python, dan TypeScript, kemudian upaya, pemikiran, caching, batch, penolakan, dan toolset agen. Anda dapat menyimpan dan menegaskan setiap permintaan di bawah ini di Apidog.

tombol

Sekilas tentang API Claude Haiku 5.5

ParameterPerilaku Haiku 5.5
ID Modelclaude-haiku-5-5 (Bedrock: anthropic.claude-haiku-5-5); tanpa alias terpisah
Harga per MTok, prompt hingga 100K token$0,10 input, $0,50 output, $0,01 baca cache
Harga per MTok, prompt di atas 100K token$0,50 input, $2,50 output, $0,05 baca cache
Konteks / keluaran maks.1M / 128K; 300K pada Batch dengan header beta output-300k-2026-03-24
output_config.effortlow, medium (default), high, xhigh, max
thinkingadaptive secara default; disabled hanya pada upaya high atau di bawahnya
thinking.displayBidang thinking kosong secara default; summarized mengembalikan teks yang mudah dibaca
temperature, top_p, top_kNilai non-default mengembalikan 400
Assistant prefillMengembalikan 400, bahkan dengan pemikiran dinonaktifkan
Prompt minimal yang dapat di-cache512 token (4.096 pada Haiku 4.5)

Sumber: halaman model Haiku 5.5 dan dokumen harga API Claude.

Panggilan API Claude Haiku 5.5 pertama Anda

Buat kunci di Claude Console (panduan kunci API Anthropic menjelaskan caranya) dan ekspor sebagai ANTHROPIC_API_KEY. Jangan pernah menempelkan kunci ke dalam kode. Kemudian kirim ini:

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 4096,
    "output_config": {"effort": "medium"},
    "thinking": {"type": "adaptive", "display": "summarized"},
    "messages": [{"role": "user", "content": "Classify this ticket as billing, bug, or feature request: The export button times out on large projects."}]
  }'

SDK Python mengambil ANTHROPIC_API_KEY dari lingkungan:

import anthropic

client = anthropic.Anthropic()
response = client.messages.create(
    model="claude-haiku-5-5",
    max_tokens=4096,
    output_config={"effort": "medium"},
    thinking={"type": "adaptive", "display": "summarized"},
    messages=[{"role": "user", "content": "Classify this ticket as billing, bug, or feature request: The export button times out on large projects."}],
)

for block in response.content:
    if block.type == "thinking":
        print("[thinking]", block.thinking)
    elif block.type == "text":
        print(block.text)
print(response.stop_reason, response.usage)

TypeScript mengikuti bentuk yang sama:

import Anthropic from "@anthropic-ai/sdk";

const client = new Anthropic();
const response = await client.messages.create({
  model: "claude-haiku-5-5",
  max_tokens: 4096,
  output_config: { effort: "medium" },
  thinking: { type: "adaptive", display: "summarized" },
  messages: [
    { role: "user", content: "Classify this ticket as billing, bug, or feature request: The export button times out on large projects." },
  ],
});

for (const block of response.content) {
  if (block.type === "text") console.log(block.text);
}
console.log(response.stop_reason, response.usage);

Tiga kebiasaan membuat kode ini berfungsi. Pilih blok konten berdasarkan type, karena respons dapat dimulai dengan blok thinking dan content[0].text akan rusak. Sisakan ruang di max_tokens, karena token pemikiran dihitung ke dalamnya. Dan jaga agar body permintaan tetap bersih: tanpa temperature, top_p, top_k, budget_tokens, atau assistant prefill. Masing-masing akan mengembalikan 400 pada model ini. Jika Anda memindahkan kode lama, panduan Haiku 5.5 vs Haiku 4.5 mencantumkan setiap perubahan yang merusak dengan JSON sebelum/sesudah.

Pilih tingkat upaya

Upaya, yang diatur dalam output_config.effort, adalah pengatur utama untuk kualitas, latensi, dan biaya. Panduan prompt memberikan titik awal ini:

Kurva biaya curam. Berikut adalah hasil uji OSWorld 2.1 (subset offline) milik Anthropic dari grafik peluncuran, dengan skor kredit parsial dan biaya per upaya:

UpayaSkorBiaya per upaya
low42.0%$0.0695
medium53.3%$0.1257
high61.3%$0.1827
xhigh67.6%$0.2792
max72.4%$0.6111

Pergi dari xhigh ke max lebih dari dua kali lipat biayanya untuk kurang dari lima poin. Rincian benchmark Haiku 5.5 memiliki grafik per upaya lainnya.

Satu keanehan: pada xhigh dalam obrolan multi-giliran, model terkadang menulis seluruh jawabannya dalam pemikirannya dan mengakhiri giliran tanpa teks yang terlihat. Periksa balasan kosong sebelum menunjukkannya kepada pengguna.

Kontrol pemikiran

Pemikiran adaptif aktif secara default, dan dua hal berubah dari Haiku 4.5. Pertama, tampilan default menyembunyikan teks. Setiap blok thinking kembali dengan bidang thinking kosong dan hanya signature. Atur "display": "summarized" (seperti pada panggilan pertama) saat Anda menginginkan ringkasan yang mudah dibaca di log atau UI. Untuk mendapatkan lebih sedikit pemikiran, turunkan upaya; meminta model untuk menjawab secara langsung tidak menghentikannya dalam pengujian Anthropic.

Kedua, Anda dapat mematikan pemikiran, tetapi hanya pada upaya high atau di bawahnya:

{
  "model": "claude-haiku-5-5",
  "max_tokens": 1024,
  "thinking": {"type": "disabled"},
  "output_config": {"effort": "low"},
  "messages": [{"role": "user", "content": "Extract the invoice number from: INV-2291, due Nov 3."}]
}

Body yang sama pada xhigh atau max mengembalikan 400. tool_choice yang dipaksakan (any atau alat bernama) diterima, tetapi respons dimulai dengan panggilan alat dan tidak membawa blok pemikiran.

Untuk loop multi-giliran dan agen, kirim kembali setiap blok pemikiran tanpa perubahan dan pertahankan riwayat hanya tambah. Mengubah system, tools, atau messages sebelumnya sebelum blok pemikiran yang dikembalikan dapat mengembalikan 400, dan blok pemikiran hanya berfungsi di akun yang membuatnya (atau yang terhubung dengannya).

Cache prompt dan pekerjaan batch

Caching adalah tempat Haiku 5.5 menjadi murah. Untuk prompt hingga 100K token, pembacaan cache berharga $0,01 per juta token dibandingkan $0,10 untuk input baru, penulisan cache 5 menit berharga $0,125 dan penulisan 1 jam $0,20. Prompt minimal yang dapat di-cache adalah 512 token, turun dari 4.096 pada Haiku 4.5, sehingga prompt sistem pendek dan daftar alat sekarang memenuhi syarat. Tandai awalan stabil dengan cache_control:

{
  "model": "claude-haiku-5-5",
  "max_tokens": 1024,
  "system": [{
    "type": "text",
    "text": "You are a support triage assistant. <long, stable policy text here>",
    "cache_control": {"type": "ephemeral"}
  }],
  "messages": [{"role": "user", "content": "Ticket: refund not received after 10 days."}]
}

Mengubah effort tingkat atas antar permintaan membatalkan cache; upaya per pesan (header beta mid-conversation-output-config-2026-07-01, Claude API dan Google Cloud) mempertahankannya. Dokumen caching prompt mencakup TTL, dan penjelasan caching prompt kami mencakup konsepnya.

Untuk pekerjaan yang dapat menunggu, API Message Batches memotong input dan output sebesar 50%: $0,05/$0,25 untuk prompt hingga 100K token dan $0,25/$1,25 di atas itu. Batch juga merupakan satu-satunya rute ke 300K token output, dengan header beta output-300k-2026-03-24.

Perhatikan batas 100K: "prompt di atas 100.000 token membayar harga yang lebih tinggi," dalam kata-kata Anthropic. Panduan harga Haiku 5.5 membahas contoh di kedua sisi.

Tangani stop_reason “refusal”

Haiku 5.5 menjalankan pengklasifikasi keamanan yang dapat menolak permintaan, dan tidak memiliki fallback sisi server. Permintaan yang ditolak akan kembali dengan stop_reason: "refusal", dan kategorinya adalah cyber, frontier_llm, bio, dan general_harms. Jika Anda beralih dari Haiku 4.5, penolakan ini baru. Mengirim permintaan yang sama lagi biasanya mengembalikan penolakan lain, jadi jangan coba lagi secara membabi buta:

def run(client, messages):
    response = client.messages.create(
        model="claude-haiku-5-5",
        max_tokens=4096,
        messages=messages,
    )
    if response.stop_reason == "refusal":
        details = getattr(response, "stop_details", None)
        category = getattr(details, "category", "unknown")
        log_refusal(category, messages)  # pencatatan Anda
        return {"status": "refused", "category": category}
    text = "".join(b.text for b in response.content if b.type == "text")
    return {"status": "ok", "text": text}

Cabangkan pada stop_reason sebelum Anda membaca content, dan rutekan penolakan ke seseorang atau model lain dalam kode Anda sendiri. Tim yang melakukan pekerjaan keamanan atau ilmu hayat yang sah yang diblokir oleh pengklasifikasi cyber atau bio dapat mengajukan permohonan ke Program Verifikasi Cyber atau Program Verifikasi Ilmu Hayat Anthropic.

Penggunaan komputer dan penggunaan browser

Pada Claude API dan Google Cloud, Haiku 5.5 mendukung penggunaan komputer hanya melalui toolset computer_toolset_20260801, yang tidak memerlukan header beta; mendeklarasikan computer_20250124 mengembalikan 400. Penggunaan browser melalui browser_toolset_20260801, yang tidak didukung Haiku 4.5. SDK Python dan TypeScript menambahkan kelas beta untuk keduanya pada hari peluncuran. Lihat dokumen alat penggunaan komputer untuk alat anggotanya.

Batas laju

Haiku 5.5 memiliki batas laju yang sama dengan Haiku 4.5: 1.000 permintaan, 2M token input, dan 400K token output per menit pada tingkat Start, hingga 10.000 permintaan, 10M input, dan 2M output pada Scale. Tingkat Prioritas tidak didukung. Untuk penanganan 429, lihat panduan batas laju terlampaui.

Uji API Claude Haiku 5.5 di Apidog

Permintaan yang disimpan membuat perbandingan upaya dan debugging penolakan dapat diulang. Berikut adalah pengaturannya di Apidog:

  1. Buat lingkungan dan tambahkan ANTHROPIC_API_KEY sebagai variabel rahasia. Referensikan sebagai {{ANTHROPIC_API_KEY}} di header x-api-key, di samping anthropic-version: 2023-06-01 dan content-type: application/json.
  2. Buat permintaan POST ke https://api.anthropic.com/v1/messages, tempel body panggilan pertama, dan simpan.
  3. Tambahkan penegasan: status adalah 200, $.stop_reason sama dengan end_turn, $.usage.output_tokens lebih besar dari 0, dan $.content[*].type berisi text. Penolakan atau balasan xhigh kosong sekarang akan menyebabkan pengujian gagal alih-alih lolos.
  4. Duplikasikan permintaan empat kali dengan low, high, xhigh, dan max, lalu jalankan foldernya. Anda akan mendapatkan usage untuk setiap tingkat upaya pada prompt Anda sendiri.
  5. Tambahkan varian prompt sistem yang di-cache dan tegaskan bahwa $.usage.cache_read_input_tokens lebih besar dari 0 pada eksekusi kedua.

Untuk pola yang lebih luas, lihat menguji aplikasi LLM.

FAQ

Apa ID model Claude Haiku 5.5? claude-haiku-5-5, tanpa akhiran tanggal dan tanpa alias terpisah, pada Claude API, Google Cloud, Microsoft Foundry, dan Claude Platform di AWS. Pada Amazon Bedrock adalah anthropic.claude-haiku-5-5.

Apakah ada API Claude Haiku 5.5 gratis? Tidak ada tingkatan gratis yang berkelanjutan, tetapi pengguna API baru mendapatkan sejumlah kecil kredit gratis untuk menguji API. Pengguna Claude.ai gratis dapat memilih Haiku 5.5 dalam obrolan, tetapi itu bukan kunci API. Paket Max dan Team sekarang menyertakan kredit API bulanan. Panduan akses gratis mencakup apa yang dihitung dan apa yang tidak.

Mengapa permintaan Haiku 4.5 saya mengembalikan 400? Periksa budget_tokens, temperature atau top_p yang tidak default, top_k apa pun, assistant prefill, atau alat computer_20250124 lama. Itu adalah penyebab yang biasa.

Bisakah saya menggunakan Haiku 5.5 di Claude Code? Ya, mulai v2.1.293. Pada Anthropic API alias haiku merujuk ke Haiku 5.5. Lihat Claude Haiku 5.5 di Claude Code.

Haruskah saya menggunakan Haiku 5.5 atau Sonnet 5.5 untuk pengkodean agentik? Anthropic mengatakan Sonnet 5.5 dan Opus 5.5 "tetap merupakan pilihan yang lebih baik untuk tugas pengkodean agentik yang kompleks." Gunakan Haiku 5.5 untuk pekerjaan dengan ruang lingkup sempit: klasifikasi, ringkasan, pemadatan, sub-agen, dan penggunaan browser.

Langkah berikutnya

Kirim permintaan panggilan pertama pada `medium`, lalu jalankan kembali pada `low` dan `high` pada prompt dari beban kerja Anda sendiri dan bandingkan `usage.output_tokens` serta kualitas jawaban. Unduh Apidog untuk menyimpan ketiga eksekusi dengan penegasan, sehingga rilis model berikutnya hanya membutuhkan perubahan satu bidang.

tombol

Mengembangkan API dengan Apidog

Apidog adalah alat pengembangan API yang membantu Anda mengembangkan API dengan lebih mudah dan efisien.