Cara Menggunakan Claude Sonnet 5.5 API: Pemanggilan Pertama, Upaya, Pemikiran, Alat, dan Streaming

Panduan API Claude Sonnet 5.5: panggilan pertama dengan claude-sonnet-5-5 di curl, Python, dan TypeScript, ditambah usaha, between_tools, strict tools, dan streaming.

Ashley Innocent

Ashley Innocent

29 September 2026

Cara Menggunakan Claude Sonnet 5.5 API: Pemanggilan Pertama, Upaya, Pemikiran, Alat, dan Streaming

Apidog untuk Perusahaan

Penerapan On-Premises

SSO & RBAC

Sesuai SOC 2

Jelajahi Apidog Enterprise

Untuk menggunakan API Claude Sonnet 5.5, kirimkan permintaan POST ke https://api.anthropic.com/v1/messages dengan "model": "claude-sonnet-5-5", kunci Anda di header x-api-key, dan anthropic-version: 2023-06-01. Biayanya $2 per juta token input dan $10 per juta token output, membaca hingga 1 juta token konteks, menulis hingga 128K, menjalankan pemikiran adaptif secara default, dan standar ke upaya high.

Anthropic merilis Sonnet 5.5 pada 28 September 2026 (apa itu Claude Sonnet 5.5 membahas spesifikasi dan tolok ukur). Panduan ini memandu Anda melalui panggilan pertama di curl, Python, dan TypeScript, lalu upaya, pemikiran, alat, streaming, penolakan, dan batasan tingkat. Memindahkan kode Sonnet 5? Panduan Sonnet 5.5 vs Sonnet 5 memiliki setiap perubahan yang merusak dengan JSON sebelum/sesudah. Anda dapat mengirim setiap permintaan di bawah ini dari Apidog dan menyimpannya sebagai uji coba tersimpan dengan pernyataan.

tombol

API Claude Sonnet 5.5 sekilas

Parameter Perilaku Sonnet 5.5
ID Model claude-sonnet-5-5 (Bedrock: anthropic.claude-sonnet-5-5)
Harga per MTok $2 input, $10 output, $0.20 pembacaan cache; Batch $1/$5
Konteks / keluaran 1M / 128K; 300K pada Batch dengan beta output-300k-2026-03-24
output_config.effort low, medium, high (default), xhigh, max
thinking.type adaptive (default jika dihilangkan) atau between_tools; disabled mengembalikan 400
thinking.display omitted (default), summarized, updates (beta)
tool_choice auto atau none; any dan tool mengembalikan 400
temperature, top_p, top_k Nilai non-default mengembalikan 400
Prompt minimal yang bisa di-cache 512 token (1.024 pada Sonnet 5)
max_tokens untuk pengkodean agentik 128.000, dengan streaming

Sumber: halaman model Sonnet 5.5 dan panduan migrasi.

Contoh API Claude Sonnet 5.5: panggilan pertama Anda

Buat kunci (panduan kunci API Anthropic akan menjelaskannya) dan ekspor sebagai ANTHROPIC_API_KEY daripada melakukan hardcode. Kemudian kirimkan ini:

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-sonnet-5-5",
    "max_tokens": 4096,
    "output_config": {"effort": "medium"},
    "messages": [{"role": "user", "content": "Explain idempotency keys in two sentences."}]
  }'

SDK Python membaca ANTHROPIC_API_KEY dari lingkungan:

import anthropic

client = anthropic.Anthropic()
response = client.messages.create(
    model="claude-sonnet-5-5",
    max_tokens=4096,
    output_config={"effort": "medium"},
    messages=[{"role": "user", "content": "Explain idempotency keys in two sentences."}],
)
print(response.stop_reason)
for block in response.content:
    if block.type == "text":
        print(block.text)

TypeScript bekerja dengan cara yang sama:

import Anthropic from "@anthropic-ai/sdk";

const client = new Anthropic();
const response = await client.messages.create({
  model: "claude-sonnet-5-5",
  max_tokens: 4096,
  output_config: { effort: "medium" },
  messages: [{ role: "user", content: "Explain idempotency keys in two sentences." }],
});
for (const block of response.content) {
  if (block.type === "text") console.log(block.text);
}

Baca blok konten berdasarkan type. Pemikiran aktif secara default, jadi respons dapat dimulai dengan blok thinking, dan kode yang membaca content[0].text akan error. Token pemikiran ditagih sebagai keluaran dan dihitung ke max_tokens bahkan ketika teksnya tersembunyi, jadi sisakan ruang di atas balasan yang Anda harapkan.

Pilih tingkat upaya

Upaya, yang diatur dalam output_config.effort, adalah pengatur utama biaya dan kualitas Anda. Anthropic mengkalibrasi ulang level untuk Sonnet 5.5, jadi pengaturan Sonnet 5 tidak berlaku; lakukan evaluasi ulang pada evaluasi Anda sendiri. Panduan prompting menyarankan titik awal ini:

Beban Kerja Mulai di
Pekerjaan Umum high (default API)
Pengkodean agentik, tugas yang terdefinisi dengan baik medium, beralih ke high untuk yang lebih sulit atau lebih panjang
Panggilan obrolan dan yang sensitif terhadap latensi medium atau low
Tugas sulit di mana evaluasi Anda menunjukkan peningkatan terukur xhigh atau max

Rentangannya luas. Pada uji coba Terminal-Bench 4.0 milik Anthropic, Sonnet 5.5 mencetak 43.0% pada high dengan biaya $1.94 per percobaan dan 70.6% pada max dengan biaya $12.54. Perincian harga Sonnet 5.5 membahas biaya per permintaan.

Rencanakan tiga perilaku. Dari medium ke atas, model berpikir sebelum hampir setiap balasan, bahkan sapaan, dan memintanya untuk berpikir lebih sedikit tidak dapat diandalkan: turunkan upaya saja. Pada low dan medium, cenderung memeriksa lebih awal pada tugas agentik yang panjang. Dan mengubah tingkat upaya tertinggi antar permintaan membatalkan cache prompt. Untuk beralih level di tengah percakapan dan menjaga cache, gunakan upaya per pesan (beta, header anthropic-beta: mid-conversation-output-config-2026-07-01): tambahkan pesan role: "system" dengan content kosong dan output_config.effort yang baru.

Kontrol pemikiran: adaptif atau between_tools

Hilangkan bidang thinking dan Sonnet 5.5 menjalankan pemikiran adaptif. Ini menolak {"type": "disabled"} dengan kode 400. Untuk mematikan pemikiran di awal, kirim between_tools, pengaturan terendah:

{
  "model": "claude-sonnet-5-5",
  "max_tokens": 16000,
  "thinking": {"type": "between_tools"},
  "output_config": {"effort": "high"},
  "messages": [{"role": "user", "content": "..."}]
}

Aturan untuk between_tools Sonnet 5.5:

Di bawah pemikiran adaptif, display menentukan apa yang terkandung dalam blok thinking. Defaultnya, omitted, mengembalikan setiap blok thinking dengan bidang thinking kosong plus sebuah signature. summarized mengembalikan ringkasan yang mudah dibaca. updates (beta, header thinking-display-updates-2026-08-18) hanya mengembalikan pembaruan progres sebagai teks.

Pembaruan progres adalah perubahan yang paling mungkin membingungkan UI. Sonnet 5.5 menempatkan catatan yang lebih panjang dari satu atau dua kalimat, yang ditulis di antara panggilan alat, ke dalam blok thinking mereka sendiri daripada teks. Di bawah omitted default, blok-blok tersebut kosong, sehingga antarmuka agen yang dulu menceritakan langkah-langkahnya menjadi hening. Atur display: "updates" atau "summarized", atau jalankan between_tools, yang mengembalikan catatan dengan teks. Render setiap blok thinking yang tidak kosong sebelum blok tool_use yang mengikutinya. Meminta penalaran dalam teks balasan dapat mengundang penolakan reasoning_extraction, jadi baca blok-blok ini sebagai gantinya.

Gunakan alat tanpa tool_choice paksa

Penggunaan alat paksa sudah tidak ada. Sebuah tool_choice berupa {"type": "any"} atau {"type": "tool", ...} mengembalikan kode 400 dengan pesan ini, juga pada endpoint penghitung token:

tool_choice: type "tool" and "any" are not supported for this model.

Kirim auto, tandai alat strict: true agar inputnya cocok dengan skema, dan beritahu model dalam prompt kapan harus memanggilnya:

{
  "model": "claude-sonnet-5-5",
  "max_tokens": 1024,
  "tools": [{
    "name": "get_weather",
    "description": "Get the current weather for a city",
    "input_schema": {
      "type": "object",
      "properties": {"location": {"type": "string"}},
      "required": ["location"],
      "additionalProperties": false
    },
    "strict": true
  }],
  "tool_choice": {"type": "auto"},
  "messages": [{"role": "user", "content": "What's the weather in Paris? Use the get_weather tool."}]
}

Sebuah permintaan dapat membawa paling banyak 20 alat ketat, dan skema ketat memerlukan additionalProperties: false pada setiap objek. Di Amazon Bedrock, alat ketat tidak tersedia untuk Sonnet 5.5: kirim auto tanpa strict dan validasi input di kode Anda.

Dua detail loop penting. Lewati setiap blok thinking kembali tanpa perubahan dengan blok tool_use-nya, termasuk yang kosong. Dan perkirakan sesekali ada kesalahan penulisan, seperti bash untuk alat yang dideklarasikan sebagai Bash. Panduan prompting menyarankan untuk menerima kecocokan yang tidak ambigu, atau mengembalikan tool_result dengan is_error: true yang menyatakan nama persisnya.

Streaming respons

Tambahkan "stream": true ke dalam body, atau gunakan pembantu stream SDK. Untuk pengkodean agentik, panduan prompting merekomendasikan max_tokens 128.000 dengan streaming:

with client.messages.stream(
    model="claude-sonnet-5-5",
    max_tokens=128000,
    output_config={"effort": "medium"},
    messages=[{"role": "user", "content": "Review this diff for bugs: ..."}],
) as stream:
    for event in stream:
        if event.type == "content_block_delta" and event.delta.type == "text_delta":
            print(event.delta.text, end="", flush=True)
    final = stream.get_final_message()

Peristiwa yang dikirim server tiba sebagai message_start, lalu content_block_start, content_block_delta dan content_block_stop untuk setiap blok, lalu message_delta (membawa stop_reason) dan message_stop. Di bawah omitted, blok thinking mengalirkan satu thinking_delta kosong dan signature_delta, lalu teks dimulai. Perkirakan jeda beberapa detik sebelum blok pembaruan progres terbuka.

stream.get_final_message() (TypeScript: stream.finalMessage()) membangun kembali blok lengkap dengan tanda tangannya. Tambahkan konten tersebut ke riwayat sebagai giliran asisten, tanpa perubahan, dan jaga agar riwayat hanya dapat ditambahkan. Sonnet 5.5 menandatangani setiap blok thinking di atas percakapan sebelumnya, jadi pada akun yang dibuat pada atau setelah 31 Agustus 2026 (00:00 UTC), memutar ulang blok setelah mengedit riwayat sebelumnya mengembalikan kode 400. Blok juga terikat pada akun yang menghasilkannya.

Tangani penolakan dan fallback

Penolakan bukanlah kesalahan. Anda mendapatkan HTTP 200 dengan stop_reason: "refusal" dan objek stop_details yang category-nya adalah cyber, bio, frontier_llm, reasoning_extraction atau general_harms, ditambah explanation. Tampilkan penjelasan daripada mem-parsing-nya; susunan katanya tidak stabil. Buat cabang berdasarkan stop_reason sebelum Anda membaca content.

Fallback sisi server adalah opt-in. Tambahkan "fallbacks": "default" dan header anthropic-beta: server-side-fallback-2026-07-01 (beta, hanya API Claude), dan API mencoba ulang penolakan cyber dan frontier_llm pada Sonnet 5. Tiga kategori lainnya tidak dicoba ulang. Bidang model dari respons menamai model yang menyajikannya, dan blok konten fallback menandai serah terima.

Batasan tingkat

Sonnet 5.5 memiliki batasan tingkat sendiri, terpisah dari Sonnet 5. Halaman batasan tingkat mencantumkan empat tingkatan:

Tingkat Permintaan/menit Token input/menit Token output/menit
Mulai 1.000 2.000.000 400.000
Bangun 5.000 5.000.000 1.000.000
Skala 10.000 10.000.000 2.000.000
Kustom Hubungi penjualan Hubungi penjualan Hubungi penjualan

Untuk penanganan 429 dan backoff, lihat panduan batasan tingkat terlampaui.

Uji API Claude Sonnet 5.5 di Apidog

Permintaan yang disimpan membuat perbandingan upaya dan debug streaming dapat diulang. Berikut adalah penyiapan di Apidog:

  1. Buat lingkungan dan tambahkan ANTHROPIC_API_KEY sebagai variabel. Referensikan sebagai {{ANTHROPIC_API_KEY}} di header x-api-key, di samping anthropic-version dan content-type.
  2. Buat permintaan POST ke https://api.anthropic.com/v1/messages, tempelkan body panggilan pertama, dan simpan.
  3. Tambahkan pernyataan: status adalah 200, $.stop_reason sama dengan end_turn, $.usage.output_tokens lebih besar dari 0, dan $.content[*].type berisi text. Penolakan sekarang akan membuat tes gagal alih-alih lulus secara diam-diam.
  4. Duplikat permintaan dengan "stream": true. Apidog menampilkan respons text/event-stream secara bertahap, sehingga Anda dapat melihat thinking_delta yang kosong, signature_delta, dan teks tiba secara berurutan.
  5. Duplikat lagi dengan "model": "claude-sonnet-5" dan simpan pasangan ini dalam satu folder: prompt yang sama, dua model, usage berdampingan.

Untuk pola yang lebih luas, lihat pengujian aplikasi LLM dan pengujian API agen AI.

FAQ

Apa ID model Claude Sonnet 5.5? claude-sonnet-5-5, tanpa akhiran tanggal, di Claude API, Google Cloud, Microsoft Foundry, dan Claude Platform di AWS. Di Amazon Bedrock, itu adalah anthropic.claude-sonnet-5-5.

Bisakah saya mematikan pemikiran sepenuhnya? Tidak. disabled mengembalikan 400. between_tools adalah pengaturan terendah: tidak ada pemikiran di awal, pada upaya low, medium atau high.

Mengapa permintaan Sonnet 5 saya mengembalikan 400 pada Sonnet 5.5? Periksa thinking.type: "disabled" dan tool_choice paksa terlebih dahulu. Panduan Sonnet 5.5 vs Sonnet 5 mencakup kelima perubahan yang merusak dan perbaikannya.

Apakah ada API Claude Sonnet 5.5 gratis? API Anthropic adalah prabayar, dan tidak ada halaman resmi yang mencantumkan kredit pendaftaran gratis. Paket obrolan Claude juga tidak termasuk akses API. Panduan API gratis mencakup program kredit dan jalur berbayar termurah.

Langkah berikutnya

Kirim permintaan panggilan pertama pada medium, lalu jalankan ulang pada high dan bandingkan usage.output_tokens serta kualitas jawaban pada prompt dari beban kerja Anda sendiri. Unduh Apidog untuk menyimpan kedua jalankan dengan pernyataan. Jika Anda lebih suka bekerja dari terminal, lihat Claude Sonnet 5.5 di Kode Claude.

Mengembangkan API dengan Apidog

Apidog adalah alat pengembangan API yang membantu Anda mengembangkan API dengan lebih mudah dan efisien.