Untuk menggunakan API Claude Sonnet 5.5, kirimkan permintaan POST ke https://api.anthropic.com/v1/messages dengan "model": "claude-sonnet-5-5", kunci Anda di header x-api-key, dan anthropic-version: 2023-06-01. Biayanya $2 per juta token input dan $10 per juta token output, membaca hingga 1 juta token konteks, menulis hingga 128K, menjalankan pemikiran adaptif secara default, dan standar ke upaya high.
Anthropic merilis Sonnet 5.5 pada 28 September 2026 (apa itu Claude Sonnet 5.5 membahas spesifikasi dan tolok ukur). Panduan ini memandu Anda melalui panggilan pertama di curl, Python, dan TypeScript, lalu upaya, pemikiran, alat, streaming, penolakan, dan batasan tingkat. Memindahkan kode Sonnet 5? Panduan Sonnet 5.5 vs Sonnet 5 memiliki setiap perubahan yang merusak dengan JSON sebelum/sesudah. Anda dapat mengirim setiap permintaan di bawah ini dari Apidog dan menyimpannya sebagai uji coba tersimpan dengan pernyataan.
API Claude Sonnet 5.5 sekilas
| Parameter | Perilaku Sonnet 5.5 |
|---|---|
| ID Model | claude-sonnet-5-5 (Bedrock: anthropic.claude-sonnet-5-5) |
| Harga per MTok | $2 input, $10 output, $0.20 pembacaan cache; Batch $1/$5 |
| Konteks / keluaran | 1M / 128K; 300K pada Batch dengan beta output-300k-2026-03-24 |
output_config.effort |
low, medium, high (default), xhigh, max |
thinking.type |
adaptive (default jika dihilangkan) atau between_tools; disabled mengembalikan 400 |
thinking.display |
omitted (default), summarized, updates (beta) |
tool_choice |
auto atau none; any dan tool mengembalikan 400 |
temperature, top_p, top_k |
Nilai non-default mengembalikan 400 |
| Prompt minimal yang bisa di-cache | 512 token (1.024 pada Sonnet 5) |
max_tokens untuk pengkodean agentik |
128.000, dengan streaming |
Sumber: halaman model Sonnet 5.5 dan panduan migrasi.
Contoh API Claude Sonnet 5.5: panggilan pertama Anda
Buat kunci (panduan kunci API Anthropic akan menjelaskannya) dan ekspor sebagai ANTHROPIC_API_KEY daripada melakukan hardcode. Kemudian kirimkan ini:
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-5-5",
"max_tokens": 4096,
"output_config": {"effort": "medium"},
"messages": [{"role": "user", "content": "Explain idempotency keys in two sentences."}]
}'
SDK Python membaca ANTHROPIC_API_KEY dari lingkungan:
import anthropic
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-sonnet-5-5",
max_tokens=4096,
output_config={"effort": "medium"},
messages=[{"role": "user", "content": "Explain idempotency keys in two sentences."}],
)
print(response.stop_reason)
for block in response.content:
if block.type == "text":
print(block.text)
TypeScript bekerja dengan cara yang sama:
import Anthropic from "@anthropic-ai/sdk";
const client = new Anthropic();
const response = await client.messages.create({
model: "claude-sonnet-5-5",
max_tokens: 4096,
output_config: { effort: "medium" },
messages: [{ role: "user", content: "Explain idempotency keys in two sentences." }],
});
for (const block of response.content) {
if (block.type === "text") console.log(block.text);
}
Baca blok konten berdasarkan type. Pemikiran aktif secara default, jadi respons dapat dimulai dengan blok thinking, dan kode yang membaca content[0].text akan error. Token pemikiran ditagih sebagai keluaran dan dihitung ke max_tokens bahkan ketika teksnya tersembunyi, jadi sisakan ruang di atas balasan yang Anda harapkan.
Pilih tingkat upaya
Upaya, yang diatur dalam output_config.effort, adalah pengatur utama biaya dan kualitas Anda. Anthropic mengkalibrasi ulang level untuk Sonnet 5.5, jadi pengaturan Sonnet 5 tidak berlaku; lakukan evaluasi ulang pada evaluasi Anda sendiri. Panduan prompting menyarankan titik awal ini:
| Beban Kerja | Mulai di |
|---|---|
| Pekerjaan Umum | high (default API) |
| Pengkodean agentik, tugas yang terdefinisi dengan baik | medium, beralih ke high untuk yang lebih sulit atau lebih panjang |
| Panggilan obrolan dan yang sensitif terhadap latensi | medium atau low |
| Tugas sulit di mana evaluasi Anda menunjukkan peningkatan terukur | xhigh atau max |
Rentangannya luas. Pada uji coba Terminal-Bench 4.0 milik Anthropic, Sonnet 5.5 mencetak 43.0% pada high dengan biaya $1.94 per percobaan dan 70.6% pada max dengan biaya $12.54. Perincian harga Sonnet 5.5 membahas biaya per permintaan.
Rencanakan tiga perilaku. Dari medium ke atas, model berpikir sebelum hampir setiap balasan, bahkan sapaan, dan memintanya untuk berpikir lebih sedikit tidak dapat diandalkan: turunkan upaya saja. Pada low dan medium, cenderung memeriksa lebih awal pada tugas agentik yang panjang. Dan mengubah tingkat upaya tertinggi antar permintaan membatalkan cache prompt. Untuk beralih level di tengah percakapan dan menjaga cache, gunakan upaya per pesan (beta, header anthropic-beta: mid-conversation-output-config-2026-07-01): tambahkan pesan role: "system" dengan content kosong dan output_config.effort yang baru.
Kontrol pemikiran: adaptif atau between_tools
Hilangkan bidang thinking dan Sonnet 5.5 menjalankan pemikiran adaptif. Ini menolak {"type": "disabled"} dengan kode 400. Untuk mematikan pemikiran di awal, kirim between_tools, pengaturan terendah:
{
"model": "claude-sonnet-5-5",
"max_tokens": 16000,
"thinking": {"type": "between_tools"},
"output_config": {"effort": "high"},
"messages": [{"role": "user", "content": "..."}]
}
Aturan untuk between_tools Sonnet 5.5:
- Ini hanya berfungsi pada
low,mediumatauhigh. Padaxhighataumaxini mengembalikan kode 400. - Ini tidak memerlukan bidang lain. Menambahkan
display,budget_tokensataublock_bindingmengembalikan kode 400. - Ini tidak memerlukan header beta dan berfungsi di setiap platform.
- Upaya tidak dapat berubah di tengah percakapan saat diatur.
- Versi SDK yang tidak mendefinisikannya akan gagal pemeriksaan tipe, jadi perbarui SDK Anda.
Di bawah pemikiran adaptif, display menentukan apa yang terkandung dalam blok thinking. Defaultnya, omitted, mengembalikan setiap blok thinking dengan bidang thinking kosong plus sebuah signature. summarized mengembalikan ringkasan yang mudah dibaca. updates (beta, header thinking-display-updates-2026-08-18) hanya mengembalikan pembaruan progres sebagai teks.
Pembaruan progres adalah perubahan yang paling mungkin membingungkan UI. Sonnet 5.5 menempatkan catatan yang lebih panjang dari satu atau dua kalimat, yang ditulis di antara panggilan alat, ke dalam blok thinking mereka sendiri daripada teks. Di bawah omitted default, blok-blok tersebut kosong, sehingga antarmuka agen yang dulu menceritakan langkah-langkahnya menjadi hening. Atur display: "updates" atau "summarized", atau jalankan between_tools, yang mengembalikan catatan dengan teks. Render setiap blok thinking yang tidak kosong sebelum blok tool_use yang mengikutinya. Meminta penalaran dalam teks balasan dapat mengundang penolakan reasoning_extraction, jadi baca blok-blok ini sebagai gantinya.
Gunakan alat tanpa tool_choice paksa
Penggunaan alat paksa sudah tidak ada. Sebuah tool_choice berupa {"type": "any"} atau {"type": "tool", ...} mengembalikan kode 400 dengan pesan ini, juga pada endpoint penghitung token:
tool_choice: type "tool" and "any" are not supported for this model.
Kirim auto, tandai alat strict: true agar inputnya cocok dengan skema, dan beritahu model dalam prompt kapan harus memanggilnya:
{
"model": "claude-sonnet-5-5",
"max_tokens": 1024,
"tools": [{
"name": "get_weather",
"description": "Get the current weather for a city",
"input_schema": {
"type": "object",
"properties": {"location": {"type": "string"}},
"required": ["location"],
"additionalProperties": false
},
"strict": true
}],
"tool_choice": {"type": "auto"},
"messages": [{"role": "user", "content": "What's the weather in Paris? Use the get_weather tool."}]
}
Sebuah permintaan dapat membawa paling banyak 20 alat ketat, dan skema ketat memerlukan additionalProperties: false pada setiap objek. Di Amazon Bedrock, alat ketat tidak tersedia untuk Sonnet 5.5: kirim auto tanpa strict dan validasi input di kode Anda.
Dua detail loop penting. Lewati setiap blok thinking kembali tanpa perubahan dengan blok tool_use-nya, termasuk yang kosong. Dan perkirakan sesekali ada kesalahan penulisan, seperti bash untuk alat yang dideklarasikan sebagai Bash. Panduan prompting menyarankan untuk menerima kecocokan yang tidak ambigu, atau mengembalikan tool_result dengan is_error: true yang menyatakan nama persisnya.
Streaming respons
Tambahkan "stream": true ke dalam body, atau gunakan pembantu stream SDK. Untuk pengkodean agentik, panduan prompting merekomendasikan max_tokens 128.000 dengan streaming:
with client.messages.stream(
model="claude-sonnet-5-5",
max_tokens=128000,
output_config={"effort": "medium"},
messages=[{"role": "user", "content": "Review this diff for bugs: ..."}],
) as stream:
for event in stream:
if event.type == "content_block_delta" and event.delta.type == "text_delta":
print(event.delta.text, end="", flush=True)
final = stream.get_final_message()
Peristiwa yang dikirim server tiba sebagai message_start, lalu content_block_start, content_block_delta dan content_block_stop untuk setiap blok, lalu message_delta (membawa stop_reason) dan message_stop. Di bawah omitted, blok thinking mengalirkan satu thinking_delta kosong dan signature_delta, lalu teks dimulai. Perkirakan jeda beberapa detik sebelum blok pembaruan progres terbuka.
stream.get_final_message() (TypeScript: stream.finalMessage()) membangun kembali blok lengkap dengan tanda tangannya. Tambahkan konten tersebut ke riwayat sebagai giliran asisten, tanpa perubahan, dan jaga agar riwayat hanya dapat ditambahkan. Sonnet 5.5 menandatangani setiap blok thinking di atas percakapan sebelumnya, jadi pada akun yang dibuat pada atau setelah 31 Agustus 2026 (00:00 UTC), memutar ulang blok setelah mengedit riwayat sebelumnya mengembalikan kode 400. Blok juga terikat pada akun yang menghasilkannya.
Tangani penolakan dan fallback
Penolakan bukanlah kesalahan. Anda mendapatkan HTTP 200 dengan stop_reason: "refusal" dan objek stop_details yang category-nya adalah cyber, bio, frontier_llm, reasoning_extraction atau general_harms, ditambah explanation. Tampilkan penjelasan daripada mem-parsing-nya; susunan katanya tidak stabil. Buat cabang berdasarkan stop_reason sebelum Anda membaca content.
Fallback sisi server adalah opt-in. Tambahkan "fallbacks": "default" dan header anthropic-beta: server-side-fallback-2026-07-01 (beta, hanya API Claude), dan API mencoba ulang penolakan cyber dan frontier_llm pada Sonnet 5. Tiga kategori lainnya tidak dicoba ulang. Bidang model dari respons menamai model yang menyajikannya, dan blok konten fallback menandai serah terima.
Batasan tingkat
Sonnet 5.5 memiliki batasan tingkat sendiri, terpisah dari Sonnet 5. Halaman batasan tingkat mencantumkan empat tingkatan:
| Tingkat | Permintaan/menit | Token input/menit | Token output/menit |
|---|---|---|---|
| Mulai | 1.000 | 2.000.000 | 400.000 |
| Bangun | 5.000 | 5.000.000 | 1.000.000 |
| Skala | 10.000 | 10.000.000 | 2.000.000 |
| Kustom | Hubungi penjualan | Hubungi penjualan | Hubungi penjualan |
Untuk penanganan 429 dan backoff, lihat panduan batasan tingkat terlampaui.
Uji API Claude Sonnet 5.5 di Apidog
Permintaan yang disimpan membuat perbandingan upaya dan debug streaming dapat diulang. Berikut adalah penyiapan di Apidog:

- Buat lingkungan dan tambahkan
ANTHROPIC_API_KEYsebagai variabel. Referensikan sebagai{{ANTHROPIC_API_KEY}}di headerx-api-key, di sampinganthropic-versiondancontent-type. - Buat permintaan POST ke
https://api.anthropic.com/v1/messages, tempelkan body panggilan pertama, dan simpan. - Tambahkan pernyataan: status adalah 200,
$.stop_reasonsama denganend_turn,$.usage.output_tokenslebih besar dari 0, dan$.content[*].typeberisitext. Penolakan sekarang akan membuat tes gagal alih-alih lulus secara diam-diam. - Duplikat permintaan dengan
"stream": true. Apidog menampilkan responstext/event-streamsecara bertahap, sehingga Anda dapat melihatthinking_deltayang kosong,signature_delta, dan teks tiba secara berurutan. - Duplikat lagi dengan
"model": "claude-sonnet-5"dan simpan pasangan ini dalam satu folder: prompt yang sama, dua model,usageberdampingan.
Untuk pola yang lebih luas, lihat pengujian aplikasi LLM dan pengujian API agen AI.
FAQ
Apa ID model Claude Sonnet 5.5? claude-sonnet-5-5, tanpa akhiran tanggal, di Claude API, Google Cloud, Microsoft Foundry, dan Claude Platform di AWS. Di Amazon Bedrock, itu adalah anthropic.claude-sonnet-5-5.
Bisakah saya mematikan pemikiran sepenuhnya? Tidak. disabled mengembalikan 400. between_tools adalah pengaturan terendah: tidak ada pemikiran di awal, pada upaya low, medium atau high.
Mengapa permintaan Sonnet 5 saya mengembalikan 400 pada Sonnet 5.5? Periksa thinking.type: "disabled" dan tool_choice paksa terlebih dahulu. Panduan Sonnet 5.5 vs Sonnet 5 mencakup kelima perubahan yang merusak dan perbaikannya.
Apakah ada API Claude Sonnet 5.5 gratis? API Anthropic adalah prabayar, dan tidak ada halaman resmi yang mencantumkan kredit pendaftaran gratis. Paket obrolan Claude juga tidak termasuk akses API. Panduan API gratis mencakup program kredit dan jalur berbayar termurah.
Langkah berikutnya
Kirim permintaan panggilan pertama pada medium, lalu jalankan ulang pada high dan bandingkan usage.output_tokens serta kualitas jawaban pada prompt dari beban kerja Anda sendiri. Unduh Apidog untuk menyimpan kedua jalankan dengan pernyataan. Jika Anda lebih suka bekerja dari terminal, lihat Claude Sonnet 5.5 di Kode Claude.
