Anthropic merilis Claude Sonnet 5 pada 30 Juni 2026, dan ini mengubah perhitungan dalam pemilihan model. Untuk tugas-tugas agensi dan penggunaan alat, Sonnet 5 memiliki kinerja yang hanya terpaut beberapa poin dari Opus 4.8 dengan biaya per token yang jauh lebih rendah. Jeda tersebut, perbedaan kualitas kecil dibandingkan dengan perbedaan harga yang besar, adalah keseluruhan keputusan. Panduan ini memberi Anda tabel perbandingan, angka benchmark yang dilaporkan, dan daftar periksa keputusan sehingga Anda dapat memilih model yang tepat untuk setiap beban kerja daripada menggunakan model termahal secara default. Kedua model mengekspos bentuk API HTTP yang sama, sehingga Anda dapat mengujinya dengan prompt Anda sendiri sebelum berkomitmen. Apidog adalah tempat yang baik untuk menyimpan permintaan tersebut, menukar ID model, dan membandingkan respons secara berdampingan.
Jawaban singkat
Pilih Sonnet 5 saat Anda membangun agen, menjalankan loop alat, atau menangani volume tinggi di mana biaya menjadi pertimbangan. Ini adalah model Sonnet yang paling agensi sejauh ini, dan kinerjanya sangat mendekati Opus 4.8 dalam tugas-tugas yang sebenarnya dilakukan agen.

Pilih Opus 4.8 ketika Anda membutuhkan penalaran tersulit, otonomi cakrawala terpanjang, atau kualitas tertinggi mutlak dan anggaran mendukungnya. Opus masih unggul ketika model tidak memiliki dukungan eksternal dan harus bernalar dari awal.
Untuk sebagian besar lalu lintas produksi, Sonnet 5 adalah pilihan default yang masuk akal dan Opus 4.8 adalah jalur eskalasi untuk sebagian kecil permintaan yang membutuhkannya.
Perbandingan berdampingan
Berikut adalah bagaimana kedua model sejajar dalam spesifikasi dan harga yang mendorong keputusan.
| Atribut | Claude Sonnet 5 | Claude Opus 4.8 |
|---|---|---|
| ID Model | claude-sonnet-5 |
claude-opus-4-8 |
| Jendela konteks | 1.000.000 token | 1.000.000 token |
| Output maks | 128.000 token | 128.000 token |
| Harga input (standar) | $3 / juta token | $5 / juta token |
| Harga output (standar) | $15 / juta token | $25 / juta token |
| Harga input pengantar | $2 / juta (hingga 31 Agustus 2026) | standar |
| Harga output pengantar | $10 / juta (hingga 31 Agustus 2026) | standar |
| Pemikiran adaptif | Aktif secara default | Didukung |
| Parameter upaya | low / medium / high / xhigh | Didukung |
| Penempatan | Sonnet paling agensi, kecepatan + kecerdasan terbaik | Penalaran terbaik, kualitas maksimal |
Jendela konteks dan output maksimum identik, jadi tidak ada model yang unggul dalam kapasitas mentah. Perbedaan sebenarnya adalah harga dan di mana setiap model paling kuat.
Dalam hal harga, Sonnet 5 mengungguli Opus 4.8 dengan selisih yang lebar. Dengan tarif standar, input Sonnet 5 adalah 60% dari Opus 4.8 ($3 vs $5) dan outputnya adalah 60% dari Opus 4.8 ($15 vs $25). Selama periode perkenalan hingga 31 Agustus 2026, Sonnet 5 bahkan lebih murah dengan $2 / $10, yang menjadikannya sekitar 40% dari harga input Opus 4.8 dan 40% dari harga outputnya. Untuk model biaya penuh, lihat rincian harga Claude Sonnet 5 dan panduan harga Opus 4.8.
Satu hal yang perlu diperhatikan: Sonnet 5 menggunakan tokenizer baru yang menghasilkan sekitar 30% lebih banyak token untuk teks input yang sama. Tarif per token lebih rendah dari Opus, tetapi jumlah token untuk teks yang setara lebih tinggi, jadi modelkan beban kerja riil Anda dengan penghitungan token daripada berasumsi penghematan persentase tetap.
Apa yang dikatakan benchmark
Angka-angka di bawah ini dilaporkan saat peluncuran. Angka-angka ini berasal dari benchmark peluncuran Anthropic dan dikuatkan di berbagai tulisan hari peluncuran. Perlakukan sebagai angka yang dilaporkan, bukan pengujian independen.
| Benchmark | Sonnet 5 | Opus 4.8 | Selisih |
|---|---|---|---|
| SWE-bench Pro (pengkodean agensi) | 63.2% | 69.2% | 6.0 pts |
| Terminal-Bench 2.1 | 80.4% | 82.7% | 2.3 pts |
| OSWorld-Verified (penggunaan komputer) | 81.2% | 83.4% | 2.2 pts |
Polanya konsisten. Ketika alat berada dalam loop, pekerjaan terminal dan penggunaan komputer, Sonnet 5 memiliki kinerja yang hanya terpaut sekitar 1 hingga 3 poin dari Opus 4.8. Pada SWE-bench Pro, yang lebih mengandalkan penalaran berkelanjutan dalam tugas pengkodean, selisihnya melebar menjadi sekitar 6 poin.
Itulah inti wawasan bagi pembeli. Berikan model alat, terminal, browser, API untuk dipanggil, dan Sonnet 5 berkinerja mendekati Opus. Singkirkan alat dan paksakan penalaran murni, dan Opus memperoleh nilai premiumnya. Anthropic menjelaskan Sonnet 5 lebih kuat dalam tugas agensi dan alat daripada penalaran murni, dan benchmark sesuai dengan itu.
Untuk tinjauan mendalam benchmark lengkap dan apa yang terlewatkan dalam pengujian ini, baca rincian benchmark Claude Sonnet 5. Anda juga dapat memeriksa silang angka-angka Anthropic di pusat transparansi Anthropic.
Kapan harus memilih Claude Sonnet 5
Sonnet 5 adalah pilihan yang tepat dalam situasi ini.
- Anda sedang membangun agen. Agen memanggil alat dan API dalam loop, dan di situlah Sonnet 5 menutup celah dengan Opus. Kinerja alat yang mendekati Opus terlihat dalam jalannya agen yang sebenarnya.
- Anda menjalankan volume tinggi. Dengan 60% dari harga per token Opus 4.8, atau 40% selama periode perkenalan, penghematan akan berlipat ganda dengan cepat di jutaan permintaan.
- Anda sensitif terhadap biaya. Jika margin Anda bergantung pada biaya inferensi, harga Sonnet 5 memberi Anda sebagian besar kemampuan Opus dengan biaya lebih rendah.
- Anda membutuhkan kecepatan. Anthropic memposisikan Sonnet 5 sebagai kombinasi terbaik antara kecepatan dan kecerdasan, yang penting untuk beban kerja interaktif dan terikat latensi.
- Anda sedang menggunakan Sonnet 4.6 saat ini. Sonnet 5 adalah peningkatan yang mudah; cukup ubah ID model dan tinjau beberapa perubahan perilaku. Lihat Sonnet 5 vs Sonnet 4.6 untuk detail migrasi.
Kapan Opus 4.8 layak mendapatkan premiumnya
Opus 4.8 layak mendapatkan harga yang lebih tinggi dalam kasus-kasus ini.
- Tugasnya adalah penalaran murni yang sulit. Analisis kompleks, matematika multi-langkah, atau perencanaan di mana model tidak dapat bergantung pada alat eksternal adalah tempat keunggulan 6 poin Opus terlihat.
- Anda membutuhkan otonomi jangka panjang. Tugas yang berjalan lama tanpa titik pemeriksaan manusia mendapat manfaat dari penalaran Opus yang lebih kuat dan tingkat perilaku yang tidak selaras yang lebih rendah.
- Kualitas tidak dapat ditawar. Untuk sebagian kecil permintaan di mana jawaban terbaik yang mungkin membenarkan biaya, Opus 4.8 adalah yang teratas dari lini Opus saat ini.
- Anda membutuhkan margin keamanan tertinggi dalam konteks agensi. Opus 4.8 mencatat tingkat perilaku yang tidak selaras yang lebih rendah daripada Sonnet 5 dalam audit perilaku otomatis Anthropic.
Jika Anda ingin gambaran lengkap tentang Opus, baca apa itu Claude Opus 4.8. Untuk pandangan lintas vendor yang lebih luas, lihat Opus 4.8 vs GPT-5.5 vs Gemini 3.5.
Daftar periksa keputusan
Jawab pertanyaan-pertanyaan ini secara berurutan. "Ya" pertama akan mengarahkan Anda ke sebuah model.
- Apakah ini tugas penalaran murni yang sulit tanpa alat dalam loop? Jika ya, dan kualitas lebih penting daripada biaya, pilih Opus 4.8.
- Apakah tugas berjalan secara otonom untuk waktu yang lama tanpa tinjauan manusia? Jika ya, condong ke Opus 4.8.
- Apakah ini beban kerja agen atau loop alat? Jika ya, pilih Sonnet 5. Kinerjanya mendekati Opus di sini dengan biaya lebih rendah.
- Apakah ini volume tinggi atau sensitif terhadap biaya? Jika ya, pilih Sonnet 5.
- Tidak ada di atas, beban kerja umum? Defaultkan ke Sonnet 5 dan eskalasi permintaan spesifik ke Opus 4.8 ketika kualitas kurang.
Pola produksi umum adalah mengarahkan sebagian besar lalu lintas ke Sonnet 5 dan mencadangkan Opus 4.8 untuk permintaan yang gagal memenuhi standar kualitas. Anda mendapatkan sebagian besar penghematan biaya sambil menjaga batas kualitas untuk kasus-kasus sulit.
Anda tidak terkunci pada satu model. Keduanya berbagi jendela konteks, batas output, dan bentuk API, jadi perutean di antara keduanya adalah masalah menukar ID model per permintaan.
Bagaimana keduanya dibandingkan dengan Fable 5
Sebagai konteks, model Anthropic yang paling mampu yang dirilis secara luas adalah Fable 5 (claude-fable-5) dengan harga $10 / $50 per juta token. Itu dua kali lipat harga Opus 4.8 dan lebih dari tiga kali lipat tarif standar Sonnet 5. Fable 5 berada di atas kedua model ini untuk pekerjaan yang paling menuntut.
Gambaran tiga tingkat: Sonnet 5 untuk pekerjaan agensi yang efisien biaya dan bervolume tinggi, Opus 4.8 untuk penalaran sulit dan kualitas terbaik, dan Fable 5 untuk yang terdepan. Untuk perbandingan langsung terkait, lihat Fable 5 vs Opus 4.8.
Uji keduanya dengan prompt Anda sendiri menggunakan Apidog
Benchmark adalah titik awal, bukan putusan untuk beban kerja Anda. Cara jujur untuk memilih adalah dengan menjalankan prompt nyata Anda terhadap kedua model dan membandingkan biaya, latensi, dan kualitas output pada tugas yang benar-benar Anda pedulikan.

Karena Sonnet 5 dan Opus 4.8 berbagi bentuk API Anthropic Messages yang sama, beralih di antara keduanya hanya melibatkan satu kolom. Berikut adalah permintaan minimal yang dapat Anda kirim ke salah satu model dengan mengubah nilai model.
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-sonnet-5",
"max_tokens": 1024,
"messages": [
{"role": "user", "content": "Summarize the tradeoffs of choosing Sonnet 5 over Opus 4.8 for an API agent."}
]
}'
Untuk menjalankan tes yang sama terhadap Opus 4.8, ubah "model": "claude-sonnet-5" menjadi "model": "claude-opus-4-8" dan kirimkan lagi.
Di sinilah Apidog membantu. Anda dapat menyimpan kedua permintaan dalam satu koleksi, menyimpan kunci API Anda sebagai variabel lingkungan sehingga tidak pernah ada dalam isi permintaan, dan beralih antara lingkungan Sonnet 5 dan lingkungan Opus 4.8 dengan satu klik. Tambahkan asersi untuk memeriksa bentuk respons atau stop_reason, lalu jalankan koleksi untuk membandingkan kedua model pada input yang sama. Ketika Anda ingin membangun berdasarkan respons tetap sebelum menghabiskan token nyata, server mock Apidog mengembalikan payload pengganti sehingga kode integrasi Anda memiliki sesuatu untuk diuji.
Jika Anda membandingkan secara berdampingan di banyak prompt, simpan setiap prompt sebagai permintaan dalam koleksi dan jalankan sebagai skenario pengujian. Anda mendapatkan perbandingan yang dapat direproduksi alih-alih panggilan manual satu kali. Untuk mengikuti, Unduh Apidog dan impor dua permintaan di atas.
Satu detail API yang perlu diingat saat Anda menguji: pada Sonnet 5, parameter sampling seperti temperature, top_p, dan top_k akan mengembalikan error 400 jika diatur ke nilai non-default, dan pemikiran eksternal manual dengan budget_tokens dihilangkan. Arahkan perilaku melalui prompt sistem dan parameter upaya sebagai gantinya. Untuk panduan praktis API, lihat cara menggunakan API Claude Sonnet 5.
FAQ
Apakah Claude Sonnet 5 lebih baik dari Opus 4.8? Tidak secara keseluruhan. Untuk tugas agensi dan penggunaan alat, Sonnet 5 hanya terpaut sekitar 1 hingga 3 poin dari Opus 4.8 dengan harga yang jauh lebih rendah, yang menjadikannya nilai yang lebih baik untuk pekerjaan tersebut. Dalam penalaran murni yang sulit, Opus 4.8 unggul sekitar 6 poin. Pilih berdasarkan beban kerja daripada menyatakan satu model secara universal lebih baik.
Seberapa murah Sonnet 5 dibandingkan Opus 4.8? Dengan tarif standar, Sonnet 5 adalah $3 / $15 per juta token input/output dibandingkan dengan Opus 4.8 yang $5 / $25, jadi sekitar 60% dari harga Opus. Selama periode perkenalan hingga 31 Agustus 2026, Sonnet 5 turun menjadi $2 / $10, sekitar 40% dari harga Opus. Perhatikan bahwa tokenizer baru Sonnet 5 menghasilkan sekitar 30% lebih banyak token untuk teks yang sama, jadi ukur beban kerja riil Anda dengan penghitungan token. Lihat rincian harga untuk perhitungan lengkap.
Apakah Sonnet 5 dan Opus 4.8 memiliki jendela konteks yang sama? Ya. Keduanya menawarkan jendela konteks 1.000.000 token dan output maksimum 128.000 token. Perbedaannya adalah harga dan kekuatan penalaran, bukan kapasitas.
Bisakah saya beralih antara Sonnet 5 dan Opus 4.8 tanpa mengubah kode saya? Hampir sepenuhnya. Keduanya menggunakan Anthropic Messages API, jadi peralihan hanya masalah mengubah nilai model dari claude-sonnet-5 menjadi claude-opus-4-8. Perhatikan perbedaan perilaku spesifik model, dan ingat bahwa Sonnet 5 menolak parameter sampling non-default dengan error 400.
Model mana yang harus saya gunakan untuk membangun agen? Sonnet 5 untuk sebagian besar pekerjaan agen. Agen berjalan dalam loop alat, dan di situlah Sonnet 5 berkinerja paling dekat dengan Opus 4.8 dengan biaya yang jauh lebih rendah. Eskalasi ke Opus 4.8 untuk langkah-langkah spesifik yang membutuhkan penalaran tersulit.
