Anthropic merilis Claude Opus 5 pada 24 Juli 2026, dan Claude Sonnet 5 pada 30 Juni 2026. Keduanya adalah generasi saat ini. Keduanya memiliki jendela konteks 1M dan output maksimum 128k. Keduanya menjalankan pemikiran adaptif secara default dan menampilkan parameter upaya. Dari luar, keduanya terlihat seperti model yang sama dengan dua harga berbeda, yang mengubah pilihan menjadi murni pertanyaan pengeluaran.
Pertanyaan itu memiliki tenggat waktu. Sonnet 5 masih dalam tarif perkenalan $2 per juta token input dan $10 per juta token output. Pada 1 September 2026, tarifnya akan berubah menjadi standar $3 / $15. Opus 5 berada pada tarif $5 / $25 dan tidak dijadwalkan untuk berubah. Jadi, selisih antara tingkatan saat ini adalah 2.5x dan kira-kira 1.67x mulai September, dan pergeseran itu cukup besar untuk membalikkan keputusan nyata. Jika Anda menganggarkan beban kerja yang akan dirilis pada Q4, anggarkanlah dengan angka September, bukan angka hari ini.

Panduan ini membandingkan keduanya berdasarkan spesifikasi, biaya riil per tugas (bukan biaya per token, yang menyesatkan di sini), di mana keunggulan pengkodean berbasis agen Opus 5 layak dibayar, dan di mana Sonnet 5 sudah cukup. Jika Anda ingin mengukur perbedaannya sendiri alih-alih mempercayai tabel, Anda dapat menjalankan kedua model secara berdampingan di Apidog dan membaca kembali bidang usage.
Gambaran harga, dan tanggal perubahannya
Berikut adalah tarif dasar yang diterbitkan dari halaman harga Anthropic.
| Model | Input / Juta Token | Output / Juta Token | Status |
|---|---|---|---|
| Claude Opus 5 | $5.00 | $25.00 | Standar |
| Claude Sonnet 5 (hingga 31 Ags 2026) | $2.00 | $10.00 | Perkenalan |
| Claude Sonnet 5 (mulai 1 Sep 2026) | $3.00 | $15.00 | Standar |
Opus 5 juga memiliki tarif yang perlu diketahui sebelum Anda membuat model apa pun: penyimpanan cache prompt sebesar $6.25 per Juta Token untuk penulisan 5 menit, $10 untuk penulisan 1 jam, dan $0.50 untuk cache hits; Batch API sebesar $2.50 / $12.50, diskon tetap 50%; mode cepat sebesar $10 / $50 untuk kecepatan output 2.5x (pratinjau penelitian, hanya API pihak pertama, tidak dapat digabungkan dengan batch); dan pengganda 1.1x pada setiap kategori token saat Anda mengatur inference_geo: "us". Rincian lengkap dengan contoh-contoh praktis ada di panduan harga Opus 5, dan sisi Sonnet dibahas dalam rincian harga Sonnet 5.
Satu detail yang mengejutkan banyak orang: biaya Opus 5 sama persis dengan biaya Opus 4.8. Anthropic tidak menaikkan harga Opus untuk lompatan generasi. Jadi, keputusan Opus versus Sonnet yang Anda buat pada Juli 2026 adalah perhitungan yang sama dengan yang Anda lakukan pada Juni, dengan Opus yang lebih baik di satu sisinya.
Spesifikasi: cangkang yang hampir identik
| Spesifikasi | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|
| ID Model | claude-opus-5 |
claude-sonnet-5 |
| Jendela Konteks | 1 Juta token (default dan maks) | 1 Juta token (default dan maks) |
| Output Maksimum | 128k (300k di Batch API dengan header beta) | 128k |
| Pemikiran Adaptif | Aktif secara default | Aktif secara default |
| Tingkat Upaya | Lima, hingga max, default high |
low / medium / high / xhigh |
| Batas Pengetahuan | Mei 2026 | Januari 2026 |
| Tingkat Prioritas | Tidak didukung | Tidak tersedia |
| Penyimpanan cache prompt, penggunaan alat, batch, visi | Didukung | Didukung |
| Tokenisasi | tokenizer generasi 4.7 | tokenizer generasi 4.7 |
Tiga baris di antaranya memiliki dampak nyata.
Perbedaan batas pengetahuan adalah empat bulan. Opus 5 dilatih hingga Mei 2026, batas terbaru dari semua model Claude saat ini; Sonnet 5 berhenti pada Januari 2026. Jika beban kerja Anda menyentuh versi pustaka atau perubahan API dari musim semi 2026, Opus 5 mengetahuinya. Itu adalah argumen tentang kekinian daripada kemampuan, dan pengambilan data dapat menutup celah ini untuk kedua model.
Tidak ada tingkatan yang memberi Anda Tingkat Prioritas. Ini membingungkan tim yang bermigrasi dari Opus 4.8, yang memang mendukungnya. Jika Anda bergantung pada Tingkat Prioritas untuk jaminan latensi, tidak ada model generasi saat ini yang dapat langsung digunakan. Panduan migrasi Opus 4.8 ke Opus 5 mencakup sisa perubahan yang signifikan.
Baris tokenizer bukanlah perbedaan, dan itu penting untuk diketahui. Ini adalah baris yang orang harapkan penting di sini, tetapi ternyata tidak.
Mengapa biaya per token masih menyesatkan di sini
Mulailah dengan membersihkan kesalahpahaman umum. Anthropic mendokumentasikan bahwa Claude 4.7 dan model-model selanjutnya menggunakan tokenizer yang lebih baru yang menghasilkan kira-kira 30% lebih banyak token untuk teks yang sama dibandingkan yang sebelumnya. Baik Opus 5 maupun Sonnet 5 termasuk dalam kelompok tersebut. Angka 30% diukur terhadap Sonnet 4.6 dan versi sebelumnya, bukan antara kedua model ini.
Jadi, Opus 5 dan Sonnet 5 menghitung teks Anda dengan cara yang sama. Dokumen 4.000 kata memiliki jumlah token input yang dapat ditagih yang sama pada keduanya, dan harga per token yang dipublikasikan dapat dibandingkan secara langsung. Jika Anda bermigrasi dari Sonnet 4.6, anggarkan untuk peningkatan 30% tersebut; jika Anda memilih antara kedua model ini, abaikan saja.
Apa yang memengaruhi biaya per tugas adalah volume output. Panduan prompting Anthropic sendiri untuk Opus 5 menyatakan bahwa respons visual dan hasil tertulis defaultnya lebih panjang daripada model Opus sebelumnya, dan bahwa mengurangi upaya akan mengurangi pemikiran tanpa secara andal mempersingkat respons visual. Token output berharga lima kali lipat dari token input pada kedua model. Permintaan Opus 5 yang menulis 30% lebih banyak prosa daripada yang Anda minta adalah item baris nyata, dan perbaikannya ada di sisi prompt, bukan sisi harga. Panduan prompting Opus 5 mencakup instruksi keringkasan yang menguranginya.
Endpoint penghitungan token Anthropic memberi Anda jumlah input yang tepat untuk kedua model pada teks Anda sendiri dalam beberapa menit. Ukur output pada sampel nyata beban kerja Anda daripada mengasumsikan.
Berikut adalah gambaran perhitungan pada beban kerja harian yang konkret: 500k token input dan 40k token output.
| Skenario | Biaya Harian | Rasio vs Sonnet 5 |
|---|---|---|
| Opus 5 | $3.50 | baseline |
| Sonnet 5, perkenalan ($2/$10) | $1.40 | Opus 2.5x |
| Sonnet 5, standar mulai 1 Sep ($3/$15) | $2.10 | Opus 1.67x |
| Opus 5 menulis 30% lebih banyak output dari yang diminta | $3.80 | Opus 1.81x |
Baris terakhir itulah yang perlu diperhatikan. Kerumitan yang tidak Anda minta dapat menelan biaya lebih besar daripada perbedaan tingkatan yang Anda pusingkan, dan itu adalah hal termurah di halaman ini untuk diperbaiki.
Dan kemudian ada perhitungan percobaan ulang, di mana seluruh perbandingan biasanya ditentukan. Dengan harga standar, satu eksekusi Opus 5 berharga $3.50 dan satu eksekusi Sonnet 5 berharga $2.10. Jika Sonnet 5 membutuhkan percobaan kedua untuk tugas yang diselesaikan Opus 5 dalam satu percobaan, kedua eksekusi tersebut berharga $4.20 dan Sonnet kini menjadi opsi yang lebih mahal. Percobaan ulang model dan waktu peninjauan manusia, bukan hanya token. Pengungkit umum untuk kedua model ada dalam panduan kami untuk mengurangi tagihan API Claude Anda.
Di mana Opus 5 mendapatkan harga premiumnya
Angka peluncuran Anthropic untuk Opus 5 sangat agresif. Untuk memperjelas statusnya: ini adalah hasil yang dijalankan oleh vendor yang diterbitkan oleh Anthropic, dan per 25 Juli 2026, belum ada yang direproduksi secara independen. Bacalah ini sebagai klaim dengan sumber, bukan sebagai pengukuran netral.
- Frontier-Bench v0.1: Opus 5 melampaui semua model lain dan lebih dari dua kali lipat skor Opus 4.8, dengan biaya per tugas yang lebih rendah.
- ARC-AGI 3: kira-kira 3x skor model terbaik berikutnya.
- OSWorld 2.0: melampaui Fable 5 dengan biaya sekitar sepertiga.
- CursorBench 3.2: dalam 0.5% dari puncak Fable 5, dengan setengah harga.
- Zapier AutomationBench: tingkat kelulusan sekitar 1.5x model terbaik berikutnya.
- Sains: kimia organik naik 10.2 poin dan analisis protein naik 7.7 poin dibandingkan Opus 4.8.
Angka peluncuran Sonnet 5 sendiri lebih rendah dari Opus 4.8: SWE-bench Pro 63.2% berbanding 69.2%, Terminal-Bench 2.1 pada 80.4% berbanding 82.7%, dan OSWorld-Verified 81.2% berbanding 83.4%. Kisah Sonnet 5 adalah bahwa ia berada dalam beberapa poin dari Opus 4.8 dalam pekerjaan berbasis agen dan penggunaan alat dengan biaya yang jauh lebih rendah, yang merupakan cerita kuat di bulan Juni. Opus 5 mengubah bentuknya: tingkatan di atas Sonnet kini secara material lebih baik daripada Opus 4.8 yang menjadi perbandingan Sonnet tersebut. Atribusi lengkap dan peringatan ada dalam rincian benchmark Opus 5 dan postingan benchmark Sonnet 5.
Dalam praktiknya, Opus 5 unggul ketika tugas memiliki satu atau lebih properti berikut:
- Pengkodean berbasis agen jangka panjang. Refactoring multi-file, migrasi, dan loop yang berjalan untuk puluhan panggilan alat. Kesalahan bertambah dalam loop agen, dan model yang lebih jarang gagal per langkah bernilai lebih dari yang disiratkan oleh selisih harganya.
- Tugas tersebut mahal jika salah. Migrasi produksi, kode terkait keamanan, apa pun yang harus ditinjau dengan cermat oleh manusia. Waktu peninjauan menghabiskan lebih banyak per jam daripada biaya salah satu model per hari.
- Penggunaan komputer dan otomatisasi desktop. OSWorld 2.0 adalah benchmark yang paling diandalkan Anthropic di sini.
- Penalaran ilmiah dan analitis yang sulit, di mana perbedaan kimia dan analisis protein adalah keuntungan paling jelas dalam set peluncuran, atau pekerjaan yang membutuhkan pengetahuan Mei 2026 yang tidak dapat Anda berikan melalui pengambilan data.
Di mana Sonnet 5 sudah jelas cukup
Jawaban jujur untuk sebagian besar lalu lintas produksi adalah Sonnet 5. Opus 5 yang lebih baik tidak membuat Sonnet 5 tidak memadai, dan membayar untuk kemampuan yang tidak dapat Anda deteksi dalam output Anda bukanlah sebuah strategi.
Sonnet 5 adalah pilihan yang tepat ketika:
- Volume tinggi dan setiap panggilan kecil. Klasifikasi, ekstraksi, ringkasan, penandaan, perutean. Batas kualitas pada tugas-tugas ini cukup rendah sehingga kedua model dapat mencapainya.
- Output divalidasi secara otomatis. Jika pemeriksaan skema atau rangkaian pengujian menangkap kegagalan dengan murah, tingkat kegagalan yang sedikit lebih tinggi adalah tingkat kegagalan yang murah.
- Latensi lebih penting daripada kedalaman, atau Anda masih dalam tahap prototipe. Bangun di atas Sonnet 5, lalu ukur apakah Opus 5 mengubah sesuatu sebelum Anda membayarnya.
Ada juga jalur gratis yang perlu diketahui: Sonnet 5 adalah model default pada paket Claude gratis, jadi Anda dapat melakukan pemeriksaan kewarasan outputnya pada prompt aktual Anda sebelum menulis sebaris kode. Opus 5 kini menjadi model dengan kinerja tertinggi yang tersedia untuk pelanggan Pro dan default untuk Max, sehingga tingkatan konsumen juga dapat mencapainya. Panduan akses gratis Opus 5 kami menunjukkan jalur yang jujur.
Tabel keputusan berdasarkan beban kerja
| Beban Kerja | Pilih | Mengapa |
|---|---|---|
| Refactoring multi-file atau migrasi dalam loop agen | Opus 5 | Kesalahan yang menumpuk membuat keandalan per langkah menjadi biaya dominan |
| Klasifikasi atau ekstraksi volume tinggi | Sonnet 5 | Keduanya mencapai batas kualitas; harga yang menang |
| Obrolan yang menghadap pelanggan dengan pengambilan data | Sonnet 5 | Pengambilan data menutup celah batas; latensi penting |
| Penggunaan komputer atau otomatisasi desktop | Opus 5 | Kesenjangan OSWorld 2.0 Anthropic adalah klaim agen paling jelas |
| Pemrosesan dokumen batch semalaman | Sonnet 5, atau Opus 5 pada Batch API | Batch dengan diskon 50% dapat menempatkan Opus 5 mendekati tarif standar Sonnet |
| Tinjauan keamanan atau kode kritis produksi | Opus 5 | Biaya kesalahan jauh lebih besar daripada selisih token |
| Analisis ilmiah atau kuantitatif | Opus 5 | Perbedaan kimia dan analisis protein adalah keuntungan terkuat |
| Prototyping dan alat internal | Sonnet 5 | Ukur sebelum Anda meningkatkan |
| Apa pun yang membutuhkan pengetahuan musim semi 2026 tanpa pengambilan data | Opus 5 | Batas Mei 2026 versus Januari 2026 |
| UX interaktif yang sensitif latensi | Sonnet 5 | Atau mode cepat Opus 5 dengan $10/$50 jika kedalaman tidak dapat ditawar |
Perhatikan baris Batch API. Opus 5 dalam mode batch adalah $2.50 / $12.50, yang berada di bawah tarif standar Sonnet 5 bulan September yaitu $3 / $15 untuk input dan sedikit di atasnya untuk output. Jika pekerjaan Anda mentolerir pemrosesan asinkron, pertanyaan tingkatan dapat sepenuhnya hilang.
Apa yang bukan dari kedua model ini
Opus 5 bukanlah puncak dari tumpukan Claude, dan penting untuk mengatakannya secara gamblang daripada membiarkan liputan peluncuran menyiratkan sebaliknya. Fable 5 tetap menjadi model Anthropic yang paling mumpuni yang dirilis secara luas, dengan harga $10 / $50. Dan Opus 5 masih tertinggal dari Mythos 5 dalam eksploitasi keamanan siber dan penelitian biologi otonom, yang merupakan pernyataan Anthropic sendiri, bukan kritik dari luar.
Pembingkaian yang akurat untuk Opus 5 adalah kemampuan kelas perintis dengan setengah harga perintis, dengan batasan yang jelas di atasnya. Jika beban kerja Anda berada pada batasan tersebut, perbandingan sebenarnya bukanlah Opus 5 melawan Sonnet 5 sama sekali; lihat Opus 5 vs Fable 5 sebagai gantinya.
Lakukan perbandingan sendiri di Apidog
Benchmark adalah beban kerja orang lain. Perbandingan yang penting adalah prompt Anda, alat Anda, kriteria penerimaan Anda. Kedua model berada di belakang endpoint Pesan yang sama, jadi mengujinya satu sama lain adalah masalah mengubah satu string.

Atur di Apidog seperti ini:
- Buat satu permintaan ke endpoint Pesan Anthropic dan simpan kunci API sebagai variabel lingkungan daripada menempelkannya ke dalam body.
- Simpan dua varian yang berbagi prompt yang sama, satu dengan
"model": "claude-opus-5"dan satu dengan"model": "claude-sonnet-5". - Baca objek
usagepada setiap respons. Jumlah token input, output, dan cache yang sebenarnya per model adalah satu-satunya input yang andal untuk model biaya. - Tambahkan pernyataan pada bentuk respons agar penolakan atau respons terpotong gagal secara terang-terangan daripada secara diam-diam.
- Ulangi permintaan Opus 5 pada tingkat
output_config.effortyang berbeda dan bandingkan biaya dengan kualitas. Opus 5 secara default kehigh, dan tingkatlowdanmedium-nya secara signifikan lebih kuat daripada model Opus sebelumnya, jadi seringkali dengan menyapu dapat menemukan pengaturan yang lebih murah yang tetap lulus. Panduan parameter upaya mencakup metodenya.
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-opus-5",
"max_tokens": 4096,
"messages": [
{"role": "user", "content": "Refactor this handler to use async I/O."}
]
}'
Dua hal yang perlu diperhatikan saat Anda menguji. Pemikiran adaptif aktif secara default pada kedua model, dan max_tokens membatasi pemikiran ditambah respons secara bersamaan, sehingga anggaran yang berfungsi pada model lama dapat terpotong. Dan pada Opus 5, menggabungkan thinking: {type: "disabled"} dengan upaya xhigh atau max akan mengembalikan 400. Unduh Apidog untuk menjalankan pasangan ini secara berdampingan, dan lihat panduan API Opus 5 untuk alur permintaan yang lengkap.
FAQ
Apakah Claude Opus 5 sepadan dengan 2.5x harga Sonnet 5? Untuk pengkodean berbasis agen jangka panjang, penggunaan komputer, dan pekerjaan yang mahal jika salah, ya. Untuk klasifikasi, ekstraksi, dan obrolan volume tinggi, biasanya tidak. Dan kelipatannya hanya 2.5x hingga 1 September 2026, setelah itu tarif standar Sonnet 5 sebesar $3 / $15 membuatnya sekitar 1.67x.
Kapan harga Claude Sonnet 5 berubah? Tarif perkenalan $2 / $10 berlaku hingga 31 Agustus 2026. Mulai 1 September 2026, tarifnya berubah menjadi $3 / $15. Opus 5 tetap pada $5 / $25.
Apakah Opus 5 dan Sonnet 5 melakukan tokenisasi teks secara berbeda? Tidak. Keduanya menggunakan tokenizer generasi 4.7, sehingga teks yang identik menghasilkan jumlah token input yang identik dan harga per token dapat dibandingkan secara langsung. Kenaikan token sekitar 30% yang didokumentasikan Anthropic diukur terhadap Sonnet 4.6 dan model sebelumnya, yang penting jika Anda meningkatkan dari salah satu model tersebut, bukan jika Anda memilih di antara kedua model ini. Bandingkan biaya per tugas yang diselesaikan, karena panjang output dan percobaan ulang lebih memengaruhi tagihan daripada perbedaan harga label.
Bisakah saya beralih antara Opus 5 dan Sonnet 5 tanpa perubahan kode? Sebagian besar bisa. Keduanya secara default menggunakan pemikiran adaptif dan menolak parameter sampling non-default. Perbedaan yang perlu diperhatikan adalah tingkat upaya (Opus 5 menampilkan tingkat max dan default ke high) dan kode 400 khusus Opus ketika pemikiran dinonaktifkan pada xhigh atau max.
Model mana yang direkomendasikan Anthropic secara default? Dokumen Anthropic sendiri sekarang menyatakan untuk memulai dengan Claude Opus 5 jika Anda tidak yakin. Itu adalah rekomendasi, bukan analisis biaya. Mulailah dari sana, lalu ukur apakah Sonnet 5 memberikan hasil yang sama dengan biaya lebih rendah. Perbandingan Sonnet 5 vs Opus 4.8 yang lebih lama masih merupakan latar belakang yang berguna tentang bagaimana tingkatan berperilaku relatif satu sama lain.
Untuk spesifikasi lengkap, atribusi benchmark, dan matriks ketersediaan, mulailah dari apa itu Claude Opus 5, dan baca postingan peluncuran Opus 5 dan gambaran umum model Anthropic untuk sumber utamanya.
