Anthropic meluncurkan Claude Opus 4.8 pada tanggal 28 Mei 2026, dan menyediakannya pada hari yang sama di seluruh Claude API, aplikasi Claude, Claude Code, dan platform cloud utama. Ini adalah model paling mumpuni dalam keluarga Claude, dibangun untuk penalaran kompleks, pengkodean agentic berjangka panjang, dan pekerjaan otonomi tinggi. ID model API adalah claude-opus-4-8.
Jika Anda sudah membangun di atas Opus 4.7, peningkatannya adalah pertukaran model satu baris. Perubahan utama bukanlah tingkatan harga baru atau jendela konteks yang lebih besar; keduanya tetap sama. Ini adalah kualitasnya. Menurut pengumuman Anthropic, Opus 4.8 sekitar empat kali lebih kecil kemungkinannya dibandingkan 4.7 untuk membiarkan cacat dalam kode lolos tanpa diketahui, dan lebih jujur tentang apa yang tidak diketahuinya. Panduan ini membahas apa yang berubah, cara mengaksesnya, dan apakah layak untuk beralih.
Versi singkat
Tiga fakta penting pada hari pertama:
- ID Model
claude-opus-4-8: tersedia sekarang di Claude API, AWS, Vertex AI, dan Microsoft Foundry - Harga sama dengan Opus 4.7: $5 per juta token input, $25 per juta token output dalam mode standar
- Konteks 1M token, output 128K token: tidak berubah dari 4.7, jadi anggaran token Anda tetap sama
Apa yang Anda dapatkan di atas itu:
- Parameter
effortbaru yang menukarkan ketelitian dengan efisiensi token di seluruh respons - Pemikiran adaptif, di mana model memutuskan seberapa banyak penalaran per permintaan
- Alur Kerja Dinamis di Claude Code, yang dapat mengaktifkan ratusan sub-agen paralel dalam satu sesi
- Kejujuran yang lebih baik, lebih sedikit cacat kode yang lolos, dan pemanggilan alat yang lebih efisien
Untuk perhitungan token per token dan skenario biaya lengkap, lihat rincian harga Opus 4.8. Untuk mulai membangun, lompat ke panduan API Opus 4.8.
Apa yang sebenarnya baru di Opus 4.8
Opus 4.8 mempertahankan spesifikasi 4.7 dan meningkatkan model di dalamnya. Peningkatan terkonsentrasi di empat area.
Kualitas kode. Model lebih sering menangkap kesalahannya sendiri. Anthropic melaporkan penurunan cacat yang lolos tinjauan tanpa diketahui sekitar 4x dibandingkan dengan 4.7. Untuk pengkodean agentic, itu berarti lebih sedikit bug senyap dalam diff yang dihasilkan.

Kejujuran dan keselarasan. Opus 4.8 lebih mudah menandai ketidakpastian dan membuat klaim yang lebih sedikit tidak didukung. Anthropic juga melaporkan tingkat penipuan dan kerja sama penyalahgunaan yang lebih rendah daripada 4.7. Jika Anda menjalankan agen tanpa pengawasan, penilaian itu lebih penting daripada titik tolok ukur.
Pemanggilan alat. Model memilih alat dengan lebih efisien dan membuang lebih sedikit panggilan, yang mengurangi latensi dan pengeluaran token dalam loop agen.
Kontrol usaha. Ini adalah perubahan API terbesar yang terlihat, dan layak mendapatkan bagiannya sendiri.
Kontrol usaha: satu model, lima gigi
Parameter effort memungkinkan Anda mengatur seberapa giat Claude menghabiskan token. Ini berada di dalam output_config dan menerima lima level: low, medium, high, xhigh, dan max. Standarnya adalah high di setiap permukaan, termasuk API dan Claude Code.
{
"model": "claude-opus-4-8",
"max_tokens": 4096,
"messages": [{"role": "user", "content": "Refaktor modul ini."}],
"output_config": { "effort": "xhigh" }
}
Detail utamanya: `effort` memengaruhi semua token, bukan hanya penalaran. Ini termasuk teks, panggilan alat, dan argumen fungsi. Usaha yang lebih rendah berarti Claude membuat lebih sedikit panggilan alat dan menulis respons yang lebih ringkas. Usaha yang lebih tinggi berarti analisis yang lebih dalam dan pekerjaan yang lebih menyeluruh.
Panduan Anthropic untuk Opus 4.8 adalah untuk memulai pada xhigh untuk tugas pengkodean dan agentic, mempertahankan high sebagai batas bawah untuk sebagian besar pekerjaan yang membutuhkan penalaran berat, dan turun ke medium atau low hanya setelah evaluasi Anda mengonfirmasi bahwa level yang lebih rendah mempertahankan kualitas. Detail lengkapnya ada di dokumen usaha Anthropic.
Pemikiran adaptif menggantikan anggaran manual
Opus 4.8 menggunakan pemikiran adaptif. Anda mengatur thinking: {type: "adaptive"} dan model memutuskan kapan dan seberapa banyak untuk bernalar per permintaan. Pada usaha high, xhigh, dan max, model hampir selalu berpikir secara mendalam. Pada level yang lebih rendah, model dapat melewati pemikiran pada masalah sederhana.
Satu hal yang perlu diketahui sebelum Anda bermigrasi: pemikiran yang diperluas secara manual dengan budget_tokens tidak didukung di Opus 4.8 dan akan mengembalikan error 400. Jika Anda membawa pola itu dari Opus lama, beralihlah ke pemikiran adaptif ditambah parameter `effort`. Kami membahas bentuk permintaan yang tepat di panduan API Opus 4.8.
Alur Kerja Dinamis di Claude Code
Fitur baru yang paling mencolok hadir di dalam Claude Code. Alur Kerja Dinamis memungkinkan satu sesi meluncurkan ratusan sub-agen paralel untuk menangani tugas-tugas besar yang bercabang. Di balik layar, ini adalah level usaha xhigh yang dipadukan dengan pesan sistem di tengah percakapan, pembaruan Messages API yang sama yang sekarang menerima entri sistem di tengah percakapan, bukan hanya di awal.
Kemampuan di tengah percakapan itulah yang memberi agen orkestrator izin tetap untuk meluncurkan pekerja saat tugas berlangsung. Jika Anda ingin mengetahui mekanismenya dan cara membangun mode orkestrasi serupa melalui API mentah, lihat ulasan mendalam Alur Kerja Dinamis Claude Code. Untuk latar belakang tentang bagaimana Claude Code menyusun jalannya agen, rincian arsitektur kerangka agen Claude Code kami adalah pengantar yang baik.
Sorotan tolok ukur
Angka utama Anthropic berfokus pada pekerjaan agentic:
- Mengalahkan GPT-5.5 pada tolok ukur Super-Agent, rangkaian yang mengukur penyelesaian tugas ujung-ke-ujung
- Menduduki puncak Tolok Ukur Agen Hukum dan merupakan model pertama yang menembus 10% secara keseluruhan di dalamnya
- 84% pada Online-Mind2Web, tes agen navigasi web
Ini adalah skor agen, bukan skor obrolan, yang memberi tahu Anda di mana Opus 4.8 ditargetkan. Untuk perbandingan langsung dengan model frontier lainnya, baca Opus 4.8 vs GPT-5.5 vs Gemini 3.5. Perbandingan Gemini 3.5 vs GPT-5.5 vs Opus 4.7 yang lebih lama masih berlaku untuk dasar 4.7.
Opus 4.8 vs Opus 4.7 sekilas
| Atribut | Opus 4.7 | Opus 4.8 |
|---|---|---|
| ID API | claude-opus-4-7 |
claude-opus-4-8 |
| Harga input | $5 / 1M token | $5 / 1M token |
| Harga output | $25 / 1M token | $25 / 1M token |
| Jendela konteks | 1M token | 1M token |
| Output maks | 128K token | 128K token |
| Level usaha | rendah hingga maks | rendah hingga maks |
| Cacat kode yang lolos | dasar | ~4x lebih sedikit |
| Kejujuran / keselarasan | dasar | ditingkatkan |
| Batas pengetahuan | Jan 2026 | Jan 2026 |
Spesifikasinya identik sengaja dibuat begitu. Anda membayar tarif yang sama untuk model yang membuat lebih sedikit kesalahan, jadi bagi sebagian besar tim migrasi memiliki risiko rendah. Uji skema alat dan evaluasi Anda setelah pertukaran, lalu luncurkan.
Cara mengakses Claude Opus 4.8
Anda memiliki empat pintu depan:
- Claude API: gunakan ID model
claude-opus-4-8terhadap endpoint Messages. Mulailah dengan panduan API Opus 4.8. - Aplikasi Claude: ini adalah model high-end default di claude.ai untuk paket berbayar, dengan akses terbatas pada paket gratis.
- Claude Code: tersedia sebagai model teratas, dengan Alur Kerja Dinamis saat Anda memilih mode usaha tinggi.
- Platform cloud: AWS (
anthropic.claude-opus-4-8di Bedrock), Vertex AI (claude-opus-4-8), dan Microsoft Foundry, di mana jendela konteks dibatasi hingga 200K token.
Jika Anda ingin mencobanya tanpa paket API berbayar terlebih dahulu, panduan cara menggunakan Opus 4.8 secara gratis mencakup jalur berbiaya rendah yang sah.
Siapa yang harus menggunakan Opus 4.8
Opus 4.8 dibangun untuk spektrum beban kerja yang sulit. Gunakanlah ketika:
- Anda menjalankan sesi pengkodean agentic yang panjang di mana bug senyap sangat mahal
- Anda membutuhkan agen untuk membuat keputusan yang tepat tanpa pengawasan
- Anda mengoordinasikan penggunaan alat multi-langkah dan menginginkan lebih sedikit panggilan yang terbuang
- Tugas benar-benar membutuhkan penalaran frontier, bukan klasifikasi cepat
Untuk pekerjaan bervolume tinggi, sensitif latensi, atau sederhana, model yang lebih kecil atau tingkat usaha yang lebih rendah akan melayani Anda lebih baik dan lebih murah. Inti dari kontrol usaha adalah Anda tidak perlu lagi beralih model untuk beralih gigi.
Menguji Opus 4.8 sebelum Anda meluncurkannya
Pertukaran model mudah ditulis dan mudah salah. Streaming bagian-bagian, validasi pemanggilan alat, bentuk output_config yang baru, dan respons pemikiran adaptif semuanya mengubah muatan yang harus diurai oleh kode Anda. Sebelum Anda mendorong claude-opus-4-8 ke produksi, putar ulang permintaan Anda yang sebenarnya terhadapnya dan bandingkan outputnya.

Apidog menangani seluruh permukaan Messages API dalam satu ruang kerja:
- Simpan endpoint Opus 4.8 sebagai permintaan, lampirkan
x-api-keyAnda, dan tekan Kirim - Tukar
claude-opus-4-7denganclaude-opus-4-8pada permintaan yang sama dan bandingkan responsnya - Lihat bagian-bagian yang dialirkan dirender sebaris dengan waktu per bagian
- Tambahkan penegasan yang menangkap penyimpangan skema saat Anda mengubah level
effort - Mock endpoint sehingga Anda dapat menguji kode hilir tanpa menghabiskan kredit
Unduh Apidog, arahkan permintaan ke endpoint Messages, dan tempelkan cuplikan curl dari panduan API. Pengaturan membutuhkan waktu sekitar dua menit.
FAQ
Apakah Claude Opus 4.8 lebih baik dari Opus 4.7? Ya, dalam hal kualitas. Model ini menangkap sekitar 4x lebih banyak cacat kode, lebih jujur tentang ketidakpastian, dan memanggil alat dengan lebih efisien. Harga, jendela konteks, dan output maksimum identik, jadi ada sedikit alasan untuk tetap menggunakan 4.7.
Berapa harga Opus 4.8? $5 per juta token input dan $25 per juta token output dalam mode standar. Mode cepat berjalan pada $10 dan $50 untuk output 2.5x lebih cepat. Perhitungan lengkapnya ada di rincian harga.
Berapa jendela konteks (context window) untuk Opus 4.8? 1M token input dan hingga 128K token output pada Messages API sinkron. Batch API mendukung hingga 300K token output dengan header beta. Di Microsoft Foundry, jendela konteks dibatasi hingga 200K token.
Apakah Opus 4.8 mendukung pemikiran yang diperpanjang (extended thinking)? Ini menggunakan pemikiran adaptif (thinking: {type: "adaptive"}), di mana model memutuskan seberapa banyak untuk bernalar. Pemikiran budget_tokens manual tidak didukung dan mengembalikan kesalahan 400.
Apa itu parameter `effort`? Pengaturan di dalam output_config yang mengontrol berapa banyak token yang dihabiskan Claude di seluruh teks, panggilan alat, dan penalaran. Levelnya berjalan dari low, medium, high (default), xhigh, dan max.
Bisakah saya menggunakan Opus 4.8 secara gratis? Tidak ada tingkatan API gratis, tetapi Anda dapat mencobanya pada paket gratis di claude.ai dengan batasan, atau melalui kredit uji coba. Lihat panduan akses gratis.
Apa itu Alur Kerja Dinamis (Dynamic Workflows)? Fitur Claude Code yang meluncurkan banyak sub-agen paralel dalam satu sesi, didukung oleh usaha xhigh dan pesan sistem di tengah percakapan. Detail ada di panduan Alur Kerja Dinamis.
