Anthropic meluncurkan Claude Opus 5 pada 24 Juli 2026, dan jawaban jujur untuk “bisakah saya menggunakannya secara gratis” memiliki dua bagian. Melalui aplikasi Claude, ya, jika Anda berada di tingkat langganan berbayar: Opus 5 adalah default baru untuk pelanggan Max dan model dengan kinerja tertinggi yang tersedia untuk pengguna Pro. Melalui API, tidak. Tidak ada jalur API gratis tanpa batas ke claude-opus-5, dan siapa pun yang mengatakan sebaliknya sedang menjual sesuatu.
Itu bukan kabar buruk, karena bagian artikel yang lebih murah inilah tempat uang sebenarnya berada. Opus 5 dibanderol $5 per juta token input dan $25 per juta token output, sama dengan Opus 4.8 dan setengah dari harga Fable 5 yaitu $10 / $50. Di atas dasar tersebut, terdapat beberapa tuas sah yang dapat memangkas tagihan riil lebih dari separuhnya. Panduan ini membahas rute gratis yang jujur terlebih dahulu, lalu jalur berbayar termurah. Saat Anda mulai memanggil API, Apidog adalah tempat Anda mengirim, menyimpan, dan membandingkan permintaan tersebut.
Untuk gambaran spesifikasi lengkap, lihat apa itu Claude Opus 5. Postingan peluncuran Opus 5 Anthropic memuat pengumuman tersebut, dan ikhtisar model berisi ID dan tabel ketersediaan. Satu perbedaan yang perlu diingat: gratis di dalam aplikasi Claude berarti langganan Anda mencakupnya, dengan tunduk pada batas penggunaan. Gratis melalui API berarti uji coba atau kredit promosi dengan saldo yang berkurang dan kemudian berhenti.
Jalur gratis 1: Tingkat langganan Claude
Materi peluncuran Anthropic menyebutkan dua tingkat konsumen untuk Opus 5:
- Max. Opus 5 menjadi model default. Anda mendapatkannya tanpa perlu mengubah apa pun.
- Pro. Opus 5 kini menjadi model dengan kinerja tertinggi yang tersedia dalam paket. Itulah perubahan penting: tingkat Opus teratas dulunya berada di atas Pro, dan sekarang tidak lagi.
Materi tersebut tidak menyebutkan paket Claude gratis sebagai permukaan Opus 5, jadi perlakukan akses paket gratis sebagai belum terkonfirmasi daripada mengasumsikan itu berfungsi. [VERIFIKASI] Periksa pemilih model Anda sebelum merencanakan berdasarkan itu.
Opus 5 juga ada di Claude Code, Claude Cowork, dan GitHub Copilot, jadi langganan yang sudah Anda bayar mungkin mencakupnya. Penggunaan di sana diukur, dan Opus 5 memiliki kebiasaan yang menghabiskan jatah lebih cepat daripada 4.8: *thinking* aktif secara default, respons berjalan lebih panjang, dan model lebih mudah mendelegasikan ke subagen. Cara menggunakan Claude Opus 5 di Claude Code mencakup cara mengendalikannya, dan cara menggunakan Claude Opus 4.8 secara gratis memiliki rute yang setara untuk generasi sebelumnya.
Jalur gratis 2: Uji coba API dan kredit promosi cloud
ID model di Claude API persis claude-opus-5, tanpa sufiks tanggal. API ini berbasis bayar sesuai penggunaan (pay as you go), tetapi dua rute jujur memungkinkan Anda memulai tanpa membayar di muka.
- Kredit akun API Anthropic baru. Akun baru biasanya dimulai dengan saldo kredit kecil, cukup untuk mengonfirmasi integrasi Anda berfungsi dan mengukur jumlah token riil sebelum Anda melampirkan kartu.
- Kredit promosi platform cloud. Opus 5 tersedia di Amazon Bedrock (sebagai
anthropic.claude-opus-5), Claude Platform di AWS, Google Cloud, dan Microsoft Foundry. Akun baru di sana sering menyertakan kredit promosi yang dapat Anda gunakan untuk pemakaian Claude. Bacalah penawaran saat ini dari setiap platform secara langsung; jumlah dan ketentuannya sering berubah sehingga angka apa pun yang dicetak di sini akan kedaluwarsa.
Gunakan kredit tersebut untuk pengukuran, bukan lalu lintas produksi. Jalankan prompt Anda yang sebenarnya, catat blok usage dari setiap respons, dan Anda akan mengetahui biaya per tugas sebelum Anda berkomitmen. Dokumentasi harga Anthropic memiliki tabel tarif saat ini.
Satu peringatan lebih penting pada Opus 5 dibandingkan model sebelumnya: **fitur *thinking* aktif secara default sekarang.** Pada Opus 4.8, permintaan tanpa bidang `thinking` berjalan tanpa *thinking*. Pada Opus 5, permintaan yang sama menjalankan *adaptive thinking*, dan token *thinking* ditagih sebagai output sebesar $25 per juta. Paket uji yang dibawa dari 4.8 tanpa perubahan akan menghabiskan kredit uji coba lebih cepat dari bulan lalu. Daftar lengkap jebakan ini ada di migrasi dari Opus 4.8 ke Opus 5.
Tidak ada jalur API gratis tanpa batas
Penting untuk dinyatakan secara gamblang, karena pertanyaan ini menarik jawaban yang tidak jujur. Tidak ada tingkat gratis dari Claude API yang memberi Anda panggilan claude-opus-5 tanpa batas, dan tidak ada proxy, kumpulan kunci, atau reseller yang secara sah memberikan akses model *frontier* gratis. Skema tersebut melanggar ketentuan Anthropic, dicabut, dan mengarahkan prompt Anda melalui infrastruktur yang tidak Anda kendalikan. Setelah kredit uji coba atau promosi Anda habis, Anda membayar per token atau Anda berhenti. Sisa artikel ini adalah tentang membayar sesedikit mungkin.
Jalur berbayar termurah
Tarif dasar adalah $5 input dan $25 output per juta token. Berikut adalah hal-hal yang sebenarnya memengaruhi angka tersebut, kira-kira berdasarkan urutan dampaknya.
Tuas 1: Batch API, diskon 50%
Apa pun yang tidak memerlukan jawaban dalam beberapa detik berikutnya harus melalui Batch API. Ini berjalan secara asinkron dan berbiaya **$2.50 input / $12.50 output per juta token**, persis setengah dari tarif standar. Tidak ada perbedaan kualitas; model yang sama menjalankan permintaan yang sama.
Ini cocok untuk lebih banyak beban kerja daripada yang orang duga: eksekusi evaluasi malam, pemrosesan dokumen massal, pengisian klasifikasi kembali, *regression suites*, *content pipelines*. Batch juga mendukung hingga **300.000 token output** per permintaan dengan *header* beta `output-300k-2026-03-24`, dibandingkan dengan 128.000 pada Messages API standar, sehingga pembuatan bentuk panjang lebih murah dan tidak terlalu terbatas di sana. Kekurangannya adalah latensi, ditambah satu catatan kompatibilitas: mode cepat tidak berfungsi dengan Batch API.
Tuas 2: `effort` `low`, tuas biaya sesungguhnya sekarang
Opus 5 mengekspos `output_config.effort`, yang dimaksud oleh liputan pers sebagai “tombol pengatur antara biaya dan kemampuan.” Ini secara default `high`. Usaha yang lebih rendah berarti lebih sedikit token *thinking*, dan token *thinking* ditagih dengan tarif output, sehingga `effort` hampir secara langsung memengaruhi pengeluaran.
Yang berubah dengan Opus 5 adalah bahwa tingkatannya dikalibrasi ulang. Anthropic mengatakan `low` dan `medium` secara signifikan lebih kuat di sini daripada pada model Opus sebelumnya, yang merupakan pertama kalinya menurunkan ke `low` menjadi pilihan serius daripada penurunan mutu. Jika Anda membawa pengaturan `effort` dari 4.8, lakukan evaluasi ulang pada penilaian Anda sendiri. Dua catatan praktis:
- Menurunkan `effort` mengurangi *thinking*, bukan panjang output yang terlihat. Respons Opus 5 berjalan lebih panjang daripada 4.8 terlepas dari `effort`. Jika Anda ingin jawaban yang lebih pendek, minta secara eksplisit di *prompt*. Itu adalah penghematan terpisah.
- Jangan menonaktifkan *thinking* untuk menghemat uang. Menggabungkan `thinking: {type: "disabled"}` dengan `effort` `xhigh` atau `max` akan langsung mengembalikan *error* 400. Panduan *prompting* Anthropic sendiri untuk Opus 5 adalah untuk membiarkan *thinking* tetap aktif dan mengontrol biaya dengan `effort` yang lebih rendah, karena *thinking* yang dinonaktifkan kadang-kadang menghasilkan panggilan *tool* yang ditulis sebagai teks biasa dan tag XML internal yang bocor ke output yang terlihat.
Penjelasan lengkap dari kelima level ada di parameter `effort` Claude Opus 5.
Tuas 3: *Prompt Caching*, sekarang dari 512 token
Pukulan *cache* berbiaya **$0.50 per juta token**, sepersepuluh dari tarif input standar. Penulisan *cache* 5 menit berbiaya $6.25 per juta; penulisan 1 jam berbiaya $10 per juta.
Perubahan Opus 5 yang patut ditindaklanjuti: **prefiks minimal yang dapat di-*cache* turun menjadi 512 token**, dari 1.024 pada Opus 4.8. *Prompt* yang sebelumnya terlalu pendek untuk di-*cache* sekarang dapat di-*cache* tanpa perubahan kode selain menambahkan *breakpoint*.
Matematikanya langsung terbayar. Ambil contoh permintaan dengan prefiks stabil 40.000 token (*system prompt* ditambah dokumen referensi) dan input variabel 10.000 token:
- Tidak di-*cache*: 50.000 token input dengan $5 per juta adalah $0.25.
- Penulisan *cache*: prefiks 40.000 token dengan $6.25 per juta adalah $0.25, dibandingkan $0.20 yang tidak di-*cache*, jadi penulisan berbiaya lima sen ekstra, sekali.
- Setiap pukulan berikutnya: 40.000 token yang di-*cache* dengan $0.50 per juta adalah $0.02, ditambah 10.000 token baru dengan $0.05. Input turun dari $0.25 menjadi $0.07.
Pukulan pertama sudah membayar untuk penulisan. Konfirmasikan bahwa itu berfungsi dengan membaca `cache_read_input_tokens` di blok `usage` respons.
Tuas 4: Lewati mode cepat
Mode cepat berbiaya **$10 input / $50 output per juta token**, persis dua kali lipat tarif dasar, sebagai imbalan atas kecepatan output sekitar 2.5x. Ini adalah pratinjau penelitian, hanya API pihak pertama (tidak tersedia di Bedrock, Google Cloud, atau Microsoft Foundry), dan tidak tersedia dengan Batch API. Jika Anda mengoptimalkan biaya, ini adalah hal termudah untuk dihilangkan. Bayar dua kali lipat hanya untuk antarmuka interaktif di mana pengguna melihat token muncul.
Tuas 5: Biarkan `inference_geo` sendiri kecuali Anda membutuhkannya
Mengatur `inference_geo: "us"` menerapkan **pengali 1.1x pada setiap kategori token**, biaya tambahan 10% pada seluruh tagihan. Ini ada untuk persyaratan residensi data; jika Anda tidak memilikinya, jangan mengaturnya.
Satu keuntungan kecil: *overhead system prompt* penggunaan *tool* Opus 5 adalah 286 token dengan `tool_choice` diatur ke `auto` atau `none`, turun dari 290 pada Opus 4.8 dan jauh di bawah 675 pada Opus 4.7. Ini bukan tuas yang Anda tarik, tetapi bermigrasi dari 4.7 akan menurunkan batas biaya per permintaan Anda sendiri. Untuk penghematan yang berlaku di seluruh jajaran Claude, potong tagihan Claude API Anda mencakup lebih banyak.
Perbandingan biaya sekilas
| Konfigurasi | Input / MTok | Output / MTok | Terbaik untuk |
|---|---|---|---|
| Standar, `effort` `high` | $5.00 | $25.00 | Default interaktif |
| Batch API | $2.50 | $12.50 | Apa pun yang asinkron |
| Pukulan *cache* pada prefiks stabil | $0.50 | t/a | Panggilan konteks panjang berulang |
| Mode cepat | $10.00 | $50.00 | Hanya yang krusial latensi |
| `inference_geo: "us"` | 1.1x semua kategori | 1.1x semua kategori | Persyaratan residensi data |
Diskon batch 50% berlaku untuk tarif token standar; verifikasi pada tagihan Anda sendiri bagaimana itu berinteraksi dengan tarif token yang di-*cache* sebelum membuat model penghematan gabungan. Contoh lengkap ada di harga Claude Opus 5.
Menguji jalur murah di Apidog
Setiap tuas di atas dapat diverifikasi dalam satu respons HTTP, yang menjadikan klien API cara tercepat untuk mengonfirmasi bahwa Anda benar-benar menghemat uang. Berikut adalah panggilan Opus 5 dasar:
curl https://api.anthropic.com/v1/messages \
--header "x-api-key: $ANTHROPIC_API_KEY" \
--header "anthropic-version: 2023-06-01" \
--header "content-type: application/json" \
--data '{
"model": "claude-opus-5",
"max_tokens": 4096,
"output_config": {"effort": "low"},
"messages": [
{"role": "user", "content": "Summarize this OpenAPI spec in three sentences."}
]
}'
Di Apidog, buat itu sebagai permintaan POST yang tersimpan dengan kunci Anda disimpan sebagai variabel lingkungan daripada ditempelkan ke badan permintaan, sehingga tidak pernah ter-*commit*. Kemudian:
- Bandingkan tingkat `effort` secara berdampingan. Gandakan permintaan, ubah `effort` menjadi `low`, `medium`, dan `high`, dan baca `usage.output_tokens` pada masing-masing. Anda melihat perbedaan biaya secara langsung alih-alih menebak.
- Konfirmasi pukulan *cache*. Kirim permintaan dengan prefiks panjang yang sama dua kali dan periksa bahwa `cache_read_input_tokens` bukan nol pada panggilan kedua. Jika tetap nol, *breakpoint* Anda berada di tempat yang salah.
- Perhatikan pemotongan `max_tokens`. *Thinking* dan respons sekarang berbagi anggaran `max_tokens`, jadi `stop_reason: "max_tokens"` berarti Anda membayar untuk output yang tidak pernah Anda gunakan. Tambahkan *assertion* untuk itu.
- Periksa *streaming* dan panggilan *tool*. Respons SSE dan *payload* panggilan *tool* dapat dibaca sepenuhnya, yang penting ketika sebuah *agentic loop* menghabiskan lebih dari yang diharapkan.
Unduh Apidog untuk mengikuti, dan lihat cara menggunakan Claude Opus 5 API untuk panduan integrasi lengkap.
Apakah Opus 5 model yang tepat untuk dioptimalkan?
Terkadang jalur termurah adalah model yang berbeda. Sonnet 5 berjalan dengan tarif perkenalan $2 / $10, meningkat menjadi $3 / $15 pada 1 September 2026, dan berbagi jendela konteks 1 juta token yang sama. Jika beban kerja Anda bukan pengodean agen atau penalaran multi-langkah yang kompleks, uji celah itu sebelum Anda mengoptimalkan tagihan Opus 5. Claude Opus 5 vs Sonnet 5 membahas di mana premium dibenarkan, dan cara menggunakan Claude Sonnet 5 secara gratis mencakup rute gratis Sonnet.
Jelaskan juga apa yang dibeli oleh premium tersebut. Klaim Anthropic menempatkan Opus 5 lebih dari dua kali skor Frontier-Bench Opus 4.8, dalam 0.5% dari Fable 5 pada CursorBench 3.2 dengan setengah harga, dan di depan Fable 5 pada OSWorld 2.0 dengan sepertiga biaya. Itu adalah angka yang dijalankan vendor yang diterbitkan oleh Anthropic, belum direproduksi secara independen pada 25 Juli 2026. Perlakukan itu sebagai klaim untuk diuji.
Opus 5 juga bukan yang teratas dari tumpukan Claude. Fable 5 tetap menjadi model Anthropic yang paling mampu yang dirilis secara luas, dan Opus 5 masih tertinggal dari Mythos 5 dalam eksploitasi keamanan siber dan penelitian biologi otonom. Kerangka yang jujur adalah kemampuan kelas *frontier* dengan setengah harga *frontier*, dengan batas atas yang disebutkan di atasnya. Lihat apa itu Claude Fable 5 jika beban kerja Anda mendekati batas tersebut.
Jalur mana yang cocok untuk Anda
| Tujuan | Jalur | Kelemahan |
|---|---|---|
| Chat, menulis, penelitian | Langganan Claude Pro atau Max | Batas terukur; Opus 5 menghabiskan lebih cepat dari 4.8 |
| Pengodean agen | Claude Code pada paket berbayar | Default yang lebih panjang dan delegasi subagen memakan jatah |
| Membuat prototipe integrasi | Uji coba API atau kredit promosi cloud | Saldo habis, lalu bayar per token |
| API produksi termurah | Batch ditambah *caching* ditambah `effort` `low` | Batch menambah latensi; *caching* membutuhkan prefiks stabil |
| API interaktif termurah | Tarif standar, *caching*, `effort` per tugas | Tidak ada diskon batch tersedia |
FAQ
Apakah Claude Opus 5 gratis? Tidak melalui API. Melalui aplikasi Claude, itu disertakan dengan langganan berbayar: default untuk Max, dan model dengan kinerja tertinggi yang tersedia untuk Pro. Materi peluncuran Anthropic tidak menyebutkan paket gratis sebagai permukaan Opus 5.
Bisakah saya mendapatkan akses API Claude Opus 5 gratis? Hanya melalui kredit uji coba akun baru atau kredit promosi di Amazon Bedrock, Google Cloud, atau Microsoft Foundry, yang semuanya memiliki saldo terbatas. Tidak ada tingkatan API gratis tanpa batas, dan tidak ada pihak ketiga yang sah dapat memberikannya.
Apa cara sah termurah untuk menjalankan Opus 5 dalam volume besar? Batch API dengan $2.50 / $12.50, ditambah *prompt caching* pada prefiks stabil apa pun di atas 512 token, ditambah `effort` `low` atau `medium` di mana evaluasi Anda memungkinkannya. Biarkan mode cepat mati dan jangan atur `inference_geo` tanpa persyaratan residensi.
Haruskah saya menonaktifkan *thinking* untuk menghemat token? Tidak. Menggabungkan *thinking* yang dinonaktifkan dengan `effort` `xhigh` atau `max` akan mengembalikan *error* 400, dan panduan Anthropic adalah untuk membiarkan *thinking* tetap aktif dan menurunkan `effort` sebagai gantinya. Dengan *thinking* yang dinonaktifkan, Opus 5 kadang-kadang menulis panggilan *tool* sebagai teks biasa yang tidak pernah dieksekusi dan membocorkan tag XML internal ke output yang terlihat. Verifikasi berapa biaya sebenarnya pengaturan Anda dengan membaca blok `usage`; permintaan yang disimpan di Apidog dengan *assertion* pada bidang-bidang tersebut secara otomatis menangkap regresi.
