Harga Claude Fable 5.1: Rincian Biaya Lengkap (2026)

Harga Claude Fable 5.1: $10/$50 per MTok, pembacaan cache $0,25 (75% di bawah Fable 5), tarif batch, dan perhitungan biaya terperinci di balik klaim penghematan 25% dan 45%.

INEZA Felin-Michel

INEZA Felin-Michel

2 September 2026

Harga Claude Fable 5.1: Rincian Biaya Lengkap (2026)

Apidog untuk Perusahaan

Penerapan On-Premises

SSO & RBAC

Sesuai SOC 2

Jelajahi Apidog Enterprise

Claude Fable 5.1 berharga $10 per juta token input dan $50 per juta token output, persis seperti yang dikenakan Fable 5. Angka yang berubah adalah pembacaan cache prompt: $0.25 per juta token, turun dari $1 pada Fable 5 dan separuh dari $0.50 Opus 5. Anthropic memperkirakan bahwa ini membuat beban kerja tipikal sekitar 25% lebih murah daripada Fable 5 dan beban kerja yang sangat agentik hingga sekitar 45% lebih murah.

Panduan ini menjabarkan setiap tarif di halaman harga resmi, mereproduksi klaim 25% dan 45% sehingga Anda dapat memasukkan rasio cache-hit Anda sendiri, menyajikan tiga contoh biaya per tugas nyata, dan mencantumkan pengungkit yang memengaruhi tagihan. Jika Anda ingin gambaran umum model terlebih dahulu, baca apa itu Claude Fable 5.1.

Tabel harga Claude Fable 5.1

Tarif Claude Fable 5.1
Input dasar $10 per juta token
Output $50 per juta token
Penulisan cache 5 menit $12.50 per juta (1.25x input)
Penulisan cache 1 jam $20 per juta (2x input)
Pembacaan cache (hit atau refresh) $0.25 per juta (0.025x input)
Input API Batch $5 per juta
Output API Batch $25 per juta
Premium konteks panjang Tidak ada; jendela 1M penuh ditagih dengan tarif standar
inference_geo: "us" 1.1x untuk setiap kategori token
Mode cepat Tidak tersedia (hanya Opus 5 dan Opus 4.8)
Tingkat Prioritas Tidak didukung
Pencarian web $10 per 1.000 pencarian, ditambah token

Claude Mythos 5.1 memiliki tarif yang sama. Diskon Batch dan pengganda cache saling bertumpuk, sehingga pembacaan cache dalam batch berharga $0.125 per juta.

Perbandingan harga pembacaan cache

Model Input dasar Pembacaan cache Pembacaan cache sebagai bagian dari input
Claude Fable 5.1 $10 $0.25 2.5%
Claude Fable 5 $10 $1.00 10%
Claude Opus 5 $5 $0.50 10%
Claude Opus 4.8 $5 $0.50 10%
Claude Sonnet 5 $2 $0.20 10%
Claude Haiku 4.5 $1 $0.10 10%

Setiap model Claude lainnya mematok harga cache hit sebesar 10% dari input dasar. Fable 5.1 mematoknya sebesar 2.5%. Efek praktisnya: cache hit Fable 5.1 lebih murah daripada cache hit Opus 5, meskipun input Fable 5.1 yang tidak di-cache dua kali lipat harganya. Untuk beban kerja di mana sebagian besar token input adalah awalan yang di-cache, tarif input efektif pada Fable 5.1 bisa turun di bawah Opus 5.

Satu catatan tentang Sonnet 5, karena perbandingan Opus 5 vs Sonnet 5 menandai kenaikan harga di bulan September: Anthropic membatalkannya. Sonnet 5 tetap seharga $2 dan $10.

Mereproduksi klaim 25% dan 45%

Anthropic tidak memublikasikan komposisi beban kerja di balik perkiraan tersebut, jadi anggap ini sebagai rekonstruksi yang menunjukkan rasio cache-hit yang mereka maksudkan, bukan sebagai model persis mereka.

Misalkan sebuah permintaan memiliki U token input yang tidak di-cache, C token input yang di-cache, dan O token output. Biaya per juta pada Fable 5 adalah 10U + 1.0C + 50O; pada Fable 5.1 adalah 10U + 0.25C + 50O. Penghematannya adalah 0.75C, dan persentase penghematannya adalah 0.75C / (10U + C + 50O).

Beban kerja gaya obrolan yang umum. Misalkan 20.000 token yang di-cache, 2.000 token input yang tidak di-cache, dan 1.500 token output per permintaan. Fable 5: 10(0.002) + 1.0(0.02) + 50(0.0015) = $0.02 + $0.02 + $0.075 = $0.115. Fable 5.1: $0.02 + $0.005 + $0.075 = $0.100. Penghematan: 13%. Untuk mencapai 25% yang diklaim Anthropic, bagian yang di-cache harus lebih besar relatif terhadap output, misalnya 60.000 token yang di-cache dibandingkan 1.500 token output yang sama, yang menghasilkan $0.155 vs $0.110, penghematan 29%.

Siklus agentik. Agen yang membaca ulang awalan cache 150.000 token pada setiap 40 giliran panggilan alat, menambahkan 1.000 token yang tidak di-cache per giliran, dan menghasilkan 800 token output per giliran. Per giliran pada Fable 5: 10(0.001) + 1.0(0.15) + 50(0.0008) = $0.01 + $0.15 + $0.04 = $0.20. Pada Fable 5.1: $0.01 + $0.0375 + $0.04 = $0.0875. Penghematan: 56% per giliran, sebelum penulisan cache satu kali. Selama 40 giliran, itu adalah $8.00 vs $3.50. Klaim Anthropic "hingga 45%" berada dalam kisaran ini setelah Anda menambahkan penulisan cache dan giliran tanpa cache yang dimiliki setiap agen nyata.

Aturan yang muncul: penghematan sebanding dengan rasio input yang di-cache terhadap output. Beban kerja yang banyak output (generasi panjang dari prompt pendek) hampir tidak merasakan perubahannya. Beban kerja yang banyak awalan (agen, RAG dengan konteks stabil besar, bot dukungan multi-giliran) melihat efek penuhnya.

Tiga contoh biaya per tugas yang diselesaikan

Ketiga contoh ini mengasumsikan Fable 5.1 dengan tarif standar, dengan penulisan cache 5 menit dibayar satu kali.

1. Ulasan kode tunggal. 30.000 token input (perbedaan ditambah prompt sistem), 4.000 token output, tanpa cache. Input $0.30, output $0.20. Total: $0.50. Ulasan yang sama pada Opus 5 adalah $0.25. Ini adalah kasus di mana Fable 5.1 harganya dua kali lipat, karena tidak ada yang di-cache.

2. Percakapan dukungan 25 giliran. Prompt sistem stabil 12.000 token yang di-cache satu kali ($0.15 untuk penulisan), kemudian 25 giliran masing-masing menambahkan 300 token input yang tidak di-cache dan 250 token output, dengan awalan yang disajikan dari cache. Input yang tidak di-cache selama percakapan: 7.500 token = $0.075. Pembacaan cache: 25 x 12.000 = 300.000 token = $0.075. Output: 6.250 token = $0.3125. Total: sekitar $0.61. Pada Fable 5, pembacaan cache saja akan menjadi $0.30, dengan total mendekati $0.84.

3. Pembangunan agentik dua jam. 120 giliran panggilan alat terhadap awalan yang tumbuh dari 20.000 menjadi 200.000 token (rata-rata 110.000 di-cache), 1.500 token yang tidak di-cache per giliran, 1.200 token output per giliran, dan sekitar enam refresh cache saat awalan tumbuh. Pembacaan cache: 120 x 110.000 = 13.2M token = $3.30. Input yang tidak di-cache: 180.000 token = $1.80. Output: 144.000 token = $7.20. Penulisan cache: sekitar 660.000 token seharga $12.50 = $8.25. Total: sekitar $20.55. Pada Fable 5, pembacaan cache akan menjadi $13.20 bukan $3.30, dengan total mendekati $30.45. Itu adalah penghematan 33% pada proses di mana output masih merupakan item biaya terbesar.

Perhatikan pada contoh 3 bahwa penulisan cache kini menjadi biaya terbesar kedua. Itu adalah sisi lain dari pembacaan murah: satu miss adalah 40 kali lipat dari satu hit, jadi apa pun yang mengatur ulang cache di tengah sesi (membangun ulang prompt sistem, mengedit giliran sebelumnya, mengubah array alat) memakan biaya jauh lebih banyak relatif terhadap kondisi stabil daripada yang terjadi pada Fable 5.

Pengungkit yang memengaruhi tagihan

Upaya. output_config.effort adalah pengungkit tunggal terbesar pada token output, dan output berharga $50 per juta. Panduan Anthropic untuk Fable 5.1 adalah memulai dengan high, dan klaim mereka adalah bahwa medium secara kasar menyamai kualitas Fable 5 dengan biaya lebih rendah sementara low seringkali kompetitif dengan Opus dan Sonnet dalam biaya per tugas. Jalankan pengujian pada evaluasi Anda sendiri. Beta upaya per pesan memungkinkan Anda untuk menurunkan ke low untuk giliran rutin dan menaikkannya untuk yang sulit tanpa reset cache.

Pertahankan cache tetap aktif. Prompt caching adalah diskonnya. Dengan pembacaan seharga $0.25 dan penulisan seharga $12.50, titik impas pada TTL 5 menit adalah satu hit. Untuk jeda waktu antara lima hingga enam puluh menit, pengiriman ulang keep-alive max_tokens: 0 pada TTL 5 menit biasanya lebih murah daripada membayar penulisan 2x untuk TTL 1 jam. Dan disiplin hanya-menambah yang mempertahankan blok pemikiran pada model ini juga mempertahankan cache: jangan pernah membangun ulang system atau tools di tengah sesi, gunakan pesan sistem di tengah percakapan untuk perubahan, dan gunakan pesan lingkup giliran untuk pengingat per giliran.

Batch apa yang bisa menunggu. API Batch memotong biaya separuhnya untuk semua, jadi permintaan batch Fable 5.1 adalah $5 dan $25, sama dengan harga sinkron Opus 5. Evaluasi, pengisian ulang data, dan pemrosesan dokumen malam hari termasuk dalam kategori ini. Perhatikan bahwa fallbacks ditolak pada batch, jadi item yang ditolak memerlukan pengiriman ulang manual.

Pilih tingkatan per rute. Dokumentasi Anthropic sendiri menyatakan untuk memulai dengan Opus 5 dan beralih ke Fable 5.1 ketika Opus 5 dengan upaya lebih tinggi masih belum memenuhi. Untuk rute di mana Opus 5 lulus evaluasi Anda, Anda membayar dua kali lipat tanpa hasil. Perbandingan Fable 5.1 vs Opus 5 membahas keputusan berdasarkan beban kerja.

Perhatikan biaya overhead alat. Setiap permintaan dengan alat membawa prompt sistem penggunaan alat yang tersembunyi. Anthropic memublikasikan jumlah untuk Opus 5 (286 token) tetapi belum memublikasikan angka Fable 5.1, jadi ukur dengan endpoint penghitung token. Perangkat alat browser menambahkan sekitar 6.600 token per permintaan dan perangkat alat komputer sekitar 4.500, semuanya di-cache setelah pengiriman pertama.

Penolakan gratis, percobaan ulang tidak. Penolakan pengklasifikasi sebelum output apa pun tidak ditagih. Sebuah fallback sisi server menagih tarif model fallback untuk percobaan ulang, dan kredit fallback Anthropic mengembalikan biaya cache dari peralihan. Instrumentasikan penolakan sebagai metrik Anda sendiri sehingga Anda tahu berapa banyak pengeluaran Fable 5.1 Anda yang dilayani oleh Opus 5.

Sebagian besar teknik umum dalam panduan kami untuk memotong tagihan API Claude masih berlaku, dengan perhitungan pembacaan cache bergeser menguntungkan Fable 5.1.

Apa yang tidak bisa Anda beli di Fable 5.1

Mode cepat hanya tersedia di Opus 5 dan Opus 4.8, seharga $10 dan $50. Tidak ada cara untuk membayar output Fable 5.1 yang lebih cepat. Tingkat Prioritas tidak didukung pada Fable 5.1 atau Mythos 5.1, sementara Fable 5 masih mendukungnya, jadi perencanaan kapasitas perusahaan yang bergantung padanya harus tetap menggunakan Fable 5 atau beralih ke Opus 5. Dan retensi data nol tidak tersedia kecuali Anthropic secara eksplisit mengizinkannya; organisasi ZDR akan mendapatkan kode 400 pada setiap permintaan.

Memeriksa pengeluaran aktual Anda di Apidog

Satu-satunya cara yang andal untuk mengetahui biaya suatu permintaan adalah objek usage, dan cara tercepat untuk membacanya adalah dengan koleksi pengujian. Di Apidog, simpan prompt sistem produksi Anda sebagai permintaan dengan cache_control aktif, kirim dua kali, dan tambahkan pernyataan pada usage.cache_creation_input_tokens untuk pengiriman pertama dan usage.cache_read_input_tokens untuk yang kedua. Kemudian tambahkan skrip pasca-respons yang mengalikan setiap bidang dengan tarifnya dan mencatat biaya per permintaan. Jalankan koleksi setiap kali Anda mengubah prompt atau definisi alat, dan Anda akan menangkap editan yang merusak cache sebelum memengaruhi tagihan. Unduh Apidog untuk membangunnya; panduan API menunjukkan permintaan yang tepat.

Harga Fable 5.1 di aplikasi Claude

Harga API adalah per token. Di aplikasi Claude, Fable 5.1 diukur berdasarkan paket. Paket Max mencakup model Fable hingga 50% dari batas penggunaan mingguan tanpa biaya tambahan, kemudian berlanjut dengan kredit penggunaan. Kursi Tim Pro dan standar mengukur Fable 5.1 melalui kredit penggunaan sejak pesan pertama. Kursi standar Enterprise memerlukan kredit penggunaan yang diaktifkan untuk penggunaan di luar batas paket, dan tagihan Enterprise berbasis penggunaan dengan tarif API standar. Permintaan yang dialihkan oleh pengaman ke model lain tidak dikenakan biaya dengan harga Fable. Panduan jalur gratis dan termurah mencakup artinya dalam praktik.

FAQ

Berapa biaya Claude Fable 5.1 per juta token? Input $10 dan output $50, tidak berubah dari Fable 5. Pembacaan cache $0.25 per juta, penulisan cache $12.50 (5 menit) dan $20 (1 jam), dan API Batch $5 dan $25.

Apakah Claude Fable 5.1 lebih murah daripada Fable 5? Per token, tidak. Dalam praktiknya, ya untuk apa pun yang menggunakan caching prompt, karena pembacaan cache turun dari $1 menjadi $0.25 per juta. Anthropic memperkirakan 25% lebih murah untuk beban kerja tipikal dan hingga 45% untuk beban kerja agentik. Beban kerja yang banyak output tidak banyak berubah.

Apakah Claude Fable 5.1 lebih murah daripada Opus 5? Tidak di-cache, tidak: harganya persis dua kali lipat. Di-cache, situasinya berbalik: cache hit Fable 5.1 ($0.25) harganya setengah dari cache hit Opus 5 ($0.50). Output masih $50 vs $25, jadi Opus 5 unggul pada rute yang banyak output.

Apakah Claude Fable 5.1 memiliki mode cepat atau Tingkat Prioritas? Tidak untuk keduanya. Mode cepat hanya Opus 5 dan Opus 4.8. Tingkat Prioritas didukung pada Fable 5 tetapi tidak pada Fable 5.1.

Apakah ada premium konteks panjang pada Claude Fable 5.1? Tidak. Jendela token 1M penuh ditagih dengan tarif standar, dan diskon cache serta batch berlaku di seluruhnya.

Berapa biaya Claude Fable 5.1 di Bedrock atau Google Cloud? Platform tersebut menetapkan harga mereka sendiri dan menambahkan premium 10% untuk endpoint regional. Platform Claude di AWS dan Microsoft Foundry menagih dengan tarif API standar melalui Unit Konsumsi Claude. Panduan ketersediaan cloud kami mencakup pengaturan di masing-masing.

Mengembangkan API dengan Apidog

Apidog adalah alat pengembangan API yang membantu Anda mengembangkan API dengan lebih mudah dan efisien.