Harga Claude Fable 5 dimulai dari $10 per juta token input dan $50 per juta token output di Anthropic API. Itu adalah keseluruhan cerita bagi kebanyakan orang yang hanya ingin tahu angkanya, tetapi gambaran lengkapnya memiliki beberapa bagian yang perlu diketahui sebelum Anda mengintegrasikan model ini ke dalam produksi. Fable 5 diluncurkan pada 9 Juni 2026, dan Anthropic memposisikannya sebagai biaya "kurang dari setengah harga Claude Mythos Preview." Panduan ini menjelaskan setiap pendorong biaya: tarif API, apa yang Anda bayar pada paket Pro dan Max, tiga contoh yang dihitung dengan aritmatika nyata, dan bagaimana Fable 5 bersaing dengan model yang lebih murah seperti Claude Opus 4.8. Jika Anda hanya memerlukan pemeriksaan biaya cepat, bagian selanjutnya menjelaskannya.
TL;DR
Claude Fable 5 berharga $10 per juta token input dan $50 per juta token output pada API. Dari 9 Juni hingga 22 Juni 2026, itu termasuk gratis di paket Pro, Max, Team, dan Enterprise berbasis kursi. Mulai 23 Juni 2026, penggunaan pada paket-paket tersebut akan menggunakan kredit penggunaan terukur dengan tarif token $10/$50 yang sama.
Harga Claude Fable 5 secara singkat
Berikut adalah angka-angka utama dalam satu tabel. Kolom "per 1K token" adalah harga yang sama yang dinyatakan dalam unit yang lebih kecil, yang berguna saat Anda memperkirakan biaya satu permintaan.
| Jenis Token | Harga per 1 Juta token | Harga per 1 Ribu token | Catatan |
|---|---|---|---|
| Input | $10.00 | $0.01 | Semua yang Anda kirim: prompt, pesan sistem, konteks, definisi alat |
| Output | $50.00 | $0.05 | Semua yang dihasilkan model, termasuk penalaran dan panggilan alat |
ID model API adalah claude-fable-5. Token output berharga 5x lipat dari token input, yang normal untuk model Anthropic frontier dan membentuk sebagian besar saran optimisasi nanti dalam postingan ini. Anda dapat mengonfirmasi tarif saat ini kapan saja di halaman harga Anthropic dan di dokumen model dan harga.
Apa yang Anda bayar di API
Anthropic menagih dua hal secara terpisah, dan Anda membayar keduanya.
Token input adalah semua yang Anda kirim ke model dalam sebuah permintaan. Itu termasuk teks prompt Anda, pesan sistem, giliran percakapan sebelumnya yang Anda putar ulang untuk konteks, dokumen yang diambil, dan JSON untuk alat apa pun yang Anda definisikan. Ini dihitung seharga $10 per juta, atau satu sen per seribu.

Token output adalah semua yang dihasilkan model kembali. Itu adalah jawaban yang terlihat ditambah penalaran internal apa pun yang dihasilkan model dan argumen panggilan alat apa pun yang ditulisnya. Ini dihitung seharga $50 per juta, atau lima sen per seribu.
Jadi, satu permintaan yang mengirimkan 2.000 token masuk dan mendapatkan 600 token kembali akan membebani Anda 2.000 token input ditambah 600 token output, yang ditagih dengan tarif terpisah. Tidak ada biaya tetap per permintaan di atas itu. Tagihan Anda murni adalah jumlah token input dan output di setiap panggilan yang Anda buat.
Anthropic mendeskripsikan Fable 5 sebagai "kurang dari setengah harga Claude Mythos Preview," yang merupakan posisi model tersebut terhadap tingkat pratinjau frontier sebelumnya. Model saudara yang dibatasi, Claude Mythos 5, memiliki tarif input $10 dan output $50 yang identik, jadi beralih di antara keduanya tidak mengubah biaya per token Anda. Jika Anda menginginkan latar belakang konseptual tentang model itu sendiri sebelum menganggarkannya, apa itu Claude Fable 5 mencakup sisi kemampuannya.
Penyertaan paket vs kredit penggunaan
Penetapan harga di API adalah satu hal. Apa yang Anda bayar dalam paket langganan Claude mengikuti jadwal yang berbeda, dan tanggal-tanggal tersebut penting.
Dari 9 Juni hingga 22 Juni 2026, Claude Fable 5 disertakan tanpa biaya tambahan pada paket Pro, Max, Team, dan Enterprise berbasis kursi. Selama periode ini Anda dapat menggunakan model pada paket-paket tersebut tanpa dihitung terhadap saldo terukur apa pun. Ini adalah promosi periode peluncuran, bukan status permanen.
Pada 23 Juni 2026, Fable 5 dihapus dari daftar yang termasuk dalam paket-paket tersebut. Setelah tanggal tersebut, penggunaan Fable 5 di paket Pro, Max, Team, atau Enterprise berbasis kursi akan menggunakan kredit penggunaan, yang berarti akan diukur dengan tarif $10 input dan $50 output per juta token yang sama dengan yang akan Anda bayar di API mentah. Anthropic telah menyatakan bahwa mereka berencana untuk mengembalikan beberapa akses paket standar saat kapasitas memungkinkan, jadi kondisi pasca-23 Juni mungkin akan melunak nanti, tetapi perilaku kredit terukur adalah yang harus dianggarkan saat ini.
Paket Enterprise berbasis konsumsi berbeda. Fable 5 sepenuhnya tersedia di sana sejak peluncuran tanpa perlu khawatir tentang jendela penyertaan, karena paket-paket tersebut menagih berdasarkan penggunaan sejak awal. Jika pertanyaan akses Anda lebih luas dari penagihan, cara mengakses Claude Fable 5 memetakan setiap titik masuk.
Pelajaran praktisnya: jika Anda membuat prototipe di kursi Pro atau Max minggu ini, Anda mendapatkan kebebasan penuh hingga 22 Juni. Rencanakan eksperimen yang lebih berat dengan sesuai, dan jika Anda mengharapkan lalu lintas produksi yang berkelanjutan, modelkan biaya Anda berdasarkan tarif API $10/$50 daripada jendela gratis, karena itulah yang akan Anda hadapi.
Contoh yang dikerjakan: berapa biaya beban kerja nyata
Angka per juta token adalah abstrak. Berikut adalah tiga beban kerja konkret dengan aritmatika yang dijelaskan, sehingga Anda dapat memetakan penggunaan Anda sendiri ke dalamnya.
Rumusnya sama setiap kali: (token input / 1,000,000) * $10 ditambah (token output / 1,000,000) * $50.
Contoh 1: giliran chatbot dukungan
Giliran dukungan pelanggan yang khas membawa beberapa instruksi sistem dan riwayat percakapan singkat, kemudian mengembalikan jawaban yang terfokus. Katakanlah 1.500 token input dan 500 token output.
- Input: 1,500 / 1,000,000 * $10 = $0.015
- Output: 500 / 1,000,000 * $50 = $0.025
- Total: $0.04 per giliran
Empat sen per giliran. Jika chatbot itu menangani 1.000 giliran sehari, Anda akan menghabiskan sekitar $40/hari, atau sekitar $1.200/bulan, sebelum pendorong biaya di bagian selanjutnya. Itu adalah pemeriksaan awal yang berguna: beban kerja bergaya obrolan di Fable 5 tetap murah per panggilan tetapi bertambah seiring volume.
Contoh 2: permintaan pembuatan kode
Pembuatan kode biasanya mengirimkan lebih banyak konteks: file yang sedang Anda edit, cuplikan terkait, dan instruksi. Katakanlah 8.000 token input dan 3.000 token output untuk fungsi yang dihasilkan secara substansial dengan penjelasan.
- Input: 8,000 / 1,000,000 * $10 = $0.08
- Output: 3,000 / 1,000,000 * $50 = $0.15
- Total: $0.23 per permintaan
Perhatikan bahwa meskipun Anda mengirimkan input hampir 3x lebih banyak daripada output, output tetap mendominasi tagihan sebesar $0.15 dari $0.23. Rasio harga output-ke-input 5:1 itulah mengapa memangkas generasi yang bertele-tele menghemat uang sungguhan.
Contoh 3: menjalankan agen dengan horizon panjang
Jalankan agen yang membaca basis kode atau dokumen besar dan melakukan banyak langkah akan meningkatkan input secara signifikan. Katakanlah 300.000 token input (banyak konteks yang diambil diputar ulang di seluruh langkah) dan 50.000 token output.
- Input: 300,000 / 1,000,000 * $10 = $3.00
- Output: 50,000 / 1,000,000 * $50 = $2.50
- Total: $5.50 per jalankan
Satu kali jalankan agen yang mendalam membutuhkan sekitar lima setengah dolar. Jalankan itu 200 kali sehari di seluruh tim dan Anda akan menghabiskan $1.100/hari. Inilah tepatnya beban kerja di mana caching prompt membuahkan hasil, karena agen memutar ulang konteks besar yang sama berulang kali. Kami akan mengukurnya selanjutnya.
Cara memangkas tagihan Claude Fable 5 Anda
Setelah Anda memutuskan Fable 5 adalah model yang tepat, ini adalah fitur-fitur API Anthropic standar yang menurunkan biaya. Tidak ada yang memerlukan akses khusus.
- Caching Prompt. Pembacaan cache berharga sekitar 0.1x harga input, jadi input yang di-cache berjalan sekitar $1 per juta, bukan $10. Penulisan cache berharga sekitar 1.25x input (sekitar $12.50 per juta untuk TTL 5 menit), jadi caching akan menguntungkan ketika Anda menggunakan kembali konteks yang sama di banyak permintaan. Ambil jalankan agen dari Contoh 3: jika 250.000 dari 300.000 token input adalah konteks stabil yang dilayani dari cache, input tersebut turun dari $3.00 menjadi sekitar $0.25 (250K pembacaan cache pada $1/Juta = $0.25, ditambah 50K input segar pada $10/Juta = $0.50). Seluruh jalankan turun dari $5.50 menjadi sekitar $3.25. Untuk agen dan chatbot yang memutar ulang prompt sistem besar, caching adalah perubahan biaya terbesar yang dapat Anda lakukan.
- API Batch. Untuk pekerjaan yang tidak memerlukan jawaban instan, seperti pemrosesan dokumen semalam atau klasifikasi massal, API Batch berjalan sekitar 50% lebih murah. Itu mengubah tarif $10/$50 menjadi sekitar $5/$25, yang merupakan harga tingkat Opus untuk output tingkat Fable. Jika pekerjaan Anda mentolerir penundaan, ini hampir seperti uang gratis.
- Ukuran model yang tepat. Tidak setiap permintaan membutuhkan Fable 5. Arahkan penalaran yang sulit dan baru ke Fable dan kirimkan lalu lintas rutin ke Opus 4.8, Sonnet 4.6, atau Haiku 4.5. Router berjenjang yang mengirimkan 80% panggilan ke model yang lebih murah dapat memangkas tagihan lebih dari setengahnya sendiri.
- Pangkas max_tokens. Output adalah sisi yang mahal dengan $50 per juta. Atur
max_tokenske apa yang sebenarnya dibutuhkan tugas daripada membiarkannya terbuka lebar, dan minta jawaban singkat dalam prompt. Memangkas generasi 3.000 token menjadi 1.500 token mengurangi separuh biaya output dari panggilan tersebut. - Streaming respons. Streaming tidak mengubah harga per token, tetapi memungkinkan Anda menghentikan generasi lebih awal setelah Anda mendapatkan yang dibutuhkan, dan meningkatkan latensi yang dirasakan sehingga Anda tidak terlalu tergoda untuk meminta terlalu banyak. Dikombinasikan dengan
max_tokensyang ketat, itu menjaga pengeluaran output tetap jujur.
Lacak pengeluaran Claude Fable 5 dengan Apidog
Cara paling jelas untuk menjaga biaya token tetap terlihat saat Anda membangun adalah dengan mengawasinya di setiap permintaan, bukan di akhir bulan ketika tagihan tiba. Apidog adalah klien API yang dapat Anda gunakan untuk mengirim permintaan ke Anthropic API dan memeriksa dengan tepat apa yang kembali.

Ketika Anda memanggil claude-fable-5 melalui Apidog, badan respons menyertakan objek usage dengan input_tokens dan output_tokens untuk permintaan tersebut. Membaca kedua angka tersebut memberi tahu Anda biaya pasti dari panggilan: kalikan token input dengan $0.00001 dan token output dengan $0.00005, tambahkan keduanya, dan Anda memiliki tagihan untuk permintaan tersebut hingga pecahan sen. Melakukan ini saat Anda mengiterasi prompt segera menunjukkan kepada Anda ketika perubahan meningkatkan jumlah token Anda, jauh sebelum muncul dalam produksi.
Alur kerja praktis: siapkan permintaan penyelesaian obrolan Anthropic di Apidog, simpan beberapa prompt representatif sebagai contoh, dan bandingkan angka usage di seluruh variasi prompt. Anda akan segera melihat pengeditan pesan sistem mana yang menambahkan ratusan token input dan perubahan format respons mana yang membengkakkan output. Lingkaran umpan balik itu sulit didapat hanya dari dasbor. Unduh Apidog untuk mengaturnya, dan pasangkan dengan panduan API Claude Fable 5 untuk struktur permintaan. Jika Anda mengawasi anggaran dengan cermat, cara menggunakan Claude Fable 5 secara gratis mencakup jalur tanpa biaya selama jendela penyertaan.
Apidog juga menyimpan riwayat permintaan, sehingga Anda dapat melihat kembali panggilan sebelumnya dan jumlah tokennya saat Anda memperkirakan biaya fitur baru. Menggunakan Apidog sebagai lapisan pemeriksaan biaya Anda selama pengembangan berarti tidak ada kejutan token saat lalu lintas meningkat.
Harga Claude Fable 5 bermuara pada sepasang angka sederhana, $10 input dan $50 output per juta token, dengan jendela paket gratis hingga 22 Juni dan kredit terukur setelah 23 Juni. Sisanya adalah perhitungan beban kerja dan beberapa pendorong biaya: cache konteks stabil Anda, kelompokkan apa yang tidak mendesak, dan turunkan ke Opus 4.8 atau Sonnet 4.6 ketika tugas tidak memerlukan tingkat frontier. Langkah selanjutnya adalah menyiapkan satu permintaan claude-fable-5 dan membaca objek usage agar perkiraan Anda berdasarkan jumlah token yang sebenarnya. Unduh Apidog untuk mengirim permintaan pertama itu dan melihat biayanya secara real time.
