Claude Fable 5.1 vs Fable 5: Perbedaan dan Haruskah Anda Upgrade?

Claude Fable 5.1 vs Fable 5: harga sama, biaya baca cache dipotong menjadi $0,25, setiap delta benchmark, 3 perubahan yang merusak, kehilangan Tingkat Prioritas, dan aturan keputusan berdasarkan beban kerja.

INEZA Felin-Michel

INEZA Felin-Michel

2 September 2026

Claude Fable 5.1 vs Fable 5: Perbedaan dan Haruskah Anda Upgrade?

Apidog untuk Perusahaan

Penerapan On-Premises

SSO & RBAC

Sesuai SOC 2

Jelajahi Apidog Enterprise

Claude Fable 5.1 menggantikan Fable 5 pada 1 September 2026, dengan harga yang sama $10 dan $50 per juta token, dengan pembacaan cache dipangkas dari $1 menjadi $0.25 per juta dan angka yang lebih baik pada setiap tolok ukur yang diterbitkan Anthropic. Fable 5 masih tersedia, dan halaman model Fable 5 Anthropic menjaminnya hingga setidaknya 9 Juni 2027. Jadi, pertanyaannya bukan apakah Fable 5.1 lebih baik di atas kertas. Pertanyaannya adalah apakah peningkatan ini sepadan dengan biaya migrasinya untuk beban kerja Anda, dan apakah ada dari tiga perubahan yang merusak yang memengaruhi Anda.

Perbandingan ini membahas apa yang identik, apa yang meningkat, apa yang menjadi lebih mahal atau sulit, dan aturan keputusan berdasarkan beban kerja. Sumbernya adalah postingan peluncuran Anthropic dan Apa yang baru di Claude Fable 5.1. Untuk lembar spesifikasi lengkap, lihat apa itu Claude Fable 5.1.

Perbandingan berdampingan

Claude Fable 5.1 Claude Fable 5
ID Model claude-fable-5-1 claude-fable-5
Dirilis 1 September 2026 9 Juni 2026 (ditangguhkan 12 Juni, kembali 1 Juli)
Pensiun Tidak lebih cepat dari 1 September 2027 Tidak lebih cepat dari 9 Juni 2027
Konteks / keluaran maks 1M / 128K 1M / 128K
Batas pengetahuan Juni 2026 Januari 2026
Harga masukan / keluaran $10 / $50 $10 / $50
Pembacaan cache $0.25 per juta $1.00 per juta
Penulisan cache $12.50 (5m), $20 (1j) Sama
Batch $5 / $25 Sama
Tokenizer Sama (generasi Opus 4.7) Sama
Berpikir Adaptif, selalu aktif Adaptif, selalu aktif
tool_choice paksa 400 Diterima
Blok berpikir dapat dibaca oleh model yang lebih lama Tidak Ya
Pemeriksaan pengeditan riwayat Ya (diberlakukan untuk akun yang dibuat pada atau setelah 31-08-2026) Tidak
Tingkat Prioritas Tidak didukung Didukung
Upaya per pesan Ya (beta) Tidak
Pesan sistem dengan cakupan giliran Ya (beta) Tidak
thinking.display: "updates" Ya (beta) Ya (beta)
Asal konten Tanda air teks + C2PA pada media Tanda air teks
Penyimpanan data Wajib 30 hari, Model Tercakup Sama
Kategori penolakan Lima yang sama Lima yang sama

Apa yang identik

Lebih dari yang mungkin Anda duga. Permukaan API, jendela konteks 1M, batas keluaran 128K, harga per token, tokenizer, minimum cache 512 token, pemikiran adaptif yang selalu aktif, nilai default "omitted" untuk thinking.display, larangan prefill, larangan parameter sampling, pesan sistem di tengah percakapan, dan set lengkap kategori penolakan serta mekanisme fallback semuanya tetap tidak berubah. Anthropic mengatakan prompt Fable 5 yang ada seharusnya berkinerja baik di Fable 5.1 tanpa perubahan.

Itu berarti sebagian besar yang kami tulis tentang Fable 5 masih berlaku: panduan batas laju (kedua model bahkan berbagi satu kumpulan batas laju), penjelasan pengamanan, dan panduan ketersediaan cloud.

Apa yang meningkat

Tolok ukur, berdasarkan angka Anthropic. Setiap baris yang diterbitkan bergerak menguntungkan Fable 5.1. Namun, jaraknya tidak seragam.

Tolok Ukur Fable 5.1 Fable 5 Delta
Terminal-Bench-Science 0.1 52.6% 24.7% +27.9
AutomationBench 31.4% 17.1% +14.3
Terminal-Bench 4.0 55.8% 42.0% +13.8
GDPval-AA v2 1853 1723 +130 Elo
OSWorld 2.0 (ketat) 41.7% 36.1% +5.6
OSWorld 2.0 (parsial) 77.9% 72.9% +5.0
Ujian Terakhir Kemanusiaan (tanpa alat) 60.9% 57.8% +3.1
CursorBench 3.2.0 73.4% 70.5% +2.9
Ujian Terakhir Kemanusiaan (dengan alat) 65.0% 63.8% +1.2

Polanya: lompatan terbesar ada pada tolok ukur agen dengan horizon panjang (penelitian ilmiah di terminal, otomatisasi alur kerja bisnis, pengkodean agen). Yang terkecil ada pada tugas pengkodean berbasis pengetahuan dan gaya IDE. Jika beban kerja Anda seperti bagian atas tabel itu, peningkatannya besar. Jika seperti bagian bawah, hanya beberapa poin. Semua ini dijalankan oleh vendor tanpa reproduksi independen; rincian tolok ukur membahas baris per baris.

Pembacaan cache dengan seperempat harga. Sesuai halaman harga, ini adalah perubahan yang paling pertama dirasakan oleh sebagian besar pengguna Fable 5. Sebuah sesi agen panjang yang membaca ulang awalan 150.000 token setiap giliran membayar $0.15 per giliran untuk pembacaan cache di Fable 5 dan membayar $0.0375 di Fable 5.1. Perkiraan Anthropic adalah 25% lebih murah pada beban kerja biasa dan hingga 45% pada beban kerja agen. Rincian harga mereproduksi perhitungan tersebut dengan tiga contoh yang dikerjakan.

Lebih sedikit positif palsu dari pengamanan. Klasifikator Fable 5 adalah keluhan paling umum setelah kembali pada bulan Juli. Anthropic melaporkan klasifikator biologi memicu 85% lebih jarang pada permintaan biologi dasar dan medis yang tidak berbahaya dibandingkan Fable 5 saat diluncurkan, dan pengamanan siber menyebabkan sekitar 60% lebih sedikit intervensi per sesi Claude Code. Fable 5.1 juga dapat mengidentifikasi kerentanan dalam kode sumber, yang ditolak oleh Fable 5. Pengembangan eksploitasi masih ditolak.

Ruang kepala upaya. Anthropic mengatakan medium pada Fable 5.1 kira-kira cocok dengan Fable 5 dengan biaya lebih rendah, dan peningkatan dibandingkan Fable 5 paling besar pada xhigh dan max. Secara praktis, beban kerja Fable 5 yang berjalan pada high seringkali dapat berpindah ke Fable 5.1 pada medium untuk kualitas yang sama dan token keluaran yang lebih sedikit, atau tetap pada high untuk peningkatan kualitas.

Batas pengetahuan. Juni 2026 versus Januari 2026. Lima bulan ekstra rilis kerangka kerja, perubahan API, dan peluncuran model yang diketahui model tanpa perlu diberitahu.

Tiga fitur harness. Perubahan upaya per pesan tanpa reset cache, pesan sistem cakupan giliran untuk pengingat per giliran, dan pembaruan kemajuan yang dapat dibaca antar panggilan alat. Fable 5 memiliki yang terakhir; dua yang pertama adalah baru.

Apa yang menjadi lebih sulit

Penggunaan alat paksa dihapus. tool_choice any dan tool mengembalikan 400 pada Fable 5.1. Jika Anda menggunakannya untuk menjamin JSON, beralihlah ke strict: true di bawah auto atau ke keluaran terstruktur. Jika Anda menggunakannya karena aplikasi memerlukan panggilan pada giliran tertentu, tambahkan pesan sistem di tengah percakapan yang menyatakan demikian. Tidak sulit, tetapi ini adalah perubahan kode pada setiap situs panggilan alat paksa.

Blok berpikir bersifat satu arah. Fable 5.1 membaca blok berpikir Fable 5, jadi percakapan yang bergerak maju mempertahankan alasannya. Fable 5 tidak dapat membaca blok Fable 5.1. Selama pemindahan bertahap di mana router mungkin mengirim percakapan kembali, API akan menghilangkan blok tersebut, tanpa tagihan, dan Fable 5 akan merencanakan ulang giliran tersebut.

Pemeriksaan pengeditan riwayat. Blok berpikir Fable 5.1 hanya berlaku dalam percakapan persis yang menghasilkannya. Edit giliran sebelumnya, bangun ulang prompt sistem, atau tukar larik alat, dan permintaan berikutnya yang memutar ulang blok tersebut akan gagal pada akun yang dibuat pada atau setelah 31 Agustus 2026. Fable 5 tidak pernah memeriksa. Jika harness Anda menyuntikkan dan menghapus pengingat per giliran, menyegarkan tanggal di prompt sistem, atau mengompresi di klien sambil menjaga giliran terbaru tetap verbatim, alokasikan waktu nyata di sini. Panduan pemikiran yang diawetkan mencakup audit dan perbaikan, dan panduan migrasi memiliki daftar periksa lengkap.

Tingkat Prioritas. Fable 5 mendukungnya; Fable 5.1 tidak. Untuk jaminan kapasitas perusahaan, itu adalah alasan untuk tetap menggunakan Fable 5 sampai Anthropic menambahkannya.

Perilaku loop agen. Tiga pergeseran yang dapat disesuaikan prompt: Fable 5.1 mungkin mengeluarkan satu panggilan alat per giliran di mana Fable 5 mengelompokkan beberapa, ia menulis lebih sedikit pembaruan kemajuan, dan pada upaya low ia menjawab dari memori lebih sering daripada mencari. Masing-masing memiliki perbaikan satu baris di panduan prompting, tetapi masing-masing juga merupakan perubahan yang harus Anda perhatikan.

Aturan keputusan berdasarkan beban kerja

Tingkatkan sekarang jika pekerjaan Anda adalah pengkodean agen yang berjalan lama, penelitian multi-langkah, atau pembuatan dokumen dan spreadsheet. Di situlah peningkatan tolok ukur terkonsentrasi, di mana harga pembacaan cache paling terasa, dan di mana penurunan positif palsu pengamanan paling penting. Cognition mengatakan akan memindahkan lalu lintas Devin-nya ke Fable 5.1 pada hari peluncuran, yang merupakan sinyal publik paling jelas dari logika tersebut.

Tingkatkan setelah audit harness jika kode Anda membangun larik messages itu sendiri dan melakukan apa pun selain menambahkan giliran. Jalankan pemeriksaan pengeditan riwayat tiga langkah terlebih dahulu, perbaiki setiap prefix_binding_mismatch, lalu beralih. Pemeriksaannya murah; menemukannya dalam produksi tidak.

Tingkatkan ke medium jika Fable 5 pada high melakukan pekerjaan rutin dengan baik dan Anda menginginkan kualitas yang sama dengan biaya lebih rendah. Jalankan ulang penyapuan upaya pada evaluasi Anda daripada mengasumsikan levelnya saling memetakan.

Tetap gunakan Fable 5 jika Tingkat Prioritas merupakan penopang beban, atau jika beban kerja Anda padat keluaran dengan sedikit awalan yang di-cache (di mana perubahan harga hampir tidak terasa dan biaya migrasi adalah biaya tambahan murni). Fable 5 dijamin hingga setidaknya 9 Juni 2027, jadi belum ada batas waktu untuk ini.

Pertimbangkan Opus 5 sebagai gantinya jika jawaban jujurnya adalah Fable 5 sudah lebih dari model yang Anda butuhkan. Panduan Anthropic sendiri adalah memulai dengan Opus 5 dan hanya naik jika tidak mencukupi. Perbandingan Fable 5.1 vs Opus 5 membahas hal tersebut dengan setengah harga.

Menguji kedua model satu sama lain di Apidog

Cara paling jelas untuk menyelesaikan ini untuk beban kerja Anda sendiri adalah dengan koleksi berdampingan. Di Apidog, simpan sepuluh prompt produksi tersulit Anda sebagai permintaan dengan model sebagai variabel lingkungan, jalankan koleksi sekali terhadap claude-fable-5 dan sekali terhadap claude-fable-5-1 dengan upaya yang sama, dan bandingkan tiga bidang per permintaan: teks, usage.output_tokens, dan usage.cache_read_input_tokens pada jalankan kedua. Tambahkan satu permintaan lagi yang menggunakan tool_choice paksa, sehingga Anda melihat 400 sebelum pengguna Anda. Unduh Apidog untuk mengaturnya; panduan API memiliki badan permintaan.

FAQ

Apakah Claude Fable 5.1 model baru atau pembaruan untuk Fable 5? Model baru dengan ID sendiri, claude-fable-5-1, dan tanggal pensiunnya sendiri. Ia menggunakan tokenizer yang sama dan harga per token yang sama dengan Fable 5 dan dilatih menggunakan data hingga Juni 2026.

Apakah Fable 5.1 lebih mahal dari Fable 5? Tidak. Sama $10 dan $50 per juta token, penulisan cache yang sama, tarif batch yang sama. Pembacaan cache lebih murah: $0.25 per juta versus $1.

Apakah kode Fable 5 saya akan berfungsi di Fable 5.1? Sebagian besar. tool_choice paksa mengembalikan 400, dan kode yang mengedit riwayat percakapan antar permintaan akan membatalkan blok berpikir pada akun yang dibuat pada atau setelah 31 Agustus 2026. Selebihnya tetap berlaku.

Apakah Fable 5 akan dihentikan? Belum. Komitmen Anthropic adalah bahwa Fable 5 tidak akan dihentikan sebelum 9 Juni 2027, pada platform yang dioperasikan Anthropic. Bedrock dan Google Cloud menetapkan tanggalnya sendiri.

Mana yang lebih baik dalam coding, Fable 5.1 atau Fable 5? Berdasarkan angka Anthropic, Fable 5.1: 55.8% vs 42.0% pada Terminal-Bench 4.0 dan 73.4% vs 70.5% pada CursorBench 3.2.0. Kesenjangan terminal-agen besar; kesenjangan gaya IDE kecil. Keduanya adalah hasil yang dijalankan vendor.

Apakah Fable 5.1 menolak lebih sedikit daripada Fable 5? Anthropic melaporkan 85% lebih sedikit positif palsu biologi dan sekitar 60% lebih sedikit intervensi siber per sesi Claude Code. Kategorinya sama, jadi pertahankan penanganan penolakan dan fallback Anda.

Mengembangkan API dengan Apidog

Apidog adalah alat pengembangan API yang membantu Anda mengembangkan API dengan lebih mudah dan efisien.