Maksimalkan Penggunaan Claude Fable 5 dengan Prompt Terbaik

Dapatkan lebih banyak dari setiap panggilan Claude Fable 5. Ubah panduan *prompting* resmi Anthropic menjadi buku panduan terukur, lalu uji upaya dan penggunaan token di Apidog.

Ashley Innocent

Ashley Innocent

12 June 2026

Maksimalkan Penggunaan Claude Fable 5 dengan Prompt Terbaik

Apidog untuk Perusahaan

Penerapan On-Premises

SSO & RBAC

Sesuai SOC 2

Jelajahi Apidog Enterprise

Claude Fable 5 lebih mumpuni daripada model sebelumnya, tetapi kemampuan itu memiliki dua sisi. Arahkan pada tugas rutin dengan upaya tinggi dan itu akan mengumpulkan konteks, mempertimbangkan, dan merapikan kode yang tidak pernah Anda minta untuk disentuh; membakar token dan menit yang tidak perlu Anda habiskan. Tulis prompt dengan baik dan model yang sama akan selesai lebih cepat, mengembalikan lebih sedikit pengisi, dan berjalan lebih lama pada masalah sulit di mana Anda benar-benar menginginkannya bekerja. Prompt adalah pengungkit yang menentukan sejauh mana setiap permintaan berjalan.

Panduan ini mengubah panduan prompt Fable 5 resmi Anthropic menjadi panduan praktis, lalu menunjukkan cara menguji dan menyetel prompt tersebut dengan Apidog sehingga Anda mengukur efeknya daripada menebak-nebak. “Memperluas penggunaan Anda” bukanlah trik untuk menghindari batasan; ini adalah tentang mendapatkan lebih banyak pekerjaan yang berguna dari setiap panggilan dengan mencocokkan upaya, cakupan, dan verbositas dengan tugas.

tombol

Apa arti sebenarnya dari “memperluas penggunaan Anda”

Tiga kontrol menentukan berapa biaya permintaan Fable 5 Anda dan berapa banyak yang Anda dapatkan kembali:

Lakukan ketiga hal itu dengan benar dalam prompt dan Anda akan memperluas penggunaan Anda dengan satu-satunya cara yang penting: lebih banyak pekerjaan selesai per token. Pola-pola di bawah ini melakukan hal tersebut.

Pola prompt yang memperluas setiap panggilan

Ini berasal langsung dari panduan Anthropic. Masing-masing adalah instruksi singkat yang Anda masukkan ke dalam prompt sistem; Fable 5 mengikuti instruksi dengan cukup baik sehingga Anda mengarahkan perilaku dengan satu kalimat, bukan daftar periksa.

Sesuaikan upaya dengan tugas

Jangan biarkan upaya pada satu pengaturan. Gunakan high sebagai patokan Anda, tingkatkan ke xhigh hanya untuk pekerjaan yang sensitif terhadap kemampuan, dan turunkan ke medium atau low untuk panggilan rutin. Jika tugas selesai dengan benar tetapi memakan waktu lebih lama dari yang seharusnya, turunkan upayanya. Satu perubahan ini menghemat biaya paling banyak, karena sebagian besar panggilan tidak memerlukan pertimbangan maksimum. Jika Anda melacak pengeluaran, perincian kami tentang biaya API Claude dan batasan tingkat API Claude menunjukkan mengapa disiplin upaya membuahkan hasil dalam jumlah besar.

Perintahkan untuk bertindak ketika memiliki informasi yang cukup

Fable 5 dapat membuat rencana berlebihan untuk tugas-tugas yang ambigu; mensurvei opsi alih-alih bergerak. Instruksi singkat memperbaikinya:

When you have enough information to act, act. Do not re-derive facts already established
in the conversation, re-litigate a decision the user has already made, or narrate
options you will not pursue. If you are weighing a choice, give a recommendation, not an
exhaustive survey. This does not apply to thinking blocks.

Mulai dengan hasilnya

Ini adalah penghemat token Anda. Memberi tahu model untuk menempatkan jawaban di awal memangkas pembukaan panjang yang memperbanyak keluaran:

Lead with the outcome. Your first sentence after finishing should answer "what happened"
or "what did you find": the thing the user would ask for if they said "just give me the
TLDR." Supporting detail and reasoning come after. Being readable and being concise are
different things, and readability matters more.

Batasi cakupan

Dengan upaya yang lebih tinggi, Fable 5 dapat merefaktor atau “membersihkan” di luar tugas. Batasi itu:

Don't add features, refactor, or introduce abstractions beyond what the task requires. A
bug fix doesn't need surrounding cleanup. Don't add error handling, fallbacks, or
validation for scenarios that cannot happen. Only validate at system boundaries (user
input, external APIs). Do the simplest thing that works well.

Landaskan klaim kemajuan pada proses jangka panjang

Pada proses otonom yang panjang, buat model memeriksa klaimnya terhadap hasil alat yang sebenarnya. Anthropic melaporkan ini hampir menghilangkan laporan status yang dibuat-buat:

Before reporting progress, audit each claim against a tool result from this session.
Only report work you can point to evidence for; if something is not yet verified, say so
explicitly.

Berikan alasannya, bukan hanya permintaannya

Fable 5 berkinerja lebih baik ketika ia mengetahui niat di balik suatu tugas, karena konteks memungkinkannya menghubungkan pekerjaan dengan apa yang penting alih-alih menebak-nebak:

I'm working on [the larger task] for [who it's for]. They need [what the output
enables]. With that in mind: [request].

Buat file memori untuk pekerjaan berulang

Fable 5 berkinerja baik ketika dapat mencatat pelajaran dan mereferensikannya nanti. File Markdown biasa berfungsi: satu pelajaran per entri, ringkasan satu baris di bagian atas, diperbarui daripada diduplikasi. Untuk alur kerja berulang, ini berlipat ganda; proses selanjutnya melewatkan kesalahan yang sudah dibuat sebelumnya.

Uji dan sesuaikan prompt Anda di Apidog

Ini adalah bagian yang ditinggalkan panduan resmi untuk Anda: mengetahui apakah perubahan prompt benar-benar membantu. Susunan kata yang terasa lebih ringkas dapat menghasilkan jumlah token yang sama; instruksi singkat dapat menjadi bumerang dan memicu penolakan. Satu-satunya cara untuk mengetahui adalah dengan menjalankan kedua versi dan membandingkannya. Apidog adalah tempat yang bersih untuk melakukan itu, karena memungkinkan Anda menyimpan permintaan, menukar variabel, memastikan respons, dan melakukan mock API sehingga iterasi tetap murah. Jika Anda belum pernah menjalankan eksperimen prompt di luar jendela obrolan, ini adalah alur kerja yang sama dengan pengujian API tanpa Postman, yang diarahkan ke endpoint Pesan.

1. Parameterisasi prompt dan upaya

Buat permintaan ke API Pesan dan tarik bagian-bagian yang mudah berubah; prompt sistem, tingkat upaya, kunci API; ke dalam variabel lingkungan Apidog. Sekarang Anda dapat mengubah upaya dari `high` ke `medium` atau menukar seluruh prompt sistem dengan satu perubahan, tanpa mengedit badan permintaan setiap saat.

POST https://api.anthropic.com/v1/messages
x-api-key: {{ANTHROPIC_API_KEY}}
anthropic-version: 2023-06-01
content-type: application/json

{
  "model": "claude-fable-5",
  "max_tokens": 2048,
  "system": "{{SYSTEM_PROMPT}}",
  "messages": [
    { "role": "user", "content": "{{TASK}}" }
  ]
}

2. A/B dua varian prompt dan ukur perbedaannya

Simpan dua versi permintaan; satu dengan instruksi keringkasan-dan-cakupan Anda, satu tanpa; dan jalankan keduanya terhadap tugas yang sama. Kemudian bandingkan apa yang sebenarnya berubah:

Sekarang “prompt yang sempurna” adalah angka yang dapat Anda tunjuk, bukan dugaan. Pertahankan varian yang mendapatkan hasil yang sama dengan token yang lebih sedikit.

3. Pastikan `stop_reason` dan tangani penolakan fallback

Fable 5 menjalankan pengklasifikasi keamanan dan dapat mengembalikan `stop_reason: "refusal"`, yang banyak pengaturan kembali ke Opus 4.8 untuk ditangani. Prompt yang terlalu agresif, atau yang meminta model untuk mengulang alasannya, dapat memicu hal ini lebih sering dari yang Anda harapkan; dan fallback senyap mengubah biaya dan perilaku Anda. Tambahkan asersi di Apidog bahwa `stop_reason` adalah `end_turn`, sehingga lonjakan penolakan muncul sebagai pengujian yang gagal alih-alih kejutan pada tagihan Anda. Perlakukan asersi itu sebagai bagian dari kontrak prompt Anda.

4. Rencanakan untuk giliran yang lebih panjang

Fable 5 berjalan lebih lama dari model lama; permintaan tugas berat individu dapat memakan waktu beberapa menit dengan upaya tinggi. Sebelum Anda merilis, tetapkan batas waktu yang realistis pada permintaan Anda di Apidog dan konfirmasikan bahwa klien Anda menangani respons yang lambat atau streaming dengan bersih daripada hang. Jika Anda melihat batas waktu mulai muncul, jalur debugging dalam memperbaiki batas waktu permintaan upstream berlaku secara langsung. Upaya yang lebih rendah juga merupakan perbaikan yang valid ketika tugas selesai dengan benar tetapi lebih lambat dari yang Anda butuhkan.

5. Mock API agar iterasi tetap gratis

Anda akan menjalankan prompt puluhan kali saat menyetelnya. Anda tidak ingin setiap iterasi ditagih. Server mock Apidog dapat menggantikan endpoint Pesan, mengembalikan bentuk respons yang disimpan; termasuk kasus penolakan dan kesalahan; sehingga Anda dapat menguji penanganan klien Anda, asersi, dan logika batas waktu tanpa mengeluarkan token. Ubah URL dasar kembali ke API langsung untuk menjalankan perbandingan sebenarnya. Jika Anda membangun ini ke dalam pipeline otomatis, panduan Apidog CLI dan Claude skills menunjukkan cara menjalankan pemeriksaan ini di CI.

FAQ

Apakah prompt yang lebih baik berarti lebih sedikit token pada Fable 5? Seringkali, ya. Instruksi keringkasan yang dimulai dengan hasil memotong pembukaan dan narasi yang dihasilkan Fable 5 tanpa diarahkan, yang menurunkan `output_tokens`. Ukur di Apidog daripada berasumsi; beberapa penulisan ulang tidak mengubah jumlah.

Apa cara tercepat untuk memangkas biaya Fable 5? Turunkan tingkat upaya pada tugas rutin. Upaya adalah pengungkit utama biaya-dan-latensi, dan `medium` atau `low` pada Fable 5 masih berkinerja baik. Simpan `high` dan `xhigh` untuk pekerjaan yang benar-benar sulit.

Mengapa permintaan Fable 5 saya mengalami timeout padahal prompt yang sama berfungsi di Opus? Fable 5 berjalan lebih lama pada tugas-tugas sulit; menit per permintaan dengan upaya tinggi adalah normal. Tingkatkan batas waktu klien Anda, tangani streaming, atau turunkan tingkat upaya jika tugas selesai dengan benar tetapi terlalu lambat.

Mengapa saya tiba-tiba mendapatkan respons Opus padahal saya meminta Fable 5? `stop_reason: "refusal"` memicu fallback. Prompt yang meminta model untuk mereproduksi alasannya, atau yang bersinggungan dengan pengklasifikasi keamanan, meningkatkan tingkat penolakan. Pastikan `stop_reason` di Apidog untuk menangkap ini.

Bisakah saya menguji perubahan prompt tanpa mengeluarkan uang? Ya. Mock endpoint Pesan di Apidog untuk mengembangkan dan menguji logika klien Anda secara gratis, lalu jalankan API langsung hanya untuk menjalankan perbandingan di mana Anda mengukur token dan latensi sebenarnya.

Penutup

Memperluas penggunaan Fable 5 Anda bukan tentang mengakali kuota; ini tentang menulis prompt yang mencocokkan upaya, cakupan, dan verbositas dengan tugas sehingga setiap panggilan melakukan lebih banyak. Panduan Anthropic memberi Anda pola-polanya; sesuaikan upaya dengan kesulitan, mulai dengan hasilnya, batasi cakupan, landaskan kemajuan, dan berikan alasannya. Apidog memberi Anda buktinya; parameterisasi prompt, A/B varian, ukur token dan latensi, dan pastikan terhadap penolakan fallback. Unduh Apidog, sambungkan permintaan Pesan Anda, dan ubah “prompt ini terasa lebih ringkas” menjadi angka yang dapat Anda pertanggungjawabkan.

tombol

Mengembangkan API dengan Apidog

Apidog adalah alat pengembangan API yang membantu Anda mengembangkan API dengan lebih mudah dan efisien.