เพิ่มประสิทธิภาพการใช้ Claude Fable 5 ด้วยสุดยอดพรอมต์

ใช้ประโยชน์จาก Claude Fable 5 ให้ได้มากขึ้นในทุกการเรียกใช้ เปลี่ยนคู่มือการพร้อมท์อย่างเป็นทางการของ Anthropic ให้เป็นคู่มือปฏิบัติที่วัดผลได้ จากนั้นทดสอบความพยายามและการใช้โทเค็นใน Apidog

Ashley Innocent

Ashley Innocent

12 June 2026

เพิ่มประสิทธิภาพการใช้ Claude Fable 5 ด้วยสุดยอดพรอมต์

Apidog สำหรับองค์กร

การติดตั้งแบบ On-Premises

SSO & RBAC

รองรับมาตรฐาน SOC 2

สำรวจ Apidog Enterprise

Claude Fable 5 มีความสามารถมากกว่าโมเดลรุ่นก่อนหน้า แต่ความสามารถนั้นก็มีทั้งข้อดีและข้อเสีย หากคุณใช้มันกับงานประจำที่ต้องใช้ความพยายามสูง มันจะรวบรวมบริบท ไตร่ตรอง และจัดระเบียบโค้ดที่คุณไม่ได้ขอให้มันแตะต้อง ซึ่งเป็นการเผาผลาญโทเค็นและเวลาที่คุณไม่จำเป็นต้องเสียไป หากคุณเขียนพรอมต์ได้ดี โมเดลเดียวกันนี้จะทำงานเสร็จเร็วขึ้น ส่งผลลัพธ์ที่เป็นส่วนเสริมลดลง และทำงานได้นานขึ้นกับปัญหาที่ยากที่คุณต้องการให้มันทำงานจริง ๆ พรอมต์คือกลไกที่กำหนดว่าแต่ละคำขอจะไปได้ไกลแค่ไหน

คู่มือนี้จะเปลี่ยน แนวทางการสร้างพรอมต์ Fable 5 อย่างเป็นทางการของ Anthropic ให้เป็นแนวทางการใช้งานจริง จากนั้นจะแสดงวิธีทดสอบและปรับแต่งพรอมต์เหล่านั้นด้วย Apidog เพื่อให้คุณสามารถวัดผลกระทบได้แทนที่จะคาดเดา "การขยายการใช้งานของคุณ" ไม่ใช่กลอุบายเพื่อหลีกเลี่ยงข้อจำกัด แต่เป็นการดึงงานที่มีประโยชน์มากขึ้นจากการเรียกใช้แต่ละครั้ง โดยการจับคู่ความพยายาม ขอบเขต และความละเอียดในการพูดให้เหมาะสมกับงาน

button

“การขยายการใช้งานของคุณ” หมายถึงอะไรกันแน่

สามปัจจัยควบคุมที่กำหนดว่าคำขอ Fable 5 แต่ละครั้งมีค่าใช้จ่ายเท่าไหร่และคุณจะได้ผลตอบแทนเท่าไหร่:

หากคุณกำหนดสามสิ่งนี้ในพรอมต์ได้อย่างถูกต้อง คุณก็จะสามารถขยายการใช้งานของคุณในแบบเดียวที่มีความสำคัญ: งานที่เสร็จสมบูรณ์มากขึ้นต่อโทเค็น รูปแบบด้านล่างนี้ทำหน้าที่ได้ตามนั้น

รูปแบบพรอมต์ที่ช่วยยืดทุกการเรียกใช้งาน

สิ่งเหล่านี้มาจากคู่มือของ Anthropic โดยตรง แต่ละข้อเป็นคำแนะนำสั้นๆ ที่คุณสามารถใส่ลงในพรอมต์ของระบบได้; Fable 5 ปฏิบัติตามคำแนะนำได้ดีพอที่คุณจะสามารถกำหนดพฤติกรรมด้วยประโยคเดียวแทนที่จะเป็นรายการตรวจสอบ

จับคู่ความพยายามกับงาน

อย่าตั้งค่าความพยายามเพียงค่าเดียว ใช้ high เป็นค่าพื้นฐานของคุณ ปรับเป็น xhigh เฉพาะสำหรับงานที่ต้องการความสามารถสูงเท่านั้น และลดเป็น medium หรือ low สำหรับการเรียกใช้งานทั่วไป หากงานเสร็จสมบูรณ์ถูกต้องแต่ใช้เวลานานเกินไป ให้ลดระดับความพยายาม การเปลี่ยนแปลงนี้ช่วยประหยัดค่าใช้จ่ายได้มากที่สุด เพราะการเรียกใช้งานส่วนใหญ่ไม่จำเป็นต้องมีการพิจารณาสูงสุด หากคุณกำลังติดตามค่าใช้จ่าย การวิเคราะห์ ค่าใช้จ่าย API ของ Claude และ ข้อจำกัดอัตรา API ของ Claude ของเราแสดงให้เห็นว่าการควบคุมความพยายามให้ผลตอบแทนเมื่อใช้งานในปริมาณมาก

บอกให้มันดำเนินการเมื่อมีข้อมูลเพียงพอ

Fable 5 อาจวางแผนงานที่ไม่ชัดเจนมากเกินไป; สำรวจตัวเลือกต่างๆ แทนที่จะดำเนินการ คำแนะนำสั้นๆ จะช่วยแก้ไขได้:

When you have enough information to act, act. Do not re-derive facts already established
in the conversation, re-litigate a decision the user has already made, or narrate
options you will not pursue. If you are weighing a choice, give a recommendation, not an
exhaustive survey. This does not apply to thinking blocks.

นำด้วยผลลัพธ์

นี่คือตัวช่วยประหยัดโทเค็นของคุณ การบอกให้โมเดลนำเสนอคำตอบก่อนจะช่วยตัดคำนำที่ยาวเหยียดที่ทำให้เอาต์พุตเพิ่มขึ้น:

Lead with the outcome. Your first sentence after finishing should answer "what happened"
or "what did you find": the thing the user would ask for if they said "just give me the
TLDR." Supporting detail and reasoning come after. Being readable and being concise are
different things, and readability matters more.

จำกัดขอบเขต

ด้วยความพยายามที่สูงขึ้น Fable 5 อาจปรับโครงสร้างหรือ "จัดระเบียบ" เกินขอบเขตของงาน กำหนดให้ชัดเจน:

Don't add features, refactor, or introduce abstractions beyond what the task requires. A
bug fix doesn't need surrounding cleanup. Don't add error handling, fallbacks, or
validation for scenarios that cannot happen. Only validate at system boundaries (user
input, external APIs). Do the simplest thing that works well.

ยืนยันการอ้างอิงความคืบหน้าในการทำงานที่ยาวนาน

ในการทำงานอัตโนมัติที่ยาวนาน ให้โมเดลตรวจสอบการกล่าวอ้างกับผลลัพธ์ของเครื่องมือจริง Anthropic รายงานว่าสิ่งนี้เกือบจะกำจัดรายงานสถานะที่ถูกสร้างขึ้นมาได้:

Before reporting progress, audit each claim against a tool result from this session.
Only report work you can point to evidence for; if something is not yet verified, say so
explicitly.

ให้เหตุผล ไม่ใช่แค่คำขอ

Fable 5 ทำงานได้ดีขึ้นเมื่อมันรู้เจตนาเบื้องหลังของงาน เพราะบริบทช่วยให้มันเชื่อมโยงงานเข้ากับสิ่งที่สำคัญแทนที่จะเป็นการคาดเดา:

I'm working on [the larger task] for [who it's for]. They need [what the output
enables]. With that in mind: [request].

สร้างไฟล์หน่วยความจำสำหรับงานที่ทำซ้ำๆ

Fable 5 ทำงานได้ดีเมื่อมันสามารถบันทึกบทเรียนและอ้างอิงได้ในภายหลัง ไฟล์ Markdown ธรรมดาก็ใช้ได้: หนึ่งบทเรียนต่อหนึ่งรายการ สรุปหนึ่งบรรทัดอยู่ด้านบน อัปเดตแทนการทำซ้ำ สำหรับเวิร์กโฟลว์ที่ทำซ้ำๆ สิ่งนี้จะทวีคูณขึ้น; การรันในภายหลังจะข้ามความผิดพลาดที่เคยเกิดขึ้นแล้ว

ทดสอบและปรับแต่งพรอมต์ของคุณใน Apidog

นี่คือส่วนที่คู่มือทางการปล่อยให้คุณจัดการ: การรู้ว่าการเปลี่ยนแปลงพรอมต์ช่วยได้จริงหรือไม่ ถ้อยคำที่ดูรัดกุมอาจให้จำนวนโทเค็นเท่าเดิม; คำสั่งที่กระชับอาจให้ผลลัพธ์ที่ไม่พึงประสงค์และกระตุ้นให้เกิดการปฏิเสธได้ วิธีเดียวที่จะรู้คือการเรียกใช้ทั้งสองเวอร์ชันและเปรียบเทียบ Apidog เป็นสถานที่ที่สะอาดในการทำเช่นนั้น เพราะมันช่วยให้คุณสามารถบันทึกคำขอ สลับตัวแปร ตรวจสอบการตอบกลับ และจำลอง API ได้ เพื่อให้การทำซ้ำมีค่าใช้จ่ายต่ำ หากคุณไม่เคยทำการทดลองพรอมต์นอกหน้าต่างแชท นี่คือเวิร์กโฟลว์เดียวกับการ ทดสอบ API โดยไม่ต้องใช้ Postman โดยมุ่งเป้าไปที่ Messages endpoint

1. กำหนดพารามิเตอร์พรอมต์และความพยายาม

สร้างคำขอไปยัง Messages API และดึงส่วนที่เปลี่ยนแปลงได้; เช่น พรอมต์ของระบบ ระดับความพยายาม คีย์ API; ไปยังตัวแปรสภาพแวดล้อมของ Apidog ตอนนี้คุณสามารถเปลี่ยนความพยายามจาก high เป็น medium หรือสลับพรอมต์ของระบบทั้งหมดด้วยการเปลี่ยนแปลงเพียงครั้งเดียว โดยไม่ต้องแก้ไขเนื้อหาคำขอทุกครั้ง

POST https://api.anthropic.com/v1/messages
x-api-key: {{ANTHROPIC_API_KEY}}
anthropic-version: 2023-06-01
content-type: application/json

{
  "model": "claude-fable-5",
  "max_tokens": 2048,
  "system": "{{SYSTEM_PROMPT}}",
  "messages": [
    { "role": "user", "content": "{{TASK}}" }
  ]
}

2. ทำ A/B test สองรูปแบบพรอมต์และวัดความแตกต่าง

บันทึกคำขอสองเวอร์ชัน; เวอร์ชันหนึ่งมีคำแนะนำเรื่องความกระชับและขอบเขต อีกเวอร์ชันหนึ่งไม่มี; จากนั้นเรียกใช้ทั้งสองเวอร์ชันกับงานเดียวกัน แล้วเปรียบเทียบว่ามีการเปลี่ยนแปลงอะไรบ้าง:

ตอนนี้ "พรอมต์ที่สมบูรณ์แบบ" คือตัวเลขที่คุณสามารถอ้างอิงได้ ไม่ใช่แค่การคาดเดา ให้เลือกรูปแบบที่ให้ผลลัพธ์เหมือนกันโดยใช้โทเค็นน้อยลง

3. ยืนยันบน stop_reason และดักจับการสำรองข้อมูลเมื่อถูกปฏิเสธ

Fable 5 ใช้ตัวจำแนกความปลอดภัยและสามารถส่งคืน stop_reason: "refusal" ได้ ซึ่งการตั้งค่าหลายอย่างจะกลับไปใช้ Opus 4.8 เพื่อจัดการ พรอมต์ที่รุนแรงเกินไป หรือพรอมต์ที่ขอให้โมเดลสะท้อนเหตุผลของมัน อาจกระตุ้นสิ่งเหล่านี้บ่อยกว่าที่คุณคาดไว้; และการสำรองข้อมูลแบบเงียบจะเปลี่ยนค่าใช้จ่ายและพฤติกรรมของคุณ เพิ่มการยืนยันใน Apidog ว่า stop_reason คือ end_turn เพื่อให้การปฏิเสธที่เพิ่มขึ้นปรากฏเป็นการทดสอบที่ล้มเหลว แทนที่จะเป็นความประหลาดใจในบิลของคุณ ถือว่าการยืนยันนั้นเป็นส่วนหนึ่งของ สัญญา ของพรอมต์ของคุณ

4. วางแผนสำหรับการทำงานที่ยาวนานขึ้น

Fable 5 ทำงานได้นานกว่าโมเดลรุ่นเก่า; คำขอสำหรับงานยากแต่ละรายการอาจใช้เวลาหลายนาทีด้วยความพยายามสูง ก่อนที่คุณจะเผยแพร่ ให้ตั้งค่าการหมดเวลาที่สมจริงสำหรับคำขอของคุณใน Apidog และยืนยันว่าไคลเอนต์ของคุณจัดการการตอบสนองที่ช้าหรือแบบสตรีมได้อย่างหมดจด แทนที่จะค้าง หากคุณพบว่ามีการหมดเวลาเกิดขึ้น เส้นทางการดีบักใน การแก้ไขปัญหาการหมดเวลาคำขออัปสตรีม สามารถนำมาใช้ได้โดยตรง การลดความพยายามลงก็เป็นวิธีแก้ไขที่ถูกต้องเมื่องานเสร็จสมบูรณ์ถูกต้องแต่ช้ากว่าที่คุณต้องการ

5. จำลอง API เพื่อให้การทำซ้ำไม่มีค่าใช้จ่าย

คุณจะเรียกใช้พรอมต์หลายสิบครั้งในขณะที่ปรับแต่งมัน คุณคงไม่อยากถูกเรียกเก็บเงินทุกครั้งที่ทำซ้ำ Mock server ของ Apidog สามารถทำหน้าที่แทน Messages endpoint ได้ โดยจะส่งคืนรูปแบบการตอบกลับที่บันทึกไว้; รวมถึงกรณีการปฏิเสธและข้อผิดพลาด; เพื่อให้คุณสามารถทดสอบการจัดการของไคลเอนต์ การยืนยัน และตรรกะการหมดเวลาโดยไม่ต้องเสียโทเค็น เปลี่ยน URL พื้นฐานกลับไปเป็น API จริงสำหรับการรันเพื่อเปรียบเทียบ หากคุณกำลังสร้างสิ่งนี้ให้เป็นส่วนหนึ่งของไปป์ไลน์อัตโนมัติ คู่มือ Apidog CLI และ Claude skills แสดงวิธีเรียกใช้การตรวจสอบเหล่านี้ใน CI

คำถามที่พบบ่อย (FAQ)

พรอมต์ที่ดีขึ้นหมายถึงการใช้โทเค็นน้อยลงบน Fable 5 หรือไม่? บ่อยครั้งก็ใช่ คำแนะนำที่กระชับและนำด้วยผลลัพธ์จะช่วยลดคำนำและการบรรยายที่ Fable 5 สร้างขึ้นโดยไม่ได้ควบคุม ซึ่งช่วยลด output_tokens ลงได้ วัดผลใน Apidog แทนที่จะคาดเดา; การเขียนใหม่บางครั้งก็ไม่ได้เปลี่ยนจำนวนโทเค็น

วิธีที่เร็วที่สุดในการลดค่าใช้จ่าย Fable 5 คืออะไร? ลดระดับความพยายาม (effort level) ในงานประจำ ความพยายามเป็นปัจจัยหลักที่ส่งผลต่อค่าใช้จ่ายและความหน่วง และ medium หรือ low บน Fable 5 ก็ยังคงทำงานได้ดี เก็บ high และ xhigh ไว้สำหรับงานที่ยากจริง ๆ

ทำไมคำขอ Fable 5 ของฉันถึงหมดเวลาเมื่อพรอมต์เดียวกันเคยใช้งานได้บน Opus? Fable 5 ใช้เวลานานกว่าในงานที่ยาก; การใช้เวลาหลายนาทีต่อคำขอด้วยความพยายามสูงถือเป็นเรื่องปกติ เพิ่มการหมดเวลาของไคลเอนต์ จัดการสตรีมมิ่ง หรือลดระดับความพยายามลง หากงานเสร็จสมบูรณ์แต่ช้าเกินไป

ทำไมฉันถึงได้รับคำตอบจาก Opus ทั้งที่ขอ Fable 5? stop_reason: "refusal" เป็นตัวกระตุ้นให้เกิดการสำรองข้อมูล พรอมต์ที่ขอให้โมเดลทำซ้ำเหตุผลของมัน หรือพรอมต์ที่ขัดแย้งกับตัวจำแนกความปลอดภัย จะเพิ่มอัตราการปฏิเสธ ยืนยันบน stop_reason ใน Apidog เพื่อดักจับสิ่งนี้

ฉันสามารถทดสอบการเปลี่ยนแปลงพรอมต์โดยไม่ต้องเสียเงินได้หรือไม่? ได้ คุณสามารถจำลอง Messages endpoint ใน Apidog เพื่อพัฒนาและทดสอบตรรกะของไคลเอนต์ของคุณได้ฟรี จากนั้นจึงเรียกใช้ API จริงเฉพาะสำหรับการรันเปรียบเทียบที่คุณวัดโทเค็นและความหน่วงที่แท้จริง

สรุป

การขยายการใช้งาน Fable 5 ของคุณไม่ใช่การหลีกเลี่ยงโควต้า แต่เป็นการเขียนพรอมต์ที่จับคู่ความพยายาม ขอบเขต และความละเอียดในการพูดให้เข้ากับงาน เพื่อให้ทุกการเรียกใช้งานมีประสิทธิภาพมากขึ้น คำแนะนำของ Anthropic มอบรูปแบบให้คุณ; จับคู่ความพยายามกับความยาก นำด้วยผลลัพธ์ จำกัดขอบเขต ยืนยันความคืบหน้า และให้เหตุผล Apidog มอบหลักฐานให้คุณ; กำหนดพารามิเตอร์พรอมต์ ทำ A/B test รูปแบบต่างๆ วัดโทเค็นและความหน่วง และยืนยันการสำรองข้อมูลเมื่อถูกปฏิเสธ ดาวน์โหลด Apidog กำหนดค่าคำขอ Messages ของคุณ และเปลี่ยน "พรอมต์นี้รู้สึกกระชับขึ้น" ให้เป็นตัวเลขที่คุณสามารถอ้างอิงได้อย่างมั่นใจ

button

ฝึกการออกแบบ API แบบ Design-first ใน Apidog

ค้นพบวิธีที่ง่ายขึ้นในการสร้างและใช้ API