Claude Sonnet 5.5 มีค่าใช้จ่าย $2 ต่อโทเค็นอินพุตหนึ่งล้านโทเค็น และ $10 ต่อโทเค็นเอาต์พุตหนึ่งล้านโทเค็นบน Claude API ซึ่งเป็นราคาเดียวกับ Sonnet 5 การอ่านแคชมีค่าใช้จ่าย $0.20 ต่อหนึ่งล้านโทเค็น Batch API ลดอัตราทั้งสองลงครึ่งหนึ่งเป็น $1 และ $5 หน้าต่างบริบท 1M เต็มจะถูกเรียกเก็บเงินในอัตรามาตรฐาน และไม่มีโหมดเร็วให้บริการ การปรับขึ้นราคาของ Sonnet 5 ที่วางแผนไว้ในวันที่ 1 กันยายน เป็น $3/$15 ถูกยกเลิกไป ดังนั้น $2/$10 จึงเป็นราคามาตรฐานในปัจจุบัน
คู่มือนี้แสดงรายการราคาแต่ละรายการของ Claude Sonnet 5.5 พร้อมตัวอย่างค่าใช้จ่ายสามตัวอย่างที่แสดงการคำนวณ และอธิบายว่าทำไมความพยายามจึงส่งผลต่อค่าใช้จ่ายของคุณมากกว่าอัตราต่อโทเค็น เพิ่งเริ่มใช้โมเดลนี้ใช่ไหม? เริ่มต้นด้วย Claude Sonnet 5.5 คืออะไร หรืออ่าน วิธีใช้ Claude Sonnet 5.5 ฟรี หากต้องการตรวจสอบตัวเลขเทียบกับปริมาณการใช้งานของคุณเอง ให้ส่งคำขอจาก Apidog และอ่านบล็อก usage ในแต่ละการตอบกลับ
ตารางราคา Claude Sonnet 5.5 API
ราคาต่อหนึ่งล้านโทเค็น (MTok) จาก เอกสารราคาของ Anthropic:
| รายการ | ราคาต่อ MTok |
|---|---|
| อินพุต | $2.00 |
| เขียนแคช 5 นาที | $2.50 |
| เขียนแคช 1 ชั่วโมง | $4.00 |
| อ่านแคช | $0.20 |
| เอาต์พุต | $10.00 |
| อินพุตแบบแบตช์ | $1.00 |
| เอาต์พุตแบบแบตช์ | $5.00 |
สามรายละเอียดที่เปลี่ยนแปลงค่าใช้จ่ายของคุณ:
- การอนุมานเฉพาะในสหรัฐอเมริกา (US-only inference).
inference_geo: "us"มีค่าใช้จ่ายเพิ่มขึ้น 1.1 เท่าสำหรับทุกหมวดหมู่โทเค็นบน Claude API และ Claude Platform บน AWS (อินพุต $2.20, เอาต์พุต $11, การอ่านแคช $0.22) การติดตั้งใช้งาน US Data Zone ของ Foundry มีค่าใช้จ่ายเพิ่มขึ้น 1.1 เท่าเช่นกัน; Bedrock และ Google Cloud มีราคาแยกต่างหาก - ไม่มีค่าพรีเมียมสำหรับบริบทขนาดยาว. คำขอ 900k โทเค็นมีค่าใช้จ่ายต่อโทเค็นเท่ากับคำขอ 9k โทเค็น
- ใช้ tokenizer เดียวกับ Sonnet 5. จำนวนโทเค็นของคุณจะยังคงเดิม
Sonnet 5.5 เปรียบเทียบกับราคาปกติอย่างไร
| โมเดล | อินพุต | เอาต์พุต | หมายเหตุ |
|---|---|---|---|
| Claude Sonnet 5.5 | $2 | $10 | อ่านแคช $0.20; บริบท 1M; ไม่มีโหมดเร็ว |
| Claude Sonnet 5 | $2 | $10 | อ่านแคช $0.20; ยกเลิกการปรับขึ้นราคา $3/$15 |
| Claude Opus 5.5 | $4 | $20 | อ่านแคช $0.20; โหมดเร็ว $8/$40 |
| Claude Haiku 4.5 | $1 | $5 | บริบท 200k |
| GPT-6 Sol | $2 | $10 | อินพุตแคชลด 90%; บริบท 872k |
| GPT-6 Luna | $0.10 | $0.50 | บริบท 1M |
Sonnet 5.5 มีราคาเพียงครึ่งหนึ่งของ Opus 5.5 สำหรับอินพุต เอาต์พุต และการเขียนแคช มีราคาปกติที่ $2/$10 เท่ากับ GPT-6 Sol ดังนั้นการเลือกระหว่างสองโมเดลนี้จึงขึ้นอยู่กับผลลัพธ์ของแต่ละงาน สำหรับข้อมูลเบื้องหลัง ดูที่ ราคา Claude Sonnet 5, สงครามราคาโมเดล AI เดือนกันยายน 2026 และ ราคา GPT-6 Sol
ตัวอย่างการทำงาน: ค่าใช้จ่ายของคำขอจริง
สูตรสำหรับแต่ละรายการ: โทเค็น ÷ 1,000,000 × ราคาต่อ MTok คำนวณราคาแต่ละรายการแล้วนำมารวมกัน
ตัวอย่างที่ 1: คำขอสไตล์แชทหนึ่งครั้ง
โทเค็นอินพุต 3,000 โทเค็น, โทเค็นเอาต์พุต 800 โทเค็น, ไม่มีการแคช
- อินพุต: 3,000 ÷ 1,000,000 × $2 = $0.006
- เอาต์พุต: 800 ÷ 1,000,000 × $10 = $0.008
- รวม: $0.006 + $0.008 = $0.014
คำขอหนึ่งพันครั้งจะมีค่าใช้จ่าย $14 เอาต์พุตคิดเป็น 21% ของโทเค็น แต่คิดเป็น 57% ของค่าใช้จ่าย ดังนั้นความยาวของเอาต์พุตจึงสำคัญกว่าความยาวของพรอมต์
ตัวอย่างที่ 2: เอเจนต์อ่านคำนำหน้า 50,000 โทเค็นซ้ำ
ลูปเอเจนต์ส่งคำนำหน้า 50,000 โทเค็นเดียวกัน (พรอมต์ระบบ, เครื่องมือ, บริบท repo) ในการเรียกใช้ 20 ครั้ง ที่นี่จะคิดราคาเฉพาะคำนำหน้าเท่านั้น
ไม่ใช้แคช: 20 × 50,000 = 1,000,000 โทเค็น; 1,000,000 ÷ 1,000,000 × $2 = $2.00
แคชพร้อมการเขียน 5 นาที:
- การเรียกใช้ครั้งที่ 1 เขียนแคช: 50,000 ÷ 1,000,000 × $2.50 = $0.125
- การเรียกใช้ครั้งที่ 2 ถึง 20 อ่านแคช: 19 × 50,000 = 950,000 โทเค็น; 950,000 ÷ 1,000,000 × $0.20 = $0.19
- รวม: $0.125 + $0.19 = $0.315
ซึ่งช่วยประหยัดได้ $1.685 หรือประมาณ 84% การเขียนแคช 5 นาทีจะคุ้มค่าเมื่อการเรียกใช้งานอยู่ภายในช่วงเวลาเท่านั้น สำหรับลูปที่ช้ากว่า การเขียนแคช 1 ชั่วโมงมีค่าใช้จ่าย 50,000 ÷ 1,000,000 × $4 = $0.20 ดังนั้นยอดรวมคือ $0.20 + $0.19 = $0.39 ซึ่งยังคงต่ำกว่าแบบไม่ใช้แคชประมาณ 80% หลักการเดียวกันนี้ใช้กับ Opus ใน การคำนวณต้นทุนการแคชพรอมต์ของเรา; อัตราการอ่าน $0.20 เหมือนกัน
ตัวอย่างที่ 3: งานแบตช์ 10,000 คำขอ
รูปแบบเดียวกับตัวอย่างที่ 1 แต่ส่งผ่าน Batch API
- อินพุต: 10,000 × 3,000 = 30,000,000 โทเค็น; 30 × $1 = $30
- เอาต์พุต: 10,000 × 800 = 8,000,000 โทเค็น; 8 × $5 = $40
- ยอดรวมแบบแบตช์: $70 เทียบกับ 30 × $2 + 8 × $10 = $140 ในอัตรามาตรฐาน
แบตช์ยังเพิ่มขีดจำกัดเอาต์พุตจาก 128K เป็น 300K โทเค็นด้วยรุ่นเบต้า output-300k-2026-03-24
ค่าใช้จ่ายต่อภารกิจ ไม่ใช่ต่อโทเค็น
ตารางอัตราบอกคุณว่าโทเค็นมีค่าใช้จ่ายเท่าไร ไม่ใช่จำนวนโทเค็นที่ภารกิจของคุณใช้ ตัวเลขที่สองนี้เปลี่ยนแปลงไปมากตามความพยายามมากกว่าความแตกต่างของอัตราระหว่างโมเดล
Anthropic กล่าวว่าในการทดสอบของพวกเขา Sonnet 5.5 "มีค่าใช้จ่ายต่อภารกิจน้อยกว่ารุ่นก่อนหน้าถึง 30%" โพสต์เปิดตัวยังแสดงต้นทุนในทุกระดับความพยายาม การรัน Terminal-Bench 4.0 เป็นของ Anthropic เอง, FrontierCode ดำเนินการโดย Cognition และต้นทุนดัชนีมาจาก Artificial Analysis:
| ความพยายาม | Terminal-Bench 4.0 (คะแนน, $/ความพยายาม) | FrontierCode v1.1 (คะแนน, $/ภารกิจ) | ดัชนี AA (คะแนน, ค่าใช้จ่ายในการรัน) |
|---|---|---|---|
| ต่ำ | 20.0%, $0.76 | 29.3%, $0.19 | 35.8, $544 |
| ปานกลาง | 28.8%, $0.83 | 36.5%, $0.24 | 40.7, $701 |
| สูง | 43.0%, $1.94 | 49.4%, $0.42 | 46.7, $1,176 |
| สูงมาก | 61.5%, $5.30 | 52.1%, $1.59 | 51.9, $2,738 |
| สูงสุด | 70.6%, $12.54 | 46.2%, $20.78 | 56.0, $8,977 |
สิ่งที่โดดเด่น:
- ค่าใช้จ่ายสูงสุดประมาณ 6.5 เท่าของระดับสูงบน Terminal-Bench ($12.54 ÷ $1.94 = 6.46) ดัชนีของ Artificial Analysis มีค่าใช้จ่ายในการรันที่ระดับสูงสุดมากกว่าระดับต่ำประมาณ 16.5 เท่า ($8,977 ÷ $544)
- ความพยายามที่มากขึ้นไม่ได้ดีกว่าเสมอไป. FrontierCode ลดลงจาก 52.1% ที่ระดับสูงมากเป็น 46.2% ที่ระดับสูงสุด ในขณะที่ค่าใช้จ่ายต่อภารกิจเพิ่มขึ้น 13 เท่า ($20.78 ÷ $1.59) หมายเหตุของ Anthropic ระบุว่าที่ระดับสูงสุด โมเดลมักจะรันทักษะการตรวจสอบที่แตกย่อยเอเจนต์ย่อย ซึ่งทำให้เกิดการหมดเวลาหรือการแก้ไขที่อยู่นอกขอบเขตในกรณีที่ Cognition ตรวจสอบ
- Opus ที่ใช้ความพยายามน้อยกว่าสามารถแข่งขันได้. Opus 5.5 ที่ระดับปานกลางทำคะแนนได้ 57.6% บน Terminal-Bench ด้วยค่าใช้จ่าย $2.94 เทียบกับ Sonnet 5.5 ที่ทำคะแนนได้ 43.0% ที่ระดับสูงด้วยค่าใช้จ่าย $1.94 การ เปรียบเทียบ Sonnet 5.5 กับ Opus 5.5 ของเราจะอธิบายการแลกเปลี่ยนนี้
ความละเอียดที่ระดับสูงสุดเป็นกับดักอีกอย่างหนึ่ง บทความของ OfficeChai ที่วิเคราะห์ข้อมูลของ Artificial Analysis ระบุว่า Sonnet 5.5 ใช้โทเค็นเอาต์พุตประมาณ 193,000 โทเค็นต่อภารกิจดัชนีที่ระดับสูงสุด โดยมีค่าใช้จ่ายต่อภารกิจสูงกว่า Sonnet 5 ประมาณ 50% Simon Willison รายงานใน Hacker News ว่าการรันด้วยความพยายามสูงสุดใช้โทเค็นความคิดไป 128,000 โทเค็นและหมดลงก่อนที่จะสร้างคำตอบได้
หกปัจจัยที่ช่วยลดค่าใช้จ่าย
- กำหนดระดับความพยายามอย่างตั้งใจ. API จะตั้งค่าเริ่มต้นเป็น
high; Claude Code และแอป Claude จะตั้งค่าเริ่มต้นเป็นmediumคู่มือการสร้างพรอมต์ของ Anthropic แนะนำให้ใช้mediumหรือlowสำหรับการแชท และxhighหรือmaxเฉพาะเมื่อต้องการคุณภาพที่สูงขึ้นอย่างชัดเจนเท่านั้น อย่าใช้การตั้งค่า Sonnet 5 ซ้ำ เนื่องจากมีการปรับเทียบมาตราส่วนใหม่แล้ว - ใช้
between_toolsในส่วนที่คุณปิดการคิด.thinking: {"type": "disabled"}ตอนนี้จะส่งคืนข้อผิดพลาด 400;{"type": "between_tools"}จะมาแทนที่ในระดับlow,mediumและhigh - แคชสิ่งใดก็ตามที่นำกลับมาใช้ใหม่. พรอมต์ที่สามารถแคชได้ขั้นต่ำคือ 512 โทเค็น (1,024 บน Sonnet 5) การเปลี่ยน
effortระดับบนสุดระหว่างคำขอจะทำให้แคชไม่ถูกต้อง ดังนั้นควรรักษาระดับความพยายามให้คงที่ - รวมงานที่รอได้เข้าด้วยกัน. ครึ่งราคาสำหรับอินพุตและเอาต์พุต
- รักษา
max_tokensให้เหมาะสม. คู่มือของ Anthropic ถือว่าstop_reason: "max_tokens"เป็นการตอบสนองที่ล้มเหลว ดังนั้นคำตอบที่ถูกตัดทอนจึงเป็นการใช้จ่ายไปโดยเปล่าประโยชน์ - ตัดงานที่ไม่จำเป็นออก. Sonnet 5.5 เพิ่มการทดสอบ เอกสาร และไฟล์ที่คุณไม่ได้ร้องขอ และเริ่มรอบการตรวจสอบเพิ่มเติมที่ระดับ
xhighและmaxวรรคพรอมต์ระบบที่ Anthropic แนะนำสามารถลดต้นทุนเซสชันได้ประมาณหนึ่งในสามที่ระดับmaxโดยไม่ส่งผลต่อคุณภาพ
คุณต้องจ่ายสำหรับ Sonnet 5.5 ที่ไหนอีกบ้าง
- แผน Claude (claude.com/pricing): แผน Free ราคา $0 และรวม Sonnet ในการแชท โดยไม่มี Claude Code แผน Pro ราคา $17/เดือน (เรียกเก็บรายปี) หรือ $20/เดือน แผน Max เริ่มต้นที่ $100/เดือน ที่นั่งสำหรับทีมราคา $20/$25 (มาตรฐาน) หรือ $100/$125 (พรีเมียม) รายปี/รายเดือน ไม่มีแผนใดรวมการเข้าถึง API
- GitHub Copilot: Pro ($10/เดือน), Pro+, Max, Business และ Enterprise เรียกเก็บเงินตามราคาปกติของผู้ให้บริการ Copilot Pro รวมเครดิต AI 1,500 เครดิตต่อเดือนในราคา $0.01 ต่อเครดิต ซึ่งเท่ากับโทเค็นประมาณ $15 หรือประมาณ 1,070 คำขอตามตัวอย่างที่ 1 ($15 ÷ $0.014) Copilot Free และ Student ไม่สามารถเลือกได้
- Cursor: อัตราเดียวกันจากกลุ่มโมเดลอื่นๆ (Pro, Pro Plus และ Ultra) บวกเพิ่ม 10% สำหรับเอนด์พอยต์เฉพาะในสหรัฐอเมริกา ($2.20/$11)
- OpenRouter: $2/$10 หรือ $1/$5 สำหรับตัวแปร
:batchไม่มีตัวแปร:free - Vercel AI Gateway: $2/$10 พร้อมการอ่านแคช $0.20 เครดิตฟรี $5 ไม่ครอบคลุม Sonnet 5.5
- Bedrock, Google Cloud, Foundry: หน้าคาราคาของแต่ละคลาวด์ Bedrock รองรับเฉพาะ Standard tier โดยไม่มี Batch
กำลังมองหาเครดิตแทนใช่ไหม? ดูที่ มี Claude Sonnet 5.5 API ฟรีหรือไม่
ติดตามค่าใช้จ่ายต่อคำขอใน Apidog
การตอบกลับ Messages ทุกครั้งจะมีออบเจกต์ usage ที่มี input_tokens, output_tokens และจำนวนแคช ซึ่งเพียงพอที่จะกำหนดราคาการเรียกใช้งานใดๆ ใน Apidog:

- จัดเก็บคีย์ของคุณเป็นตัวแปรสภาพแวดล้อม
ANTHROPIC_API_KEY - บันทึกคำขอนี้หนึ่งครั้งต่อระดับความพยายาม (
low,medium,high) ด้วยพรอมต์เดียวกัน:
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-5-5",
"max_tokens": 4000,
"thinking": {"type": "between_tools"},
"output_config": {"effort": "medium"},
"messages": [{"role": "user", "content": "Classify this support ticket: ..."}]
}'
- เพิ่มตัวประมวลผลหลังการทำงานที่กำหนดราคาการเรียกใช้งานและแจ้งข้อผิดพลาดหากมีการตัดทอน:
const body = pm.response.json();
const u = body.usage;
const cost = (u.input_tokens * 2 + u.output_tokens * 10) / 1e6;
pm.environment.set("last_call_usd", cost.toFixed(5));
pm.test("not truncated", () => pm.expect(body.stop_reason).to.not.eql("max_tokens"));
- รันทั้งสามรายการและเปรียบเทียบ
usage.output_tokensและค่าใช้จ่ายเคียงข้างกัน หากคุณใช้แคช ให้เพิ่มจำนวนแคชตามอัตราของมันเอง
ขั้นตอนการใช้งานคำขอแบบเต็มอยู่ใน วิธีใช้ Claude Sonnet 5.5 API
คำถามที่พบบ่อย
Claude Sonnet 5.5 มีค่าใช้จ่ายเท่าไรต่อหนึ่งล้านโทเค็น? อินพุต $2 และเอาต์พุต $10 บน Claude API การอ่านแคชมีค่าใช้จ่าย $0.20; Batch API เรียกเก็บ $1 และ $5
Sonnet 5.5 แพงกว่า Sonnet 5 หรือไม่? ไม่ อัตราต่อโทเค็นเท่ากัน และ Anthropic กล่าวว่า Sonnet 5.5 มีค่าใช้จ่ายต่อภารกิจน้อยกว่าถึง 30% ในการทดสอบ
มีค่าบริการเพิ่มเติมสำหรับโทเค็นที่เกิน 200k หรือไม่? ไม่ หน้าต่าง 1M เต็มจะถูกเรียกเก็บเงินในอัตรามาตรฐาน
Sonnet 5.5 มีโหมดเร็วหรือไม่? ไม่มี โหมดเร็วมีให้ใช้เฉพาะบน Opus 5.5, Opus 5 และ Opus 4.8 เท่านั้น
Claude Sonnet 5.5 ฟรีหรือไม่? ในแอปแชท Claude ใช่: ทุกคนสามารถแชทกับมันได้ในแผน Free API ทำงานบนเครดิตแบบเติมเงิน; คู่มือ API ฟรีครอบคลุมโปรแกรมเครดิต
ขั้นตอนต่อไป: กำหนดราคาเวิร์กโหลดของคุณเอง
นำรูปแบบคำขอสามรูปแบบที่ใช้บ่อยที่สุดของคุณ รันแต่ละรูปแบบในสองระดับความพยายาม และคูณตัวเลข usage ด้วยตารางด้านบน คุณจะเห็นได้อย่างรวดเร็วว่า medium เป็นไปตามมาตรฐานคุณภาพของคุณหรือไม่ หรือ high คุ้มค่ากับโทเค็นพิเศษที่ใช้ไป ดาวน์โหลด Apidog เพื่อเก็บคำขอเหล่านั้นและสคริปต์ค่าใช้จ่ายไว้เคียงข้างกัน
