คลาวด์ ซอนเน็ต 5.5 เทียบกับ ซอนเน็ต 5: มีอะไรใหม่ และสิ่งที่ต้องแก้ไขก่อนเปลี่ยนไปใช้

Sonnet 5.5 เทียบกับ Sonnet 5: ราคา $2/$10 เท่ากัน, คะแนนสูงกว่ามาก, และการเปลี่ยนแปลงหลัก 5 ประการที่ส่งผลให้เกิดข้อผิดพลาด 400 รายละเอียดข้อผิดพลาดและการแก้ไข JSON ทั้งก่อนและหลัง

Medy Evrard

29 September 2026

คลาวด์ ซอนเน็ต 5.5 เทียบกับ ซอนเน็ต 5: มีอะไรใหม่ และสิ่งที่ต้องแก้ไขก่อนเปลี่ยนไปใช้

Apidog สำหรับองค์กร

การติดตั้งแบบ On-Premises

SSO & RBAC

รองรับมาตรฐาน SOC 2

สำรวจ Apidog Enterprise

Claude Sonnet 5.5 (claude-sonnet-5-5, เปิดตัวเมื่อ 28 กันยายน 2026) มีราคาเท่ากับ Sonnet 5 คือ $2 ต่อล้านโทเค็นอินพุต และ $10 ต่อล้านโทเค็นเอาต์พุต และใช้ tokenizer ตัวเดียวกัน มันทรงพลังกว่ามาก และ Anthropic กล่าวว่าเร็วกว่า 30%+ บนตารางการเปิดตัว Terminal-Bench 4.0 เพิ่มขึ้นจาก 10.3% เป็น 70.6%, CursorBench 4.0 จาก 34.1% เป็น 55.5% และ OSWorld 2.1 จาก 57.0% เป็น 80.1% ข้อสังเกตคือ API รูปแบบคำขอห้าแบบที่เคยใช้ได้กับ Sonnet 5 ตอนนี้จะคืนค่าเป็น 400 และการเปลี่ยนแปลงหนึ่งอย่างทำให้รูปแบบการตอบกลับเปลี่ยนไปโดยไม่มีข้อผิดพลาด คำตัดสิน: อัปเกรดได้ แต่แก้ไขหกสิ่งเหล่านั้นก่อน

ด้านล่างนี้คือ: การเปลี่ยนแปลงแต่ละรายการที่ส่งผลกระทบพร้อมข้อผิดพลาดที่แน่นอนและ JSON ก่อน/หลัง จากนั้นเป็นรายการตรวจสอบ สำหรับข้อมูลจำเพาะ โปรดดู what is Claude Sonnet 5.5; สำหรับการเปลี่ยนแปลงครั้งก่อน โปรดดู Claude Sonnet 5 vs Sonnet 4.6. Apidog ช่วยให้คุณสามารถเปรียบเทียบคำขอเก่าและใหม่ควบคู่กันไปในขณะที่คุณทดสอบ

Sonnet 5 เทียบกับ Sonnet 5.5 โดยสรุป

Claude Sonnet 5 Claude Sonnet 5.5
ราคาต่อ MTok (in / out / cache read) $2 / $10 / $0.20 $2 / $10 / $0.20
บริบทและเอาต์พุต 1M บริบท 1M บริบท, 128K เอาต์พุต
thinking.type ที่ยอมรับ adaptive, disabled adaptive, between_tools
display เริ่มต้น omitted omitted
Effort low ถึง max ระดับเดียวกัน ปรับเทียบใหม่; ค่าเริ่มต้น API คือ high
พรอมต์ที่แคชได้ขั้นต่ำ 1,024 โทเค็น 512 โทเค็น
Effort ต่อข้อความ, ข้อความระบบกลางบทสนทนา ไม่มี มี
tool_choice ที่ถูกบังคับ รองรับ ข้อผิดพลาด 400
การป้องกันทางไซเบอร์แบบ Opus ไม่มี มี; ความเสี่ยงสูงทางไซเบอร์จะกลับไปใช้ Sonnet 5
บล็อกการคิด ไม่มีการตรวจสอบบทสนทนา ผูกกับโมเดล, บทสนทนา และบัญชี
Terminal-Bench 4.0 10.3% 70.6%
CursorBench 4.0 34.1% 55.5%
FrontierCode 1.1 (Main) 42.4% 46.2% (สูงสุด), 52.1% (xhigh)
GDPval-AA v2.1 (Elo) 1449 1844
OSWorld 2.1 (บางส่วน) 57.0% 80.1%
HLE (พร้อมเครื่องมือ) 54.9% 64.5%
การยกเลิกการใช้งาน ยังคงให้บริการเป็นการป้องกันทางไซเบอร์สำรอง ไม่เร็วกว่า 28 กันยายน 2027

Anthropic ได้รัน Terminal-Bench, HLE และ OSWorld; Cursor ได้รัน CursorBench, Cognition FrontierCode และ Artificial Analysis GDPval-AA การรัน Terminal-Bench ของ Artificial Analysis เอง ให้ผล 63.6% เทียบกับ 14.1% ดังนั้นช่องว่างยังคงอยู่ FrontierCode มีค่า 5.5 สองค่าเนื่องจากที่ระดับสูงสุดมันมักจะกระจาย subagents ตรวจสอบออกไป และการทดสอบจะลงโทษการแก้ไขที่อยู่นอกขอบเขต ดู Claude Sonnet 5.5 benchmarks

ห้าการเปลี่ยนแปลงที่ส่งผลกระทบ

แต่ละรายการจะคืนค่า 400 `invalid_request_error` สำหรับโค้ดที่ทำงานได้ดีบน Sonnet 5

1. thinking: disabled ถูกยกเลิก; ให้ส่ง between_tools แทน

Sonnet 5.5 ปฏิเสธ thinking: {"type": "disabled"}:

"thinking.type.disabled" is not supported for this model. Use "thinking.type.between_tools" for the lowest thinking setting, or "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.

ส่ง between_tools ซึ่งเป็นการตั้งค่าการคิดที่ต่ำที่สุด มันจะข้ามการคิดล่วงหน้า; บันทึกความคืบหน้าระหว่างการเรียกใช้เครื่องมือยังคงมาถึงในรูปแบบบล็อก thinking ซึ่งคุณส่งคืนได้โดยไม่ต้องเปลี่ยนแปลง มันทำงานได้เฉพาะที่ระดับ effort low, medium หรือ high เท่านั้น และไม่รับฟิลด์อื่นใด (display, budget_tokens หรือ block_binding จะคืนค่า 400) และจะล็อก effort สำหรับการสนทนานั้น

// ก่อน (claude-sonnet-5)
{"model": "claude-sonnet-5", "max_tokens": 16000,
 "thinking": {"type": "disabled"},
 "output_config": {"effort": "xhigh"}}

// หลัง (claude-sonnet-5-5)
{"model": "claude-sonnet-5-5", "max_tokens": 16000,
 "thinking": {"type": "between_tools"},
 "output_config": {"effort": "high"}}

หากคุณต้องการ xhigh หรือ max ให้ละเว้น thinking เพื่อให้การคิดแบบปรับตัวทำงาน

2. tool_choice แบบบังคับคืนค่า 400

tool_choice เป็น any หรือ tool จะล้มเหลว รวมถึงที่ปลายทางสำหรับนับโทเค็น:

tool_choice: type "tool" and "any" are not supported for this model.

ส่ง auto, ระบุเครื่องมือเป็น strict: true (ทุกออบเจกต์ต้องมี additionalProperties: false) และระบุในพรอมต์ว่าจะใช้เมื่อใด โมเดลสามารถตอบกลับเป็นข้อความได้แทน ดังนั้นควรจัดการกับการเปลี่ยนรอบที่ไม่มีการเรียกใช้เครื่องมือ

// ก่อน (claude-sonnet-5)
"tool_choice": {"type": "tool", "name": "get_weather"}

// หลัง (claude-sonnet-5-5)
"tools": [{"name": "get_weather",
  "input_schema": {"type": "object",
    "properties": {"location": {"type": "string"}},
    "required": ["location"], "additionalProperties": false},
  "strict": true}],
"tool_choice": {"type": "auto"},
"messages": [{"role": "user",
  "content": "What's the weather in Paris? Use the get_weather tool."}]

ขีดจำกัดคือ 20 เครื่องมือแบบ strict ต่อคำขอ บน Amazon Bedrock เครื่องมือแบบ strict ไม่พร้อมใช้งานสำหรับ Sonnet 5.5: ให้ส่ง auto โดยไม่มี strict และตรวจสอบอินพุตในโค้ดของคุณ

3. บล็อกการคิดถูกผูกติดกับโมเดล, บทสนทนา และบัญชี

บล็อกการคิดของ Sonnet 5.5 แต่ละบล็อกจะถูกเซ็นชื่อเพื่อครอบคลุมทุกสิ่งที่มาก่อนหน้า: `system`, `tools` และข้อความก่อนหน้านี้ สำหรับบัญชีที่สร้างขึ้นในหรือหลังวันที่ 31 สิงหาคม 2026 (00:00 UTC) การเล่นบล็อกซ้ำหลังจากการแก้ไขจะคืนค่า 400 บน Claude API, Bedrock และ Google Cloud:

messages.1.content.0: Invalid `signature` in `thinking` block. The block is bound to a different conversation. Remove the block, or set `thinking.block_binding.prefix_mismatch_behavior` to "drop_block".

บัญชีเก่าไม่ได้บังคับใช้สิ่งนี้โดยค่าเริ่มต้น ดังนั้นการรันที่สะอาดบนคีย์เก่าจึงไม่สามารถพิสูจน์อะไรได้ เก็บการสนทนาให้เป็นแบบ append-only และเปลี่ยนคำสั่งหรือเครื่องมือด้วยข้อความระบบกลางบทสนทนา หากคุณจำเป็นต้องแก้ไข ให้ส่ง anthropic-beta: thinking-binding-controls-2026-08-01 และทิ้งบล็อกที่ไม่ตรงกัน:

"thinking": {"type": "adaptive",
  "block_binding": {"prefix_mismatch_behavior": "drop_block"}}

สิ่งนี้ใช้ได้กับการคิดแบบปรับตัวเท่านั้น; สำหรับ between_tools ให้ลบบล็อกการคิดออกจากการเปลี่ยนรอบที่แก้ไข Sonnet 5.5 อ่านบล็อกจากการสนทนา Sonnet 5, Opus 4.8, Haiku 4.5 และรุ่นก่อนหน้า; มันทิ้งบล็อก Opus 5, Opus 5.5, Fable และ Mythos รวมถึงบล็อก Sonnet 5.5 จากบัญชีอื่น โดยไม่ทำให้คำขอล้มเหลว ไม่มีโมเดลอื่นใดที่อ่านบล็อกของมัน ดู Claude Fable 5.1 preserved thinking

4. computer_20251124 ล้มเหลวบน Claude API และ Google Cloud

ที่นั่น การใช้งานคอมพิวเตอร์ต้องใช้ชุดเครื่องมือใหม่ ข้อผิดพลาดเริ่มต้นว่า:

'claude-sonnet-5-5' does not support tool types: computer_20251124.
// ก่อน (claude-sonnet-5)
"tools": [{"type": "computer_20251124", ...}]

// หลัง (claude-sonnet-5-5, Claude API และ Google Cloud)
"tools": [{"type": "computer_toolset_20260801"}]

ทิ้ง header beta สำหรับการใช้งานคอมพิวเตอร์แบบเก่าและอัปเดตลูปของคุณสำหรับบล็อก tool_use ที่เป็นสมาชิก, การดำเนินการแบบแบตช์ และ toolset_name บนผลลัพธ์ Bedrock ยังคงยอมรับ computer_20251124; แต่ computer_20250124 ล้มเหลวทุกที่

5. การจับคู่ Advisor บางรายการถูกปฏิเสธ

ด้วยเครื่องมือ advisor (beta) ตัว executor ของ Sonnet 5.5 จะยอมรับเฉพาะ Opus 5, Opus 5.5, Sonnet 5.5, Fable 5, Fable 5.1, Mythos 5 หรือ Mythos 5.1 เป็น advisor เท่านั้น advisor ของ Sonnet 5, Opus 4.8 และ Opus 4.7 จะคืนค่า 400 ในตอนนี้ คำแนะนำยังมาถึงในรูปแบบที่เข้ารหัสเป็นบล็อก `advisor_redacted_result` ดังนั้นโค้ดที่วิเคราะห์ข้อความคำแนะนำจึงไม่ได้รับอะไรเลย

การเปลี่ยนแปลงที่เงียบ: ข้อความระหว่างการเรียกใช้เครื่องมือย้ายไปยังบล็อกการคิด

การเปลี่ยนแปลงนี้ไม่ทำให้เกิดความล้มเหลวใดๆ บน Sonnet 5 บันทึกย่อระหว่างการเรียกใช้เครื่องมือจะกลับมาเป็น text บน Sonnet 5.5 สิ่งใดก็ตามที่ยาวกว่าหนึ่งหรือสองประโยคจะมาถึงในรูปแบบบล็อก thinking สำหรับการอัปเดตความคืบหน้า ซึ่งจะว่างเปล่าภายใต้ display: "omitted" เริ่มต้น UI ของเอเจนต์ที่สตรีมบันทึกย่อเหล่านั้นจะเงียบไปโดยไม่มีข้อผิดพลาด สามวิธีแก้ไข:

// Header: anthropic-beta: thinking-display-updates-2026-08-18
"thinking": {"type": "adaptive", "display": "updates"}

การเปลี่ยนแปลงพฤติกรรมโดยไม่มีการเปลี่ยนแปลงโค้ด

สิ่งเหล่านี้ไม่ได้ทำให้คำขอล้มเหลว แต่จะเปลี่ยนเอาต์พุตและค่าใช้จ่าย คู่มือการพร้อมท์ มีวิธีแก้ไข

ค่าใช้จ่ายต่อภารกิจ: ราคาเท่าเดิม แต่ใช้เงินน้อยลงต่อผลลัพธ์

โพสต์เปิดตัว ของ Anthropic กล่าวว่า Sonnet 5.5 "มีค่าใช้จ่ายต่อภารกิจน้อยกว่ารุ่นก่อนหน้าถึง 30%" ในการทดสอบของพวกเขา ราคาเท่ากัน ดังนั้นการประหยัดมาจากการใช้โทเค็นและขั้นตอนที่น้อยลง แผนภูมิ effort ของมันแสดงให้เห็นว่า effort ที่ต่ำกว่าบน 5.5 เอาชนะการทำงานที่ดีที่สุดของ Sonnet 5:

Benchmark (แผนภูมิของ Anthropic) Sonnet 5.5 Sonnet 5, การรันที่ดีที่สุด
Terminal-Bench 4.0 28.8% ที่ medium, $0.83 10.3% ที่ max, $11.62
FrontierCode 1.1 49.4% ที่ high, $0.42 42.7% ที่ xhigh, $10.07
CursorBench 4.0 35.8% ที่ low, $0.50 34.1% ที่ max, $7.17

ค่าใช้จ่ายของ CursorBench เป็นการประมาณการของ Anthropic ตามราคาในรายการ อีกด้านหนึ่งคือ max: ตามรายงานของ OfficeChai ที่อ้างอิงข้อมูล Artificial Analysis Sonnet 5.5 ที่ระดับสูงสุดใช้โทเค็นเอาต์พุตประมาณ 193,000 ต่อภารกิจดัชนี และค่าใช้จ่ายต่อภารกิจสูงกว่า Sonnet 5 ประมาณ 50% การประหยัดอยู่ที่ระดับ high และต่ำกว่านั้น ดู Claude Sonnet 5.5 pricing

รายการตรวจสอบการโยกย้าย

สลับ claude-sonnet-5 เป็น claude-sonnet-5-5 จากนั้นรันการตรวจสอบหกข้อจาก คู่มือการโยกย้าย ของ Anthropic:

  1. แทนที่ disabled ด้วย between_tools ที่ระดับ effort high หรือต่ำกว่า
  2. แทนที่ tool_choice แบบบังคับด้วย auto, strict: true และบรรทัดพรอมต์ (บน Bedrock ตรวจสอบในโค้ด)
  3. เก็บประวัติแบบ append-only; ใช้ข้อความระบบกลางบทสนทนาสำหรับการเปลี่ยนแปลง
  4. ย้ายการใช้งานคอมพิวเตอร์ไปยัง computer_toolset_20260801 บน Claude API และ Google Cloud
  5. เลือก advisor ที่รองรับ และหยุดการแยกวิเคราะห์ข้อความคำแนะนำ
  6. ตั้งค่า thinking.display หาก UI ของคุณแสดงข้อความระหว่างการเรียกใช้เครื่องมือ

จากนั้นรันการกวาด effort ของคุณใหม่ Claude Code สามารถทำให้การโยกย้ายเป็นไปโดยอัตโนมัติ:

/claude-api migrate this project to claude-sonnet-5-5

เทียบเท่ากับ Opus คือ Claude Opus 5.5 vs Opus 5 migration

เปลี่ยนการโยกย้ายให้เป็นการทดสอบรีเกรสชันใน Apidog

ใน Apidog ให้บันทึกคำขอสามรายการไปยัง https://api.anthropic.com/v1/messages ในโปรเจกต์เดียว ซึ่งทั้งหมดอยู่ในสภาพแวดล้อมเดียวกัน:

  1. Baseline: เนื้อหา Sonnet 5 ปัจจุบันของคุณ
  2. Old body, new model: เปลี่ยนเฉพาะ model เป็น claude-sonnet-5-5 ยืนยันสถานะ 400 และข้อความข้อผิดพลาดที่กล่าวถึง between_tools หรือ tool_choice
  3. Migrated: เนื้อหาที่แก้ไขแล้ว ยืนยันสถานะ 200, stop_reason ที่ไม่ใช่ refusal หรือ max_tokens และบล็อก tool_use สำหรับคำขอเครื่องมือ

เก็บ ANTHROPIC_API_KEY ไว้ในสภาพแวดล้อมและอ้างถึงเป็น {{ANTHROPIC_API_KEY}} ในเฮดเดอร์ x-api-key เปรียบเทียบ usage.output_tokens ในระดับ effort ต่างๆ เพื่อให้ได้ตัวเลขค่าใช้จ่ายต่อภารกิจของคุณเอง เมื่อบันทึกเป็นสถานการณ์ทดสอบ การถดถอยไปที่ disabled จะทำให้การรันล้มเหลวแทนที่จะเป็นการผลิต พื้นฐานคำขอ: วิธีใช้ Claude Sonnet 5.5 API

คำถามที่พบบ่อย

Claude Sonnet 5.5 แพงกว่า Sonnet 5 หรือไม่? ไม่ ราคาเท่ากันทั้งคู่คือ $2/$10 ต่อล้านโทเค็น พร้อมค่าอ่านแคช $0.20 และใช้ tokenizer ตัวเดียวกัน

ทำไมฉันถึงได้รับข้อความ "thinking.type.disabled is not supported" บน Sonnet 5.5? disabled ถูกนำออกไปแล้ว ส่ง thinking: {"type": "between_tools"} ที่ระดับ effort low, medium หรือ high โดยไม่มีฟิลด์ thinking อื่นๆ

บทสนทนา Sonnet 5 จะถูกนำไปใช้กับ Sonnet 5.5 ได้หรือไม่? ได้ Sonnet 5.5 อ่านบล็อกการคิดของ Sonnet 5 ได้ การย้ายกลับจะทำให้สูญเสียบล็อกเหล่านั้น: ไม่มีโมเดลอื่นใดที่อ่านบล็อก Sonnet 5.5 ได้

ฉันควรย้ายทุกอย่างไปที่ Sonnet 5.5 หรือไม่? สำหรับงานส่วนใหญ่ ควรย้าย ดูงานที่เกี่ยวข้องกับไซเบอร์ ซึ่งอาจจะกลับไปใช้ Sonnet 5 และการเรียกใช้เครื่องมือ Bedrock ซึ่งจะสูญเสียโหมด strict ไป คู่มือ Claude Sonnet 5 ของเรา ครอบคลุมโมเดลที่คุณกำลังจะเปลี่ยนออกไป

ขั้นตอนต่อไปของคุณ

บันทึกคำขอ Sonnet 5 ของคุณและคู่แฝด 5.5 เคียงข้างกัน ยืนยันข้อผิดพลาด 400 แก้ไข และย้ายทราฟฟิกเมื่อการแก้ไขผ่านแล้ว ดาวน์โหลด Apidog เพื่อสร้างการทดสอบนั้น

ฝึกการออกแบบ API แบบ Design-first ใน Apidog

ค้นพบวิธีที่ง่ายขึ้นในการสร้างและใช้ API