Claude Haiku 5.5 (claude-haiku-5-5, เปิดตัว 7 ตุลาคม 2026) มีราคาถูกกว่า Haiku 4.5 ถึง 90% สำหรับการป้อนคำสั่ง (prompts) สูงสุด 100K โทเค็น ($0.10/$0.50 ต่อล้านโทเค็นอินพุต/เอาต์พุต เทียบกับ $1/$5) มีหน้าต่างบริบท (context window) 1M โทเค็น แทนที่จะเป็น 200K และได้คะแนนสูงกว่ามากในการทดสอบเกณฑ์มาตรฐาน (benchmark) ทุกรายการที่ระบุทั้งสองรุ่น ข้อสังเกตคือ: รูปแบบคำขอห้ารูปแบบที่ใช้งานได้ในเวอร์ชัน 4.5 ตอนนี้ส่งคืนค่า 400 และการเปลี่ยนแปลงอีกหลายอย่างก็ปรับเปลี่ยนการตอบสนองและค่าใช้จ่ายโดยไม่มีข้อผิดพลาด
ด้านล่างนี้: ตารางเปรียบเทียบ, แต่ละการเปลี่ยนแปลงที่ส่งผลกระทบพร้อม JSON ก่อน/หลัง, การเปลี่ยนแปลงที่ไม่แจ้งให้ทราบ และแผนการทดสอบสำหรับ Apidog สำหรับเอกสารข้อมูลจำเพาะฉบับเต็ม โปรดอ่าน Claude Haiku 5.5 คืออะไร หากคุณยังคงใช้โมเดลรุ่นเก่าอยู่ คู่มือ API ของ Claude Haiku 4.5 ของเราครอบคลุมเรื่องนี้
ปุ่ม
Haiku 4.5 เทียบกับ Haiku 5.5 โดยสรุป
| Claude Haiku 4.5 | Claude Haiku 5.5 | |
|---|---|---|
| รหัสโมเดล (Claude API) | claude-haiku-4-5-20251001 |
claude-haiku-5-5 |
| บริบท / เอาต์พุตสูงสุด | 200K / 64K | 1M / 128K |
| อินพุต / เอาต์พุต ต่อ MTok | $1 / $5 | $0.10 / $0.50 สำหรับ prompts สูงสุด 100K โทเค็น; $0.50 / $2.50 สำหรับส่วนที่เกิน |
| อ่านแคช / เขียน 5 นาที ต่อ MTok | $0.10 / $1.25 | $0.01 / $0.125 สูงสุด 100K; $0.05 / $0.625 สำหรับส่วนที่เกิน |
| อินพุต / เอาต์พุต แบบ Batch ต่อ MTok | $0.50 / $2.50 | $0.05 / $0.25 สูงสุด 100K; $0.25 / $1.25 สำหรับส่วนที่เกิน |
| การคิด (Thinking) | `budget_tokens` แบบกำหนดเอง | ปรับอัตโนมัติเท่านั้น, เปิดใช้งานโดยค่าเริ่มต้น |
| ระดับความพยายาม (Effort levels) | ไม่มี | ต่ำ, ปานกลาง (ค่าเริ่มต้น), สูง, สูงมาก, สูงสุด |
| Prompt ที่สามารถแคชได้ขั้นต่ำ | 4,096 โทเค็น | 512 โทเค็น |
| Tokenization | แบบเก่า | ประมาณ 30% ของจำนวนโทเค็นที่มากขึ้นสำหรับข้อความเดียวกัน |
| พารามิเตอร์การสุ่มตัวอย่างที่ไม่ใช่ค่าเริ่มต้น, การเติมข้อความล่วงหน้า (prefill) | ยอมรับ | ข้อผิดพลาด 400 |
| ระดับความสำคัญ (Priority Tier) | รองรับ | ไม่รองรับ |
| สถานะ | ใช้งานอยู่, จะไม่เลิกใช้งานก่อน 15 ต.ค. 2026 | ใช้งานอยู่, จะไม่เลิกใช้งานก่อน 7 ต.ค. 2027 |
Haiku 4.5 ยังไม่ถูกยกเลิก หน้า การยกเลิกโมเดล ระบุว่ายังคงใช้งานอยู่โดยไม่มีกำหนดวันที่ยกเลิก ดังนั้นคุณสามารถย้ายข้อมูลได้ตามตารางเวลาของคุณเอง ขีดจำกัดอัตรา (Rate limits) ยังคงเหมือนกันทั้งสองรุ่น
การเปลี่ยนแปลงหลักห้าประการ
แต่ละรายการจะส่งคืนค่า 400 บน Haiku 5.5 สำหรับ body ที่ใช้งานได้บน 4.5 คู่มือ การย้ายข้อมูล Haiku 5.5 ระบุรายการทั้งหมด
1. การคิดแบบกำหนดเองด้วย budget_tokens
Haiku 5.5 ทำงานเฉพาะการคิดแบบปรับตัว (adaptive thinking) เท่านั้น งบประมาณที่กำหนดไว้ล่วงหน้าจะถูกปฏิเสธ
// ก่อน (Haiku 4.5)
{
"model": "claude-haiku-4-5-20251001",
"max_tokens": 16000,
"thinking": { "type": "enabled", "budget_tokens": 8000 },
"messages": [{ "role": "user", "content": "Classify this ticket." }]
}
// หลัง (Haiku 5.5)
{
"model": "claude-haiku-5-5",
"max_tokens": 16000,
"thinking": { "type": "adaptive" },
"output_config": { "effort": "medium" },
"messages": [{ "role": "user", "content": "Classify this ticket." }]
}
ตอนนี้ 'Effort' (ความพยายาม) คือตัวปรับ: หาก 4.5 เคยใช้งบประมาณน้อย ให้เลือกความพยายามที่ต่ำลง คุณยังสามารถส่ง `thinking: {"type": "disabled"}` ได้ แต่เฉพาะที่ระดับความพยายาม `high` หรือต่ำกว่าเท่านั้น ที่ `xhigh` หรือ `max` ก็จะส่งคืนค่า 400 ด้วยเช่นกัน
2. พารามิเตอร์การสุ่มตัวอย่าง
ลบ `temperature`, `top_p` และ `top_k` ออก ค่าที่ยอมรับได้มีเพียง `temperature: 1` และ `top_p: 0.99` เท่านั้น ค่าอื่น ๆ ทั้งหมดจะส่งคืนค่า 400 รวมถึง `top_p: 1`, `top_k` ใด ๆ, และการส่ง `temperature` กับ `top_p` พร้อมกัน
// ก่อน (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
"temperature": 0.2, "top_k": 40,
"messages": [{ "role": "user", "content": "Extract the order ID." }] }
// หลัง (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
"messages": [{ "role": "user", "content": "Extract the order ID." }] }
หากคุณใช้ temperature ต่ำเพื่อให้ได้ผลลัพธ์ที่สอดคล้องกัน ให้ย้ายความตั้งใจนั้นไปไว้ใน prompt แทน
3. การเติมข้อความผู้ช่วยล่วงหน้า (Assistant prefill)
การส่งท้ายด้วยคำตอบจากผู้ช่วยเพื่อให้โมเดลทำงานต่อจะถูกปฏิเสธ แม้จะปิดการคิด (thinking) ไว้ก็ตาม ให้จบ `messages` ด้วยคำตอบจากผู้ใช้
// ก่อน (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
"messages": [
{ "role": "user", "content": "Return the sentiment as JSON." },
{ "role": "assistant", "content": "{\"sentiment\": \"" }
] }
// หลัง (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
"system": "Reply with only a JSON object. No preamble.",
"messages": [
{ "role": "user", "content": "Return the sentiment as JSON." }
] }
สำหรับรูปแบบที่เข้มงวด คู่มือการย้ายข้อมูลแนะนำให้ใช้ structured outputs หรือเครื่องมือที่มีช่อง enum สำหรับการจัดหมวดหมู่
4. การใช้งานคอมพิวเตอร์: computer_20250124 เปลี่ยนเป็น computer_toolset_20260801
บน Claude API และ Google Cloud, Haiku 5.5 รองรับการใช้งานคอมพิวเตอร์ผ่าน toolset ใหม่เท่านั้น ลบเฮดเดอร์เบต้า `computer-use-2025-01-24` ออก และลบ `fine-grained-tool-streaming-2025-05-14` ออกหากคุณส่งไป เนื่องจากจะส่งคืนค่า 400 เมื่อใช้ร่วมกับ toolset
// ก่อน (Haiku 4.5, header anthropic-beta: computer-use-2025-01-24)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 4096,
"tools": [{ "type": "computer_20250124", "name": "computer",
"display_width_px": 1280, "display_height_px": 800 }],
"messages": [{ "role": "user", "content": "Open the settings page." }] }
// หลัง (Haiku 5.5, ไม่มี beta header)
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"tools": [{ "type": "computer_toolset_20260801" }],
"messages": [{ "role": "user", "content": "Open the settings page." }] }
Agent loop ของคุณก็เปลี่ยนแปลงเช่นกัน: โดยเปลี่ยนไปใช้ `name` และ `toolset_name` ของแต่ละบล็อก `tool_use` แทน `input.action` และสะท้อนค่า `toolset_name` ในผลลัพธ์ Haiku 5.5 ยังมีเครื่องมือใช้งานเบราว์เซอร์ (`browser_toolset_20260801`) ซึ่ง Haiku 4.5 ไม่รองรับ ดู การใช้งานคอมพิวเตอร์ของ Claude Code สำหรับภาพรวมที่กว้างขึ้น
5. การแก้ไขเทิร์นก่อนหน้าก่อนบล็อกการคิด (thinking block)
บล็อกการคิดของ Haiku 5.5 จะยังคงใช้งานได้ตราบเท่าที่ข้อมูลทั้งหมดที่ส่งไปก่อนหน้านั้นไม่เปลี่ยนแปลง หากคุณเปลี่ยน `system`, `tools` หรือข้อความก่อนหน้าแล้วส่งบล็อกนั้นกลับไป คุณจะได้รับข้อผิดพลาด 400 Haiku 4.5 ไม่เคยตรวจสอบสิ่งนี้ ในตัวอย่างนี้ เทิร์นที่ 1 ส่ง "system": "You are a billing agent." และเทิร์นที่ 2 ทำการแก้ไข
// ก่อน: edited system + replayed thinking block = 400
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"system": "You are a billing agent. Be brief.",
"messages": [
{ "role": "user", "content": "Why was I charged twice?" },
{ "role": "assistant", "content": [
{ "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
{ "type": "text", "text": "Checking." } ] },
{ "role": "user", "content": "Order 4412." }
] }
// หลัง: earlier turns unchanged, new instruction appended
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
"system": "You are a billing agent.",
"messages": [
{ "role": "user", "content": "Why was I charged twice?" },
{ "role": "assistant", "content": [
{ "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
{ "type": "text", "text": "Checking." } ] },
{ "role": "user", "content": "Order 4412. Be brief." }
] }
สำหรับบัญชีที่สร้างก่อนวันที่ 31 สิงหาคม 2026 เวลา 00:00 UTC ข้อผิดพลาดจะปรากฏเฉพาะในคำขอที่ตั้งค่า `thinking.block_binding.prefix_mismatch_behavior` เท่านั้น
การเปลี่ยนแปลงที่ไม่แจ้งให้ทราบซึ่งจะไม่ก่อให้เกิดข้อผิดพลาด
- ช่อง `thinking` ว่างเปล่าโดยค่าเริ่มต้น แต่ละบล็อก `thinking` จะกลับมาพร้อมกับช่อง `thinking` ที่ว่างเปล่าและมีเพียง `signature` เท่านั้น Haiku 4.5 เคยส่งคืนการคิดแบบสรุป ตั้งค่า `thinking: {"type": "adaptive", "display": "summarized"}` หากคุณบันทึกหรือแสดงผล
- การตอบสนองสามารถเริ่มต้นด้วยการคิด การคิดแบบปรับตัวจะเปิดใช้งานอยู่เสมอแม้ว่าคุณจะไม่ได้ตั้งค่า ดังนั้นให้เลือกบล็อกเนื้อหาตาม `type` ไม่ใช่ตามดัชนี
- จำนวนโทเค็นเพิ่มขึ้นประมาณ 30% tokenizer ใหม่นับข้อความเดียวกันว่ามีโทเค็นเพิ่มขึ้นประมาณ 30% นับ prompts ใหม่ และจำไว้ว่าโทเค็นการคิดจะนับรวมใน `max_tokens` ดังนั้นขีดจำกัดที่น้อยอาจทำให้หยุดด้วย `stop_reason: "max_tokens"` ก่อนที่จะมีข้อความใดๆ
- `tool_choice` แบบบังคับจะข้ามการคิด `any` หรือเครื่องมือที่มีชื่อยังคงใช้งานได้ แต่การตอบสนองจะเริ่มต้นด้วยการเรียกใช้เครื่องมือและไม่มีบล็อก `thinking` ใช้ `tool_choice: {"type": "auto"}` และบอกโมเดลว่าจะเรียกใช้เครื่องมือเมื่อใด หากคุณต้องการให้โมเดลใช้เหตุผลก่อน
- การปฏิเสธใหม่ ไม่มี fallback Haiku 5.5 ใช้ตัวจัดประเภทความปลอดภัย (`cyber`, `frontier_llm`, `bio`, `general_harms`) ที่สามารถส่งคืน `stop_reason: "refusal"` ไม่มี fallback ฝั่งเซิร์ฟเวอร์ และการลองใหม่มักจะถูกปฏิเสธอีกครั้ง
- Priority Tier ถูกยกเลิกแล้ว หากคุณมีข้อผูกพัน Priority Tier บน Haiku 4.5 ให้วางแผนความจุแยกต่างหาก
- บล็อกการคิดจะถูกผูกกับบัญชี พวกมันใช้งานได้เฉพาะในบัญชีที่สร้างขึ้นหรือบัญชีที่เชื่อมโยงเท่านั้น การเล่นซ้ำการสนทนาที่จัดเก็บไว้ผ่านบัญชีอื่นจะทำให้สูญเสียการใช้เหตุผลนั้นไป
- การแคชที่ถูกลงเริ่มต้นเร็วกว่า prompt ที่สามารถแคชได้ขั้นต่ำลดลงจาก 4,096 เหลือ 512 โทเค็น ดังนั้น system prompts สั้นๆ ที่ไม่เคยแคชบน 4.5 ตอนนี้จะสามารถแคชได้
สิ่งที่ได้รับการปรับปรุง
ตัวเลขเหล่านี้เป็นรายงานจาก Anthropic โดย Haiku 5.5 ทำงานด้วยความพยายามสูงสุด; Artificial Analysis ได้ทำการทดสอบ GDPval-AA และ AA-Briefcase อย่างเป็นอิสระ
| เกณฑ์มาตรฐาน | Haiku 4.5 | Haiku 5.5 |
|---|---|---|
| GDPval-AA v2.1 (Elo) | 735 | 1620 |
| AA-Briefcase v1.1 (Elo) | 614 | 1578 |
| OSWorld 2.1, ชุดย่อยแบบออฟไลน์ | 15.7% | 72.4% |
| Humanity’s Last Exam, พร้อมเครื่องมือ | 18.7% | 57.4% |
| Terminal-Bench 4.0 | 0.0% | 39.2% |
| SWE-bench Multilingual | 67.4% | 83.7% |
| Chartography, ไม่มีเครื่องมือ | 6.4% | 46.4% |
การทดสอบ Terminal-Bench ของ Haiku 4.5 ใช้งบประมาณการคิด 63,999 โทเค็นที่กำหนดไว้ ที่ความพยายาม medium โดยค่าเริ่มต้น Haiku 5.5 ได้คะแนน 1277 บน GDPval-AA ซึ่งยังคงสูงกว่า 4.5 อย่างมาก Box รายงานคะแนนที่สูงกว่า Haiku 4.5 ถึง 11 จุด โดยมีความหน่วง (latency) ลดลงประมาณครึ่งหนึ่ง ตารางฉบับเต็มอยู่ใน เกณฑ์มาตรฐานของ Claude Haiku 5.5
Anthropic ยังคงวางตำแหน่ง Sonnet 5.5 และ Opus 5.5 ให้เป็นตัวเลือกที่ดีกว่าสำหรับการเขียนโค้ด agentic ที่ซับซ้อน Haiku 5.5 มุ่งเป้าไปที่การจัดหมวดหมู่, การดึงข้อมูล, การสรุป, การย่อ, subagents และการใช้งานเบราว์เซอร์
ในด้านราคา Anthropic ระบุว่า Haiku 5.5 มีราคาถูกลงโดยเฉลี่ยประมาณ 75% ตัวเลขดังกล่าวรวมส่วนลด 90% สำหรับราคาโทเค็นสูงสุด 100K และส่วนลด 50% สำหรับส่วนที่เกินกว่านั้น โดยได้หักลบโทเค็นที่เพิ่มขึ้นจาก tokenizer ใหม่แล้ว system prompt สำหรับการใช้เครื่องมือก็ลดลงเช่นกัน จาก 496 เหลือ 286 โทเค็น เมื่อใช้ `auto` tool choice ตัวอย่างการใช้งานอยู่ใน ราคาของ Claude Haiku 5.5
ทดสอบการย้ายข้อมูลใน Apidog
ใน Apidog ให้สร้างหนึ่งโปรเจกต์ที่มีคำขอที่บันทึกไว้สามรายการไปยัง `https://api.anthropic.com/v1/messages`:

- ฐานข้อมูล: body ของ Haiku 4.5 ปัจจุบันของคุณ ตรวจสอบสถานะ 200
- Body เก่า, โมเดลใหม่: เปลี่ยนเฉพาะ `model` เป็น `claude-haiku-5-5` ตรวจสอบสถานะ 400 เก็บสำเนาหนึ่งชุดสำหรับการเปลี่ยนแปลงที่ส่งผลกระทบแต่ละรายการที่คุณพบ
- ย้ายข้อมูลแล้ว: body ที่แก้ไขแล้ว ตรวจสอบสถานะ 200, `stop_reason` ที่ไม่ใช่ `refusal` หรือ `max_tokens` และบล็อกข้อความที่พบโดย `type`
จัดเก็บ `ANTHROPIC_API_KEY` เป็นตัวแปรสภาพแวดล้อม และอ้างอิงเป็น `{{ANTHROPIC_API_KEY}}` ในส่วนหัว `x-api-key` พร้อมกับ `anthropic-version: 2023-06-01` เปรียบเทียบ `usage.input_tokens` ระหว่างคำขอพื้นฐานและคำขอที่ย้ายข้อมูลแล้ว เพื่อดูการเปลี่ยนแปลงของ tokenizer ใน prompts ของคุณเอง บันทึกชุดนี้เป็นสถานการณ์การทดสอบ และเพื่อนร่วมทีมที่นำ `temperature` กลับมาใช้ใหม่จะทำให้การทำงานล้มเหลวแทนที่จะเป็นในส่วนการผลิตจริง ข้อมูลพื้นฐานของคำขออยู่ใน วิธีการใช้ Claude Haiku 5.5 API
หากคุณทำงานใน Claude Code การใช้ /claude-api migrate this project to claude-haiku-5-5 จะทำการสลับรหัสโมเดลและแก้ไขพารามิเตอร์ จากนั้นจะให้รายการตรวจสอบแก่คุณ โปรดทราบว่าชื่อย่อ haiku จะอ้างถึง Haiku 5.5 เฉพาะบน Anthropic API เท่านั้น ดู Claude Haiku 5.5 ใน Claude Code
คำถามที่พบบ่อย
Claude Haiku 4.5 ถูกยกเลิกแล้วหรือยัง? ยัง ไม่ถูกยกเลิก มันถูกระบุว่ายังคงใช้งานอยู่โดยไม่มีกำหนดวันที่ยกเลิก และจะไม่ถูกถอดออกก่อนวันที่ 15 ตุลาคม 2026
ทำไมคำขอ Haiku 4.5 ของฉันถึงส่งคืนค่า 400 บน Haiku 5.5? ตรวจสอบ `budget_tokens`, `temperature`/`top_p`/`top_k`, การเติมข้อความผู้ช่วยล่วงหน้า (assistant prefill), `computer_20250124` หรือการแก้ไขเทิร์นก่อนหน้าก่อนบล็อกการคิด (thinking block) นี่คือห้าการเปลี่ยนแปลงหลักที่ส่งผลกระทบ
Haiku 5.5 มีราคาถูกกว่า Haiku 4.5 สำหรับ prompts ที่ยาวหรือไม่? ใช่ สำหรับโทเค็นที่เกิน 100K จะมีราคา $0.50/$2.50 ต่อล้าน ซึ่งเป็นครึ่งหนึ่งของ Haiku 4.5 ที่ราคา $1/$5 Haiku 4.5 ไม่สามารถรับ prompts ที่เกิน 200K ได้เลย
ฉันควรเปลี่ยนทุกอย่างไปใช้ Haiku 5.5 หรือไม่? สำหรับงานการจัดหมวดหมู่ การดึงข้อมูล และ subagent ให้ทดสอบก่อนแล้วจึงย้าย เปรียบเทียบกับคู่แข่งที่ใกล้เคียงที่สุดใน Haiku 5.5 vs GPT-6 Luna
ขั้นตอนถัดไป
บันทึกคำขอ Haiku 4.5 ของคุณถัดจากคู่แฝด Haiku 5.5 ยืนยันข้อผิดพลาด 400 แก้ไข และย้ายทราฟฟิกเมื่อคำขอที่ย้ายข้อมูลแล้วผ่านการทดสอบ ดาวน์โหลด Apidog เพื่อสร้างคู่ทดสอบนั้น
