So sánh Claude Haiku 5.5 và 4.5: Có gì mới và lỗi nghiêm trọng cần sửa ngay

Haiku 5.5 so với Haiku 4.5: Rẻ hơn 90% cho tối đa 100K token, ngữ cảnh 1M, và năm thay đổi gây lỗi trả về mã lỗi 400. Các sửa lỗi JSON trước/sau bên trong.

Medy Evrard

8 tháng 10 2026

So sánh Claude Haiku 5.5 và 4.5: Có gì mới và lỗi nghiêm trọng cần sửa ngay

Apidog cho doanh nghiệp

Triển khai tại chỗ

SSO & RBAC

Tuân thủ SOC 2

Khám phá Apidog Enterprise

Claude Haiku 5.5 (claude-haiku-5-5, phát hành ngày 7 tháng 10 năm 2026) có giá thấp hơn 90% so với Haiku 4.5 đối với các lời nhắc lên đến 100K token (0,10 USD/0,50 USD trên mỗi triệu token đầu vào/đầu ra so với 1 USD/5 USD), có cửa sổ ngữ cảnh 1M token thay vì 200K, và đạt điểm cao hơn nhiều trên mọi bài kiểm tra hiệu năng ra mắt liệt kê cả hai phiên bản. Hạn chế: năm cấu trúc yêu cầu hoạt động trên 4.5 giờ trả về lỗi 400, và một số thay đổi khác làm thay đổi phản hồi và chi phí mà không báo lỗi.

Dưới đây: một bảng so sánh, mỗi thay đổi gây lỗi kèm theo JSON trước/sau, các thay đổi ngầm, và kế hoạch kiểm thử cho Apidog. Để biết bảng thông số kỹ thuật đầy đủ, hãy đọc Claude Haiku 5.5 là gì. Nếu bạn vẫn đang sử dụng phiên bản cũ hơn, hướng dẫn API Claude Haiku 4.5 của chúng tôi sẽ đề cập đến nó.

nút

Haiku 4.5 so với Haiku 5.5: Tổng quan

Claude Haiku 4.5 Claude Haiku 5.5
ID Mô hình (Claude API) claude-haiku-4-5-20251001 claude-haiku-5-5
Ngữ cảnh / đầu ra tối đa 200K / 64K 1M / 128K
Đầu vào / đầu ra trên mỗi MTok $1 / $5 $0.10 / $0.50 cho lời nhắc lên đến 100K token; $0.50 / $2.50 cho hơn 100K
Đọc bộ nhớ đệm / ghi 5 phút trên mỗi MTok $0.10 / $1.25 $0.01 / $0.125 cho lên đến 100K; $0.05 / $0.625 cho hơn 100K
Đầu vào / đầu ra theo lô trên mỗi MTok $0.50 / $2.50 $0.05 / $0.25 cho lên đến 100K; $0.25 / $1.25 cho hơn 100K
Suy nghĩ budget_tokens thủ công Chỉ thích ứng, mặc định bật
Mức độ nỗ lực Không có thấp, trung bình (mặc định), cao, rất cao, tối đa
Lời nhắc tối thiểu có thể lưu vào bộ đệm 4.096 token 512 token
Bộ mã hóa token Cũ hơn Khoảng 30% nhiều token hơn cho cùng một văn bản
Tham số lấy mẫu không mặc định, tiền điền Được chấp nhận Lỗi 400
Hạng ưu tiên Được hỗ trợ Không được hỗ trợ
Trạng thái Đang hoạt động, không ngừng hoạt động trước ngày 15 tháng 10 năm 2026 Đang hoạt động, không ngừng hoạt động trước ngày 7 tháng 10 năm 2027

Haiku 4.5 không bị ngừng hỗ trợ. Trang ngừng hỗ trợ mô hình liệt kê nó là Hoạt động mà không có ngày ngừng hỗ trợ, vì vậy bạn có thể di chuyển theo lịch trình của riêng mình. Giới hạn tốc độ vẫn giống nhau trên cả hai phiên bản.

Năm thay đổi gây lỗi

Mỗi thay đổi đều trả về lỗi 400 trên Haiku 5.5 đối với một nội dung hoạt động trên 4.5. Hướng dẫn di chuyển Haiku 5.5 liệt kê tất cả các thay đổi này.

1. Suy nghĩ thủ công với budget_tokens

Haiku 5.5 chỉ chạy suy nghĩ thích ứng. Một ngân sách cố định sẽ bị từ chối.

// Trước (Haiku 4.5)
{
  "model": "claude-haiku-4-5-20251001",
  "max_tokens": 16000,
  "thinking": { "type": "enabled", "budget_tokens": 8000 },
  "messages": [{ "role": "user", "content": "Classify this ticket." }]
}

// Sau (Haiku 5.5)
{
  "model": "claude-haiku-5-5",
  "max_tokens": 16000,
  "thinking": { "type": "adaptive" },
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "Classify this ticket." }]
}

Mức độ nỗ lực (Effort) giờ đây là đòn bẩy: nơi 4.5 sử dụng ngân sách nhỏ, hãy chọn mức độ nỗ lực thấp hơn. Bạn vẫn có thể gửi thinking: {"type": "disabled"}, nhưng chỉ ở mức độ nỗ lực high (cao) trở xuống; ở mức xhigh (rất cao) hoặc max (tối đa) thì đó cũng là lỗi 400.

2. Tham số lấy mẫu

Loại bỏ temperature, top_p và top_k. Các giá trị được chấp nhận duy nhất là temperature: 1 và top_p: 0.99. Bất kỳ giá trị nào khác đều là lỗi 400, bao gồm top_p: 1, bất kỳ top_k nào và gửi temperature và top_p cùng nhau.

// Trước (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
  "temperature": 0.2, "top_k": 40,
  "messages": [{ "role": "user", "content": "Extract the order ID." }] }

// Sau (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
  "messages": [{ "role": "user", "content": "Extract the order ID." }] }

Nếu bạn đã sử dụng nhiệt độ thấp để có đầu ra nhất quán, hãy chuyển ý định đó vào lời nhắc.

3. Trợ lý tiền điền

Một lượt trợ lý cuối cùng để mô hình tiếp tục sẽ bị từ chối, ngay cả khi tắt chế độ suy nghĩ. Kết thúc messages bằng một lượt của người dùng.

// Trước (Haiku 4.5)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 1024,
  "messages": [
    { "role": "user", "content": "Return the sentiment as JSON." },
    { "role": "assistant", "content": "{\"sentiment\": \"" }
  ] }

// Sau (Haiku 5.5)
{ "model": "claude-haiku-5-5", "max_tokens": 1024,
  "system": "Reply with only a JSON object. No preamble.",
  "messages": [
    { "role": "user", "content": "Return the sentiment as JSON." }
  ] }

Đối với các định dạng nghiêm ngặt, hướng dẫn di chuyển chỉ ra các đầu ra có cấu trúc hoặc một công cụ có các trường enum để phân loại.

4. Sử dụng máy tính: từ computer_20250124 sang computer_toolset_20260801

Trên Claude API và Google Cloud, Haiku 5.5 chỉ hỗ trợ sử dụng máy tính thông qua bộ công cụ mới. Bỏ tiêu đề beta computer-use-2025-01-24, và bỏ fine-grained-tool-streaming-2025-05-14 nếu bạn gửi nó, vì nó sẽ gây ra lỗi 400 khi đi kèm với bộ công cụ.

// Trước (Haiku 4.5, tiêu đề anthropic-beta: computer-use-2025-01-24)
{ "model": "claude-haiku-4-5-20251001", "max_tokens": 4096,
  "tools": [{ "type": "computer_20250124", "name": "computer",
              "display_width_px": 1280, "display_height_px": 800 }],
  "messages": [{ "role": "user", "content": "Open the settings page." }] }

// Sau (Haiku 5.5, không có tiêu đề beta)
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "tools": [{ "type": "computer_toolset_20260801" }],
  "messages": [{ "role": "user", "content": "Open the settings page." }] }

Vòng lặp tác nhân của bạn cũng thay đổi: phân phối trên name và toolset_name của mỗi khối tool_use thay vì input.action, và lặp lại toolset_name trên kết quả. Haiku 5.5 cũng có công cụ sử dụng trình duyệt (browser_toolset_20260801), mà Haiku 4.5 không hỗ trợ. Xem Sử dụng máy tính trong Claude Code để có cái nhìn tổng quan hơn.

5. Chỉnh sửa các lượt trước đó trước một khối suy nghĩ

Một khối suy nghĩ của Haiku 5.5 chỉ hợp lệ khi mọi thứ được gửi trước đó không thay đổi. Thay đổi system, tools hoặc một tin nhắn trước đó và gửi lại khối, bạn sẽ nhận được lỗi 400. Haiku 4.5 chưa bao giờ chạy kiểm tra này. Ở đây, lượt 1 gửi "system": "You are a billing agent." và lượt 2 chỉnh sửa nó.

// Trước: hệ thống đã chỉnh sửa + khối suy nghĩ được phát lại = 400
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "system": "You are a billing agent. Be brief.",
  "messages": [
    { "role": "user", "content": "Why was I charged twice?" },
    { "role": "assistant", "content": [
      { "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
      { "type": "text", "text": "Checking." } ] },
    { "role": "user", "content": "Order 4412." }
  ] }

// Sau: các lượt trước đó không thay đổi, hướng dẫn mới được thêm vào
{ "model": "claude-haiku-5-5", "max_tokens": 4096,
  "system": "You are a billing agent.",
  "messages": [
    { "role": "user", "content": "Why was I charged twice?" },
    { "role": "assistant", "content": [
      { "type": "thinking", "thinking": "", "signature": "<from turn 1>" },
      { "type": "text", "text": "Checking." } ] },
    { "role": "user", "content": "Order 4412. Be brief." }
  ] }

Trên các tài khoản được tạo trước ngày 31 tháng 8 năm 2026, 00:00 UTC, lỗi chỉ xuất hiện trên các yêu cầu đặt thinking.block_binding.prefix_mismatch_behavior.

Những thay đổi ngầm không gây lỗi

Những gì đã được cải thiện

Đây là những con số do Anthropic báo cáo với Haiku 5.5 ở mức nỗ lực tối đa; Artificial Analysis đã chạy GDPval-AA và AA-Briefcase một cách độc lập.

Bài kiểm tra hiệu năng Haiku 4.5 Haiku 5.5
GDPval-AA v2.1 (Elo) 735 1620
AA-Briefcase v1.1 (Elo) 614 1578
OSWorld 2.1, tập con ngoại tuyến 15.7% 72.4%
Kỳ thi cuối cùng của nhân loại, có công cụ 18.7% 57.4%
Terminal-Bench 4.0 0.0% 39.2%
SWE-bench Đa ngôn ngữ 67.4% 83.7%
Phân tích biểu đồ, không công cụ 6.4% 46.4%

Haiku 4.5 chạy Terminal-Bench đã sử dụng ngân sách suy nghĩ cố định 63.999 token. Ở mức nỗ lực medium (trung bình) mặc định, Haiku 5.5 đạt 1277 điểm trên GDPval-AA, vẫn cao hơn đáng kể so với 4.5. Box đã báo cáo điểm số cao hơn 11 điểm so với Haiku 4.5 với độ trễ chỉ bằng một nửa. Các bảng đầy đủ có trong các bài kiểm tra hiệu năng của Claude Haiku 5.5.

Anthropic vẫn định vị Sonnet 5.5 và Opus 5.5 là những lựa chọn tốt hơn cho việc mã hóa tác nhân phức tạp. Haiku 5.5 nhắm mục tiêu phân loại, trích xuất, tóm tắt, nén, các tác nhân phụ và sử dụng trình duyệt.

Về chi phí, Anthropic cho biết Haiku 5.5 hoạt động rẻ hơn khoảng 75% trung bình. Con số đó pha trộn giá thấp hơn 90% cho đến 100K token và thấp hơn 50% cho các trường hợp vượt quá, và nó đã loại bỏ các token bổ sung từ bộ mã hóa token mới. Lời nhắc hệ thống sử dụng công cụ cũng đã được rút gọn, từ 496 xuống 286 token với lựa chọn công cụ auto. Các ví dụ chi tiết có trong giá của Claude Haiku 5.5.

Kiểm tra việc di chuyển trong Apidog

Trong Apidog, tạo một dự án với ba yêu cầu đã lưu tới https://api.anthropic.com/v1/messages:

  1. Cơ sở: nội dung Haiku 4.5 hiện tại của bạn. Xác nhận trạng thái 200.
  2. Nội dung cũ, mô hình mới: chỉ thay đổi model thành claude-haiku-5-5. Xác nhận trạng thái 400. Giữ một bản sao cho mỗi thay đổi gây lỗi bạn gặp phải.
  3. Đã di chuyển: nội dung đã sửa. Xác nhận trạng thái 200, một stop_reason không phải refusal hoặc max_tokens, và một khối văn bản được tìm thấy theo type.

Lưu ANTHROPIC_API_KEY làm biến môi trường và tham chiếu nó dưới dạng {{ANTHROPIC_API_KEY}} trong tiêu đề x-api-key, với anthropic-version: 2023-06-01. So sánh usage.input_tokens giữa các yêu cầu cơ sở và yêu cầu đã di chuyển để xem sự thay đổi của bộ mã hóa token trên các lời nhắc của riêng bạn. Lưu bộ này dưới dạng một kịch bản kiểm thử, và một đồng đội nào đó vô tình đưa lại temperature sẽ khiến quá trình chạy kiểm thử thất bại thay vì gây lỗi trên môi trường sản phẩm. Các kiến thức cơ bản về yêu cầu có trong cách sử dụng Claude Haiku 5.5 API.

Nếu bạn làm việc trong Claude Code, /claude-api migrate this project to claude-haiku-5-5 sẽ áp dụng việc hoán đổi ID mô hình và các bản sửa lỗi tham số, sau đó cung cấp cho bạn một danh sách kiểm tra. Lưu ý rằng biệt danh haiku chỉ phân giải thành Haiku 5.5 trên Anthropic API; xem Claude Haiku 5.5 trong Claude Code.

Câu hỏi thường gặp

Claude Haiku 4.5 có bị ngừng hỗ trợ không? Không. Nó được liệt kê là Hoạt động mà không có ngày ngừng hỗ trợ, và thời điểm ngừng hoạt động của nó không sớm hơn ngày 15 tháng 10 năm 2026.

Tại sao yêu cầu Haiku 4.5 của tôi trả về lỗi 400 trên Haiku 5.5? Kiểm tra xem có budget_tokens, temperature/top_p/top_k, một trợ lý tiền điền, computer_20250124, hoặc các chỉnh sửa đối với các lượt trước đó trước một khối suy nghĩ hay không. Đó là năm thay đổi gây lỗi.

Haiku 5.5 có rẻ hơn Haiku 4.5 cho các lời nhắc dài không? Có. Với hơn 100K token, nó có giá 0,50 USD/2,50 USD trên mỗi triệu, bằng một nửa so với 1 USD/5 USD của Haiku 4.5. Haiku 4.5 hoàn toàn không thể xử lý các lời nhắc vượt quá 200K.

Tôi có nên chuyển mọi thứ sang Haiku 5.5 không? Đối với công việc phân loại, trích xuất và tác nhân phụ, hãy kiểm tra trước, sau đó di chuyển. So sánh nó với đối thủ gần nhất trong Haiku 5.5 so với GPT-6 Luna.

Bước tiếp theo

Lưu yêu cầu Haiku 4.5 của bạn cạnh phiên bản Haiku 5.5 tương đương, xác nhận lỗi 400, sửa nó và chuyển lưu lượng truy cập sau khi yêu cầu đã di chuyển được thông qua. Tải xuống Apidog để xây dựng cặp kiểm thử đó.

Thực hành thiết kế API trong Apidog

Khám phá cách dễ dàng hơn để xây dựng và sử dụng API