Claude Haiku 5.5 là gì?

Claude Haiku 5.5 là gì? Mô hình của Anthropic ra mắt ngày 7 tháng 10 năm 2026: $0.10/$0.50 cho các lời nhắc lên đến 100K token, 1M ngữ cảnh, điểm chuẩn và những thay đổi so với Haiku 4.5.

Ashley Innocent

Ashley Innocent

8 tháng 10 2026

Claude Haiku 5.5 là gì?

Apidog cho doanh nghiệp

Triển khai tại chỗ

SSO & RBAC

Tuân thủ SOC 2

Khám phá Apidog Enterprise

Claude Haiku 5.5 là mô hình nhỏ nhất và nhanh nhất hiện tại của Anthropic, ra mắt vào ngày 7 tháng 10 năm 2026, với ID API là claude-haiku-5-5. Chi phí là 0,10 đô la cho mỗi triệu token đầu vào và 0,50 đô la cho mỗi triệu token đầu ra đối với các lời nhắc (prompts) lên đến 100K token, và 0,50 đô la/2,50 đô la đối với các lời nhắc trên 100K. Trong bài đăng ra mắt, Anthropic cho biết nó tốn “ít hơn khoảng 75% chi phí để vận hành” so với Haiku 4.5 trung bình, và gọi đây là “mô hình nhanh nhất của chúng tôi cho đến nay.” Đây cũng là Haiku đầu tiên có cài đặt mức độ nỗ lực (effort setting), và nó mang đến cửa sổ ngữ cảnh (context window) 1 triệu token.

Dưới đây: thông số kỹ thuật, giá hai cấp, các thay đổi so với Haiku 4.5, điểm chuẩn, nơi để chạy nó và ai nên chuyển đổi, cùng với các liên kết đến các hướng dẫn chuyên sâu hơn như phân tích chi phí Haiku 5.5. Để gọi mô hình khi bạn đọc, Apidog có thể gửi yêu cầu Messages, lưu khóa của bạn vào biến môi trường và hiển thị phản hồi cùng với mức sử dụng token của nó.

nút

Thông số kỹ thuật Claude Haiku 5.5 nhanh chóng

Thông số Claude Haiku 5.5
Ngày phát hành 7 tháng 10 năm 2026
ID mô hình (Claude API, Google Cloud, Microsoft Foundry, Claude Platform trên AWS) claude-haiku-5-5 (ID cố định, không có hậu tố ngày)
ID mô hình (Amazon Bedrock) anthropic.claude-haiku-5-5
Cửa sổ ngữ cảnh 1 triệu token (Haiku 4.5: 200K)
Đầu ra tối đa 128K (Haiku 4.5: 64K); 300K trên Batch API với tiêu đề beta output-300k-2026-03-24
Tư duy Chỉ thích ứng
Mức độ nỗ lực low, medium (mặc định), high, xhigh, max
Ngày cắt dữ liệu Tháng 6 năm 2026
Giá mỗi triệu token, lời nhắc lên đến 100K token 0,10 đô la đầu vào, 0,50 đô la đầu ra
Giá mỗi triệu token, lời nhắc trên 100K token 0,50 đô la đầu vào, 2,50 đô la đầu ra
Ngừng hoạt động Không sớm hơn ngày 7 tháng 10 năm 2027

Vị trí của Haiku 5.5 trong dòng sản phẩm Claude

Mô hình Đầu vào / đầu ra mỗi triệu token Mức độ nỗ lực mặc định Độ trễ
Claude Fable 5.1 10 đô la / 50 đô la high Chậm hơn
Claude Opus 5.5 4 đô la / 20 đô la medium Trung bình
Claude Sonnet 5.5 2 đô la / 10 đô la high Nhanh
Claude Haiku 5.5 0,10 đô la / 0,50 đô la cho lời nhắc lên đến 100K token medium Nhanh nhất

Cả bốn mô hình đều có cửa sổ ngữ cảnh 1 triệu token, đầu ra tối đa 128K và ngày cắt dữ liệu tháng 6 năm 2026. Anthropic đã xây dựng Haiku 5.5 “cho các tác vụ có khối lượng lớn, nhạy cảm với độ trễ như phân loại, trích xuất và định tuyến,” cộng với tóm tắt, hỗ trợ trực tiếp, sử dụng trình duyệt và công việc của các tác nhân phụ (subagent) dưới Opus 5.5 hoặc Sonnet 5.5.

Tuyên bố về tốc độ có một chú thích: nhanh nhất “ở tốc độ tiêu chuẩn của mỗi mô hình,” nhưng chậm hơn Opus ở Chế độ Nhanh (Fast Mode). Anthropic không công bố con số token mỗi giây.

Giá của Claude Haiku 5.5

Giá phụ thuộc vào độ dài của lời nhắc. Một lời nhắc trên 100.000 token sẽ phải trả mức giá cao hơn.

Nguồn: Giá API Claude.

Con số “giảm khoảng 75%” là mức trung bình: rẻ hơn 90% so với Haiku 4.5 đối với các lời nhắc lên đến 100K token, rẻ hơn 50% đối với các lời nhắc trên 100K, với 90% yêu cầu của Haiku 4.5 nằm dưới ngưỡng. Con số này đã tính đến tokenizer mới, vốn tạo ra nhiều hơn khoảng 30% token cho cùng một văn bản.

Suy luận chỉ ở Hoa Kỳ (inference_geo) có chi phí cao hơn 1,1 lần đối với mọi danh mục token. Lời nhắc có thể lưu trữ tối thiểu giảm xuống 512 token, từ 4.096 trên Haiku 4.5.

Dưới 100K token, giá niêm yết khớp chính xác với GPT-6 Luna (đầu vào 0,10 đô la, đầu ra 0,50 đô la, đọc bộ nhớ cache 0,01 đô la, ghi bộ nhớ cache 0,125 đô la). Các ngưỡng khác nhau: phụ phí của Luna bắt đầu từ trên 272K token đầu vào. So sánh Haiku 5.5 với GPT-6 Luna xem xét chi tiết sự khác biệt đó, và hướng dẫn định giá có các ví dụ chi phí thực tế.

Những thay đổi so với Haiku 4.5

Cửa sổ ngữ cảnh tăng gấp năm lần, đầu ra tối đa tăng gấp đôi và bạn lần đầu tiên có quyền kiểm soát mức độ nỗ lực. Hướng dẫn di chuyển cảnh báo rằng mã được viết cho Haiku 4.5 có thể bị lỗi. Năm thay đổi trả về lỗi 400:

  1. Ngân sách tư duy thủ công (Manual thinking budgets). thinking: {"type": "enabled", "budget_tokens": N} sẽ thất bại. Hãy sử dụng {"type": "adaptive"} với output_config.effort.
  2. Tham số lấy mẫu (Sampling parameters). Xóa temperature, top_p và top_k. Các giá trị temperature hoặc top_p không mặc định sẽ thất bại, cũng như bất kỳ top_k nào hoặc việc gửi cả temperature và top_p.
  3. Điền trước trợ lý (Assistant prefill). Bị từ chối, ngay cả khi đã tắt chức năng tư duy.
  4. Công cụ sử dụng máy tính cũ. Trên Claude API và Google Cloud, hãy sử dụng computer_toolset_20260801; computer_20250124 sẽ thất bại.
  5. Lịch sử đã chỉnh sửa. Việc thay đổi system, tools hoặc các tin nhắn trước đó trước khi một khối tư duy được trả về sẽ thất bại. Hãy giữ các cuộc hội thoại chỉ thêm vào (append-only).

Các thay đổi khác sẽ không gây lỗi nhưng sẽ làm thay đổi kết quả của bạn:

Tính năng tư duy có thể được tắt trên API ở mức độ nỗ lực high trở xuống; ở mức xhigh và max, điều đó sẽ trả về lỗi 400. Haiku 4.5 chưa bị lỗi thời (deprecated): nó vẫn được liệt kê là đang hoạt động. Hướng dẫn Haiku 5.5 so với Haiku 4.5 có JSON trước/sau cho mỗi bản sửa lỗi.

Điểm chuẩn của Claude Haiku 5.5

Điểm của Haiku 5.5 được đo ở mức nỗ lực tối đa, chủ yếu là trung bình qua năm lần thử. Artificial Analysis đã chạy GDPval-AA và AA-Briefcase, Cognition đã chạy FrontierCode, và Anthropic đã chấm điểm Chartography (một điểm chuẩn của Surge AI) bằng cách triển khai riêng của mình.

Đọc ba ô cẩn thận. FrontierCode đặt Haiku ở mức tối đa so với Sonnet 5.5 ở mức xhigh; ở mức tối đa, Sonnet đạt 46,2%, thấp hơn 46,4% của Haiku. Anthropic đã chạy điểm OSWorld của Luna thông qua API của OpenAI, trong khi điểm Terminal-Bench của Luna đến từ bảng xếp hạng công khai (Codex CLI). Và ở mức nỗ lực mặc định medium, Haiku 5.5 đạt 1277 trên GDPval-AA và 1372 trên AA-Briefcase.

Anthropic cho biết Sonnet 5.5 và Opus 5.5 “vẫn là lựa chọn tốt hơn cho các tác vụ mã hóa tác nhân phức tạp.” Không có bảng xếp hạng độc lập nào có kết quả Haiku 5.5 tính đến ngày 8 tháng 10 năm 2026; Cursor báo cáo 48,4% trên CursorBench riêng của mình ở mức tối đa. Phân tích chuyên sâu về điểm chuẩn có điểm và chi phí cho từng mức độ nỗ lực.

Nơi bạn có thể sử dụng Claude Haiku 5.5

Nền tảng Truy cập Ghi chú
Claude API claude-haiku-5-5 Thanh toán theo token
Amazon Bedrock anthropic.claude-haiku-5-5 Thanh toán qua AWS Marketplace
Google Cloud, Microsoft Foundry, Claude Platform trên AWS claude-haiku-5-5 ID giống như Claude API
Claude.ai (web, iOS, Android) Trình chọn mô hình Người dùng miễn phí, Pro, Max, Team và Doanh nghiệp có thể chọn nó
Claude Code /model claude-haiku-5-5 v2.1.293 trở lên; gói trả phí
Vercel AI Gateway anthropic/claude-haiku-5.5 Từ 0,10 đô la / 0,50 đô la
Cursor claude-haiku-5-5 Nhóm các mô hình khác

Tính đến ngày 8 tháng 10 năm 2026, nó chưa có trên OpenRouter hoặc chưa được công bố cho GitHub Copilot.

Truy cập trò chuyện trên gói Miễn phí không phải là khóa API, và API được thanh toán theo mức sử dụng vượt quá khoản tín dụng miễn phí nhỏ mà Anthropic cấp cho người dùng mới để thử nghiệm. Các gói Max và Team hiện bao gồm tín dụng API hàng tháng (100 đô la trên Max 5x, 200 đô la trên Max 20x, lên đến 500 đô la được gộp trên Team), nhưng không bao gồm Claude Code. Hướng dẫn truy cập miễn phí liệt kê những gì miễn phí và không miễn phí.

Trong Claude Code, bí danh haiku chỉ có nghĩa là Haiku 5.5 trên Anthropic API; ở những nơi khác, nó vẫn có nghĩa là Haiku 4.5. Xem Haiku 5.5 trong Claude Code để biết cách thiết lập tác nhân phụ.

Ai nên chuyển sang Haiku 5.5

Trong bài đăng ra mắt của Anthropic, Asana báo cáo độ trễ thấp hơn hơn 30% trong việc hoàn thành tác vụ, và Box ghi nhận điểm số cao hơn 11 điểm so với Haiku 4.5 với độ trễ chỉ bằng khoảng một nửa. Đây là những tuyên bố từ khách hàng, không phải là các thử nghiệm độc lập.

Thẻ hệ thống ghi nhận rằng nó từ chối nhiều hơn bất kỳ mô hình nào khác trong quá trình kiểm toán tự động của Anthropic, vì vậy hãy kiểm tra tỷ lệ từ chối trên các lời nhắc của riêng bạn.

Gửi yêu cầu Haiku 5.5 đầu tiên của bạn

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 4000,
    "thinking": {"type": "adaptive", "display": "summarized"},
    "output_config": {"effort": "low"},
    "messages": [
      {"role": "user", "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error."}
    ]
  }'

Bỏ qua các tham số lấy mẫu và điền trước. Đọc các khối nội dung theo type, vì phản hồi có thể bắt đầu bằng một khối tư duy.

Trong Apidog, nhập lệnh curl làm yêu cầu mới và lưu khóa vào biến môi trường ANTHROPIC_API_KEY. Thêm các xác nhận (assertions) rằng stop_reason không phải là refusal hoặc max_tokens. Sau đó nhân đôi yêu cầu ở mức medium và so sánh usage để xem chi phí của mỗi mức độ nỗ lực. Hướng dẫn API Haiku 5.5 bao gồm bộ nhớ cache, xử lý theo lô (batch) và truyền trực tuyến (streaming), và hướng dẫn khóa API Anthropic sẽ giúp ích nếu bạn cần một khóa.

Câu hỏi thường gặp

Claude Haiku 5.5 được phát hành khi nào? Ngày 7 tháng 10 năm 2026, chín ngày sau Sonnet 5.5.

Claude Haiku 5.5 có miễn phí không? Trong ứng dụng trò chuyện Claude.ai, người dùng miễn phí có thể chọn nó. API được tính phí, ngoài các khoản tín dụng thử nghiệm nhỏ cho người dùng mới. Xem mọi cách truy cập miễn phí.

Cửa sổ ngữ cảnh của Claude Haiku 5.5 là gì? 1 triệu token, với đầu ra tối đa 128K trên Messages API.

Haiku 4.5 có bị ngừng hoạt động không? Chưa. Nó vẫn được liệt kê là đang hoạt động, với thời điểm ngừng hoạt động không sớm hơn ngày 15 tháng 10 năm 2026.

Bước tiếp theo

Hãy chọn một công việc có khối lượng lớn mà bạn đang thực hiện hôm nay, chẳng hạn như phân loại yêu cầu (ticket triage) hoặc tóm tắt tài liệu. Gửi nó đến claude-haiku-5-5 ở mức low và medium, kiểm tra đầu ra và so sánh usage với mô hình hiện tại của bạn. Tải xuống Apidog để lưu giữ các yêu cầu và xác nhận đó trong một dự án, sau đó sử dụng hướng dẫn định giá để chuyển số lượng token thành hóa đơn hàng tháng.

Thực hành thiết kế API trong Apidog

Khám phá cách dễ dàng hơn để xây dựng và sử dụng API