Giá Claude Haiku 5.5

Giá Claude Haiku 5.5: 0,10 USD / 0,50 USD cho mỗi triệu token đối với lời nhắc lên đến 100.000, 0,50 USD / 2,50 USD cho lời nhắc trên 100.000. Các ví dụ về chi phí bộ nhớ đệm (caching

INEZA Felin-Michel

INEZA Felin-Michel

8 tháng 10 2026

Giá Claude Haiku 5.5

Apidog cho doanh nghiệp

Triển khai tại chỗ

SSO & RBAC

Tuân thủ SOC 2

Khám phá Apidog Enterprise

Claude Haiku 5.5 có giá 0.10 USD cho mỗi triệu token đầu vào và 0.50 USD cho mỗi triệu token đầu ra đối với các lời nhắc lên đến 100K token. Một lời nhắc trên 100.000 token có giá cao hơn: 0.50 USD đầu vào và 2.50 USD đầu ra. Đọc bộ nhớ đệm bắt đầu từ 0.01 USD, API Batch giảm một nửa mọi mức giá và Anthropic cho biết chi phí chạy mô hình này “rẻ hơn khoảng 75%” so với Haiku 4.5 tính trung bình.

Hướng dẫn này bao gồm từng hạng mục, phép tính đằng sau con số 75% đó, ba ví dụ thực tế (một ví dụ vượt 100K), chi phí theo mức độ nỗ lực, và cách Haiku 5.5 so sánh với Haiku 4.5, GPT-6 Luna và Sonnet 5.5. Mới tìm hiểu về mô hình này? Bắt đầu với Claude Haiku 5.5 là gì. Để kiểm tra các số liệu trên lưu lượng truy cập của riêng bạn, hãy gửi yêu cầu từ Apidog và đọc khối usage của mỗi phản hồi.

Bảng giá API của Claude Haiku 5.5

Giá mỗi triệu token (MTok), từ tài liệu giá của Anthropic:

Hạng mục Lời nhắc tối đa 100K token Lời nhắc trên 100K token
Đầu vào $0.10 $0.50
Đầu ra $0.50 $2.50
Ghi bộ nhớ đệm 5 phút $0.125 $0.625
Ghi bộ nhớ đệm 1 giờ $0.20 $1.00
Đọc bộ nhớ đệm (lượt truy cập và làm mới) $0.01 $0.05
Đầu vào theo lô $0.05 $0.25
Đầu ra theo lô $0.25 $1.25

Tài liệu nêu rõ: “một lời nhắc trên 100.000 token có giá cao hơn.” Các mô hình Claude khác từ 4.6 trở đi tính phí toàn bộ cửa sổ 1M với một mức giá; Haiku 5.5 là trường hợp ngoại lệ. Cũng cần lưu ý:

“Khoảng 75% ít hơn” đến từ đâu

Haiku 5.5 có giá thấp hơn 90% so với Haiku 4.5 lên đến 100.000 token và thấp hơn 50% khi vượt ngưỡng; 90% yêu cầu của Haiku 4.5 nằm dưới 100K; và con số này tính cả bộ mã hóa mới. Một cách tính toán gần đúng:

  1. Trọng số theo số lượng yêu cầu: 0.9 × 90% + 0.1 × 50% = 86% thấp hơn.
  2. Thêm khoảng 30% token: 14% chi phí còn lại trở thành 14% × 1.3 = 18.2%, vì vậy mức tiết kiệm giảm xuống còn khoảng 82%.

Con số của Anthropic lại thấp hơn. Họ không công bố trọng số, và các lời nhắc dài có thể chiếm nhiều chi phí hơn số lượng yêu cầu. Hãy coi 75% là mức trung bình; dữ liệu usage của bạn mới là câu trả lời thực sự.

Chi phí cho mỗi lần thử ở mỗi cấp độ nỗ lực

Haiku 5.5 là Haiku đầu tiên có các mức độ nỗ lực (low đến max; medium là mặc định của API), và nỗ lực làm thay đổi hóa đơn của bạn nhiều hơn bảng giá. Những số liệu này đến từ các biểu đồ theo nỗ lực của bài đăng ra mắt. Anthropic chạy OSWorld và Terminal-Bench; Artificial Analysis chạy GDPval-AA:

Nỗ lực OSWorld 2.1 (điểm, $/lần thử) GDPval-AA v2.1 (Elo, $/tác vụ) Terminal-Bench 4.0 (điểm, $/lần thử)
Thấp 42.0%, $0.0695 1125, $0.0117 12.7%, $0.424
Trung bình 53.3%, $0.1257 1277, $0.0304 20.3%, $0.6798
Cao 61.3%, $0.1827 1420, $0.0894 24.8%, $1.0372
Rất cao 67.6%, $0.2792 1513, $0.2673 31.5%, $1.7545
Tối đa 72.4%, $0.6111 1620, $0.8659 39.2%, $2.6433

Những điểm nổi bật:

Cách Haiku 5.5 so sánh về giá

Mô hình Đầu vào / đầu ra trên MTok Đọc bộ nhớ đệm Ghi bộ nhớ đệm 5 phút Quy tắc lời nhắc dài
Claude Haiku 5.5 $0.10 / $0.50 lên đến 100K $0.01 $0.125 Trên 100K: $0.50 / $2.50
GPT-6 Luna $0.10 / $0.50 $0.01 $0.125 Đầu vào trên 272K: 2x đầu vào và bộ nhớ đệm, 1.5x đầu ra ($0.20 / $0.75)
Claude Haiku 4.5 $1 / $5 $0.10 $1.25 Một mức giá (ngữ cảnh 200K)
Claude Sonnet 5.5 $2 / $10 $0.10 $2.50 Một mức giá trên 1M

GPT-6 Luna ngang với Haiku 5.5 lên đến 100K; ngưỡng khác nhau. Theo trang mô hình của OpenAI, phụ phí Luna bắt đầu trên 272K và áp dụng “cho toàn bộ yêu cầu.” Cuộc gọi trong Ví dụ 3 vẫn ở mức giá cơ bản của Luna: (150,000 × $0.10 + 2,000 × $0.50) ÷ 1,000,000 = $0.016, so với $0.08 trên Haiku 5.5. Các bộ mã hóa cũng khác nhau: một người bình luận trên Hacker News ước tính 100K token Claude bằng khoảng 60-65K token GPT. Trên biểu đồ OSWorld của Anthropic, Haiku 5.5 ở mức medium (53.3%, $0.1257) đánh bại Luna ở mức max (48.9%, $0.205). Chi tiết hơn trong Claude Haiku 5.5 so với GPT-6 Luna.

Sonnet 5.5 giảm chi phí đọc bộ nhớ đệm từ 0.20 USD xuống 0.10 USD cùng ngày, rẻ hơn khoảng 20% cho hầu hết công việc tác nhân theo Anthropic. Hướng dẫn giá Sonnet 5.5 của chúng tôi ra đời trước khi có sự giảm giá này.

Haiku 4.5 không bị ngừng sử dụng; Haiku 5.5 so với Haiku 4.5 liệt kê các thay đổi đột phá cần khắc phục trước.

Tín dụng API và các gói dành cho người tiêu dùng

Tín dụng API Max và Team. Max 5x nhận được 100 USD tín dụng Nền tảng Claude mỗi tháng, Max 20x nhận 200 USD, và Team nhận 20 USD cho mỗi ghế Standard và 100 USD cho mỗi ghế Premium, được gộp chung và giới hạn ở 500 USD. Miễn phí, Pro và Enterprise không đủ điều kiện. Theo tài liệu tín dụng API, chúng bao gồm API Claude, không phải Claude Code hoặc các đám mây, và không được chuyển sang tháng sau. Với 0.10 USD cho mỗi MTok, 100 USD mua được 1 tỷ token đầu vào, hoặc khoảng 220.000 yêu cầu của Ví dụ 1 (100 USD ÷ 0.000455 USD).

Các gói dành cho người tiêu dùng (claude.com/pricing): Người dùng gói Miễn phí ($0), Pro, Max, Team và Enterprise có thể chọn Haiku 5.5 trên Claude.ai trên web, iOS và Android. Gói Pro là 17 USD/tháng nếu thanh toán hàng năm hoặc 20 USD hàng tháng; Max bắt đầu từ 100 USD/tháng. Gói Miễn phí không có Claude Code, và một gói trò chuyện không thể chạy một script hoặc công việc CI. Cách sử dụng Claude Haiku 5.5 miễn phí bao gồm phần còn lại.

Đám mây. Bedrock, Google Cloud và Foundry tính phí Haiku 5.5 thông qua các trang giá của riêng họ.

Theo dõi chi phí cho mỗi yêu cầu trong Apidog

Mỗi phản hồi Tin nhắn trả về một đối tượng usage, đủ để tính giá một cuộc gọi trong Apidog:

  1. Lưu khóa của bạn dưới dạng biến môi trường ANTHROPIC_API_KEY.
  2. Lưu yêu cầu này một lần cho mỗi cấp độ nỗ lực (low, medium, high) với cùng một lời nhắc:
curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 4000,
    "thinking": {"type": "adaptive"},
    "output_config": {"effort": "medium"},
    "messages": [{"role": "user", "content": "Classify this support ticket: ..."}]
  }'
  1. Thêm một bộ xử lý hậu kỳ chọn cấp độ và tính giá cuộc gọi. Nó coi input_tokens là độ dài lời nhắc, điều này đúng khi không có bộ nhớ đệm:
const body = pm.response.json();
const u = body.usage;
const long = u.input_tokens > 100000;
const rateIn = long ? 0.50 : 0.10;
const rateOut = long ? 2.50 : 0.50;
const cost = (u.input_tokens * rateIn + u.output_tokens * rateOut) / 1e6;
pm.environment.set("haiku_call_usd", cost.toFixed(6));
pm.test("not a refusal", () => pm.expect(body.stop_reason).to.not.eql("refusal"));
  1. Chạy cả ba và so sánh token đầu ra và chi phí cạnh nhau.

Kiểm tra từ chối rất quan trọng vì các bộ phân loại an toàn của Haiku 5.5 không có dự phòng phía máy chủ. Hướng dẫn chi tiết có trong cách sử dụng API Claude Haiku 5.5.

Câu hỏi thường gặp

Claude Haiku 5.5 có giá bao nhiêu cho mỗi triệu token? 0.10 USD đầu vào và 0.50 USD đầu ra cho các lời nhắc lên đến 100K token; 0.50 USD và 2.50 USD khi vượt ngưỡng.

Haiku 5.5 có rẻ hơn Haiku 4.5 không? Có: rẻ hơn 90% mỗi token lên đến 100K, rẻ hơn 50% khi vượt ngưỡng, và rẻ hơn khoảng 75% trung bình theo Anthropic.

Haiku 5.5 có giá tương đương với GPT-6 Luna không? Lên đến 100K thì có. Vượt ngưỡng đó Haiku 5.5 tăng 5 lần; Luna giữ nguyên cho đến 272K. Tổng quan về GPT-6 Luna của chúng tôi có chi tiết.

Tín dụng gói Max có hoạt động trong Claude Code không? Không. Chúng bao gồm API Nền tảng Claude, không phải Claude Code. Xem Claude Haiku 5.5 trong Claude Code để biết cách truy cập gói ở đó.

Bước tiếp theo: định giá khối lượng công việc của bạn

Lấy ba dạng yêu cầu phổ biến nhất của bạn, kiểm tra xem bao nhiêu yêu cầu vượt 100K, và chạy từng yêu cầu ở mức low và medium. Nhân các số usage với bảng trên để có được mức tiết kiệm thực tế của bạn. Tải Apidog để giữ các yêu cầu đó và script tính chi phí trong một dự án.

Thực hành thiết kế API trong Apidog

Khám phá cách dễ dàng hơn để xây dựng và sử dụng API