Claude Haiku 5.5 có giá 0.10 USD cho mỗi triệu token đầu vào và 0.50 USD cho mỗi triệu token đầu ra đối với các lời nhắc lên đến 100K token. Một lời nhắc trên 100.000 token có giá cao hơn: 0.50 USD đầu vào và 2.50 USD đầu ra. Đọc bộ nhớ đệm bắt đầu từ 0.01 USD, API Batch giảm một nửa mọi mức giá và Anthropic cho biết chi phí chạy mô hình này “rẻ hơn khoảng 75%” so với Haiku 4.5 tính trung bình.
Hướng dẫn này bao gồm từng hạng mục, phép tính đằng sau con số 75% đó, ba ví dụ thực tế (một ví dụ vượt 100K), chi phí theo mức độ nỗ lực, và cách Haiku 5.5 so sánh với Haiku 4.5, GPT-6 Luna và Sonnet 5.5. Mới tìm hiểu về mô hình này? Bắt đầu với Claude Haiku 5.5 là gì. Để kiểm tra các số liệu trên lưu lượng truy cập của riêng bạn, hãy gửi yêu cầu từ Apidog và đọc khối usage của mỗi phản hồi.
Bảng giá API của Claude Haiku 5.5
Giá mỗi triệu token (MTok), từ tài liệu giá của Anthropic:
| Hạng mục | Lời nhắc tối đa 100K token | Lời nhắc trên 100K token |
|---|---|---|
| Đầu vào | $0.10 | $0.50 |
| Đầu ra | $0.50 | $2.50 |
| Ghi bộ nhớ đệm 5 phút | $0.125 | $0.625 |
| Ghi bộ nhớ đệm 1 giờ | $0.20 | $1.00 |
| Đọc bộ nhớ đệm (lượt truy cập và làm mới) | $0.01 | $0.05 |
| Đầu vào theo lô | $0.05 | $0.25 |
| Đầu ra theo lô | $0.25 | $1.25 |
Tài liệu nêu rõ: “một lời nhắc trên 100.000 token có giá cao hơn.” Các mô hình Claude khác từ 4.6 trở đi tính phí toàn bộ cửa sổ 1M với một mức giá; Haiku 5.5 là trường hợp ngoại lệ. Cũng cần lưu ý:
- Chỉ suy luận tại Mỹ. Định tuyến chỉ ở Mỹ thông qua
inference_geocó chi phí gấp 1.1 lần trên mỗi danh mục token trên API Claude và Nền tảng Claude trên AWS: 0.11 USD đầu vào và 0.55 USD đầu ra dưới 100K. - Một bộ mã hóa mới. Cùng một văn bản tạo ra nhiều token hơn khoảng 30% so với trên Haiku 4.5.
- Chi phí công cụ thấp hơn. Lời nhắc hệ thống sử dụng công cụ là 286 token (tự động/không), giảm từ 496 token trên Haiku 4.5.
- Không có Ưu tiên và không có chế độ nhanh.
“Khoảng 75% ít hơn” đến từ đâu
Haiku 5.5 có giá thấp hơn 90% so với Haiku 4.5 lên đến 100.000 token và thấp hơn 50% khi vượt ngưỡng; 90% yêu cầu của Haiku 4.5 nằm dưới 100K; và con số này tính cả bộ mã hóa mới. Một cách tính toán gần đúng:
- Trọng số theo số lượng yêu cầu: 0.9 × 90% + 0.1 × 50% = 86% thấp hơn.
- Thêm khoảng 30% token: 14% chi phí còn lại trở thành 14% × 1.3 = 18.2%, vì vậy mức tiết kiệm giảm xuống còn khoảng 82%.

Con số của Anthropic lại thấp hơn. Họ không công bố trọng số, và các lời nhắc dài có thể chiếm nhiều chi phí hơn số lượng yêu cầu. Hãy coi 75% là mức trung bình; dữ liệu usage của bạn mới là câu trả lời thực sự.
Chi phí cho mỗi lần thử ở mỗi cấp độ nỗ lực
Haiku 5.5 là Haiku đầu tiên có các mức độ nỗ lực (low đến max; medium là mặc định của API), và nỗ lực làm thay đổi hóa đơn của bạn nhiều hơn bảng giá. Những số liệu này đến từ các biểu đồ theo nỗ lực của bài đăng ra mắt. Anthropic chạy OSWorld và Terminal-Bench; Artificial Analysis chạy GDPval-AA:
| Nỗ lực | OSWorld 2.1 (điểm, $/lần thử) | GDPval-AA v2.1 (Elo, $/tác vụ) | Terminal-Bench 4.0 (điểm, $/lần thử) |
|---|---|---|---|
| Thấp | 42.0%, $0.0695 | 1125, $0.0117 | 12.7%, $0.424 |
| Trung bình | 53.3%, $0.1257 | 1277, $0.0304 | 20.3%, $0.6798 |
| Cao | 61.3%, $0.1827 | 1420, $0.0894 | 24.8%, $1.0372 |
| Rất cao | 67.6%, $0.2792 | 1513, $0.2673 | 31.5%, $1.7545 |
| Tối đa | 72.4%, $0.6111 | 1620, $0.8659 | 39.2%, $2.6433 |
Những điểm nổi bật:
- Tối đa tốn gấp 4.9 lần mức trung bình trên OSWorld ($0.6111 ÷ $0.1257) và gấp 28.5 lần mức trung bình trên GDPval-AA ($0.86593 ÷ $0.03042).
- Điểm trên bảng ra mắt là mức nỗ lực tối đa. Ở mức mặc định
medium, GDPval-AA là 1277, không phải 1620. - Đối với lập trình tác nhân, hãy kiểm tra Sonnet. Trên Terminal-Bench, Sonnet 5.5 ở mức
low(với 0.10 USD đọc bộ nhớ đệm) đạt 20% với 0.6205 USD, so với Haiku 5.5 ở mứcmediumđạt 20.3% với 0.6798 USD. Anthropic cho biết Sonnet và Opus “vẫn là lựa chọn tốt hơn cho các tác vụ lập trình tác nhân phức tạp.” Phân tích điểm chuẩn của chúng tôi có đầy đủ thông tin.
Cách Haiku 5.5 so sánh về giá
| Mô hình | Đầu vào / đầu ra trên MTok | Đọc bộ nhớ đệm | Ghi bộ nhớ đệm 5 phút | Quy tắc lời nhắc dài |
|---|---|---|---|---|
| Claude Haiku 5.5 | $0.10 / $0.50 lên đến 100K | $0.01 | $0.125 | Trên 100K: $0.50 / $2.50 |
| GPT-6 Luna | $0.10 / $0.50 | $0.01 | $0.125 | Đầu vào trên 272K: 2x đầu vào và bộ nhớ đệm, 1.5x đầu ra ($0.20 / $0.75) |
| Claude Haiku 4.5 | $1 / $5 | $0.10 | $1.25 | Một mức giá (ngữ cảnh 200K) |
| Claude Sonnet 5.5 | $2 / $10 | $0.10 | $2.50 | Một mức giá trên 1M |
GPT-6 Luna ngang với Haiku 5.5 lên đến 100K; ngưỡng khác nhau. Theo trang mô hình của OpenAI, phụ phí Luna bắt đầu trên 272K và áp dụng “cho toàn bộ yêu cầu.” Cuộc gọi trong Ví dụ 3 vẫn ở mức giá cơ bản của Luna: (150,000 × $0.10 + 2,000 × $0.50) ÷ 1,000,000 = $0.016, so với $0.08 trên Haiku 5.5. Các bộ mã hóa cũng khác nhau: một người bình luận trên Hacker News ước tính 100K token Claude bằng khoảng 60-65K token GPT. Trên biểu đồ OSWorld của Anthropic, Haiku 5.5 ở mức medium (53.3%, $0.1257) đánh bại Luna ở mức max (48.9%, $0.205). Chi tiết hơn trong Claude Haiku 5.5 so với GPT-6 Luna.
Sonnet 5.5 giảm chi phí đọc bộ nhớ đệm từ 0.20 USD xuống 0.10 USD cùng ngày, rẻ hơn khoảng 20% cho hầu hết công việc tác nhân theo Anthropic. Hướng dẫn giá Sonnet 5.5 của chúng tôi ra đời trước khi có sự giảm giá này.
Haiku 4.5 không bị ngừng sử dụng; Haiku 5.5 so với Haiku 4.5 liệt kê các thay đổi đột phá cần khắc phục trước.
Tín dụng API và các gói dành cho người tiêu dùng
Tín dụng API Max và Team. Max 5x nhận được 100 USD tín dụng Nền tảng Claude mỗi tháng, Max 20x nhận 200 USD, và Team nhận 20 USD cho mỗi ghế Standard và 100 USD cho mỗi ghế Premium, được gộp chung và giới hạn ở 500 USD. Miễn phí, Pro và Enterprise không đủ điều kiện. Theo tài liệu tín dụng API, chúng bao gồm API Claude, không phải Claude Code hoặc các đám mây, và không được chuyển sang tháng sau. Với 0.10 USD cho mỗi MTok, 100 USD mua được 1 tỷ token đầu vào, hoặc khoảng 220.000 yêu cầu của Ví dụ 1 (100 USD ÷ 0.000455 USD).
Các gói dành cho người tiêu dùng (claude.com/pricing): Người dùng gói Miễn phí ($0), Pro, Max, Team và Enterprise có thể chọn Haiku 5.5 trên Claude.ai trên web, iOS và Android. Gói Pro là 17 USD/tháng nếu thanh toán hàng năm hoặc 20 USD hàng tháng; Max bắt đầu từ 100 USD/tháng. Gói Miễn phí không có Claude Code, và một gói trò chuyện không thể chạy một script hoặc công việc CI. Cách sử dụng Claude Haiku 5.5 miễn phí bao gồm phần còn lại.
Đám mây. Bedrock, Google Cloud và Foundry tính phí Haiku 5.5 thông qua các trang giá của riêng họ.
Theo dõi chi phí cho mỗi yêu cầu trong Apidog
Mỗi phản hồi Tin nhắn trả về một đối tượng usage, đủ để tính giá một cuộc gọi trong Apidog:
- Lưu khóa của bạn dưới dạng biến môi trường
ANTHROPIC_API_KEY. - Lưu yêu cầu này một lần cho mỗi cấp độ nỗ lực (
low,medium,high) với cùng một lời nhắc:
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 4000,
"thinking": {"type": "adaptive"},
"output_config": {"effort": "medium"},
"messages": [{"role": "user", "content": "Classify this support ticket: ..."}]
}'
- Thêm một bộ xử lý hậu kỳ chọn cấp độ và tính giá cuộc gọi. Nó coi
input_tokenslà độ dài lời nhắc, điều này đúng khi không có bộ nhớ đệm:
const body = pm.response.json();
const u = body.usage;
const long = u.input_tokens > 100000;
const rateIn = long ? 0.50 : 0.10;
const rateOut = long ? 2.50 : 0.50;
const cost = (u.input_tokens * rateIn + u.output_tokens * rateOut) / 1e6;
pm.environment.set("haiku_call_usd", cost.toFixed(6));
pm.test("not a refusal", () => pm.expect(body.stop_reason).to.not.eql("refusal"));
- Chạy cả ba và so sánh token đầu ra và chi phí cạnh nhau.
Kiểm tra từ chối rất quan trọng vì các bộ phân loại an toàn của Haiku 5.5 không có dự phòng phía máy chủ. Hướng dẫn chi tiết có trong cách sử dụng API Claude Haiku 5.5.
Câu hỏi thường gặp
Claude Haiku 5.5 có giá bao nhiêu cho mỗi triệu token? 0.10 USD đầu vào và 0.50 USD đầu ra cho các lời nhắc lên đến 100K token; 0.50 USD và 2.50 USD khi vượt ngưỡng.
Haiku 5.5 có rẻ hơn Haiku 4.5 không? Có: rẻ hơn 90% mỗi token lên đến 100K, rẻ hơn 50% khi vượt ngưỡng, và rẻ hơn khoảng 75% trung bình theo Anthropic.
Haiku 5.5 có giá tương đương với GPT-6 Luna không? Lên đến 100K thì có. Vượt ngưỡng đó Haiku 5.5 tăng 5 lần; Luna giữ nguyên cho đến 272K. Tổng quan về GPT-6 Luna của chúng tôi có chi tiết.
Tín dụng gói Max có hoạt động trong Claude Code không? Không. Chúng bao gồm API Nền tảng Claude, không phải Claude Code. Xem Claude Haiku 5.5 trong Claude Code để biết cách truy cập gói ở đó.
Bước tiếp theo: định giá khối lượng công việc của bạn
Lấy ba dạng yêu cầu phổ biến nhất của bạn, kiểm tra xem bao nhiêu yêu cầu vượt 100K, và chạy từng yêu cầu ở mức low và medium. Nhân các số usage với bảng trên để có được mức tiết kiệm thực tế của bạn. Tải Apidog để giữ các yêu cầu đó và script tính chi phí trong một dự án.
