Claude Haiku 5.5 và GPT-6 Luna có cùng giá niêm yết: $0.10/$0.50 cho mỗi triệu token đầu vào/đầu ra đối với lời nhắc Haiku lên đến 100K token, với $0.01 cho mỗi lần đọc bộ nhớ đệm và $0.125 cho mỗi lần ghi bộ nhớ đệm trên cả hai. Sự khác biệt nằm ở điểm kết thúc của mức giá đó. Haiku 5.5 chuyển sang mức $0.50/$2.50 khi vượt quá 100K token; Luna giữ nguyên mức cơ bản cho đến 272K token đầu vào, sau đó tính phí gấp 2 lần đầu vào và 1.5 lần đầu ra. Trên bảng ra mắt của Anthropic, Haiku 5.5 đạt điểm cao hơn ở mọi hàng chung. Trên biểu đồ chi phí của Anthropic, Luna rẻ hơn cho mỗi tác vụ ở mọi cấp độ nỗ lực GDPval-AA và ở bốn trong năm mức của OSWorld; ở mức OSWorld trung bình, Haiku 5.5 rẻ hơn một chút.
Dưới đây: giá, thông số kỹ thuật, các điểm chuẩn chung và đơn vị thực hiện, đường cong chi phí theo nỗ lực, và định tuyến theo khối lượng công việc. Để biết chi tiết từng mô hình, xem Claude Haiku 5.5 là gì và GPT-6 Luna là gì. Phần cuối cùng gửi cùng một lời nhắc đến cả hai trong Apidog.
Giá so sánh
| Mỗi 1 triệu token | Claude Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| Đầu vào, cấp cơ bản | $0.10 (lời nhắc lên đến 100K token) | $0.10 (lên đến 272K token đầu vào) |
| Đầu ra, cấp cơ bản | $0.50 | $0.50 |
| Đọc bộ nhớ đệm, cấp cơ bản | $0.01 | $0.01 |
| Ghi bộ nhớ đệm, cấp cơ bản | $0.125 (5 phút) | $0.125 |
| Cấp cao hơn, đầu vào / đầu ra | $0.50 / $2.50 (trên 100K) | $0.20 / $0.75 (trên 272K) |
| Cấp cao hơn, đọc / ghi bộ nhớ đệm | $0.05 / $0.625 | Giá bộ nhớ đệm gấp 2 lần |
| Xử lý hàng loạt | $0.05 / $0.25 lên đến 100K; $0.25 / $1.25 trên mức đó | 50% so với giá tiêu chuẩn (Xử lý hàng loạt và Linh hoạt) |
Nguồn: tài liệu về giá của Anthropic và trang mô hình GPT-6 Luna của OpenAI. OpenAI định giá lại “toàn bộ yêu cầu” trên 272K. Anthropic cho biết “một lời nhắc có hơn 100.000 token sẽ phải trả giá cao hơn,” tính phí theo từng yêu cầu dựa trên độ dài lời nhắc.
Dưới 100K token, hóa đơn khớp từng dòng. Giữa 100K và 272K, Haiku 5.5 đắt gấp 5 lần Luna về đầu vào và đầu ra. Trên 272K, cả hai đều ở mức cao hơn, và Luna vẫn rẻ hơn.
Hai ví dụ, được tính bằng token riêng của mỗi nhà cung cấp:
- Lời nhắc 150K token, đầu ra 2K. Haiku 5.5: 0.15 × $0.50 + 0.002 × $2.50 = $0.080. Luna: 0.15 × $0.10 + 0.002 × $0.50 = $0.016.
- Lời nhắc 300K token, đầu ra 2K. Haiku 5.5: 0.30 × $0.50 + 0.002 × $2.50 = $0.155. Luna: 0.30 × $0.20 + 0.002 × $0.75 = $0.0615.
Anthropic cho biết các lời nhắc lên đến 100K token chiếm khoảng 90% yêu cầu của Haiku 4.5. Nếu lưu lượng truy cập của bạn tương tự, hầu hết các cuộc gọi của bạn sẽ có cùng chi phí trên cả hai mô hình. Xem thêm tính toán trong giá của Claude Haiku 5.5.
Trình tokenizer thay đổi ngưỡng
Một token trên mô hình này không giống một token trên mô hình khác. Theo Anthropic, trình tokenizer được cập nhật của Haiku 5.5 tạo ra nhiều hơn khoảng 30% token so với Haiku 4.5 cho cùng một văn bản. Trong chủ đề ra mắt trên Hacker News, một người bình luận ước tính rằng “100K token của Claude hiện đại tương đương khoảng ~60-65K token GPT hiện đại.” Đây là ước tính của cộng đồng, không phải số liệu từ nhà cung cấp. Nếu đúng như vậy, giới hạn 100K của Haiku sẽ đạt được nhanh hơn về mặt văn bản so với các con số thô cho thấy. Hãy đếm các lời nhắc của riêng bạn trên cả hai API và đọc từng đối tượng usage.
Thông số kỹ thuật
| Claude Haiku 5.5 | GPT-6 Luna | |
|---|---|---|
| ID mô hình API | claude-haiku-5-5 |
gpt-6-luna |
| Cửa sổ ngữ cảnh | 1M token | 1,050,000 token |
| Đầu ra tối đa | 128K token (300K trên Xử lý hàng loạt với tiêu đề beta) | 128.000 token |
| Ngày cắt giảm kiến thức | Tháng 6 năm 2026 | Ngày 18 tháng 5 năm 2026 |
| Mức độ nỗ lực | thấp, trung bình (mặc định), cao, rất cao, tối đa | không, thấp, trung bình (mặc định), cao, rất cao, tối đa |
| Tắt suy nghĩ | thinking: {"type": "disabled"} ở mức nỗ lực cao hoặc thấp hơn |
Nỗ lực suy luận none |
| Truy cập trò chuyện miễn phí | Người dùng Claude.ai miễn phí có thể chọn | Người dùng miễn phí và Go trong ứng dụng ChatGPT dành cho máy tính để bàn |
Cả hai đều mặc định là medium. Trên Haiku 5.5, tham số là output_config.effort; trên Luna là reasoning.effort. Không có tùy chọn trò chuyện miễn phí nào là khóa API, vì vậy nó không thể điều khiển một tập lệnh, tác vụ CI hoặc tác nhân. Xem Claude Haiku 5.5 miễn phí và GPT-6 Luna miễn phí.
Một điểm khác biệt về bộ nhớ đệm quan trọng trong các vòng lặp. Trên Haiku 5.5, việc thay đổi effort cấp cao nhất giữa các yêu cầu sẽ làm mất hiệu lực bộ nhớ đệm lời nhắc. OpenAI cho biết việc thay đổi mức độ nỗ lực suy luận không còn làm hỏng bộ nhớ đệm trên các mô hình GPT-6 (Bộ nhớ đệm lời nhắc GPT-6).
Điểm chuẩn: Bảng của Anthropic và đơn vị thực hiện từng ô Luna
Mọi số liệu dưới đây đều lấy từ bài đăng ra mắt của Anthropic và thẻ hệ thống của họ. Anthropic đã biên soạn bảng, nhưng các bên khác nhau đã thực hiện các hàng khác nhau. Kết quả của Haiku 5.5 ở mức nỗ lực tối đa, chủ yếu được tính trung bình trên năm lần thử nghiệm.
| Điểm chuẩn | Haiku 5.5 | GPT-6 Luna | Cách lấy nguồn dữ liệu cho ô Luna |
|---|---|---|---|
| GDPval-AA v2.1 (Elo) | 1620 | 1437 | Được thực hiện độc lập bởi Artificial Analysis |
| AA-Briefcase v1.1 (Elo) | 1578 | 1336 | Được thực hiện độc lập bởi Artificial Analysis |
| OSWorld 2.1, tập con ngoại tuyến | 72.4% | 48.9% | Được Anthropic thực hiện trên cùng 82 tác vụ thông qua API của OpenAI |
| Terminal-Bench 4.0 | 39.2% | 16.4% | Bảng xếp hạng công khai, Codex CLI ở mức nỗ lực tối đa |
| FrontierCode 1.1 (Chính) | 46.4% | 42.4% | Được thực hiện bởi Cognition (Claude trong Claude Code, GPT trong Codex) |
| Chartography, không công cụ | 46.4% | 29.1% | Theo báo cáo công khai của Surge AI |
Các hàng chia sẻ tên điểm chuẩn, không phải bộ công cụ kiểm thử: Terminal-Bench đối chiếu Haiku 5.5 trong Claude Code với Luna trong Codex CLI. OSWorld là gần nhất với việc được kiểm soát, vì Anthropic đã chạy cả hai mô hình trên cùng các tác vụ, nhưng đó vẫn là một nhà cung cấp chạy mô hình của đối thủ.
Chưa có cuộc đối đầu độc lập nào. Tính đến ngày 8 tháng 10 năm 2026, Artificial Analysis không có trang Haiku 5.5 nào, và chúng tôi không tìm thấy kết quả Haiku 5.5 nào trên Vals, LMArena, SWE-bench hay Aider. Bảng xếp hạng của AA ngày hôm đó liệt kê GPT-6 Luna (tối đa) ở Chỉ số Thông minh là 38 và 129 token đầu ra mỗi giây. Kết quả đầy đủ của Haiku 5.5: Điểm chuẩn Claude Haiku 5.5.
Chi phí cho mỗi lần thử ở mỗi mức độ nỗ lực
Bảng ra mắt hiển thị từng mô hình ở mức tối đa. Trang ra mắt của Anthropic cũng vẽ biểu đồ từng mức độ nỗ lực so với chi phí, với Luna trên hai biểu đồ.
OSWorld 2.1 (tập con ngoại tuyến), điểm tín dụng một phần / chi phí cho mỗi lần thử:
| Nỗ lực | Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| Thấp | 42.0% / $0.0695 | 19.2% / $0.038 |
| Trung bình | 53.3% / $0.1257 | 37.5% / $0.1261 |
| Cao | 61.3% / $0.1827 | 42.3% / $0.1435 |
| Rất cao | 67.6% / $0.2792 | 44.8% / $0.1672 |
| Tối đa | 72.4% / $0.6111 | 48.9% / $0.205 |
GDPval-AA v2.1, Elo / chi phí cho mỗi tác vụ:
| Nỗ lực | Haiku 5.5 | GPT-6 Luna |
|---|---|---|
| Thấp | 1125 / $0.01167 | 1036 / $0.0038 |
| Trung bình | 1277 / $0.03042 | 1262 / $0.02 |
| Cao | 1420 / $0.08938 | 1344 / $0.03 |
| Rất cao | 1513 / $0.26725 | 1364 / $0.05 |
| Tối đa | 1620 / $0.86593 | 1437 / $0.09 |
Luna có chi phí thấp hơn ở mọi mức độ nỗ lực trên GDPval-AA và ở mức thấp, cao, rất cao và tối đa trên OSWorld. Ở mức OSWorld trung bình, Haiku 5.5 rẻ hơn một chút ($0.1257 so với $0.1261). Haiku 5.5 đạt điểm cao hơn ở mọi mức. So sánh ở mức chi tiêu tương đương:
- OSWorld: ở mức trung bình, Haiku 5.5 có giá $0.1257 cho mỗi lần thử so với $0.1261 của Luna và đạt 53.3% so với 37.5% của Luna. Haiku ở mức trung bình cũng đánh bại Luna ở mức tối đa (48.9%) với chi phí thấp hơn.
- GDPval-AA: Luna ở mức tối đa (1437, $0.09) và Haiku 5.5 ở mức cao (1420, $0.08938) có chi phí tương đương và cách nhau 17 Elo.
Do đó, trong việc sử dụng máy tính, Haiku 5.5 mang lại điểm số cao hơn trên mỗi đô la trong thử nghiệm của Anthropic. Trong công việc tri thức, cả hai gần như tương đương khi chi tiêu bằng nhau, và mức giá thấp hơn của Luna chiến thắng khi mục tiêu là 'đủ tốt'.
Định tuyến: mô hình nào cho khối lượng công việc nào
Anthropic định vị Haiku 5.5 cho “các tác vụ có phạm vi hẹp” và cho biết Sonnet 5.5 và Opus 5.5 “vẫn là những lựa chọn tốt hơn cho các tác vụ mã hóa phức tạp dựa trên tác nhân.” Cả hai mô hình ở đây đều được xây dựng cho khối lượng lớn.
| Khối lượng công việc | Bắt đầu với | Lý do |
|---|---|---|
| Phân loại, định tuyến, trích xuất dưới 100K token | Một trong hai; thử cả hai | Giá giống nhau; chọn dựa trên độ chính xác cho nhãn của bạn |
| Hỏi đáp tài liệu dài, 100K đến 272K token | GPT-6 Luna | Mức cơ bản giữ đến 272K; Haiku 5.5 đắt gấp 5 lần khi trên 100K |
| Tự động hóa trình duyệt và máy tính để bàn | Claude Haiku 5.5 | Điểm OSWorld cao hơn với chi phí tương đương |
| Tác nhân phụ dưới Opus 5.5 hoặc Sonnet 5.5 | Claude Haiku 5.5 | Mô hình Claude Code model: haiku frontmatter (Haiku 5.5 trên API của Anthropic) |
| Chi phí thấp nhất cho mỗi cuộc gọi | GPT-6 Luna | Mức sàn rẻ nhất: $0.038 (OSWorld) và $0.0038 (GDPval-AA) ở mức thấp |
| Soạn thảo công việc tri thức ở mức nỗ lực cao | Một trong hai; thử cả hai | Chênh lệch 17 Elo ở mức chi tiêu tương đương trên GDPval-AA |
Xem Claude Haiku 5.5 trong Claude Code cho tác nhân phụ và GPT-6 Luna cho khối lượng công việc API cao để triển khai pipeline QPS cao. Bạn đang chuyển từ Haiku 4.5? Haiku 5.5 so với Haiku 4.5 liệt kê năm lỗi 400 mới.
Thử nghiệm cả hai song song trong Apidog
Cuộc đối đầu giải quyết vấn đề này được chạy trên các lời nhắc của bạn. Trong Apidog, tạo một dự án với hai yêu cầu và cùng một lời nhắc:
- Lưu
ANTHROPIC_API_KEYvà khóa OpenAI của bạn dưới dạng biến môi trường. - Thêm yêu cầu Haiku 5.5 bên dưới, sau đó là yêu cầu Luna với cùng một lời nhắc và mức độ nỗ lực.
- Đảm bảo rằng
stop_reasoncủa Haiku không phải là"refusal"(không có dự phòng phía máy chủ) vàusagenằm trong ngân sách token của bạn. - Chạy cả hai ở mức nỗ lực thấp, trung bình và cao và lưu từng phản hồi để so sánh token, độ trễ và đầu ra.
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 2048,
"thinking": {"type": "adaptive"},
"output_config": {"effort": "medium"},
"messages": [
{"role": "user", "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error since this morning."}
]
}'
Bỏ qua `temperature`, `top_p` và `top_k`: các giá trị không mặc định sẽ trả về lỗi 400 trên Haiku 5.5. Hướng dẫn: cách sử dụng API Claude Haiku 5.5. Đối với các bộ đánh giá, xem kiểm thử ứng dụng LLM.
Câu hỏi thường gặp
Claude Haiku 5.5 và GPT-6 Luna có cùng giá không? Có, đối với lời nhắc Haiku lên đến 100K token: $0.10/$0.50, $0.01 đọc bộ nhớ đệm, $0.125 ghi bộ nhớ đệm. Trên mức đó, Haiku 5.5 có giá $0.50/$2.50 trong khi Luna giữ mức cơ bản cho đến 272K.
Mô hình nào đạt điểm cao hơn? Haiku 5.5, ở mọi hàng chung trong bảng ra mắt của Anthropic. Anthropic đã biên soạn bảng đó; chưa có cuộc đối đầu độc lập nào tồn tại.
Mô hình nào rẻ hơn cho mỗi tác vụ? Thường là Luna: ở mọi mức độ nỗ lực trên biểu đồ GDPval-AA của Anthropic và bốn trong năm mức trên OSWorld (ở mức trung bình, Haiku 5.5 rẻ hơn $0.0004). Ở mức chi tiêu tương đương, Haiku 5.5 dẫn đầu trên OSWorld; GDPval-AA thì gần bằng.
Có mô hình nào miễn phí không? Chỉ trong trò chuyện: Người dùng Claude.ai miễn phí có thể chọn Haiku 5.5, và người dùng miễn phí và Go có Luna trong ứng dụng ChatGPT dành cho máy tính để bàn. Không có tùy chọn nào cung cấp cho bạn khóa API. Xem Claude Haiku 5.5 miễn phí.
Chọn theo độ dài lời nhắc, sau đó kiểm tra
Trước tiên hãy kiểm tra độ dài lời nhắc của bạn. Dưới 100K token, giá tương đương và độ chính xác quyết định, trong đó các số liệu của Anthropic ủng hộ Haiku 5.5. Giữa 100K và 272K, ngưỡng của Luna giúp tiết kiệm tiền trên mỗi cuộc gọi. Sau đó chạy cả hai trên các yêu cầu thực tế ở hai hoặc ba mức độ nỗ lực: tải Apidog, đặt cả hai yêu cầu vào một dự án, và để các số liệu `usage` quyết định.
