Claude Haiku 5.5 đối đầu GPT-6 Luna

Haiku 5.5 so với GPT-6 Luna: cùng mức giá 0,10 USD/0,50 USD dưới 100K token, các cấp bậc prompt dài khác nhau, các điểm chuẩn của Anthropic và dữ liệu chi phí theo từng nỗ lực.

Medy Evrard

8 tháng 10 2026

Claude Haiku 5.5 đối đầu GPT-6 Luna

Apidog cho doanh nghiệp

Triển khai tại chỗ

SSO & RBAC

Tuân thủ SOC 2

Khám phá Apidog Enterprise

Claude Haiku 5.5 và GPT-6 Luna có cùng giá niêm yết: $0.10/$0.50 cho mỗi triệu token đầu vào/đầu ra đối với lời nhắc Haiku lên đến 100K token, với $0.01 cho mỗi lần đọc bộ nhớ đệm và $0.125 cho mỗi lần ghi bộ nhớ đệm trên cả hai. Sự khác biệt nằm ở điểm kết thúc của mức giá đó. Haiku 5.5 chuyển sang mức $0.50/$2.50 khi vượt quá 100K token; Luna giữ nguyên mức cơ bản cho đến 272K token đầu vào, sau đó tính phí gấp 2 lần đầu vào và 1.5 lần đầu ra. Trên bảng ra mắt của Anthropic, Haiku 5.5 đạt điểm cao hơn ở mọi hàng chung. Trên biểu đồ chi phí của Anthropic, Luna rẻ hơn cho mỗi tác vụ ở mọi cấp độ nỗ lực GDPval-AA và ở bốn trong năm mức của OSWorld; ở mức OSWorld trung bình, Haiku 5.5 rẻ hơn một chút.

nút

Dưới đây: giá, thông số kỹ thuật, các điểm chuẩn chung và đơn vị thực hiện, đường cong chi phí theo nỗ lực, và định tuyến theo khối lượng công việc. Để biết chi tiết từng mô hình, xem Claude Haiku 5.5 là gì và GPT-6 Luna là gì. Phần cuối cùng gửi cùng một lời nhắc đến cả hai trong Apidog.

Giá so sánh

Mỗi 1 triệu token Claude Haiku 5.5 GPT-6 Luna
Đầu vào, cấp cơ bản $0.10 (lời nhắc lên đến 100K token) $0.10 (lên đến 272K token đầu vào)
Đầu ra, cấp cơ bản $0.50 $0.50
Đọc bộ nhớ đệm, cấp cơ bản $0.01 $0.01
Ghi bộ nhớ đệm, cấp cơ bản $0.125 (5 phút) $0.125
Cấp cao hơn, đầu vào / đầu ra $0.50 / $2.50 (trên 100K) $0.20 / $0.75 (trên 272K)
Cấp cao hơn, đọc / ghi bộ nhớ đệm $0.05 / $0.625 Giá bộ nhớ đệm gấp 2 lần
Xử lý hàng loạt $0.05 / $0.25 lên đến 100K; $0.25 / $1.25 trên mức đó 50% so với giá tiêu chuẩn (Xử lý hàng loạt và Linh hoạt)

Nguồn: tài liệu về giá của Anthropic và trang mô hình GPT-6 Luna của OpenAI. OpenAI định giá lại “toàn bộ yêu cầu” trên 272K. Anthropic cho biết “một lời nhắc có hơn 100.000 token sẽ phải trả giá cao hơn,” tính phí theo từng yêu cầu dựa trên độ dài lời nhắc.

Dưới 100K token, hóa đơn khớp từng dòng. Giữa 100K và 272K, Haiku 5.5 đắt gấp 5 lần Luna về đầu vào và đầu ra. Trên 272K, cả hai đều ở mức cao hơn, và Luna vẫn rẻ hơn.

Hai ví dụ, được tính bằng token riêng của mỗi nhà cung cấp:

Anthropic cho biết các lời nhắc lên đến 100K token chiếm khoảng 90% yêu cầu của Haiku 4.5. Nếu lưu lượng truy cập của bạn tương tự, hầu hết các cuộc gọi của bạn sẽ có cùng chi phí trên cả hai mô hình. Xem thêm tính toán trong giá của Claude Haiku 5.5.

Trình tokenizer thay đổi ngưỡng

Một token trên mô hình này không giống một token trên mô hình khác. Theo Anthropic, trình tokenizer được cập nhật của Haiku 5.5 tạo ra nhiều hơn khoảng 30% token so với Haiku 4.5 cho cùng một văn bản. Trong chủ đề ra mắt trên Hacker News, một người bình luận ước tính rằng “100K token của Claude hiện đại tương đương khoảng ~60-65K token GPT hiện đại.” Đây là ước tính của cộng đồng, không phải số liệu từ nhà cung cấp. Nếu đúng như vậy, giới hạn 100K của Haiku sẽ đạt được nhanh hơn về mặt văn bản so với các con số thô cho thấy. Hãy đếm các lời nhắc của riêng bạn trên cả hai API và đọc từng đối tượng usage.

Thông số kỹ thuật

Claude Haiku 5.5 GPT-6 Luna
ID mô hình API claude-haiku-5-5 gpt-6-luna
Cửa sổ ngữ cảnh 1M token 1,050,000 token
Đầu ra tối đa 128K token (300K trên Xử lý hàng loạt với tiêu đề beta) 128.000 token
Ngày cắt giảm kiến thức Tháng 6 năm 2026 Ngày 18 tháng 5 năm 2026
Mức độ nỗ lực thấp, trung bình (mặc định), cao, rất cao, tối đa không, thấp, trung bình (mặc định), cao, rất cao, tối đa
Tắt suy nghĩ thinking: {"type": "disabled"} ở mức nỗ lực cao hoặc thấp hơn Nỗ lực suy luận none
Truy cập trò chuyện miễn phí Người dùng Claude.ai miễn phí có thể chọn Người dùng miễn phí và Go trong ứng dụng ChatGPT dành cho máy tính để bàn

Cả hai đều mặc định là medium. Trên Haiku 5.5, tham số là output_config.effort; trên Luna là reasoning.effort. Không có tùy chọn trò chuyện miễn phí nào là khóa API, vì vậy nó không thể điều khiển một tập lệnh, tác vụ CI hoặc tác nhân. Xem Claude Haiku 5.5 miễn phí và GPT-6 Luna miễn phí.

Một điểm khác biệt về bộ nhớ đệm quan trọng trong các vòng lặp. Trên Haiku 5.5, việc thay đổi effort cấp cao nhất giữa các yêu cầu sẽ làm mất hiệu lực bộ nhớ đệm lời nhắc. OpenAI cho biết việc thay đổi mức độ nỗ lực suy luận không còn làm hỏng bộ nhớ đệm trên các mô hình GPT-6 (Bộ nhớ đệm lời nhắc GPT-6).

Điểm chuẩn: Bảng của Anthropic và đơn vị thực hiện từng ô Luna

Mọi số liệu dưới đây đều lấy từ bài đăng ra mắt của Anthropic và thẻ hệ thống của họ. Anthropic đã biên soạn bảng, nhưng các bên khác nhau đã thực hiện các hàng khác nhau. Kết quả của Haiku 5.5 ở mức nỗ lực tối đa, chủ yếu được tính trung bình trên năm lần thử nghiệm.

Điểm chuẩn Haiku 5.5 GPT-6 Luna Cách lấy nguồn dữ liệu cho ô Luna
GDPval-AA v2.1 (Elo) 1620 1437 Được thực hiện độc lập bởi Artificial Analysis
AA-Briefcase v1.1 (Elo) 1578 1336 Được thực hiện độc lập bởi Artificial Analysis
OSWorld 2.1, tập con ngoại tuyến 72.4% 48.9% Được Anthropic thực hiện trên cùng 82 tác vụ thông qua API của OpenAI
Terminal-Bench 4.0 39.2% 16.4% Bảng xếp hạng công khai, Codex CLI ở mức nỗ lực tối đa
FrontierCode 1.1 (Chính) 46.4% 42.4% Được thực hiện bởi Cognition (Claude trong Claude Code, GPT trong Codex)
Chartography, không công cụ 46.4% 29.1% Theo báo cáo công khai của Surge AI

Các hàng chia sẻ tên điểm chuẩn, không phải bộ công cụ kiểm thử: Terminal-Bench đối chiếu Haiku 5.5 trong Claude Code với Luna trong Codex CLI. OSWorld là gần nhất với việc được kiểm soát, vì Anthropic đã chạy cả hai mô hình trên cùng các tác vụ, nhưng đó vẫn là một nhà cung cấp chạy mô hình của đối thủ.

Chưa có cuộc đối đầu độc lập nào. Tính đến ngày 8 tháng 10 năm 2026, Artificial Analysis không có trang Haiku 5.5 nào, và chúng tôi không tìm thấy kết quả Haiku 5.5 nào trên Vals, LMArena, SWE-bench hay Aider. Bảng xếp hạng của AA ngày hôm đó liệt kê GPT-6 Luna (tối đa) ở Chỉ số Thông minh là 38 và 129 token đầu ra mỗi giây. Kết quả đầy đủ của Haiku 5.5: Điểm chuẩn Claude Haiku 5.5.

Chi phí cho mỗi lần thử ở mỗi mức độ nỗ lực

Bảng ra mắt hiển thị từng mô hình ở mức tối đa. Trang ra mắt của Anthropic cũng vẽ biểu đồ từng mức độ nỗ lực so với chi phí, với Luna trên hai biểu đồ.

OSWorld 2.1 (tập con ngoại tuyến), điểm tín dụng một phần / chi phí cho mỗi lần thử:

Nỗ lực Haiku 5.5 GPT-6 Luna
Thấp 42.0% / $0.0695 19.2% / $0.038
Trung bình 53.3% / $0.1257 37.5% / $0.1261
Cao 61.3% / $0.1827 42.3% / $0.1435
Rất cao 67.6% / $0.2792 44.8% / $0.1672
Tối đa 72.4% / $0.6111 48.9% / $0.205

GDPval-AA v2.1, Elo / chi phí cho mỗi tác vụ:

Nỗ lực Haiku 5.5 GPT-6 Luna
Thấp 1125 / $0.01167 1036 / $0.0038
Trung bình 1277 / $0.03042 1262 / $0.02
Cao 1420 / $0.08938 1344 / $0.03
Rất cao 1513 / $0.26725 1364 / $0.05
Tối đa 1620 / $0.86593 1437 / $0.09

Luna có chi phí thấp hơn ở mọi mức độ nỗ lực trên GDPval-AA và ở mức thấp, cao, rất cao và tối đa trên OSWorld. Ở mức OSWorld trung bình, Haiku 5.5 rẻ hơn một chút ($0.1257 so với $0.1261). Haiku 5.5 đạt điểm cao hơn ở mọi mức. So sánh ở mức chi tiêu tương đương:

Do đó, trong việc sử dụng máy tính, Haiku 5.5 mang lại điểm số cao hơn trên mỗi đô la trong thử nghiệm của Anthropic. Trong công việc tri thức, cả hai gần như tương đương khi chi tiêu bằng nhau, và mức giá thấp hơn của Luna chiến thắng khi mục tiêu là 'đủ tốt'.

Định tuyến: mô hình nào cho khối lượng công việc nào

Anthropic định vị Haiku 5.5 cho “các tác vụ có phạm vi hẹp” và cho biết Sonnet 5.5 và Opus 5.5 “vẫn là những lựa chọn tốt hơn cho các tác vụ mã hóa phức tạp dựa trên tác nhân.” Cả hai mô hình ở đây đều được xây dựng cho khối lượng lớn.

Khối lượng công việc Bắt đầu với Lý do
Phân loại, định tuyến, trích xuất dưới 100K token Một trong hai; thử cả hai Giá giống nhau; chọn dựa trên độ chính xác cho nhãn của bạn
Hỏi đáp tài liệu dài, 100K đến 272K token GPT-6 Luna Mức cơ bản giữ đến 272K; Haiku 5.5 đắt gấp 5 lần khi trên 100K
Tự động hóa trình duyệt và máy tính để bàn Claude Haiku 5.5 Điểm OSWorld cao hơn với chi phí tương đương
Tác nhân phụ dưới Opus 5.5 hoặc Sonnet 5.5 Claude Haiku 5.5 Mô hình Claude Code model: haiku frontmatter (Haiku 5.5 trên API của Anthropic)
Chi phí thấp nhất cho mỗi cuộc gọi GPT-6 Luna Mức sàn rẻ nhất: $0.038 (OSWorld) và $0.0038 (GDPval-AA) ở mức thấp
Soạn thảo công việc tri thức ở mức nỗ lực cao Một trong hai; thử cả hai Chênh lệch 17 Elo ở mức chi tiêu tương đương trên GDPval-AA

Xem Claude Haiku 5.5 trong Claude Code cho tác nhân phụ và GPT-6 Luna cho khối lượng công việc API cao để triển khai pipeline QPS cao. Bạn đang chuyển từ Haiku 4.5? Haiku 5.5 so với Haiku 4.5 liệt kê năm lỗi 400 mới.

Thử nghiệm cả hai song song trong Apidog

Cuộc đối đầu giải quyết vấn đề này được chạy trên các lời nhắc của bạn. Trong Apidog, tạo một dự án với hai yêu cầu và cùng một lời nhắc:

  1. Lưu ANTHROPIC_API_KEY và khóa OpenAI của bạn dưới dạng biến môi trường.
  2. Thêm yêu cầu Haiku 5.5 bên dưới, sau đó là yêu cầu Luna với cùng một lời nhắc và mức độ nỗ lực.
  3. Đảm bảo rằng stop_reason của Haiku không phải là "refusal" (không có dự phòng phía máy chủ) và usage nằm trong ngân sách token của bạn.
  4. Chạy cả hai ở mức nỗ lực thấp, trung bình và cao và lưu từng phản hồi để so sánh token, độ trễ và đầu ra.
curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 2048,
    "thinking": {"type": "adaptive"},
    "output_config": {"effort": "medium"},
    "messages": [
      {"role": "user", "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error since this morning."}
    ]
  }'

Bỏ qua `temperature`, `top_p` và `top_k`: các giá trị không mặc định sẽ trả về lỗi 400 trên Haiku 5.5. Hướng dẫn: cách sử dụng API Claude Haiku 5.5. Đối với các bộ đánh giá, xem kiểm thử ứng dụng LLM.

Câu hỏi thường gặp

Claude Haiku 5.5 và GPT-6 Luna có cùng giá không? Có, đối với lời nhắc Haiku lên đến 100K token: $0.10/$0.50, $0.01 đọc bộ nhớ đệm, $0.125 ghi bộ nhớ đệm. Trên mức đó, Haiku 5.5 có giá $0.50/$2.50 trong khi Luna giữ mức cơ bản cho đến 272K.

Mô hình nào đạt điểm cao hơn? Haiku 5.5, ở mọi hàng chung trong bảng ra mắt của Anthropic. Anthropic đã biên soạn bảng đó; chưa có cuộc đối đầu độc lập nào tồn tại.

Mô hình nào rẻ hơn cho mỗi tác vụ? Thường là Luna: ở mọi mức độ nỗ lực trên biểu đồ GDPval-AA của Anthropic và bốn trong năm mức trên OSWorld (ở mức trung bình, Haiku 5.5 rẻ hơn $0.0004). Ở mức chi tiêu tương đương, Haiku 5.5 dẫn đầu trên OSWorld; GDPval-AA thì gần bằng.

Có mô hình nào miễn phí không? Chỉ trong trò chuyện: Người dùng Claude.ai miễn phí có thể chọn Haiku 5.5, và người dùng miễn phí và Go có Luna trong ứng dụng ChatGPT dành cho máy tính để bàn. Không có tùy chọn nào cung cấp cho bạn khóa API. Xem Claude Haiku 5.5 miễn phí.

Chọn theo độ dài lời nhắc, sau đó kiểm tra

Trước tiên hãy kiểm tra độ dài lời nhắc của bạn. Dưới 100K token, giá tương đương và độ chính xác quyết định, trong đó các số liệu của Anthropic ủng hộ Haiku 5.5. Giữa 100K và 272K, ngưỡng của Luna giúp tiết kiệm tiền trên mỗi cuộc gọi. Sau đó chạy cả hai trên các yêu cầu thực tế ở hai hoặc ba mức độ nỗ lực: tải Apidog, đặt cả hai yêu cầu vào một dự án, và để các số liệu `usage` quyết định.

Thực hành thiết kế API trong Apidog

Khám phá cách dễ dàng hơn để xây dựng và sử dụng API