Cách dùng Claude Haiku 5.5 trong Claude Code và làm mô hình sub-agent

Claude Haiku 5.5 trong Claude Code: v2.1.293+, /model claude-haiku-5-5, bẫy bí danh haiku, mô hình: các tác nhân phụ haiku, nỗ lực, và bước giá 100K.

Ashley Innocent

Ashley Innocent

8 tháng 10 2026

Cách dùng Claude Haiku 5.5 trong Claude Code và làm mô hình sub-agent

Apidog cho doanh nghiệp

Triển khai tại chỗ

SSO & RBAC

Tuân thủ SOC 2

Khám phá Apidog Enterprise

Để sử dụng Claude Haiku 5.5 trong Claude Code, hãy cập nhật lên v2.1.293 hoặc phiên bản mới hơn bằng lệnh claude update, sau đó bắt đầu một phiên làm việc với claude --model claude-haiku-5-5 hoặc chạy /model claude-haiku-5-5 bên trong một phiên. Lợi ích lớn hơn cho hầu hết mọi người là chạy nó dưới dạng một subagent: đặt model: haiku vào một tệp subagent và để Sonnet 5.5 hoặc Opus 5.5 xử lý các tìm kiếm, chạy thử nghiệm và tóm tắt. Với khóa API, chi phí là 0,10 đô la / 0,50 đô la cho mỗi triệu token đầu vào/đầu ra đối với các lời nhắc lên tới 100K token, và 0,50 đô la / 2,50 đô la nếu vượt quá con số đó.

Dưới đây: thiết lập, bẫy bí danh haiku, mức nỗ lực, tệp subagent, bước giá 100K và khi nào Sonnet hoặc Opus nên dẫn đầu. Đối với chính mô hình, hãy đọc Claude Haiku 5.5 là gì. Nếu mã của bạn gọi các API, Apidog chứa các kịch bản kiểm thử mà một subagent Haiku có thể chạy cho bạn.

Claude Haiku 5.5 trong Claude Code: Sơ lược

Cài đặt Haiku 5.5
Phiên bản tối thiểu v2.1.293 (claude update)
ID mô hình claude-haiku-5-5
Bí danh haiku Haiku 5.5 chỉ trên Anthropic API
Ngữ cảnh 1M gốc trên mọi gói, không có hậu tố [1m]
Tự động nén Khoảng 967K token theo mặc định
Mức nỗ lực mặc định medium (các cấp từ low đến max)
Suy nghĩ Luôn bật; không thể tắt
Giá API 0,10 đô la / 0,50 đô la cho các lời nhắc lên tới 100K token; 0,50 đô la / 2,50 đô la trên 100K
Gói dịch vụ Pro, Max, Team, Enterprise hoặc khóa API; không phải gói Miễn phí

Bước 1: Cập nhật Claude Code

Haiku 5.5 cần Claude Code v2.1.293 hoặc phiên bản mới hơn. Mục nhật ký thay đổi gọi nó là “hiện là mô hình Haiku mặc định trên Anthropic API.”

claude update

Claude Code không có trong gói Miễn phí. Người dùng miễn phí có thể chọn Haiku 5.5 trong các ứng dụng Claude.ai, nhưng Claude Code yêu cầu gói Pro, Max, Team, Enterprise hoặc khóa API của Anthropic. Theo claude.com/pricing, gói Pro là 17 đô la mỗi tháng nếu thanh toán hàng năm hoặc 20 đô la hàng tháng, và gói Max bắt đầu từ 100 đô la.

Bước 2: Chọn Haiku 5.5 làm mô hình chính của bạn

claude --model claude-haiku-5-5

Trong một phiên làm việc đang chạy, /model claude-haiku-5-5 có tác dụng tương tự. Nếu cài đặt model đã lưu của bạn là haiku, một phiên làm việc đã lưu trên Haiku 4.5 sẽ tiếp tục trên Haiku 5.5.

Bí danh haiku chỉ có nghĩa là Haiku 5.5 trên Anthropic API

Nhà cung cấp haiku được giải quyết thành
Anthropic API Haiku 5.5
Nền tảng Claude trên AWS Haiku 4.5
Amazon Bedrock, Nền tảng Agent của Google Cloud Haiku 4.5
Microsoft Foundry Haiku 4.5

Trên bất kỳ nhà cung cấp đám mây nào, /model haiku và model: haiku trong một tệp subagent đều cho bạn Haiku 4.5. Thay vào đó, hãy ghim ID đầy đủ: claude-haiku-5-5 trên Google Cloud và Claude Platform trên AWS, tên triển khai của bạn trên Foundry, và một ID cấu hình suy luận như us.anthropic.claude-haiku-5-5 trên Amazon Bedrock. Hoặc trỏ bí danh đến nó bằng ANTHROPIC_DEFAULT_HAIKU_MODEL (Bước 5).

Bước 3: Chọn mức độ nỗ lực

Haiku 5.5 là Haiku đầu tiên có khả năng kiểm soát mức độ nỗ lực: low, medium, high, xhigh và max, bắt đầu từ medium trong Claude Code.

claude --model claude-haiku-5-5 --effort high

Trong một phiên làm việc, /effort low lưu một mức cho mô hình hiện tại. Hướng dẫn nhắc lệnh của Anthropic khuyến nghị low cho các tác vụ công cụ ngắn và yêu cầu khối lượng lớn, medium cho hầu hết công việc và high cho các tác vụ tác nhân dài hơn. Hãy lưu xhigh và max cho những công việc mà các đánh giá của bạn cho thấy sự cải thiện.

Tính năng suy nghĩ vẫn bật. Bạn không thể tắt nó trên Haiku 5.5 trong Claude Code; alwaysThinkingEnabled: false và MAX_THINKING_TOKENS=0 không có tác dụng. (API Messages thô có thể tắt nó ở mức high trở xuống.) Hãy giảm mức nỗ lực khi bạn muốn ít token suy nghĩ hơn.

Bước 4: Chạy Haiku 5.5 dưới dạng một subagent

Anthropic nói rằng Haiku 5.5 “kết hợp tốt với Opus 5.5 và Sonnet 5.5 dưới dạng một subagent trong công việc mã hóa.” Subagent là các tệp Markdown có frontmatter YAML trong .claude/agents/ (dự án) hoặc ~/.claude/agents/ (tất cả các dự án). Chỉ name và description là bắt buộc, và tài liệu subagent chấp nhận sonnet, opus, haiku, fable, một ID mô hình đầy đủ, hoặc inherit cho model. Hướng dẫn subagent của chúng tôi bao gồm các phạm vi và công cụ.

Thay thế Explore bằng một trình khám phá rẻ tiền

Subagent Explore tích hợp chạy trên mô hình của cuộc trò chuyện chính, không phải Haiku. Trong một phiên Opus 5.5, mọi tìm kiếm Explore đều chạy trên Opus. Một subagent người dùng hoặc dự án có tên Explore sẽ ghi đè lên subagent tích hợp và giữ model riêng của nó:

---
name: Explore
description: Tìm kiếm cơ sở mã chỉ đọc nhanh chóng. Sử dụng để tìm tệp, ký hiệu và vị trí gọi mà không chỉnh sửa bất cứ thứ gì.
tools: Read, Grep, Glob
model: haiku
effort: low
---

Bạn tìm kiếm cơ sở mã và báo cáo những gì bạn tìm thấy. Trả về đường dẫn tệp với số dòng và tóm tắt ngắn gọn về mỗi kết quả khớp. Không bao giờ chỉnh sửa tệp.

Lưu nó dưới dạng .claude/agents/Explore.md. Chạy /tasks trong khi nó hoạt động để xác nhận mô hình. Trên nhà cung cấp đám mây, hãy thay thế haiku bằng ID đầy đủ từ Bước 2.

Buộc mọi subagent sử dụng Haiku

Để chạy mọi subagent trên Haiku, bao gồm cả Explore, hãy đặt cả hai biến trong khối env của tệp cài đặt:

{
  "env": {
    "CLAUDE_CODE_SUBAGENT_MODEL": "haiku",
    "CLAUDE_CODE_SUBAGENT_MODEL_FORCE": "1"
  }
}

Chỉ riêng CLAUDE_CODE_SUBAGENT_MODEL là mặc định: trường model riêng của subagent vẫn được ưu tiên và Explore không di chuyển.

Bước 5: Hướng công việc nền đến Haiku 5.5

ANTHROPIC_DEFAULT_HAIKU_MODEL đặt “mô hình để sử dụng cho haiku, hoặc chức năng nền,” chẳng hạn như tóm tắt các phiên trước đó cho claude --resume. ANTHROPIC_SMALL_FAST_MODEL cũ hơn đã bị phản đối, theo tài liệu tham chiếu biến môi trường; hãy thay thế nó nếu hồ sơ shell của bạn vẫn đặt nó.

Trên Anthropic API, bạn không cần đặt bất cứ điều gì. Trên Google Cloud, các tác vụ nền mặc định là Sonnet; trên Foundry, là mô hình chính; trên Bedrock, là Sonnet hoặc mô hình chính. Khi Haiku 5.5 được bật trong tài khoản của bạn, hãy ghim nó:

# Nền tảng Agent của Google Cloud
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-5-5

# Amazon Bedrock (ID cấu hình suy luận)
export ANTHROPIC_DEFAULT_HAIKU_MODEL=us.anthropic.claude-haiku-5-5

Bước giá 100K trong các phiên dài

Giá của Haiku 5.5 phụ thuộc vào độ dài lời nhắc, và Claude Code gửi cuộc trò chuyện làm lời nhắc trong mỗi lượt. Khi ngữ cảnh của một phiên vượt quá 100K token, mỗi yêu cầu sẽ được tính phí 0,50 đô la / 2,50 đô la thay vì 0,10 đô la / 0,50 đô la, gấp năm lần tỷ lệ lời nhắc ngắn. Các tài liệu không nói rõ liệu các token được lưu trong bộ nhớ cache có được tính vào ngưỡng đó hay không, vì vậy hãy dự trù ngân sách như thể chúng có.

Tự động nén sẽ không cứu được bạn: Haiku 5.5 nén ở khoảng 967K token theo mặc định, vì vậy một phiên có thể chạy vượt xa bước giá ban đầu. Hai thói quen giúp ích khi bạn trả tiền theo mỗi token:

  1. Nén sớm hơn. /autocompact 100k đặt cửa sổ thấp nhất mà Claude Code chấp nhận, vì vậy phiên sẽ nén gần ranh giới thay vì gần 1M.
  2. Đẩy các công việc cồng kềnh vào các subagent. Một subagent có ngữ cảnh riêng, vì vậy nhật ký kiểm thử và kết quả tìm kiếm sẽ nằm ngoài cuộc trò chuyện chính.

Ngay cả khi trên 100K, 0,50 đô la / 2,50 đô la vẫn bằng một phần tư so với 2 đô la / 10 đô la của Sonnet 5.5. Trên gói trả phí, các phiên sử dụng giới hạn sử dụng, và Anthropic chưa công bố cách Haiku 5.5 được tính vào đó. Phân tích giá Haiku 5.5 của chúng tôi giải thích về cách tính toán.

Người đăng ký gói Max và Team: các tín dụng API hàng tháng mới (100 đô la trên Max 5x, 200 đô la trên Max 20x, lên đến 500 đô la được gộp trên Team) không bao gồm Claude Code tương tác, theo tài liệu tín dụng API của Anthropic.

Khi nào nên giữ Sonnet 5.5 hoặc Opus 5.5 làm mô hình chính

Anthropic cho biết Sonnet 5.5 và Opus 5.5 “vẫn là lựa chọn tốt hơn cho các tác vụ mã hóa phức tạp, mang tính tác nhân.” Trên Terminal-Bench 4.0, được Anthropic chạy trong Claude Code ở mức nỗ lực tối đa, Haiku 5.5 đạt 39,2% so với 70,6% của Sonnet 5.5. Các biểu đồ ra mắt bổ sung chi phí cho mỗi lần thử:

Mức nỗ lực Haiku 5.5 Sonnet 5.5
medium 20,3% với 0,68 đô la 28,8% với 0,68 đô la
high 24,8% với 1,04 đô la 43% với 1,46 đô la
max 39,2% với 2,64 đô la 70,6% với 10,44 đô la

Ở mức medium, cả hai đều có chi phí tương đương nhau cho mỗi lần thử và Sonnet đạt điểm cao hơn. Giá token của Haiku không chuyển sang công việc shell dài, vì vậy đừng biến nó thành mô hình chính cho các phiên mã hóa khó.

Việc sử dụng máy tính lại kể một câu chuyện khác. Trên OSWorld 2.1, Haiku 5.5 ở mức medium đạt 53,3% với 0,13 đô la mỗi lần thử, trong khi Sonnet 5.5 ở mức low đạt 57,9% với 0,68 đô la. Phân tích điểm chuẩn Haiku 5.5 của chúng tôi có mọi hàng, và hướng dẫn Claude Code của Sonnet 5.5 bao gồm phía mô hình chính.

Một cách phân chia thực tế: Sonnet 5.5 hoặc Opus 5.5 làm mô hình chính, Haiku 5.5 cho Explore, các trình chạy thử nghiệm, trình đọc nhật ký và trình tìm nạp tài liệu.

Ví dụ: Một subagent Haiku chạy các bài kiểm thử Apidog của bạn

Các lần chạy thử nghiệm dài dòng và lặp lại, rất phù hợp với Haiku. Apidog CLI chạy các kịch bản kiểm thử Apidog đã lưu của bạn từ terminal, vì vậy một subagent có thể chạy chúng và trả về một báo cáo ngắn trong khi ngữ cảnh của mô hình chính vẫn sạch sẽ.

---
name: api-test-runner
description: Chạy các kịch bản kiểm thử Apidog của dự án bằng Apidog CLI sau khi một điểm cuối API thay đổi, sau đó báo cáo số lượng pass và fail cùng với các yêu cầu bị lỗi.
tools: Bash, Read
model: haiku
effort: low
---

Chạy lệnh kiểm thử Apidog CLI được ghi lại trong README của kho lưu trữ này cho kịch bản bao gồm điểm cuối đã thay đổi. Báo cáo số lượng pass và fail.
Đối với mỗi lỗi, cung cấp tên yêu cầu, kết quả mong đợi và kết quả thực tế. Không chỉnh sửa mã. Không thử lại một lần chạy thất bại quá một lần.

Thiết lập cho CLI, bao gồm xác thực và lệnh chạy, có trong Apidog CLI trong Claude Code. Tải xuống Apidog để xây dựng các kịch bản mà subagent sẽ chạy.

Di chuyển một ứng dụng từ Haiku 4.5

Nếu ứng dụng của bạn gọi Haiku 4.5 thông qua API, Claude Code có thể bắt đầu quá trình di chuyển:

/claude-api migrate this project to claude-haiku-5-5

Hãy chuẩn bị cho những thay đổi đột phá: suy nghĩ budget_tokens thủ công, temperature hoặc top_p không mặc định, bất kỳ top_k nào và trợ lý điền trước đều trả về lỗi 400 trên Haiku 5.5. Hướng dẫn Haiku 5.5 so với Haiku 4.5 liệt kê từng bản sửa lỗi. Sau khi chỉnh sửa, hãy lưu yêu cầu cũ và mới dưới dạng một cặp trong Apidog, lưu trữ ANTHROPIC_API_KEY dưới dạng biến môi trường và khẳng định trên stop_reason và usage, để một lỗi dừng refusal mới hoặc một sự gia tăng token sẽ làm lỗi kiểm thử thay vì đến môi trường sản xuất.

Câu hỏi thường gặp

Haiku 5.5 có phải là mô hình mặc định trong Claude Code không? Không. Nó là mô hình Haiku mặc định trên Anthropic API, có nghĩa là bí danh haiku trỏ đến nó. Chọn nó làm mô hình chính của bạn bằng --model hoặc /model.

Tôi có thể sử dụng Haiku 5.5 trong Claude Code trên gói Miễn phí không? Không. Claude Code yêu cầu một gói trả phí hoặc khóa API. Người dùng miễn phí có thể chọn Haiku 5.5 trong các ứng dụng Claude.ai; xem cách sử dụng Claude Haiku 5.5 miễn phí.

Tại sao model: haiku lại cho tôi Haiku 4.5? Bạn đang sử dụng Bedrock, Google Cloud, Foundry hoặc Claude Platform trên AWS, hoặc trên một phiên bản trước v2.1.293. Ghim ID đầy đủ hoặc đặt ANTHROPIC_DEFAULT_HAIKU_MODEL.

Tôi có thể tắt tính năng suy nghĩ để tiết kiệm token không? Không trong Claude Code. Thay vào đó, hãy giảm mức độ nỗ lực; low là cài đặt rẻ nhất.

Bước tiếp theo của bạn

Chạy claude update, thêm ghi đè Haiku Explore và giữ mô hình chính hiện tại của bạn trong một tuần. Sau đó, thêm subagent chạy thử nghiệm nếu dự án của bạn có API. Để gọi mô hình từ mã của riêng bạn, hãy bắt đầu với hướng dẫn API Haiku 5.5. Apidog miễn phí để bắt đầu và cung cấp cho subagent đó các bài kiểm thử thực để chạy.

button

Thực hành thiết kế API trong Apidog

Khám phá cách dễ dàng hơn để xây dựng và sử dụng API