Claude Sonnet 5.5 (claude-sonnet-5-5, phát hành ngày 28 tháng 9 năm 2026) có giá tương đương Sonnet 5, $2 cho mỗi triệu token đầu vào và $10 cho mỗi triệu token đầu ra, đồng thời sử dụng cùng một tokenizer. Nó mạnh hơn nhiều và Anthropic cho biết nhanh hơn 30%+. Trên bảng ra mắt, Terminal-Bench 4.0 tăng từ 10.3% lên 70.6%, CursorBench 4.0 từ 34.1% lên 55.5% và OSWorld 2.1 từ 57.0% lên 80.1%. Vấn đề nằm ở API. Năm cấu trúc yêu cầu hoạt động trên Sonnet 5 giờ đây trả về lỗi 400, và một thay đổi làm thay đổi cấu trúc phản hồi mà không có lỗi. Kết luận: nâng cấp, nhưng hãy khắc phục sáu điều đó trước.
Dưới đây: mỗi thay đổi gây lỗi cùng với lỗi chính xác và JSON trước/sau, sau đó là danh sách kiểm tra. Để biết thông số kỹ thuật, xem Claude Sonnet 5.5 là gì; để biết bước nhảy trước đó, xem Claude Sonnet 5 so với Sonnet 4.6. Apidog giữ các yêu cầu cũ và mới cạnh nhau trong khi bạn kiểm thử.
So sánh nhanh Sonnet 5 và Sonnet 5.5
| Claude Sonnet 5 | Claude Sonnet 5.5 | |
|---|---|---|
| Giá mỗi MTok (đầu vào / đầu ra / đọc bộ đệm) | $2 / $10 / $0.20 | $2 / $10 / $0.20 |
| Ngữ cảnh và đầu ra | 1M ngữ cảnh | 1M ngữ cảnh, 128K đầu ra |
thinking.type được chấp nhận |
adaptive, disabled |
adaptive, between_tools |
display mặc định |
omitted |
omitted |
| Nỗ lực | low đến max |
Các mức độ tương tự, được hiệu chỉnh lại; API mặc định high |
| Lời nhắc có thể lưu vào bộ đệm tối thiểu | 1.024 token | 512 token |
| Nỗ lực mỗi tin nhắn, tin nhắn hệ thống giữa cuộc hội thoại | Không | Có |
tool_choice bị buộc |
Được hỗ trợ | Lỗi 400 |
| Biện pháp bảo vệ an ninh mạng kiểu Opus | Không | Có; rủi ro an ninh mạng cao sẽ quay về Sonnet 5 |
| Khối suy nghĩ | Không kiểm tra hội thoại | Gắn với mô hình, hội thoại và tài khoản |
| Terminal-Bench 4.0 | 10.3% | 70.6% |
| CursorBench 4.0 | 34.1% | 55.5% |
| FrontierCode 1.1 (Chính) | 42.4% | 46.2% (tối đa), 52.1% (rất cao) |
| GDPval-AA v2.1 (Elo) | 1449 | 1844 |
| OSWorld 2.1 (một phần) | 57.0% | 80.1% |
| HLE (có công cụ) | 54.9% | 64.5% |
| Ngừng hỗ trợ | Vẫn được phục vụ như dự phòng an ninh mạng | Không sớm hơn ngày 28 tháng 9 năm 2027 |
Anthropic đã chạy Terminal-Bench, HLE và OSWorld; Cursor đã chạy CursorBench, Cognition FrontierCode và Artificial Analysis GDPval-AA. Kết quả Terminal-Bench riêng của Artificial Analysis cho thấy 63.6% so với 14.1%, vì vậy khoảng cách vẫn được giữ. FrontierCode có hai con số 5.5 vì ở mức tối đa, nó thường xuyên phân tán các tác tử phụ xem xét, và điểm chuẩn sẽ phạt các chỉnh sửa ngoài phạm vi. Xem các điểm chuẩn của Claude Sonnet 5.5.
Năm thay đổi gây lỗi
Mỗi thay đổi đều trả về lỗi 400 invalid_request_error cho mã hoạt động tốt trên Sonnet 5.
1. thinking: disabled đã bị loại bỏ; hãy gửi between_tools
Sonnet 5.5 từ chối thinking: {"type": "disabled"}:
"thinking.type.disabled" is not supported for this model. Use "thinking.type.between_tools" for the lowest thinking setting, or "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.
Gửi between_tools, cài đặt thấp nhất. Nó bỏ qua suy nghĩ ban đầu; các ghi chú tiến độ giữa các lệnh gọi công cụ vẫn đến dưới dạng khối thinking, bạn truyền lại chúng mà không thay đổi. Nó chỉ hoạt động ở nỗ lực low, medium hoặc high, không chấp nhận trường nào khác (display, budget_tokens hoặc block_binding sẽ trả về lỗi 400), và khóa nỗ lực cho cuộc hội thoại.
// Trước (claude-sonnet-5)
{"model": "claude-sonnet-5", "max_tokens": 16000,
"thinking": {"type": "disabled"},
"output_config": {"effort": "xhigh"}}
// Sau (claude-sonnet-5-5)
{"model": "claude-sonnet-5-5", "max_tokens": 16000,
"thinking": {"type": "between_tools"},
"output_config": {"effort": "high"}}
Nếu bạn cần xhigh hoặc max, hãy bỏ qua thinking để chế độ suy nghĩ thích ứng hoạt động.
2. tool_choice bị buộc trả về lỗi 400
tool_choice là any hoặc tool sẽ thất bại, kể cả trên điểm cuối đếm token:
tool_choice: type "tool" and "any" are not supported for this model.
Gửi auto, đánh dấu công cụ là strict: true (mọi đối tượng cần additionalProperties: false), và nói rõ trong lời nhắc khi nào nên sử dụng nó. Mô hình giờ đây có thể phản hồi bằng văn bản thay thế, vì vậy hãy xử lý các lượt không có lệnh gọi công cụ.
// Trước (claude-sonnet-5)
"tool_choice": {"type": "tool", "name": "get_weather"}
// Sau (claude-sonnet-5-5)
"tools": [{"name": "get_weather",
"input_schema": {"type": "object",
"properties": {"location": {"type": "string"}},
"required": ["location"], "additionalProperties": false},
"strict": true}],
"tool_choice": {"type": "auto"},
"messages": [{"role": "user",
"content": "Thời tiết ở Paris thế nào? Sử dụng công cụ get_weather."}]
Giới hạn là 20 công cụ nghiêm ngặt cho mỗi yêu cầu. Trên Amazon Bedrock, các công cụ nghiêm ngặt không khả dụng cho Sonnet 5.5: hãy gửi auto mà không có strict và xác thực đầu vào trong mã của bạn.
3. Các khối suy nghĩ được gắn với mô hình, cuộc hội thoại và tài khoản
Mỗi khối suy nghĩ của Sonnet 5.5 được ký trên mọi thứ trước đó: system, tools và các tin nhắn trước đó. Đối với các tài khoản được tạo vào hoặc sau ngày 31 tháng 8 năm 2026 (00:00 UTC), việc phát lại một khối sau khi chỉnh sửa sẽ trả về lỗi 400 trên Claude API, Bedrock và Google Cloud:
messages.1.content.0: Invalid `signature` in `thinking` block. The block is bound to a different conversation. Remove the block, or set `thinking.block_binding.prefix_mismatch_behavior` to "drop_block".
Các tài khoản cũ hơn không bắt buộc điều này theo mặc định, vì vậy một lần chạy sạch với khóa cũ không chứng minh được điều gì. Hãy giữ các cuộc hội thoại chỉ được thêm vào và thay đổi hướng dẫn hoặc công cụ bằng tin nhắn hệ thống giữa cuộc hội thoại. Nếu bạn phải chỉnh sửa, hãy gửi anthropic-beta: thinking-binding-controls-2026-08-01 và bỏ các khối không khớp:
"thinking": {"type": "adaptive",
"block_binding": {"prefix_mismatch_behavior": "drop_block"}}
Điều đó chỉ hoạt động với tư duy thích ứng; với between_tools, hãy loại bỏ các khối suy nghĩ từ lượt chỉnh sửa trở đi. Sonnet 5.5 đọc các khối từ Sonnet 5, Opus 4.8, Haiku 4.5 và các phiên bản trước đó; nó bỏ qua các khối Opus 5, Opus 5.5, Fable và Mythos, cũng như các khối Sonnet 5.5 từ một tài khoản khác, mà không làm thất bại yêu cầu. Không có mô hình nào khác đọc các khối của nó. Xem Claude Fable 5.1 preserved thinking.
4. computer_20251124 lỗi trên Claude API và Google Cloud
Ở đó, việc sử dụng máy tính cần bộ công cụ mới. Lỗi bắt đầu:
'claude-sonnet-5-5' does not support tool types: computer_20251124.
// Trước (claude-sonnet-5)
"tools": [{"type": "computer_20251124", ...}]
// Sau (claude-sonnet-5-5, Claude API và Google Cloud)
"tools": [{"type": "computer_toolset_20260801"}]
Bỏ tiêu đề beta sử dụng máy tính cũ và cập nhật vòng lặp của bạn cho các khối tool_use thành viên, các hành động theo lô và toolset_name trên kết quả. Bedrock vẫn chấp nhận computer_20251124; computer_20250124 thất bại ở mọi nơi.
5. Một số cặp cố vấn bị từ chối
Với công cụ cố vấn (beta), một trình thực thi Sonnet 5.5 chỉ chấp nhận Opus 5, Opus 5.5, Sonnet 5.5, Fable 5, Fable 5.1, Mythos 5 hoặc Mythos 5.1 làm cố vấn. Các cố vấn Sonnet 5, Opus 4.8 và Opus 4.7 giờ đây sẽ trả về lỗi 400. Lời khuyên cũng đến dưới dạng mã hóa như một khối advisor_redacted_result, vì vậy mã phân tích văn bản lời khuyên sẽ không nhận được gì.
Thay đổi ngầm: văn bản giữa các lệnh gọi công cụ di chuyển vào khối suy nghĩ
Thay đổi này không làm hỏng bất cứ điều gì. Trên Sonnet 5, các ghi chú giữa các lệnh gọi công cụ trả về dưới dạng text. Trên Sonnet 5.5, bất cứ điều gì dài hơn một hoặc hai câu sẽ đến dưới dạng khối thinking cập nhật tiến độ, trống rỗng theo mặc định display: "omitted". Giao diện người dùng của tác nhân (agent UI) phát trực tuyến các ghi chú đó sẽ im lặng, không có lỗi. Ba cách khắc phục:
display: "updates"(tư duy thích ứng, tiêu đề betathinking-display-updates-2026-08-18) chỉ trả về các cập nhật. Nếu không có tiêu đề, nó sẽ bị từ chối.display: "summarized"kết hợp các cập nhật với các tóm tắt lý luận.between_toolstrả về văn bản mà không cầndisplay.
// Tiêu đề: anthropic-beta: thinking-display-updates-2026-08-18
"thinking": {"type": "adaptive", "display": "updates"}
Thay đổi hành vi mà không cần thay đổi mã
Những điều này không làm thất bại các yêu cầu, nhưng chúng thay đổi đầu ra và chi phí. Hướng dẫn tạo lời nhắc có các bản sửa lỗi.
- Nỗ lực được hiệu chỉnh lại. Các tên gọi tương tự, nhưng lượng suy nghĩ khác nhau. Chạy lại thử nghiệm của bạn: bắt đầu ở
high,mediumcho mã hóa tác nhân được chỉ định rõ ràng,mediumhoặclowcho trò chuyện; lưuxhighvàmaxcho các lợi ích đã được đo lường. - Thay đổi
effortcấp cao nhất giữa các yêu cầu làm mất hiệu lực bộ nhớ đệm lời nhắc. Thay vào đó, hãy sử dụng nỗ lực mỗi tin nhắn beta. - Nó suy nghĩ trước hầu hết mọi phản hồi từ
mediumtrở lên. Hãy giảm nỗ lực; việc nhắc nó suy nghĩ ít hơn không đáng tin cậy. - Nó kiểm tra sớm ở mức
lowvàmediumđối với các tác vụ tác nhân dài. - Nó thêm các bài kiểm tra, tài liệu và tệp không được yêu cầu, cộng thêm các tác nhân phụ đánh giá ở
xhighvàmax. Lời nhắc được Anthropic đề xuất đã cắt giảm chi phí phiên ở mứcmaxkhoảng một phần ba. - Nhiều lần từ chối hơn. Đây là Sonnet đầu tiên có biện pháp bảo vệ an ninh mạng kiểu Opus. Một lần từ chối là HTTP 200 với
stop_reason: "refusal"và một danh mụcstop_details; tính năng dự phòng phía máy chủ beta trên Claude API (fallbacks: "default") thử lại các lần từ chốicybervàfrontier_llmtrên Sonnet 5. - Tham số lấy mẫu. Các tham số
temperature,top_phoặctop_kkhông mặc định sẽ trả về lỗi 400. Anthropic liệt kê điều này dưới các thay đổi từ Sonnet 4.6 và các phiên bản trước đó, vì vậy bạn có thể đã loại bỏ chúng rồi.
Chi phí mỗi tác vụ: cùng giá, ít đô la hơn mỗi kết quả
Bài đăng ra mắt của Anthropic nói rằng Sonnet 5.5 "có chi phí mỗi tác vụ thấp hơn tới 30% so với phiên bản tiền nhiệm" trong thử nghiệm của họ. Giá cả giống hệt nhau, vì vậy việc tiết kiệm đến từ việc sử dụng ít token và bước hơn. Các biểu đồ hiệu suất theo nỗ lực của nó cho thấy nỗ lực thấp hơn trên 5.5 đã vượt qua kết quả tốt nhất của Sonnet 5:
| Điểm chuẩn (biểu đồ của Anthropic) | Sonnet 5.5 | Sonnet 5, lần chạy tốt nhất |
|---|---|---|
| Terminal-Bench 4.0 | 28.8% ở mức medium, $0.83 | 10.3% ở mức max, $11.62 |
| FrontierCode 1.1 | 49.4% ở mức high, $0.42 | 42.7% ở mức xhigh, $10.07 |
| CursorBench 4.0 | 35.8% ở mức low, $0.50 | 34.1% ở mức max, $7.17 |
Chi phí CursorBench là ước tính của Anthropic theo giá niêm yết. Mặt trái là max: theo bài viết của OfficeChai về dữ liệu Phân tích Nhân tạo, Sonnet 5.5 ở mức tối đa sử dụng khoảng 193.000 token đầu ra cho mỗi tác vụ lập chỉ mục, và chi phí mỗi tác vụ cao hơn khoảng 50% so với Sonnet 5. Việc tiết kiệm chi phí nằm ở mức high trở xuống; xem giá Claude Sonnet 5.5.
Danh sách kiểm tra di chuyển
Thay thế claude-sonnet-5 bằng claude-sonnet-5-5, sau đó chạy sáu kiểm tra từ hướng dẫn di chuyển của Anthropic:
- Thay thế
disabledbằngbetween_tools, ở nỗ lựchighhoặc thấp hơn. - Thay thế
tool_choicebị buộc bằngauto,strict: truevà một dòng nhắc (trên Bedrock, xác thực trong mã). - Giữ lịch sử chỉ được thêm vào; sử dụng tin nhắn hệ thống giữa cuộc hội thoại để thay đổi.
- Chuyển việc sử dụng máy tính sang
computer_toolset_20260801trên Claude API và Google Cloud. - Chọn một cố vấn được hỗ trợ, và ngừng phân tích văn bản lời khuyên.
- Đặt
thinking.displaynếu giao diện người dùng của bạn hiển thị văn bản giữa các lệnh gọi công cụ.
Sau đó, chạy lại kiểm tra nỗ lực của bạn. Claude Code có thể tự động hóa quá trình di chuyển:
/claude-api migrate this project to claude-sonnet-5-5
Tương đương với Opus là di chuyển Claude Opus 5.5 so với Opus 5.
Biến quá trình di chuyển thành kiểm thử hồi quy trong Apidog
Trong Apidog, lưu ba yêu cầu tới https://api.anthropic.com/v1/messages trong một dự án, tất cả trên cùng một môi trường:

- Đường cơ sở: nội dung Sonnet 5 hiện tại của bạn.
- Nội dung cũ, mô hình mới: chỉ
modelđược thay đổi thànhclaude-sonnet-5-5. Xác nhận trạng thái 400 và một thông báo lỗi đề cập đếnbetween_toolshoặctool_choice. - Đã di chuyển: nội dung đã được sửa. Xác nhận trạng thái 200, một
stop_reasonkhông phải làrefusalhoặcmax_tokens, và một khốitool_usecho các yêu cầu công cụ.
Giữ ANTHROPIC_API_KEY trong môi trường và tham chiếu nó dưới dạng {{ANTHROPIC_API_KEY}} trong tiêu đề x-api-key. So sánh usage.output_tokens giữa các mức độ nỗ lực để có số liệu chi phí mỗi tác vụ của riêng bạn. Được lưu dưới dạng kịch bản kiểm thử, một hồi quy về disabled sẽ làm thất bại lần chạy thay vì sản xuất. Các kiến thức cơ bản về yêu cầu: cách sử dụng Claude Sonnet 5.5 API.
Các câu hỏi thường gặp
Claude Sonnet 5.5 có đắt hơn Sonnet 5 không? Không. Cả hai đều có giá $2/$10 cho mỗi triệu token với $0.20 cho việc đọc bộ đệm, và tokenizer là như nhau.
Tại sao tôi lại nhận được thông báo “thinking.type.disabled is not supported” trên Sonnet 5.5? disabled đã bị loại bỏ. Gửi thinking: {"type": "between_tools"} ở nỗ lực low, medium hoặc high, không kèm theo các trường suy nghĩ khác.
Các cuộc hội thoại của Sonnet 5 có thể chuyển sang Sonnet 5.5 không? Có. Sonnet 5.5 đọc các khối suy nghĩ của Sonnet 5. Chuyển ngược lại sẽ làm mất chúng: không có mô hình nào khác đọc các khối của Sonnet 5.5.
Tôi có nên chuyển mọi thứ sang Sonnet 5.5 không? Đối với hầu hết các khối lượng công việc, có. Hãy chú ý đến các tác vụ liên quan đến an ninh mạng, có thể phải quay về Sonnet 5, và các lệnh gọi công cụ của Bedrock, vốn mất chế độ nghiêm ngặt. Hướng dẫn Claude Sonnet 5 của chúng tôi đề cập đến mô hình bạn đang rời đi.
Bước tiếp theo của bạn
Lưu yêu cầu Sonnet 5 của bạn và phiên bản 5.5 song song, xác nhận lỗi 400, khắc phục nó và chuyển lưu lượng truy cập khi bản sửa lỗi đã qua. Tải xuống Apidog để xây dựng bài kiểm thử đó.
