Claude Sonnet 5.5 là mẫu mô hình tầm trung của Anthropic, được phát hành vào ngày 28 tháng 9 năm 2026, với API id là claude-sonnet-5-5. Chi phí là 2 đô la cho mỗi triệu token đầu vào và 10 đô la cho mỗi triệu token đầu ra, tương tự như Sonnet 5. Trong bài đăng ra mắt, Anthropic cho biết nó "chạy nhanh hơn 30%+" so với Sonnet 5 và, trong thử nghiệm của Anthropic, "tiết kiệm chi phí lên đến 30% cho mỗi tác vụ so với phiên bản tiền nhiệm." Đây là mô hình thứ hai trong dòng Claude 5.5: một bổ sung rẻ hơn cho Opus 5.5 (4 đô la / 20 đô la) và một bước trên Haiku 4.5.
Dưới đây: thông số kỹ thuật, dòng sản phẩm, những thay đổi so với Sonnet 5, các điểm chuẩn, nơi để chạy nó và ai nên chuyển đổi, cùng với các liên kết đến các hướng dẫn sâu hơn như phân tích giá. Để gọi mô hình khi bạn đọc, Apidog có thể gửi yêu cầu Messages, giữ khóa của bạn trong biến môi trường và hiển thị phản hồi cùng với mức sử dụng token.
Thông số kỹ thuật Claude Sonnet 5.5 trong nháy mắt
| Thông số | Claude Sonnet 5.5 |
|---|---|
| Ngày phát hành | 28 tháng 9, 2026 |
| ID mô hình (Claude API, Google Cloud, Microsoft Foundry, Claude Platform trên AWS) | claude-sonnet-5-5 |
| ID mô hình (Amazon Bedrock) | anthropic.claude-sonnet-5-5 |
| Cửa sổ ngữ cảnh | 1M token |
| Đầu ra tối đa | 128K; 300K trên Batch API với bản beta output-300k-2026-03-24 |
| Suy nghĩ | Thích ứng, mặc định bật |
| Nỗ lực mặc định | high trên Claude Platform; medium trong Claude Code và các ứng dụng Claude |
| Giới hạn kiến thức | Tháng 6 năm 2026 |
| Ngừng hoạt động | Không sớm hơn ngày 28 tháng 9, 2027 |
| Giá mỗi MTok | 2 đô la đầu vào, 10 đô la đầu ra, 0.20 đô la đọc bộ nhớ cache, 2.50 đô la (5 phút) hoặc 4 đô la (1 giờ) ghi bộ nhớ cache; Batch 1 đô la / 5 đô la |
Nguồn: tổng quan mô hình Sonnet 5.5 và trang giá Claude.
Không có phí cao cấp cho ngữ cảnh dài: một yêu cầu 900K token có giá mỗi token tương đương với một yêu cầu 9K token. Chế độ nhanh không khả dụng; chỉ có ở Opus. Suy luận chỉ ở Mỹ (inference_geo: "us") có giá cao hơn 1.1 lần. Kế hoạch tăng giá của Sonnet 5 vào ngày 1 tháng 9 lên 3 đô la / 15 đô la đã bị hủy bỏ, vì vậy 2 đô la / 10 đô la là mức giá tiêu chuẩn của Sonnet.
Vị trí của Sonnet 5.5 trong dòng sản phẩm Claude
| Mô hình | Đầu vào / đầu ra mỗi MTok | Ngữ cảnh / đầu ra tối đa | Trên Claude Free? | Vai trò |
|---|---|---|---|---|
| Claude Fable 5.1 | 10 đô la / 50 đô la | 1M / 128K | Không | Lý luận đòi hỏi cao, công việc đại diện tầm nhìn dài hạn |
| Claude Opus 5.5 | 4 đô la / 20 đô la | 1M / 128K | Không | Công việc phức tạp, không giới hạn |
| Claude Sonnet 5.5 | 2 đô la / 10 đô la | 1M / 128K | Có (chat) | Công việc hàng ngày được xác định rõ ràng |
| Claude Haiku 4.5 | 1 đô la / 5 đô la | 200K / 64K | Có | Mức chi phí thấp nhất |
Anthropic định vị Sonnet 5.5 cho các tác vụ hàng ngày được xác định rõ ràng, sửa lỗi và tài liệu, trang trình bày, bảng tính được đánh bóng, và nói rằng Opus 5.5 "vẫn mạnh hơn rõ rệt trong các công việc phức tạp, không giới hạn." Haiku 5.5 dự kiến sẽ ra mắt "trong vài tuần tới." Đối với cấp độ cao hơn, hãy đọc Claude Opus 5.5 là gì.
Có gì mới so với Sonnet 5
Giá và trình tokenizer không thay đổi. Hợp đồng API thì có. Hướng dẫn di chuyển liệt kê năm thay đổi gây lỗi:
thinking: {"type": "disabled"}đã bị loại bỏ. Sử dụng{"type": "between_tools"}, chỉ chấp nhận ở mức nỗ lựclow,mediumhoặchigh.- Bắt buộc sử dụng công cụ đã bị xóa.
tool_choicelàanyhoặctoolsẽ thất bại. Gửiautovới các công cụstrict: truevà cho biết trong lời nhắc khi nào nên sử dụng chúng. - Các khối tư duy được gắn với cuộc trò chuyện. Đối với các tài khoản được tạo vào hoặc sau ngày 31-08-2026, việc phát lại một khối sau khi chỉnh sửa lịch sử trước đó sẽ thất bại. Giữ các cuộc trò chuyện chỉ được thêm vào.
computer_20251124bị từ chối trên Claude API và Google Cloud. Sử dụngcomputer_toolset_20260801.- Các cặp Advisor bị hạn chế chỉ cho Opus 5, Opus 5.5, Sonnet 5.5, Fable 5, Fable 5.1, Mythos 5 hoặc Mythos 5.1.

Một thay đổi thứ sáu không gây lỗi nhưng thay đổi hình dạng phản hồi: văn bản giữa các lệnh gọi công cụ giờ đây đến dưới dạng các khối thinking cập nhật tiến độ, trống rỗng theo mặc định display: "omitted", để giao diện người dùng của bạn có thể im lặng giữa tác vụ. Đặt display: "updates" (tiêu đề beta thinking-display-updates-2026-08-18) hoặc "summarized" để xem chúng.
Cũng mới:
- Nỗ lực được hiệu chỉnh lại. Không sao chép các cài đặt của Sonnet 5. Bắt đầu ở mức
high(hoặcmediumcho mã hóa đại diện được chỉ định rõ ràng) và chạy một đợt quét mới. - Bảo vệ an ninh mạng. Đây là Sonnet đầu tiên có chúng: các tác vụ an ninh mạng có rủi ro cao hơn "sẽ rõ ràng quay trở lại Sonnet 5" trong các ứng dụng của Anthropic; trên API, việc quay lại là tùy chọn (
fallbacks: "default", beta). - Suy nghĩ gắn với tài khoản. Suy nghĩ không thể di chuyển giữa các tài khoản, điều này quan trọng nếu bạn chuyển đổi tài khoản giữa phiên trong Claude Code.
- Nỗ lực trên mỗi tin nhắn. Thay đổi nỗ lực cấp cao nhất giữa các yêu cầu làm mất hiệu lực bộ nhớ cache lời nhắc; thay đổi nỗ lực trên mỗi tin nhắn beta tránh được điều đó.
- Mức tối thiểu bộ nhớ cache thấp hơn. Lời nhắc có thể lưu vào bộ nhớ cache nhỏ nhất là 512 token, giảm từ 1.024.
Hướng dẫn Sonnet 5.5 so với Sonnet 5 có các lỗi chính xác và JSON trước/sau cho từng bản sửa lỗi.
Các điểm chuẩn của Claude Sonnet 5.5
Bảng ra mắt so sánh Sonnet 5.5 với Sonnet 5, Opus 5.5 và GPT-6 Sol. Sonnet 5.5 chạy ở mức nỗ lực tối đa trừ khi một hàng nói khác.
| Điểm chuẩn | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4% (xhigh) | Không báo cáo |
| FrontierCode 1.1 Main (max) | 46.2% | 42.4% | 54.4% | 49.3% |
| FrontierCode 1.1 Main (xhigh) | 52.1% | 42.7% | 51.4% | 48.4% |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% | Không báo cáo |
| GDPval-AA v2.1 (Elo) | 1844 | 1449 | 1846 | 1487 |
| Humanity’s Last Exam (tools) | 64.5% | 54.9% | 67.7% | Không báo cáo |
| OSWorld 2.1 (một phần) | 80.1% | 57.0% | 81.8% | Không báo cáo |
n/r: không báo cáo. Hàng FrontierCode xhigh lấy từ biểu đồ nỗ lực trên trang ra mắt.
Anthropic đã tự chạy Terminal-Bench, Humanity’s Last Exam và OSWorld. Cognition đã chạy FrontierCode, nơi Sonnet 5.5 đạt điểm thấp hơn ở mức tối đa: nó thường xuyên phân nhánh các subagent đánh giá, trong những trường hợp Cognition kiểm tra đã gây ra lỗi hết thời gian chờ hoặc chỉnh sửa ngoài phạm vi. Cursor đã chạy CursorBench; Artificial Analysis đã chạy GDPval-AA. Đọc kỹ phần dẫn đầu của Terminal-Bench so với Opus: Artificial Analysis đã đo Sonnet 5.5 ở mức 63.6% trong lần chạy riêng của mình, và thẻ hệ thống cho biết việc quay lại đã ảnh hưởng đến 10% số thử nghiệm của Opus so với 1.5% của Sonnet.
Sonnet 5.5 đạt điểm 56 trên Chỉ số Trí tuệ Phân tích Nhân tạo, đứng thứ 3 trong số 216, sau hai điểm cuối Opus 5.5 (Sonnet 5 đạt 38 điểm). Vấn đề là sự dài dòng: chỉ số này tốn 8.977 đô la để chạy ở nỗ lực tối đa so với 1.176 đô la ở mức cao. Phân tích sâu điểm chuẩn có các bảng theo nỗ lực.
Nơi bạn có thể sử dụng Claude Sonnet 5.5
| Giao diện | Truy cập | Ghi chú |
|---|---|---|
| Claude API | claude-sonnet-5-5 |
Tín dụng trả trước |
| Amazon Bedrock | anthropic.claude-sonnet-5-5 |
Chỉ suy luận đa khu vực toàn cầu (Khu vực thương mại); không có công cụ nghiêm ngặt |
| Google Cloud, Microsoft Foundry, Claude Platform trên AWS | claude-sonnet-5-5 |
Cùng ID với Claude API |
| Claude.ai (web, iOS, Android) | Chat | Bất kỳ ai, kể cả tài khoản Miễn phí |
| Claude Code | claude --model claude-sonnet-5-5 |
Các gói trả phí, v2.1.284+; mặc định vẫn là Opus 5.5 |
| GitHub Copilot | VS Code, JetBrains, Copilot CLI và hơn thế nữa | Pro, Pro+, Max, Business, Enterprise |
| Cursor | claude-sonnet-5-5 |
Nhóm Mô hình khác (Pro trở lên) |
| OpenRouter, Vercel AI Gateway | anthropic/claude-sonnet-5.5 |
2 đô la / 10 đô la; không có phiên bản miễn phí |
Trong Claude Code, biệt danh sonnet chỉ ánh xạ tới Sonnet 5.5 trên Anthropic API; trên Bedrock, Google Cloud và Foundry nó vẫn giải quyết thành Sonnet 4.5, vì vậy hãy ghim toàn bộ ID. Xem Sonnet 5.5 trong Claude Code để biết các kế hoạch và nỗ lực. Changelog của Copilot trên GitHub nói rằng việc triển khai là dần dần.
Bất kỳ ai cũng có thể trò chuyện với Sonnet 5.5 trên gói Claude Free, nhưng gói trò chuyện không bao gồm khóa API, và việc sử dụng API là trả trước. Xem cách sử dụng Sonnet 5.5 miễn phí và liệu có tồn tại API Sonnet 5.5 miễn phí hay không.
Ai nên chuyển sang Sonnet 5.5
- Bạn đang chạy Sonnet 5: hãy chuyển đổi. Giá và trình tokenizer khớp nhau, và Sonnet 5.5 vượt trội Sonnet 5 trên mọi hàng của bảng ra mắt. Dành thời gian cho các thay đổi gây lỗi và một đợt quét nỗ lực.
- Bạn đang chạy Opus 5.5 cho mọi thứ: hãy định tuyến các công việc được xác định rõ ràng (sửa lỗi, tài liệu, đánh giá mã đơn giản, các tác vụ subagent) sang Sonnet 5.5 với một nửa giá niêm yết, và giữ Opus cho các vấn đề không giới hạn. So sánh Sonnet 5.5 với Opus 5.5 phân tích điều này theo khối lượng công việc.
- Bạn dự định chạy ở mức nỗ lực cao trở lên: hãy kiểm tra Opus 5.5 ở mức nỗ lực thấp hơn nữa. Trên Terminal-Bench 4.0, Sonnet 5.5 ở mức cao đạt 43.0% với chi phí 1.94 đô la mỗi lần thử; Opus 5.5 ở mức trung bình đạt 57.6% với chi phí 2.94 đô la. Sonnet đạt 70.6% ở mức tối đa tốn 12.54 đô la mỗi lần thử. Nhiều người bình luận trên Hacker News đọc biểu đồ theo cách này: Sonnet chuyên về nỗ lực thấp hoặc trung bình, hoặc công việc subagent dưới sự điều phối của Opus.
- Công việc của bạn nặng về bảo mật: Anthropic cảnh báo về việc tăng số lần từ chối "ngay cả đối với các tác vụ an ninh mạng lành tính."
Những gì khách hàng ban đầu báo cáo
Các tuyên bố của khách hàng từ trang ra mắt của Anthropic, không phải các thử nghiệm độc lập:
- Slack: nó vượt trội Sonnet 5 trên hầu hết các đánh giá Slackbot ngoại tuyến mà không cần thay đổi lời nhắc và ít hơn khoảng 14% token đầu ra.
- Base44: trên 118 bản dựng ứng dụng, nó đạt chất lượng Opus 5 với 3.6 lần lặp mỗi bản dựng so với 7.7 lần đối với Opus 5.
- Balyasny Asset Management: trên 2.441 tác vụ tài chính, nó sử dụng khoảng 121K token cho mỗi câu trả lời so với 497K cho Sonnet 5.
Gửi yêu cầu Sonnet 5.5 đầu tiên của bạn
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-5-5",
"max_tokens": 16000,
"output_config": {"effort": "medium"},
"messages": [
{"role": "user", "content": "List three risks of retrying a POST request without an idempotency key."}
]
}'
Suy nghĩ được bật mặc định, vì vậy hãy bỏ qua trường thinking. Bỏ qua temperature, top_p và top_k: các giá trị không mặc định sẽ trả về lỗi 400. Các từ chối sẽ trả về dưới dạng HTTP 200 với stop_reason: "refusal" và một danh mục stop_details, vì vậy hãy kiểm tra phần nội dung, không chỉ trạng thái.
Trong Apidog, dán lệnh curl vào một yêu cầu mới, di chuyển khóa vào biến môi trường ANTHROPIC_API_KEY, và xác nhận rằng stop_reason không phải là refusal hoặc max_tokens. Sao chép nó ở nỗ lực low và high để so sánh usage. Hướng dẫn API Sonnet 5.5 bao gồm streaming, công cụ và bộ nhớ cache; hướng dẫn khóa API Anthropic của chúng tôi sẽ giúp bạn nếu bạn cần một khóa.
Câu hỏi thường gặp
Claude Sonnet 5.5 được phát hành khi nào? Ngày 28 tháng 9 năm 2026, sáu ngày sau Opus 5.5.
Cửa sổ ngữ cảnh của Claude Sonnet 5.5 là bao nhiêu? 1M token, với đầu ra tối đa 128K (300K trên Batch API với tiêu đề beta). Các lời nhắc dài có chi phí mỗi token giống như các lời nhắc ngắn.
Claude Sonnet 5.5 có miễn phí không? Trong ứng dụng trò chuyện Claude.ai, có, bao gồm cả trên gói Free. API là trả trước và Claude Code cần gói trả phí. Xem mọi tuyến đường miễn phí.
Giới hạn kiến thức của Claude Sonnet 5.5 là khi nào? Tháng 6 năm 2026.
Sonnet 5.5 có phải là mô hình mặc định trong Claude Code không? Không. Mặc định vẫn là Opus 5.5 trên mọi gói trả phí. Chuyển đổi bằng /model hoặc claude --model claude-sonnet-5-5.
Bước tiếp theo
Lấy một khối lượng công việc bạn đang chạy trên Sonnet 5 hoặc Opus 5.5 hôm nay. Gửi nó đến claude-sonnet-5-5 ở mức low, medium và high, so sánh chất lượng và usage, và giữ cài đặt rẻ nhất vượt qua các kiểm tra của bạn. Tải Apidog để giữ các yêu cầu và xác nhận đó trong một dự án, sau đó sử dụng phân tích giá để chuyển đổi số lượng token thành hóa đơn hàng tháng.

