GPT-6.1 Sol và Claude Sonnet 5.5 đều có giá niêm yết là 2 đô la cho mỗi triệu token đầu vào và 10 đô la cho mỗi triệu token đầu ra, và chúng được ra mắt cách nhau một ngày: Sonnet 5.5 vào ngày 28 tháng 9 năm 2026, và GPT-6.1 Sol vào ngày 29 tháng 9. Cả hai nhà cung cấp đều chưa thử nghiệm hiệu năng của sản phẩm mình so với đối thủ. OpenAI đã so sánh GPT-6.1 Sol với Claude Opus 5.5 và Fable 5.1, trong khi Anthropic so sánh Sonnet 5.5 với GPT-6 Sol, phiên bản Sol trước đó. Cách lựa chọn trung thực nhất là chạy cả hai trên các tác vụ của riêng bạn và so sánh chi phí cho mỗi tác vụ, chứ không phải giá mỗi token.
Dưới đây: thông số kỹ thuật và giá cả song song, những gì mỗi nhà cung cấp tuyên bố và so sánh với mô hình nào, các số liệu của bên thứ ba (tất cả đều trên GPT-6 Sol, không phải 6.1), và một phương pháp để tự bạn chạy so sánh trong Apidog. Để biết thông tin chi tiết về từng mô hình, hãy xem GPT-6.1 Sol là gì và Claude Sonnet 5.5 là gì.
GPT-6.1 Sol so với Claude Sonnet 5.5: thông số kỹ thuật và giá cả
Nguồn: trang giá của OpenAI, tổng quan về Sonnet 5.5 và giá cả của Anthropic, cùng với trang mô hình GPT-6.1 Sol được liên kết bên dưới.
| GPT-6.1 Sol | Claude Sonnet 5.5 | |
|---|---|---|
| ID mô hình | gpt-6.1-sol |
claude-sonnet-5-5 (Bedrock: anthropic.claude-sonnet-5-5) |
| Ra mắt | 29 tháng 9, 2026 | 28 tháng 9, 2026 |
| Đầu vào / đầu ra mỗi 1M | $2 / $10 | $2 / $10 |
| Đọc bộ nhớ đệm mỗi 1M | $0.10 | $0.20 |
| Ghi bộ nhớ đệm mỗi 1M | $2.50 | $2.50 (5 phút), $4 (1 giờ) |
| Theo lô mỗi 1M | $1 / $5 | $1 / $5 |
| Lời nhắc trên 272K token đầu vào | $4 đầu vào, $0.20 được lưu vào bộ nhớ đệm, $15 đầu ra cho toàn bộ yêu cầu | Không có phí phụ trội trong cửa sổ 1M |
| Cấp độ nhanh hơn | Nhanh ở mức $4 / $20; Siêu nhanh “sắp ra mắt” | Chế độ nhanh không có sẵn |
| Cửa sổ ngữ cảnh | 1,050,000 (tối đa 922,000 đầu vào) | 1M |
| Đầu ra tối đa | 128,000 | 128K (300K trên Batch với một tiêu đề beta) |
| Thời điểm cắt bỏ kiến thức | 30 tháng 4, 2026 | Tháng 6 năm 2026 |
| Mức độ nỗ lực | thấp, trung bình (mặc định), cao, rất cao, tối đa; không có không |
thấp, trung bình, cao (mặc định API), rất cao, tối đa; tư duy không thể tắt (cài đặt thấp nhất: between_tools) |
| Dạng API | Phản hồi (có công cụ), Hoàn thành trò chuyện (không có công cụ), Xử lý theo lô | Tin nhắn, Xử lý theo lô |
| Các nền tảng khác | OpenRouter (openai/gpt-6.1-sol) |
Bedrock, Google Cloud, Microsoft Foundry, Nền tảng Claude trên AWS |
| Truy cập miễn phí | Không có. Phiên bản Plus, Pro, Business, Enterprise và Edu có thể sử dụng trong ChatGPT Work và Codex (không phải Chat; Enterprise và Edu khi quản trị viên bật, theo tài liệu mô hình); không có cấp API miễn phí | Bất kỳ ai cũng có thể trò chuyện với nó trên Claude.ai; API tính phí theo token |
Hai hàng quan trọng nhất đối với chi phí. Lượt đọc bộ nhớ đệm của GPT-6.1 Sol có giá bằng một nửa so với Sonnet 5.5, vì vậy việc tái sử dụng một lời nhắc hệ thống dài sẽ rẻ hơn trên OpenAI. Trên 272K token đầu vào, cán cân thay đổi: trang mô hình GPT-6.1 Sol định giá toàn bộ yêu cầu ở mức gấp 2 lần giá đầu vào và bộ nhớ đệm, và gấp 1.5 lần đầu ra, trong khi Sonnet 5.5 vẫn ở mức 2 đô la và 10 đô la. Một lời nhắc 400.000 token với câu trả lời 5.000 token có giá khoảng 1.68 đô la trên GPT-6.1 Sol và 0.85 đô la trên Sonnet 5.5, khi không dùng bộ nhớ đệm.
Mỗi nhà cung cấp tuyên bố gì, và so sánh với mô hình nào
| OpenAI về GPT-6.1 Sol | Anthropic về Claude Sonnet 5.5 | |
|---|---|---|
| So sánh với | GPT-6 Sol, GPT-6 Astra, Claude Opus 5.5, Claude Fable 5.1 | Sonnet 5, Opus 5.5, GPT-6 Sol (GPT-5.6 Sol trong hai biểu đồ) |
| Bao gồm mô hình kia | Không | Không (GPT-6.1 Sol chưa tồn tại) |
| Tiêu đề | “Trí tuệ gần Astra” với một phần năm giá token tiêu chuẩn của Astra | Nhanh hơn 30%+ so với Sonnet 5, giảm tới 30% chi phí cho mỗi tác vụ |
| Ai đã thực hiện các số liệu | OpenAI (kết quả của đối thủ từ các báo cáo công khai, theo chú thích của họ) | Anthropic, cùng với Cognition, Cursor, Artificial Analysis và Surge AI cho các điểm chuẩn cụ thể |
Bài đăng ra mắt GPT-6.1 Sol của OpenAI nêu rõ các kết quả do OpenAI báo cáo trong văn bản của họ:
- AutomationBench 1.0.6, nỗ lực trung bình: +2.2 điểm phần trăm so với Opus 5.5 với chi phí khoảng một phần ba, và +4.8 điểm phần trăm so với GPT-6 Sol.
- Terminal-Bench Science 0.1, nỗ lực tối đa: 5.47 đô la cho mỗi tác vụ, so với 23.21 đô la cho Opus 5.5. GPT-6 Astra vẫn đạt điểm cao nhất, ở mức 68.1%.
- OSWorld 2.0 ngoại tuyến, nỗ lực tối đa: +7 điểm phần trăm so với GPT-6 Sol với chi phí ít hơn một nửa.
Bài đăng ra mắt Sonnet 5.5 của Anthropic bao gồm một cột GPT-6 Sol:
- FrontierCode 1.1, do Cognition thực hiện: Sonnet 5.5 đạt 52.1% ở mức rất cao (46.2% ở mức tối đa) so với 49.3% của GPT-6 Sol. Ở mức nỗ lực cao, Anthropic cho biết Sonnet 5.5 đạt điểm tốt nhất của GPT-6 Sol với chi phí khoảng một phần năm.
- GDPval-AA v2.1 và AA-Briefcase v1.1, do Artificial Analysis thực hiện: 1844 so với 1487, và 1811 so với 1483.
Phân tích điểm chuẩn Sonnet 5.5 bao gồm phần còn lại của bảng của Anthropic.
Opus 5.5 xuất hiện trên cả hai biểu đồ, và cả hai nhà cung cấp đều báo cáo AutomationBench và Terminal-Bench Science, vì vậy rất dễ bị cám dỗ để kết nối hai bên. Các con số không khớp. OpenAI báo cáo AutomationBench 1.0.6 ở mức nỗ lực trung bình trong hệ thống riêng của họ, trong khi bảng tóm tắt thẻ hệ thống của Anthropic chạy các mô hình Claude của họ ở mức nỗ lực tối đa (Sonnet 5.5 44.7, Opus 5.5 42.5; GPT-6 Sol 32.0). Anthropic cung cấp điểm 59.9% cho Sonnet 5.5 trên Terminal-Bench Science, nhưng văn bản của OpenAI không đưa ra điểm thô cho GPT-6.1 Sol. Và OpenAI đã thử nghiệm sử dụng máy tính trên OSWorld 2.0 ngoại tuyến, Anthropic trên OSWorld 2.1. So sánh GPT-6 Sol với Claude Opus 5.5 cũng gặp phải rào cản tương tự.
Những gì bên thứ ba đã đo lường (trên GPT-6 Sol, không phải 6.1)
Mọi so sánh của bên thứ ba trong kết quả tìm kiếm đều ghép Sonnet 5.5 với GPT-6 Sol. Nổi bật nhất là Artificial Analysis, với Chỉ số Trí tuệ v4.3.2 tổng hợp 10 đánh giá:
| Nỗ lực | Chỉ số Sonnet 5.5 | Chi phí mỗi tác vụ của Sonnet 5.5 | Chỉ số GPT-6 Sol | Chi phí mỗi tác vụ của GPT-6 Sol |
|---|---|---|---|---|
| trung bình | 41 | $0.59 | 40 | $0.25 |
| cao | 47 | $1.08 | 43 | $0.38 |
| rất cao | 52 | $2.74 | 44 | $0.52 |
| tối đa | 56 | $7.60 | 48 | $1.05 |
Ở mức nỗ lực tối đa, cùng trang đó đo lường Sonnet 5.5 đạt 138 token đầu ra mỗi giây và GPT-6 Sol đạt 76. Sonnet 5.5 đạt điểm cao hơn và chi phí mỗi tác vụ cao hơn ở mọi mức nỗ lực được hiển thị, mặc dù giá niêm yết giống nhau; sự khác biệt nằm ở việc tiêu thụ token. Sonnet 5.5 ở mức cao (47, 1.08 đô la) tương đương với GPT-6 Sol ở mức tối đa (48, 1.05 đô la).
Dữ liệu biểu đồ riêng của Anthropic có cả hai mặt. Trên AA-Briefcase, GPT-6 Sol có chi phí mỗi tác vụ thấp hơn ở mọi mức nỗ lực (0.34 đô la so với 1.64 đô la ở mức trung bình) trong khi Sonnet 5.5 đạt điểm cao hơn. Trên FrontierCode, Sonnet 5.5 ở mức cao đạt 49.4% với 0.42 đô la mỗi tác vụ, so với 49.3% của GPT-6 Sol ở mức tối đa với 2.07 đô la.
Tất cả những điều này đều là về Sol cũ hơn. OpenAI cho biết GPT-6.1 Sol vượt trội hơn GPT-6 Sol ở cùng hoặc thấp hơn mức nỗ lực trên một số điểm chuẩn, vì vậy hãy mong đợi thứ hạng của nó sẽ thay đổi khi các bên thứ ba thử nghiệm.
Mỗi mô hình có khả năng mạnh hơn ở đâu, theo cách nhìn của các nhà cung cấp
GPT-6.1 Sol. OpenAI giới thiệu nó cho “việc viết mã phức tạp, sử dụng máy tính và công việc chuyên nghiệp khi bạn muốn hiệu suất gần Astra với chi phí thấp hơn.” Các lợi ích đã nêu của nó là về tự động hóa đại lý, sử dụng máy tính và các tác vụ khoa học, cộng thêm ít lỗi thực tế hơn ở mức nỗ lực thấp. Về giá cả, nó ưu tiên các khối lượng công việc nặng về bộ nhớ đệm dưới 272K token đầu vào, và đây là một trong hai mô hình duy nhất có cấp tốc độ trả phí (Fast).
Claude Sonnet 5.5. Anthropic giới thiệu nó cho các tác vụ hàng ngày có phạm vi rõ ràng, sửa lỗi và các tài liệu, slide và bảng tính được trau chuốt, và cho biết Opus 5.5 “vẫn mạnh hơn rõ rệt trong các công việc phức tạp, không giới hạn” (xem Sonnet 5.5 so với Opus 5.5). Các điểm mạnh được báo cáo của nó là viết mã đại lý (70.6% trên Terminal-Bench 4.0 ở mức tối đa, do Anthropic thực hiện), công việc tri thức và sử dụng máy tính (80.1% một phần trên OSWorld 2.1). Về giá cả, nó ưu tiên các lời nhắc trên 272K token, và nó chạy trên Bedrock, Google Cloud và Microsoft Foundry.
Hai hành vi làm sai lệch một thử nghiệm đơn giản. Mức nỗ lực mặc định khác nhau (`medium` cho GPT-6.1 Sol, `high` cho Sonnet 5.5 trên API), vì vậy hãy so sánh các cài đặt tương ứng. Và cả hai đều không sử dụng các nút điều chỉnh lấy mẫu: Sonnet 5.5 trả về 400 cho các giá trị `temperature`, `top_p` hoặc `top_k` không mặc định, và hướng dẫn GPT-6 của OpenAI khuyên nên giảm `temperature` và `top_p` khi nỗ lực không phải là `none`. Kiểm soát sự biến thiên bằng các lần chạy lặp lại.
Tự chạy so sánh trong Apidog
Chọn 20 đến 50 tác vụ từ lưu lượng truy cập thực của bạn với các câu trả lời có thể kiểm tra, chẳng hạn như trường JSON hoặc nhãn. Sau đó, trong Apidog:
- Tạo một môi trường với `OPENAI_API_KEY` và `ANTHROPIC_API_KEY` làm khóa bí mật, cộng thêm `EFFORT`./li>
- Lưu hai yêu cầu chia sẻ một biến `{{prompt}}`. Các dạng khác nhau (tham chiếu Responses, tham chiếu Messages); so sánh định dạng API sẽ giải thích lý do:
POST https://api.openai.com/v1/responses
Authorization: Bearer {{OPENAI_API_KEY}}
Content-Type: application/json
{"model": "gpt-6.1-sol", "reasoning": {"effort": "{{EFFORT}}"},
"max_output_tokens": 25000, "input": "{{prompt}}"}
POST https://api.anthropic.com/v1/messages
x-api-key: {{ANTHROPIC_API_KEY}}
anthropic-version: 2023-06-01
content-type: application/json
{"model": "claude-sonnet-5-5", "max_tokens": 25000,
"output_config": {"effort": "{{EFFORT}}"},
"messages": [{"role": "user", "content": "{{prompt}}"}]}
- Thêm các xác nhận cho mỗi hình dạng, sau đó một xác nhận trên chính câu trả lời so với một cột `expected`:
| Kiểm tra | Phản hồi OpenAI | Tin nhắn Anthropic |
|---|---|---|
| Kết thúc bình thường | $.status bằng completed |
$.stop_reason bằng end_turn |
| Câu trả lời có sẵn | $.output[*].type chứa message |
$.content[*].type chứa text |
| Token đầu ra, bao gồm lý do | $.usage.output_tokens |
$.usage.output_tokens |
| Đọc bộ nhớ đệm | $.usage.input_tokens_details.cached_tokens |
$.usage.cache_read_input_tokens |
| Ghi bộ nhớ đệm | $.usage.input_tokens_details.cache_write_tokens |
$.usage.cache_creation_input_tokens |
- Tính giá mỗi phản hồi trong một tập lệnh hậu xử lý. `input_tokens` của OpenAI bao gồm các token được lưu trong bộ nhớ đệm và token ghi vào bộ nhớ đệm, vì vậy hãy trừ chúng trước khi áp dụng mức giá 2 đô la (lưu vào bộ nhớ đệm lời nhắc của OpenAI). `input_tokens` của Anthropic chỉ đếm các token sau điểm ngắt bộ nhớ đệm cuối cùng (lưu vào bộ nhớ đệm lời nhắc của Anthropic). Áp dụng quy tắc 272K cho phía OpenAI.
- Đặt cả hai yêu cầu vào một kịch bản kiểm thử, giữ các lời nhắc trên một dòng duy nhất, không có dấu ngoặc kép, trong tệp CSV và chạy nó từ Apidog CLI ở mỗi mức nỗ lực mà bạn quan tâm:
apidog run --access-token "$APIDOG_ACCESS_TOKEN" -t "$SCENARIO_ID" -e "$ENV_ID" \
-d prompts.csv --env-var "EFFORT=medium" -r cli,junit
Chia tổng chi tiêu cho số tác vụ đã vượt qua: đó là chi phí mỗi tác vụ của bạn. Chạy ít nhất `medium` và `high` trên cả hai, vì tên mức nỗ lực không được hiệu chuẩn giống nhau giữa các nhà cung cấp. Để biết chi tiết yêu cầu, hãy xem hướng dẫn API GPT-6.1 Sol và cách sử dụng API Claude Sonnet 5.5.
Câu hỏi thường gặp
GPT-6.1 Sol có rẻ hơn Claude Sonnet 5.5 không? Giá niêm yết giống nhau, 2 đô la/10 đô la cho mỗi 1M. Lượt đọc bộ nhớ đệm của GPT-6.1 Sol rẻ hơn; Sonnet 5.5 rẻ hơn khi trên 272K token đầu vào. Chi phí thực tế phụ thuộc vào số token được sử dụng cho mỗi tác vụ.
Mô hình nào tốt hơn trong việc viết mã? Không có điểm chuẩn chung. Anthropic báo cáo Sonnet 5.5 vượt trội hơn GPT-6 Sol trên FrontierCode; OpenAI báo cáo GPT-6.1 Sol đánh bại điểm DeepSWE tốt nhất của GPT-6 Sol thêm 6.4 điểm phần trăm. Hãy kiểm tra trên kho lưu trữ của riêng bạn.
Mô hình nào nhanh hơn? Artificial Analysis đo được Sonnet 5.5 đạt 138 token mỗi giây và GPT-6 Sol đạt 76, cả hai đều ở mức nỗ lực tối đa. Hiện chưa có số liệu của bên thứ ba cho GPT-6.1 Sol.
Có mô hình nào miễn phí không? GPT-6.1 Sol không có cấp miễn phí. Sonnet 5.5 có sẵn trong các ứng dụng trò chuyện của Claude.ai, nhưng API tính phí theo token. Xem cách sử dụng Claude Sonnet 5.5 miễn phí.
Lựa chọn bằng cách chạy cả hai
Lấy mười tác vụ từ danh sách công việc tồn đọng của bạn, chạy cả hai mô hình ở mức `medium` và `high`, và so sánh chi phí cho mỗi tác vụ hoàn thành. Tải xuống Apidog để giữ cặp này như một kịch bản mà bạn có thể chạy lại khi Artificial Analysis công bố số liệu của GPT-6.1 Sol hoặc khi một trong hai nhà cung cấp phát hành một bản cập nhật mới.
