GPT-6.1 Sol là mẫu hình Sol mới nhất của OpenAI, ra mắt tại DevDay vào ngày 29 tháng 9 năm 2026, với ID mẫu API là gpt-6.1-sol. Nó có giá 2 đô la cho mỗi triệu token đầu vào và 10 đô la cho mỗi triệu token đầu ra, cùng mức giá niêm yết với GPT-6 Sol, nhưng token đầu vào được lưu trong bộ nhớ đệm giảm từ 0,20 đô la xuống 0,10 đô la. Nó có thể nhận tới 922.000 token đầu vào trong một cửa sổ ngữ cảnh 1.050.000 token, tạo ra tới 128.000 token đầu ra và có ngày cắt giảm kiến thức là 30 tháng 4 năm 2026. OpenAI quảng cáo nó có "trí thông minh gần với Astra" với chi phí chỉ bằng một phần năm giá token tiêu chuẩn của GPT-6 Astra.
Bài giải thích này bao gồm thông tin về tính khả dụng, giá cả, thông số kỹ thuật, các tuyên bố điểm chuẩn của OpenAI, và khi nào GPT-6 Astra vẫn là lựa chọn tốt hơn. Đối với tất cả những gì OpenAI đã ra mắt trong ngày hôm đó, hãy xem tổng hợp DevDay 2026; để biết về mẫu hình mà nó kế nhiệm, hãy đọc GPT-6 Sol là gì. Bạn có thể gửi yêu cầu gpt-6.1-sol đầu tiên của mình từ Apidog và lưu nó dưới dạng một bài kiểm tra đã lưu.
Tổng quan về GPT-6.1 Sol
| Đặc điểm | GPT-6.1 Sol |
|---|---|
| ID Mẫu hình | gpt-6.1-sol (một phiên bản); OpenRouter: openai/gpt-6.1-sol |
| Cửa sổ ngữ cảnh | 1.050.000 token |
| Đầu vào / đầu ra tối đa | 922.000 / 128.000 token |
| Ngày cắt giảm kiến thức | 30 tháng 4 năm 2026 |
| Mức độ nỗ lực suy luận | low (thấp), medium (trung bình, mặc định), high (cao), xhigh (rất cao), max (tối đa); không có none (không) hoặc minimal (tối thiểu) |
| Phương thức | Đầu vào văn bản và hình ảnh, đầu ra văn bản |
| Điểm cuối | Chat Completions, Responses, Batch (không phải Realtime, Live, Assistants hoặc tinh chỉnh) |
| Công cụ tích hợp | web_search, file_search, code_interpreter, computer_use, apply_patch, hosted_shell, mcp, tool_search, image_generation, skills |
| Giới hạn tỷ lệ | Bậc 1: 500 RPM, 500K TPM; Bậc 5: 15.000 RPM, 40M TPM |
Nguồn: trang mẫu hình GPT-6.1 Sol. Cửa sổ ngữ cảnh và giới hạn đầu vào khớp với những gì trang mẫu hình GPT-6 Sol liệt kê hôm nay, vì vậy kích thước ngữ cảnh không phải là điểm nâng cấp.
Nơi bạn có thể sử dụng GPT-6.1 Sol
Bài đăng ra mắt của OpenAI cho biết nó khả dụng “cho tất cả người dùng Plus, Pro, Business, Enterprise và Edu trong ChatGPT Work và Codex,” và bổ sung rằng nó “chưa có sẵn trong Chat.” Các phiên bản Free và Go không có trong danh sách, và tài liệu về mẫu hình của OpenAI nói rằng Enterprise và Edu giữ nó ở trạng thái tắt cho đến khi quản trị viên bật nó lên. Trong API, nó là gpt-6.1-sol trên Chat Completions, Responses và Batch, được tính phí theo token, và OpenRouter cung cấp nó dưới dạng openai/gpt-6.1-sol với cùng mức giá niêm yết trên điểm cuối OpenAI của nó.
Không có bậc API miễn phí. Hướng dẫn miễn phí GPT-6.1 Sol xếp hạng các lộ trình rẻ nhất và nêu tên một lựa chọn thay thế miễn phí (một mẫu hình khác).
Giá GPT-6.1 Sol
Tất cả các mức giá đều tính trên mỗi triệu token, từ trang giá của OpenAI, đối với các lời nhắc lên đến 272K token đầu vào:
| Mẫu hình và bậc | Đầu vào | Đầu vào lưu đệm | Ghi đệm | Đầu ra |
|---|---|---|---|---|
| GPT-6.1 Sol, Tiêu chuẩn | 2,00 đô la | 0,10 đô la | 2,50 đô la | 10,00 đô la |
| GPT-6.1 Sol, Theo lô hoặc Linh hoạt | 1,00 đô la | 0,05 đô la | 1,25 đô la | 5,00 đô la |
| GPT-6.1 Sol, Nhanh | 4,00 đô la | 0,20 đô la | 5,00 đô la | 20,00 đô la |
| GPT-6 Sol, Tiêu chuẩn | 2,00 đô la | 0,20 đô la | 2,50 đô la | 10,00 đô la |
| GPT-6 Astra, Tiêu chuẩn | 10,00 đô la | 1,00 đô la | 12,50 đô la | 50,00 đô la |
| GPT-6 Astra, Siêu nhanh | 60,00 đô la | 6,00 đô la | 75,00 đô la | 300,00 đô la |
| GPT-6 Luna, Tiêu chuẩn | 0,10 đô la | 0,01 đô la | 0,125 đô la | 0,50 đô la |
Chế độ Siêu nhanh (Ultrafast) cho GPT-6.1 Sol “sắp ra mắt,” chưa có giá. Ba điểm nổi bật trong bảng.
- Đối với mỗi token, bản nâng cấp là miễn phí. Giá niêm yết đầu vào và đầu ra khớp chính xác với GPT-6 Sol. Tỷ lệ duy nhất thay đổi là đầu vào được lưu trong bộ nhớ đệm, mà OpenAI định giá ở "0,10 đô la cho mỗi triệu token, thấp hơn 95% so với giá đầu vào tiêu chuẩn và thấp hơn 50% so với giá đầu vào được lưu đệm của GPT-6 Sol." Tái sử dụng một lời nhắc hệ thống dài, lược đồ công cụ hoặc ngữ cảnh kho lưu trữ, và khoản chi đó trên hóa đơn của bạn sẽ giảm một nửa. Số lượng token đầu ra có thể thay đổi với một mẫu hình mới, vì vậy hãy đo lường trước khi bạn hứa hẹn tiết kiệm. Hướng dẫn lưu đệm lời nhắc GPT-6 cho thấy cách cấu trúc lời nhắc để tận dụng bộ nhớ đệm.
- Lời nhắc dài tốn kém hơn. Sau 272K token đầu vào, trang mẫu hình nói rằng toàn bộ yêu cầu sẽ được tính phí gấp đôi tỷ lệ đầu vào và lưu đệm và gấp 1,5 lần tỷ lệ đầu ra: 4 đô la đầu vào, 0,20 đô la lưu đệm và 15 đô la đầu ra trên gói Tiêu chuẩn. Bạn có thể gửi 922K token, nhưng bạn phải trả gấp đôi cho đầu vào để làm điều đó.
- Astra đắt gấp năm lần. GPT-6 Astra có giá niêm yết 10 đô la/50 đô la, gấp năm lần mức giá tiêu chuẩn của 6.1 Sol, đây là nguồn gốc của cách nói "một phần năm" của OpenAI. Astra cũng là mẫu hình duy nhất có Ultrafast được cung cấp rộng rãi ngày nay, với giá gấp 6 lần giá Tiêu chuẩn của nó.
Những thay đổi so với GPT-6 Sol
| GPT-6 Sol | GPT-6.1 Sol | |
|---|---|---|
| ID Mẫu hình | gpt-6-sol |
gpt-6.1-sol |
| Đầu vào / đầu ra trên 1M | 2 đô la / 10 đô la | 2 đô la / 10 đô la |
| Đầu vào lưu đệm trên 1M | 0,20 đô la | 0,10 đô la |
| Mức độ nỗ lực | none (không) đến max (tối đa) |
low (thấp) đến max (tối đa) |
| Ngày cắt giảm kiến thức | 20 tháng 4 năm 2026 | 30 tháng 4 năm 2026 |
Trang mẫu hình GPT-6 Sol hiện ghi “Xem GPT-6.1 Sol để biết mẫu hình Sol mới hơn.” Việc chuyển đổi sẽ khiến bạn mất hai điều. Bất kỳ yêu cầu nào gửi reasoning: {"effort": "none"} cần một giá trị mới: hãy chuyển nó sang low, mức thấp nhất mà 6.1 Sol chấp nhận, và chạy lại đánh giá của bạn, bởi vì low vẫn thực hiện suy luận và các token suy luận được tính phí như đầu ra. Ngày cắt giảm kiến thức cũng tiến thêm mười ngày. Hướng dẫn API GPT-6.1 Sol hướng dẫn chi tiết quá trình di chuyển với các ví dụ yêu cầu.
Điểm chuẩn GPT-6.1 Sol: OpenAI tuyên bố gì
Mọi con số trong phần này đều đến từ bài đăng ra mắt của OpenAI: OpenAI đã chạy các mẫu hình của riêng mình và cho biết kết quả của đối thủ cạnh tranh đến từ các báo cáo công khai. OpenAI công bố điểm thô dưới dạng biểu đồ; các khác biệt dưới đây là những gì họ nêu trong văn bản. Chi phí là chi phí cho mỗi tác vụ ở mức độ nỗ lực đã nêu.
| Điểm chuẩn | OpenAI nói gì về GPT-6.1 Sol |
|---|---|
| DeepSWE v1.1 | Khớp với Astra "với chi phí khoảng một phần năm"; vượt qua điểm số tốt nhất của GPT-6 Sol 6,4 điểm phần trăm với nỗ lực và chi phí thấp hơn |
| GDP.pdf | Cao hơn Opus 5.5 "với các dự phòng với chi phí dưới một nửa cho mỗi tác vụ"; tiệm cận Astra với chi phí khoảng một phần năm cho mỗi tác vụ |
| AutomationBench 1.0.6 | +2,2 điểm phần trăm so với Opus 5.5 ở mức độ nỗ lực trung bình với chi phí khoảng một phần ba; +4,8 điểm phần trăm so với GPT-6 Sol ở cùng thiết lập |
| OSWorld 2.0 offline (phần thưởng một phần) | +7 điểm phần trăm so với GPT-6 Sol ở nỗ lực tối đa với chi phí dưới một nửa; trong phạm vi 2,1 điểm phần trăm của Astra ở mức tối đa với chi phí khoảng một phần bảy cho mỗi tác vụ |
| Terminal-Bench Science 0.1 | Hơn gấp đôi GPT-6 Sol ở nỗ lực tối đa; 5,47 đô la cho mỗi tác vụ so với 23,21 đô la cho Opus 5.5 và 23,80 đô la cho Astra |
| Tính xác thực (các cuộc hội thoại có lỗi bị gắn cờ) | Ở nỗ lực thấp, tỷ lệ phản hồi có lỗi giảm từ 11,4% (GPT-6 Sol) xuống 7,7%, giảm khoảng 32%; trong phạm vi 1,9 điểm phần trăm của Astra với chi phí dưới một phần năm cho mỗi tác vụ |
Đọc bảng với ba lưu ý sau:
- Các đối thủ là Opus 5.5 và Fable 5.1, không phải Claude Sonnet 5.5, ra mắt sớm hơn một ngày với cùng mức giá 2 đô la/10 đô la. Không nhà cung cấp nào đã công bố so sánh trực tiếp 6.1 Sol vs Sonnet 5.5; hướng dẫn GPT-6.1 Sol vs Claude Sonnet 5.5 chỉ ra cách chạy một so sánh trên các lời nhắc của riêng bạn. Trên AutomationBench, OpenAI cũng lưu ý điểm chi phí của Fable 5.1 bỏ qua các dự phòng, vốn xảy ra trên khoảng 40% tác vụ.
- Trọng tâm là chi phí cho mỗi tác vụ, không phải điểm số cao nhất. Hầu hết các hàng đều ghi “khớp” hoặc “tiệm cận” Astra với một phần nhỏ chi phí. Điều này mạnh về ngân sách, nhưng yếu hơn nếu bạn cần điểm số cao nhất.
- Tính xác thực được đo trên các cuộc hội thoại mà người dùng đã gắn cờ có lỗi, chứ không phải cách sử dụng thông thường.
Astra vẫn thắng một thử nghiệm quan trọng. Trên Terminal-Bench Science, OpenAI cho biết Astra vẫn đạt điểm cao nhất, ở mức 68,1%, và khuyến nghị Astra cho các công việc khoa học khó nhất.
Khi nào GPT-6 Astra vẫn là lựa chọn đúng đắn
Đối với hầu hết các khối lượng công việc lập trình và tác nhân đã chạy trên GPT-6 Sol, 6.1 Sol là một sự thay thế tương đương với cùng mức giá. Hãy giữ Astra khi:
- Tác vụ là công việc khoa học hoặc công việc terminal khó nhất. Đó là hướng dẫn của chính OpenAI sau Terminal-Bench Science.
- Bạn cần Ultrafast ngay hôm nay. Astra Ultrafast đã có sẵn trong API và trong ChatGPT Work và Codex trên Pro 500 và Enterprise. 6.1 Sol “sắp ra mắt.”
- Bạn đang xây dựng trên công cụ
computer-usecủa API Agents. Tài liệu của nó chỉ đề cậpgpt-6-astra. Trang mẫu hình 6.1 Sol liệt kêcomputer_uselà một công cụ, vì vậy hãy kiểm tra tài liệu API Agents trước khi bạn chuyển đổi tác nhân. - Vài điểm cuối cùng quan trọng hơn khoảng cách chi phí gấp 5 lần. Trên OSWorld và tính xác thực, Astra vẫn dẫn trước khoảng 2 điểm phần trăm.
Ở hướng ngược lại, GPT-6 Luna với giá 0,10 đô la/0,50 đô la đáp ứng các tác vụ phân loại và trích xuất khối lượng lớn mà khả năng suy luận cấp độ Sol là quá mức cần thiết. So sánh Luna vs Sol vs Astra phân tích chi phí cho mỗi tác vụ theo bậc, và hướng dẫn API GPT-6 Astra bao gồm các tham số của Astra.
Gọi GPT-6.1 Sol và kiểm tra chi phí
Đây là yêu cầu đầu tiên trên Responses API, với khóa được đọc từ một biến môi trường:
curl https://api.openai.com/v1/responses \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"reasoning": {"effort": "low"},
"input": "List three ways to make a webhook receiver idempotent."
}'
Phản hồi mang theo một đối tượng usage với input_tokens, output_tokens và output_tokens_details.reasoning_tokens. Hướng dẫn suy luận của OpenAI nói rằng các token suy luận được tính phí như đầu ra, vì vậy mức độ nỗ lực làm thay đổi hóa đơn của bạn ngay cả khi câu trả lời hiển thị có cùng độ dài. Lượt truy cập bộ nhớ đệm hiển thị trong input_tokens_details.cached_tokens.
Để biến điều đó thành một kiểm tra lặp lại trong Apidog:
- Tạo một môi trường với
OPENAI_API_KEYvàMODEL_IDđược đặt thànhgpt-6.1-sol. GửiBearer {{OPENAI_API_KEY}}trong tiêu đề Authorization và"model": "{{MODEL_ID}}"trong phần thân. - Lưu yêu cầu dưới dạng POST tới
https://api.openai.com/v1/responses. - Thêm các khẳng định: trạng thái là 200,
$.usage.output_tokenslớn hơn 0, và$.usage.output_tokens_details.reasoning_tokensnằm dưới một ngưỡng bạn chọn cho lời nhắc này. - Đặt một tiền tố cố định ít nhất 1.024 token (độ dài tối thiểu có thể lưu vào bộ nhớ đệm trong hướng dẫn lưu bộ nhớ đệm lời nhắc) ở đầu
input, gửi hai lần, và khẳng định$.usage.input_tokens_details.cached_tokenslớn hơn 0 trong lần chạy thứ hai. - Sao chép môi trường với
MODEL_IDđược đặt thànhgpt-6-solvà chạy cùng một yêu cầu trong cả hai. Cùng một lời nhắc, hai mẫu hình,usageđặt cạnh nhau.
Câu hỏi thường gặp
GPT-6.1 Sol có miễn phí không? Không. Nó có trong ChatGPT Work và Codex cho các người dùng Plus, Pro, Business, Enterprise và Edu, và API không có bậc miễn phí. Hướng dẫn miễn phí GPT-6.1 Sol bao gồm các lộ trình chi phí thấp nhất.
ID mẫu hình của GPT-6.1 Sol là gì? gpt-6.1-sol, một phiên bản duy nhất. Trên OpenRouter, nó là openai/gpt-6.1-sol.
GPT-6.1 Sol có hỗ trợ mức độ nỗ lực suy luận none không? Không. Nó chấp nhận low (thấp), medium (trung bình, mặc định), high (cao), xhigh (rất cao) và max (tối đa). Các yêu cầu đã gửi none tới GPT-6 Sol cần một giá trị mới.
GPT-6.1 Sol có tốt hơn GPT-6 Astra không? Không phải trên mọi phương diện. OpenAI cho biết nó phù hợp hoặc tiệm cận Astra trên một số điểm chuẩn với chi phí chỉ bằng một phần năm đến một phần bảy cho mỗi tác vụ, nhưng Astra vẫn dẫn đầu Terminal-Bench Science ở mức 68,1%.
Bước tiếp theo
Nếu bạn đang chạy GPT-6 Sol hôm nay, hãy thay đổi ID mẫu hình, thay thế bất kỳ nỗ lực none nào bằng low, và so sánh usage trên một vài lời nhắc thực tế trước khi bạn chuyển đổi lưu lượng sản xuất. Tải xuống Apidog để giữ cả hai lần chạy dưới dạng yêu cầu đã lưu với các khẳng định, sau đó làm theo hướng dẫn API GPT-6.1 Sol để có danh sách kiểm tra di chuyển đầy đủ.
