GPT-6.1 Sol là gì?

GPT-6.1 Sol được giải thích: ID mô hình gpt-6.1-sol, giá 2 đô la/10 đô la với đầu vào được lưu trong bộ nhớ đệm là 0,10 đô la, đầu vào tối đa 922K, các mức độ nỗ lực và các tiêu chuẩn đánh giá của OpenAI so với Astra.

Ashley Innocent

Ashley Innocent

30 tháng 9 2026

GPT-6.1 Sol là gì?

Apidog cho doanh nghiệp

Triển khai tại chỗ

SSO & RBAC

Tuân thủ SOC 2

Khám phá Apidog Enterprise

GPT-6.1 Sol là mẫu hình Sol mới nhất của OpenAI, ra mắt tại DevDay vào ngày 29 tháng 9 năm 2026, với ID mẫu API là gpt-6.1-sol. Nó có giá 2 đô la cho mỗi triệu token đầu vào và 10 đô la cho mỗi triệu token đầu ra, cùng mức giá niêm yết với GPT-6 Sol, nhưng token đầu vào được lưu trong bộ nhớ đệm giảm từ 0,20 đô la xuống 0,10 đô la. Nó có thể nhận tới 922.000 token đầu vào trong một cửa sổ ngữ cảnh 1.050.000 token, tạo ra tới 128.000 token đầu ra và có ngày cắt giảm kiến thức là 30 tháng 4 năm 2026. OpenAI quảng cáo nó có "trí thông minh gần với Astra" với chi phí chỉ bằng một phần năm giá token tiêu chuẩn của GPT-6 Astra.

Bài giải thích này bao gồm thông tin về tính khả dụng, giá cả, thông số kỹ thuật, các tuyên bố điểm chuẩn của OpenAI, và khi nào GPT-6 Astra vẫn là lựa chọn tốt hơn. Đối với tất cả những gì OpenAI đã ra mắt trong ngày hôm đó, hãy xem tổng hợp DevDay 2026; để biết về mẫu hình mà nó kế nhiệm, hãy đọc GPT-6 Sol là gì. Bạn có thể gửi yêu cầu gpt-6.1-sol đầu tiên của mình từ Apidog và lưu nó dưới dạng một bài kiểm tra đã lưu.

nút

Tổng quan về GPT-6.1 Sol

Đặc điểm GPT-6.1 Sol
ID Mẫu hình gpt-6.1-sol (một phiên bản); OpenRouter: openai/gpt-6.1-sol
Cửa sổ ngữ cảnh 1.050.000 token
Đầu vào / đầu ra tối đa 922.000 / 128.000 token
Ngày cắt giảm kiến thức 30 tháng 4 năm 2026
Mức độ nỗ lực suy luận low (thấp), medium (trung bình, mặc định), high (cao), xhigh (rất cao), max (tối đa); không có none (không) hoặc minimal (tối thiểu)
Phương thức Đầu vào văn bản và hình ảnh, đầu ra văn bản
Điểm cuối Chat Completions, Responses, Batch (không phải Realtime, Live, Assistants hoặc tinh chỉnh)
Công cụ tích hợp web_search, file_search, code_interpreter, computer_use, apply_patch, hosted_shell, mcp, tool_search, image_generation, skills
Giới hạn tỷ lệ Bậc 1: 500 RPM, 500K TPM; Bậc 5: 15.000 RPM, 40M TPM

Nguồn: trang mẫu hình GPT-6.1 Sol. Cửa sổ ngữ cảnh và giới hạn đầu vào khớp với những gì trang mẫu hình GPT-6 Sol liệt kê hôm nay, vì vậy kích thước ngữ cảnh không phải là điểm nâng cấp.

Nơi bạn có thể sử dụng GPT-6.1 Sol

Bài đăng ra mắt của OpenAI cho biết nó khả dụng “cho tất cả người dùng Plus, Pro, Business, Enterprise và Edu trong ChatGPT Work và Codex,” và bổ sung rằng nó “chưa có sẵn trong Chat.” Các phiên bản Free và Go không có trong danh sách, và tài liệu về mẫu hình của OpenAI nói rằng Enterprise và Edu giữ nó ở trạng thái tắt cho đến khi quản trị viên bật nó lên. Trong API, nó là gpt-6.1-sol trên Chat Completions, Responses và Batch, được tính phí theo token, và OpenRouter cung cấp nó dưới dạng openai/gpt-6.1-sol với cùng mức giá niêm yết trên điểm cuối OpenAI của nó.

Không có bậc API miễn phí. Hướng dẫn miễn phí GPT-6.1 Sol xếp hạng các lộ trình rẻ nhất và nêu tên một lựa chọn thay thế miễn phí (một mẫu hình khác).

Giá GPT-6.1 Sol

Tất cả các mức giá đều tính trên mỗi triệu token, từ trang giá của OpenAI, đối với các lời nhắc lên đến 272K token đầu vào:

Mẫu hình và bậc Đầu vào Đầu vào lưu đệm Ghi đệm Đầu ra
GPT-6.1 Sol, Tiêu chuẩn 2,00 đô la 0,10 đô la 2,50 đô la 10,00 đô la
GPT-6.1 Sol, Theo lô hoặc Linh hoạt 1,00 đô la 0,05 đô la 1,25 đô la 5,00 đô la
GPT-6.1 Sol, Nhanh 4,00 đô la 0,20 đô la 5,00 đô la 20,00 đô la
GPT-6 Sol, Tiêu chuẩn 2,00 đô la 0,20 đô la 2,50 đô la 10,00 đô la
GPT-6 Astra, Tiêu chuẩn 10,00 đô la 1,00 đô la 12,50 đô la 50,00 đô la
GPT-6 Astra, Siêu nhanh 60,00 đô la 6,00 đô la 75,00 đô la 300,00 đô la
GPT-6 Luna, Tiêu chuẩn 0,10 đô la 0,01 đô la 0,125 đô la 0,50 đô la

Chế độ Siêu nhanh (Ultrafast) cho GPT-6.1 Sol “sắp ra mắt,” chưa có giá. Ba điểm nổi bật trong bảng.

Những thay đổi so với GPT-6 Sol

GPT-6 Sol GPT-6.1 Sol
ID Mẫu hình gpt-6-sol gpt-6.1-sol
Đầu vào / đầu ra trên 1M 2 đô la / 10 đô la 2 đô la / 10 đô la
Đầu vào lưu đệm trên 1M 0,20 đô la 0,10 đô la
Mức độ nỗ lực none (không) đến max (tối đa) low (thấp) đến max (tối đa)
Ngày cắt giảm kiến thức 20 tháng 4 năm 2026 30 tháng 4 năm 2026

Trang mẫu hình GPT-6 Sol hiện ghi “Xem GPT-6.1 Sol để biết mẫu hình Sol mới hơn.” Việc chuyển đổi sẽ khiến bạn mất hai điều. Bất kỳ yêu cầu nào gửi reasoning: {"effort": "none"} cần một giá trị mới: hãy chuyển nó sang low, mức thấp nhất mà 6.1 Sol chấp nhận, và chạy lại đánh giá của bạn, bởi vì low vẫn thực hiện suy luận và các token suy luận được tính phí như đầu ra. Ngày cắt giảm kiến thức cũng tiến thêm mười ngày. Hướng dẫn API GPT-6.1 Sol hướng dẫn chi tiết quá trình di chuyển với các ví dụ yêu cầu.

Điểm chuẩn GPT-6.1 Sol: OpenAI tuyên bố gì

Mọi con số trong phần này đều đến từ bài đăng ra mắt của OpenAI: OpenAI đã chạy các mẫu hình của riêng mình và cho biết kết quả của đối thủ cạnh tranh đến từ các báo cáo công khai. OpenAI công bố điểm thô dưới dạng biểu đồ; các khác biệt dưới đây là những gì họ nêu trong văn bản. Chi phí là chi phí cho mỗi tác vụ ở mức độ nỗ lực đã nêu.

Điểm chuẩn OpenAI nói gì về GPT-6.1 Sol
DeepSWE v1.1 Khớp với Astra "với chi phí khoảng một phần năm"; vượt qua điểm số tốt nhất của GPT-6 Sol 6,4 điểm phần trăm với nỗ lực và chi phí thấp hơn
GDP.pdf Cao hơn Opus 5.5 "với các dự phòng với chi phí dưới một nửa cho mỗi tác vụ"; tiệm cận Astra với chi phí khoảng một phần năm cho mỗi tác vụ
AutomationBench 1.0.6 +2,2 điểm phần trăm so với Opus 5.5 ở mức độ nỗ lực trung bình với chi phí khoảng một phần ba; +4,8 điểm phần trăm so với GPT-6 Sol ở cùng thiết lập
OSWorld 2.0 offline (phần thưởng một phần) +7 điểm phần trăm so với GPT-6 Sol ở nỗ lực tối đa với chi phí dưới một nửa; trong phạm vi 2,1 điểm phần trăm của Astra ở mức tối đa với chi phí khoảng một phần bảy cho mỗi tác vụ
Terminal-Bench Science 0.1 Hơn gấp đôi GPT-6 Sol ở nỗ lực tối đa; 5,47 đô la cho mỗi tác vụ so với 23,21 đô la cho Opus 5.5 và 23,80 đô la cho Astra
Tính xác thực (các cuộc hội thoại có lỗi bị gắn cờ) Ở nỗ lực thấp, tỷ lệ phản hồi có lỗi giảm từ 11,4% (GPT-6 Sol) xuống 7,7%, giảm khoảng 32%; trong phạm vi 1,9 điểm phần trăm của Astra với chi phí dưới một phần năm cho mỗi tác vụ

Đọc bảng với ba lưu ý sau:

Astra vẫn thắng một thử nghiệm quan trọng. Trên Terminal-Bench Science, OpenAI cho biết Astra vẫn đạt điểm cao nhất, ở mức 68,1%, và khuyến nghị Astra cho các công việc khoa học khó nhất.

Khi nào GPT-6 Astra vẫn là lựa chọn đúng đắn

Đối với hầu hết các khối lượng công việc lập trình và tác nhân đã chạy trên GPT-6 Sol, 6.1 Sol là một sự thay thế tương đương với cùng mức giá. Hãy giữ Astra khi:

Ở hướng ngược lại, GPT-6 Luna với giá 0,10 đô la/0,50 đô la đáp ứng các tác vụ phân loại và trích xuất khối lượng lớn mà khả năng suy luận cấp độ Sol là quá mức cần thiết. So sánh Luna vs Sol vs Astra phân tích chi phí cho mỗi tác vụ theo bậc, và hướng dẫn API GPT-6 Astra bao gồm các tham số của Astra.

Gọi GPT-6.1 Sol và kiểm tra chi phí

Đây là yêu cầu đầu tiên trên Responses API, với khóa được đọc từ một biến môi trường:

curl https://api.openai.com/v1/responses \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6.1-sol",
    "reasoning": {"effort": "low"},
    "input": "List three ways to make a webhook receiver idempotent."
  }'

Phản hồi mang theo một đối tượng usage với input_tokens, output_tokens và output_tokens_details.reasoning_tokens. Hướng dẫn suy luận của OpenAI nói rằng các token suy luận được tính phí như đầu ra, vì vậy mức độ nỗ lực làm thay đổi hóa đơn của bạn ngay cả khi câu trả lời hiển thị có cùng độ dài. Lượt truy cập bộ nhớ đệm hiển thị trong input_tokens_details.cached_tokens.

Để biến điều đó thành một kiểm tra lặp lại trong Apidog:

  1. Tạo một môi trường với OPENAI_API_KEY và MODEL_ID được đặt thành gpt-6.1-sol. Gửi Bearer {{OPENAI_API_KEY}} trong tiêu đề Authorization và "model": "{{MODEL_ID}}" trong phần thân.
  2. Lưu yêu cầu dưới dạng POST tới https://api.openai.com/v1/responses.
  3. Thêm các khẳng định: trạng thái là 200, $.usage.output_tokens lớn hơn 0, và $.usage.output_tokens_details.reasoning_tokens nằm dưới một ngưỡng bạn chọn cho lời nhắc này.
  4. Đặt một tiền tố cố định ít nhất 1.024 token (độ dài tối thiểu có thể lưu vào bộ nhớ đệm trong hướng dẫn lưu bộ nhớ đệm lời nhắc) ở đầu input, gửi hai lần, và khẳng định $.usage.input_tokens_details.cached_tokens lớn hơn 0 trong lần chạy thứ hai.
  5. Sao chép môi trường với MODEL_ID được đặt thành gpt-6-sol và chạy cùng một yêu cầu trong cả hai. Cùng một lời nhắc, hai mẫu hình, usage đặt cạnh nhau.

Câu hỏi thường gặp

GPT-6.1 Sol có miễn phí không? Không. Nó có trong ChatGPT Work và Codex cho các người dùng Plus, Pro, Business, Enterprise và Edu, và API không có bậc miễn phí. Hướng dẫn miễn phí GPT-6.1 Sol bao gồm các lộ trình chi phí thấp nhất.

ID mẫu hình của GPT-6.1 Sol là gì? gpt-6.1-sol, một phiên bản duy nhất. Trên OpenRouter, nó là openai/gpt-6.1-sol.

GPT-6.1 Sol có hỗ trợ mức độ nỗ lực suy luận none không? Không. Nó chấp nhận low (thấp), medium (trung bình, mặc định), high (cao), xhigh (rất cao) và max (tối đa). Các yêu cầu đã gửi none tới GPT-6 Sol cần một giá trị mới.

GPT-6.1 Sol có tốt hơn GPT-6 Astra không? Không phải trên mọi phương diện. OpenAI cho biết nó phù hợp hoặc tiệm cận Astra trên một số điểm chuẩn với chi phí chỉ bằng một phần năm đến một phần bảy cho mỗi tác vụ, nhưng Astra vẫn dẫn đầu Terminal-Bench Science ở mức 68,1%.

Bước tiếp theo

Nếu bạn đang chạy GPT-6 Sol hôm nay, hãy thay đổi ID mẫu hình, thay thế bất kỳ nỗ lực none nào bằng low, và so sánh usage trên một vài lời nhắc thực tế trước khi bạn chuyển đổi lưu lượng sản xuất. Tải xuống Apidog để giữ cả hai lần chạy dưới dạng yêu cầu đã lưu với các khẳng định, sau đó làm theo hướng dẫn API GPT-6.1 Sol để có danh sách kiểm tra di chuyển đầy đủ.

Thực hành thiết kế API trong Apidog

Khám phá cách dễ dàng hơn để xây dựng và sử dụng API