Không, GPT-6.1 Sol không miễn phí. OpenAI đã ra mắt nó vào ngày 29 tháng 9 năm 2026 cho người dùng Plus, Pro, Business, Enterprise và Edu trong ChatGPT Work và Codex. Nó chưa có mặt trong Chat, các gói Free và Go không được sử dụng, và mô hình API gpt-6.1-sol không có bậc miễn phí. Giá API tiêu chuẩn là 2 đô la cho mỗi triệu token đầu vào, 0,10 đô la cho mỗi triệu token đầu vào được lưu trong bộ nhớ cache và 10 đô la cho mỗi triệu token đầu ra.
Mặt tích cực là các tùy chọn rẻ hơn đã trở nên rẻ hơn nữa. GPT-6.1 Sol giữ nguyên giá niêm yết 2/10 đô la của GPT-6 Sol và giảm một nửa chi phí cho đầu vào được lưu trong bộ nhớ cache. Hướng dẫn này xếp hạng mọi tùy chọn theo chi phí, nêu rõ những gì không miễn phí, đưa ra ví dụ về chi phí với mức giá thực tế và chỉ ra một giải pháp thay thế miễn phí từ cùng dòng GPT-6. Để biết về bản thân mô hình, hãy xem GPT-6.1 Sol là gì; câu hỏi tương tự về phiên bản tiền nhiệm của nó được trả lời trong GPT-6 Sol có miễn phí không. Trước khi chọn một tùy chọn, hãy đo lường chi phí của các lời nhắc của bạn trong Apidog.
Mọi cách truy cập GPT-6.1 Sol, so sánh
| Cách truy cập | Chi phí | Những gì bạn nhận được | Điểm cần lưu ý |
|---|---|---|---|
| Giải pháp thay thế miễn phí (không phải Sol): GPT-6 Luna trong ứng dụng ChatGPT dành cho máy tính để bàn | 0 đô la với gói Free | Luna, không phải Sol, trong Work và Codex của ứng dụng máy tính để bàn | Mô hình khác; không có trong Chat; không có khóa API |
| ChatGPT Plus trong Codex hoặc ChatGPT Work | Một gói đăng ký Plus | 6.1 Sol cho các tác vụ viết mã và công việc | Giới hạn sử dụng gói; không có trong Chat; không có khóa API |
| Đăng nhập bằng các ứng dụng đối tác của ChatGPT | Tính vào mức sử dụng gói Plus hoặc Pro của bạn | Gói của bạn trong các ứng dụng như Devin, Notion, Vercel, T3, OpenClaw và Dactyl | Chỉ dành cho Plus và Pro; giới hạn hàng tuần cho mỗi ứng dụng; mặc định tắt tín dụng |
| API, Batch hoặc Flex | 1 đô la đầu vào, 0.05 đô la lưu cache, 5 đô la đầu ra | Bằng một nửa giá Standard | Batch là bất đồng bộ; Flex chậm hơn và có thể trả về lỗi 429 |
| API, Standard với tính năng lưu cache | 2 đô la đầu vào, 0.10 đô la lưu cache, 10 đô la đầu ra | Mô hình từ mã của riêng bạn | Mọi token đều bị tính phí; các lượt cache hit cần một tiền tố ổn định |
OpenRouter openai/gpt-6.1-sol |
2 đô la đầu vào, 0.10 đô la lưu cache, 10 đô la đầu ra (điểm cuối OpenAI) | Một khóa cho nhiều nhà cung cấp | Cùng giá niêm yết; không miễn phí |
Tất cả các mức giá API đều tính trên mỗi triệu token cho các lời nhắc lên đến 272K token đầu vào, từ trang giá của OpenAI và trang mô hình của OpenRouter.
ChatGPT Plus: gói khởi đầu cho việc sử dụng tương tác
Nếu bạn muốn tự mình sử dụng 6.1 Sol trong Codex hoặc ChatGPT Work, Plus là gói thấp nhất bao gồm nó. Bài đăng ra mắt của OpenAI cho biết nó có sẵn "cho tất cả người dùng Plus, Pro, Business, Enterprise và Edu trong ChatGPT Work và Codex" và nói rằng nó "chưa có mặt trong Chat." Theo tài liệu mô hình của OpenAI, Enterprise và Edu sẽ giữ nó ở trạng thái tắt cho đến khi quản trị viên bật nó lên.
Bạn không phải trả tiền cho mỗi token ở đây, nhưng giới hạn sử dụng gói được áp dụng; hướng dẫn của chúng tôi về giới hạn sử dụng Codex giải thích cách chúng hoạt động. Hướng dẫn Codex miễn phí bao gồm các tùy chọn không tốn phí của Codex, nhưng đối với 6.1 Sol, danh sách của OpenAI bắt đầu từ gói Plus.
Đăng nhập bằng ChatGPT: gói của bạn trong các ứng dụng khác
DevDay đã thêm tính năng Đăng nhập bằng ChatGPT. Phần nhận dạng (OAuth/OIDC) có sẵn trên toàn cầu. Hơn nữa, người dùng Plus và Pro có thể sử dụng gói của mình trong các công cụ tham gia. OpenAI đã ra mắt với 16 đối tác, và tóm tắt DevDay của họ đề cập đến Devin của Cognition, Notion, Vercel, T3, OpenClaw và Dactyl.
Cách sử dụng hoạt động, theo bài viết trợ giúp của OpenAI về việc sử dụng gói của bạn trong các ứng dụng khác:
- Các yêu cầu đủ điều kiện được tính vào mức sử dụng ChatGPT Work và Codex của gói của bạn.
- Mỗi ứng dụng có một giới hạn sử dụng hàng tuần được đặt theo tỷ lệ phần trăm tổng mức sử dụng hàng tuần của bạn. Đó là một giới hạn, không phải một nhóm tài nguyên được dành riêng.
- Thanh toán bằng tín dụng sau khi bạn đạt giới hạn là tùy chọn, mặc định tắt và chỉ áp dụng khi giới hạn của ứng dụng đạt 100%.
- Ứng dụng nhận tên, địa chỉ email và ảnh hồ sơ của bạn. Nó không nhận được các cuộc trò chuyện, ký ức hay khóa API của bạn.
Kiểm tra xem một ứng dụng sử dụng mô hình nào trước khi giả định đó là 6.1 Sol. Nếu bạn đang thắc mắc OpenClaw tự nó tốn bao nhiêu, hãy xem OpenClaw có miễn phí không. Phần dành cho nhà phát triển, từ ID khách hàng đến luồng OAuth, nằm trong hướng dẫn Đăng nhập bằng ChatGPT của chúng tôi.
Gói ChatGPT không phải là khóa API
Đây là cái bẫy trong hầu hết các tìm kiếm "GPT miễn phí". Gói Plus hoặc Pro cung cấp cho bạn 6.1 Sol trong ChatGPT Work và Codex, chứ không phải khóa API. Một script, công việc CI hoặc tác nhân gửi Authorization: Bearer $OPENAI_API_KEY tới https://api.openai.com/v1 sẽ thanh toán theo từng token, bất kể bạn đang sử dụng gói nào. Cách duy nhất để mã sử dụng gói là thông qua luồng OAuth của tính năng Đăng nhập bằng ChatGPT, mà tài liệu sử dụng gói của OpenAI mở ra cho các ứng dụng mã nguồn mở và được lưu trữ cục bộ, với các giới hạn xem trước: chỉ truyền trực tuyến, store: false, không có temperature, và không có các công cụ lưu trữ như tìm kiếm tệp. Những yêu cầu đó vẫn được tính vào mức sử dụng Plus hoặc Pro của bạn và giới hạn của ứng dụng.
Cách truy cập API rẻ nhất: Batch, Flex và bộ nhớ cache
Ba đòn bẩy giúp giảm chi phí cho mỗi token:
- **Batch** chạy các tác vụ bất đồng bộ với một nửa giá Standard: 1 đô la đầu vào, 0.05 đô la lưu cache, 5 đô la đầu ra. Hướng dẫn API Batch của chúng tôi sẽ hướng dẫn bạn toàn bộ quá trình một tác vụ.
- **Flex** tính phí theo giá Batch cho các yêu cầu thông thường khi bạn đặt
service_tier: "flex". Hướng dẫn xử lý Flex cảnh báo về các phản hồi chậm hơn và thỉnh thoảng có lỗi429 Resource Unavailable, những lỗi này không bị tính phí. - **Lưu cache lời nhắc** được bật mặc định. Đầu vào được lưu cache có giá 0.10 đô la, thấp hơn 95% so với đầu vào tiêu chuẩn và bằng một nửa so với 0.20 đô la của GPT-6 Sol. Hướng dẫn lưu cache lời nhắc của OpenAI đặt mức tối thiểu là 1.024 token, tính phí ghi cache ở mức 1.25 lần so với tốc độ đầu vào không được lưu cache (2.50 đô la ở đây), và giữ một tiền tố có thể tái sử dụng trong 30 phút sau lần ghi hoặc sử dụng cuối cùng.
Giữ lời nhắc dưới 272K token đầu vào. Vượt quá mức đó, trang mô hình cho biết toàn bộ yêu cầu sẽ bị tính phí ở mức 2 lần tốc độ đầu vào và cache, và 1.5 lần tốc độ đầu ra.
Ví dụ minh họa: chi phí của một lệnh gọi tác nhân
Giả sử một bước tác nhân có tiền tố 100.000 token (lời nhắc hệ thống, lược đồ công cụ, ngữ cảnh kho lưu trữ) không thay đổi giữa các lệnh gọi, 8.000 token đầu vào mới và 2.000 token đầu ra, bao gồm cả quá trình suy luận. Tiền tố đã được lưu vào bộ nhớ cache, và chế độ lưu cache chỉ rõ ràng sẽ dừng việc ghi cache tại tiền tố, vì vậy các token mới sẽ được tính phí như đầu vào thông thường.
Trên Standard với lượt cache hit:
- Đầu vào được lưu cache: 100.000 x 0.10 đô la / 1.000.000 = 0.0100 đô la
- Đầu vào mới: 8.000 x 2.00 đô la / 1.000.000 = 0.0160 đô la
- Đầu ra: 2.000 x 10.00 đô la / 1.000.000 = 0.0200 đô la
- Tổng cộng: 0.0460 đô la cho mỗi lệnh gọi
Trên Batch hoặc Flex, mọi mức giá đều giảm một nửa: 0.0050 đô la + 0.0080 đô la + 0.0100 đô la = 0.0230 đô la. Trên GPT-6 Sol, dòng được lưu cache tăng gấp đôi lên 0.0200 đô la, vì vậy lệnh gọi có giá 0.0560 đô la. Nếu không có lượt cache hit trên 6.1 Sol, tất cả 108.000 token đầu vào sẽ được tính phí ở mức 2.00 đô la: 0.2160 đô la + 0.0200 đô la = 0.2360 đô la.
| Kịch bản | Mỗi lệnh gọi | 1.000 lệnh gọi |
|---|---|---|
| 6.1 Sol Standard, có cache hit | $0.046 | $46 |
| 6.1 Sol Batch hoặc Flex, có cache hit | $0.023 | $23 |
| GPT-6 Sol Standard, có cache hit | $0.056 | $56 |
| 6.1 Sol Standard, không có cache hit | $0.236 | $236 |
Lệnh gọi đầu tiên ghi tiền tố vào bộ nhớ cache với 2.50 đô la cho mỗi triệu: 100.000 x 2.50 đô la / 1.000.000 = 0.25 đô la cho phần đó. Sau đó, tỷ lệ cache hit làm hóa đơn thay đổi khoảng năm lần, Batch hoặc Flex giảm một nửa, và việc chuyển từ GPT-6 Sol giúp tiết kiệm một cent cho mỗi lệnh gọi trong ví dụ này vì chỉ có dòng được lưu cache thay đổi. Để biết thêm về việc sử dụng cache, hãy đọc lưu cache lời nhắc GPT-6.
Những gì KHÔNG miễn phí
- **ChatGPT Free và Go:** không có 6.1 Sol.
- **ChatGPT Chat:** 6.1 Sol chưa có mặt ở đó, trên bất kỳ gói nào.
- **API:** không có bậc miễn phí.
- **Đăng nhập bằng ChatGPT trên tài khoản Free:** việc sử dụng gói chỉ dành cho Plus và Pro.
- **OpenRouter:** cùng giá niêm yết, không phải giảm giá.
- **Cực nhanh (Ultrafast):** của 6.1 Sol đang "sắp ra mắt," và trên GPT-6 Astra nó có giá gấp 6 lần Standard.
Giải pháp thay thế miễn phí: GPT-6 Luna
Nếu bạn cần một thứ gì đó không tốn phí, GPT-6 Luna có sẵn trên gói Free trong Work và Codex của ứng dụng ChatGPT dành cho máy tính để bàn (gói Go, một gói trả phí, cũng có). Nó không có trong Chat. Đây là một mô hình khác, rẻ hơn, và một vị trí trong gói không đi kèm khóa API, vì vậy nó cũng không thể cung cấp năng lượng cho một script hoặc tác nhân bạn viết. Hướng dẫn GPT-6 Luna miễn phí bao gồm thiết lập. Trên API, Luna được niêm yết với 0.10 đô la đầu vào và 0.50 đô la đầu ra, bằng một phần hai mươi tốc độ đầu vào và đầu ra của 6.1 Sol, điều này làm cho nó trở thành lựa chọn rẻ tiền cho phân loại và trích xuất khối lượng lớn.
Đo lường mức sử dụng token thực tế trong Apidog trước khi bạn chọn
Ví dụ sử dụng số lượng token giả định. Các con số thực tế của bạn sẽ quyết định tùy chọn nào hiệu quả nhất, và một yêu cầu được lưu trong Apidog sẽ giúp bạn có được chúng:
- Tạo một môi trường với
OPENAI_API_KEYvàMODEL_IDđược đặt thànhgpt-6.1-sol. - Lưu một yêu cầu POST tới
https://api.openai.com/v1/responsesvớiBearer {{OPENAI_API_KEY}}trong tiêu đề Authorization và một phần thân chứa"model": "{{MODEL_ID}}","reasoning": {"effort": "low"}cùng với một lời nhắc thực tế từ khối lượng công việc của bạn làm đầu vào. - Gửi hai lần. Xác nhận
$.usage.input_tokens_details.cached_tokenslớn hơn 0 trong lần chạy thứ hai, để một chỉnh sửa lời nhắc làm hỏng việc lưu cache sẽ khiến kiểm tra thất bại. - So sánh
usage.output_tokensvàusage.output_tokens_details.reasoning_tokensở mức thấp (low) và trung bình (medium). Hướng dẫn suy luận nói rằng các token suy luận được tính phí như đầu ra. - Thêm một script sau phản hồi để định giá mỗi lệnh gọi theo mức Standard:
const u = pm.response.json().usage;
const d = u.input_tokens_details || {};
const cached = d.cached_tokens || 0;
const written = d.cache_write_tokens || 0;
const fresh = u.input_tokens - cached - written;
const usd = (fresh * 2 + cached * 0.1 + written * 2.5 + u.output_tokens * 10) / 1e6;
console.log(`gpt-6.1-sol Standard: $${usd.toFixed(4)} cho mỗi lệnh gọi`);
Nhân với khối lượng hàng ngày của bạn và giảm một nửa cho Batch hoặc Flex. Lưu yêu cầu vào một kịch bản kiểm thử và Apidog CLI có thể chạy lại nó trong CI, để một thay đổi lời nhắc làm giảm tỷ lệ cache hit của bạn sẽ hiển thị trước khi hóa đơn được gửi đến.
Câu hỏi thường gặp
GPT-6.1 Sol có miễn phí trong ChatGPT không? Không. Nó có trong ChatGPT Work và Codex dành cho người dùng Plus, Pro, Business, Enterprise và Edu. Nó chưa có mặt trong Chat và không có trên gói Free hoặc Go.
Tôi có thể sử dụng gói ChatGPT Plus của mình để gọi API GPT-6.1 Sol không? Không phải bằng khóa API: một gói không phải là một khóa, và mã gửi khóa sẽ trả tiền cho mỗi token. Đăng nhập bằng ChatGPT cho phép các ứng dụng xây dựng luồng OAuth của nó, bao gồm cả các ứng dụng mã nguồn mở và được lưu trữ cục bộ, tính các yêu cầu đủ điều kiện vào mức sử dụng Plus hoặc Pro, trong giới hạn xem trước.
Có API GPT-6.1 Sol miễn phí không? Không. Mức giá chính thức rẻ nhất là Batch hoặc Flex: 1 đô la đầu vào, 0.05 đô la lưu cache và 5 đô la đầu ra cho mỗi triệu token.
GPT-6.1 Sol có miễn phí trên OpenRouter không? Không. OpenRouter liệt kê openai/gpt-6.1-sol ở mức 2 đô la/10 đô la trên điểm cuối OpenAI của nó, giống như giá niêm yết của OpenAI.
GPT-6.1 Sol có rẻ hơn GPT-6 Sol không? Giá niêm yết là như nhau, 2 đô la/10 đô la. Đầu vào được lưu cache bằng một nửa (0.10 đô la so với 0.20 đô la), vì vậy các khối lượng công việc có tỷ lệ cache hit cao sẽ rẻ hơn.
Bước tiếp theo
Chọn cách truy cập dựa trên các con số. Tải xuống Apidog, lưu một yêu cầu thực tế, gửi hai lần và đọc mức sử dụng. Nếu bạn chỉ cần 6.1 Sol một cách tương tác, Plus trong Codex là điểm khởi đầu; nếu mã của bạn cần nó, hãy sử dụng API với tính năng lưu cache và chuyển mọi thứ có thể chờ sang Batch hoặc Flex. Hướng dẫn API GPT-6.1 Sol bao gồm yêu cầu đầu tiên và việc di chuyển từ gpt-6-sol.
