GPT-6 miễn phí không? Cách sử dụng GPT-6 giá rẻ nhất

GPT-6 Sol không miễn phí: nó yêu cầu các gói Plus, Pro, Business, Enterprise hoặc Edu trong ChatGPT Work và Codex. GPT-6 Luna miễn phí trong ứng dụng máy tính để bàn. Gói Plus là lựa chọn trả phí rẻ nhất với mức giá 2$/10$.

Ashley Innocent

Ashley Innocent

23 tháng 9 2026

GPT-6 miễn phí không? Cách sử dụng GPT-6 giá rẻ nhất

Apidog cho doanh nghiệp

Triển khai tại chỗ

SSO & RBAC

Tuân thủ SOC 2

Khám phá Apidog Enterprise

Không. GPT-6 Sol không miễn phí trên bất kỳ nền tảng nào mà OpenAI đã phát hành khi ra mắt. Thông báo về tính khả dụng của OpenAI rất rõ ràng: Sol và Luna có mặt trong ChatGPT Work và Codex dành cho người dùng Plus, Pro, Business, Enterprise và Edu, và người dùng Free và Go có thể truy cập GPT-6 Luna trong ứng dụng dành cho máy tính để bàn. Sol không có trong danh sách miễn phí đó. Cả hai mô hình này đều chưa có trong Chat. Trên API, gpt-6-sol tính phí theo mức sử dụng là 2 USD cho mỗi triệu token đầu vào và 10 USD cho mỗi triệu token đầu ra.

Đây là phần đáng để bạn dành thời gian. Có một mô hình GPT-6 hoàn toàn miễn phí, nó ra mắt cùng ngày, và đối với phần lớn những gì mọi người muốn dùng Sol thì đây chính là câu trả lời trung thực. GPT-6 Luna hoạt động miễn phí trong ứng dụng dành cho máy tính để bàn cho tài khoản Free và Go, và nó không phải là đồ chơi: ngữ cảnh 1 triệu token, và đạt 66,6% trên DeepSWE 1.1 ở nỗ lực tối đa so với 68,8% của Sol. Nếu bạn đến đây vì muốn làm việc tiên tiến mà không cần đăng ký, hãy thử cái đó trước. Chúng tôi đã viết riêng về cách này trong bài cách sử dụng GPT-6 Luna miễn phí.

Bài viết này bao gồm ba điều thực sự đúng: ai có thể sử dụng Sol và bằng cách nào, những cách miễn phí nào tồn tại và chúng kết thúc ở đâu, và con đường trả phí rẻ nhất để truy cập gpt-6-sol trông như thế nào khi bạn chấp nhận rằng mình sẽ phải trả tiền cho nó.

Ai có thể sử dụng GPT-6 Sol, tổng quan nhanh

Nền tảng GPT-6 Sol GPT-6 Luna
ChatGPT Miễn phí Không Có, ứng dụng máy tính
ChatGPT Go Không Có, ứng dụng máy tính
ChatGPT Plus, Pro, Business, Enterprise, Edu Có, trong Work và Codex Có, trong Work và Codex
Chat Chưa Chưa
API Trả phí theo mức sử dụng, gpt-6-sol Trả phí theo mức sử dụng, gpt-6-luna

Hai chi tiết trong bảng đó thường xuyên bị hiểu sai. Thứ nhất, “trong ứng dụng dành cho máy tính để bàn” là một giới hạn thực sự đối với lộ trình miễn phí của Luna, chứ không phải là chiêu trò tiếp thị. Thứ hai, Work và Codex là nơi truy cập trả phí, vì vậy gói đăng ký Plus không đưa Sol vào giao diện Chat mà bạn có thể đã quen thuộc.

Lộ trình miễn phí thực sự tồn tại

GPT-6 Luna có giá 0,10 USD cho mỗi triệu token đầu vào và 0,50 USD cho mỗi triệu token đầu ra trên API, và hoàn toàn miễn phí trong ứng dụng dành cho máy tính để bàn cho tài khoản Free và Go. Điểm chỉ số trí tuệ phân tích nhân tạo của nó là 37 so với 48 của Sol, vì vậy nó là một bước lùi, nhưng hãy xem bước lùi đó đến đâu. Trên DeepSWE 1.1 ở nỗ lực tối đa, Luna đạt 66,6%, mà OpenAI mô tả là tương đương với Claude Opus 5 và Claude Fable 5 ở nỗ lực trung bình, với chi phí thấp hơn 93% cho mỗi tác vụ so với Opus 5 và thấp hơn 96% so với Fable 5. Trên OSWorld 2.0 ngoại tuyến, Luna ở mức tối đa đánh bại GPT-5.6 Sol ở mức trung bình với chi phí chỉ bằng khoảng một phần mười. Về tính xác thực, Luna ở nỗ lực cao hơn tương đương với GPT-5.6 Sol với chi phí chỉ bằng khoảng một phần trăm.

Hãy nói rõ về những gì phần miễn phí của câu đó bao gồm. Quyền lợi của Free và Go là sử dụng Luna tương tác bên trong ứng dụng ChatGPT dành cho máy tính để bàn. Nó không phải là một khóa API và không thể điều khiển một script, một tác vụ CI, hoặc một tác vụ agent tự động. Mọi thứ có tính lập trình đều thông qua API với mức giá 0,10 USD và 0,50 USD của Luna, rẻ nhưng không phải là miễn phí.

Hãy đọc điều đó như một hướng dẫn mua sắm hơn là một bảng điểm. Nếu công việc của bạn là chỉnh sửa mã, các vòng lặp tác tử qua một kho lưu trữ, xử lý tài liệu, phân loại, hoặc bất kỳ điều gì bạn trước đây đã giao cho một mô hình cấp trung, Luna không phải là một sự thỏa hiệp mà bạn phải xin lỗi. Sol chứng minh giá trị của nó ở những tác vụ khó hơn: 33,2% trên AutomationBench 1.0.6 ở nỗ lực cực cao, 56,4% trên Agents’ Last Exam V1 ở mức tối đa, và có số lỗi thực tế chỉ bằng khoảng một nửa so với phiên bản tiền nhiệm.

Thông số kỹ thuật đầy đủ có trong GPT-6 Sol là gìGPT-6 Luna là gì, và quyết định cấp độ về chi phí cho mỗi tác vụ có trong Luna so với Sol so với Astra.

Dùng thử API và tín dụng khuyến mãi đám mây

Lộ trình miễn phí trung thực thứ hai là tín dụng, với một đặc tính bạn nên nắm rõ trước khi lên kế hoạch: số dư tín dụng sẽ giảm dần rồi hết. Nó là bản dùng thử, không phải một cấp bậc.

Hãy sử dụng các tín dụng đó để đo lường, chứ không phải cho lưu lượng truy cập sản xuất. Chạy các lời nhắc thực tế của bạn, đọc khối `usage` từ mỗi phản hồi, và bạn sẽ biết chi phí cho mỗi tác vụ của mình trước khi cam kết ngân sách. Điều đó đáng giá hơn chính bản thân các tín dụng.

Không có con đường miễn phí không giới hạn nào đến gpt-6-sol

Cần phải nói rõ ràng, vì câu hỏi này thường thu hút những câu trả lời không trung thực. Không có bậc miễn phí nào của OpenAI API cung cấp cho bạn các cuộc gọi gpt-6-sol không giới hạn. Không có proxy, pool khóa hay nhà phân phối nào cấp quyền truy cập mô hình tiên tiến miễn phí một cách hợp pháp. Các phương án đó vi phạm điều khoản của nhà cung cấp, bị thu hồi và chuyển hướng lời nhắc của bạn qua hạ tầng mà bạn không kiểm soát. Khi các tín dụng dùng thử hoặc khuyến mãi đã hết, bạn sẽ trả tiền cho mỗi token hoặc ngừng sử dụng.

Con đường trả phí rẻ nhất

Mức giá cơ bản là 2 USD cho đầu vào và 10 USD cho đầu ra trên mỗi triệu token. OpenAI mô tả điều đó rẻ hơn 50% so với GPT-5.6, và từ ngữ bổ nghĩa trong cách diễn đạt của họ rất quan trọng: nó rẻ hơn 50% so với giá khuyến mãi của GPT-5.6, chứ không phải giá niêm yết. Các yếu tố dưới đây sẽ làm giảm hóa đơn nhiều hơn so với những gì tiêu đề gợi ý.

Yếu tố 1: Bộ nhớ đệm (caching), là mức giảm giá lớn nhất

GPT-6 được phát hành cùng với tính năng bộ nhớ đệm lời nhắc thực sự. Các lượt đọc đầu vào được lưu vào bộ nhớ đệm được giảm giá 90%, điều này đưa mức giá đầu vào thực tế của Sol xuống 0,20 USD cho mỗi triệu token đối với phần lời nhắc được lưu vào bộ nhớ đệm. Đó là một mức giảm lớn hơn so với mức giảm giá mà mọi người đã viết.

Ba điều đã thay đổi cùng với mức giảm giá, và mỗi điều đều loại bỏ một lý do khiến bộ nhớ đệm trước đây thường bỏ lỡ:

Ngoài ra còn có một bảng điều khiển bộ nhớ đệm và công cụ chẩn đoán, vì vậy tỷ lệ truy cập trúng giờ đây là điều bạn có thể quan sát chứ không phải suy luận. GitHub báo cáo rằng có hơn 50% số token lời nhắc cần xử lý mới trên hàng tỷ yêu cầu. Một điểm cần lưu ý: các nguồn của chúng tôi không nêu rõ tốc độ ghi vào bộ nhớ đệm cho GPT-6, vì vậy đừng coi việc ghi là miễn phí. Cơ chế hoạt động có trong bài Bộ nhớ đệm lời nhắc GPT-6.

Yếu tố 2: Nỗ lực suy luận, trục chi phí thực tế

Mỗi hàng đánh giá mà OpenAI công bố đều đi kèm với một điểm số và một mức độ nỗ lực, và đó không phải là sự trang trí. Nỗ lực đổi lấy độ chính xác, và token là chi phí. Sol ở mức `xhigh` đạt 33,2% trên AutomationBench với 0,27 USD cho mỗi tác vụ; cùng một mô hình ở nỗ lực thấp hơn sẽ tốn ít hơn và đạt điểm thấp hơn. Một cài đặt rẻ hơn mà cần ba lần thử thì không hề rẻ hơn, vì vậy cách duy nhất để chọn đúng là tự chạy đánh giá ở hai cài đặt và so sánh chi phí cho mỗi tác vụ hoàn thành, chứ không phải chi phí cho mỗi cuộc gọi.

Yếu tố 3: Token đầu ra, có chi phí gấp năm lần đầu vào

Với 2 USD đầu vào và 10 USD đầu ra, một phản hồi có giá trị bằng năm token đầu vào trên mỗi token đầu ra. Các câu trả lời dài dòng, nhiều lời thoại là nơi mà các hóa đơn nhỏ trở nên lớn. Yêu cầu định dạng bạn muốn, giới hạn phản hồi khi tác vụ cho phép, và ưu tiên đầu ra có cấu trúc hơn là văn xuôi khi máy móc đang đọc kết quả.

Một số dư tín dụng nhỏ thực sự có thể mua được gì

Đây là phép tính, được thực hiện dựa trên các mức giá trên chứ không phải bất kỳ thông tin nào OpenAI đã in. Hãy lấy một bước tác tử thông thường: một lời nhắc 40.000 token và một hoàn thành 2.000 token.

Cấu hình Chi phí mỗi cuộc gọi Số cuộc gọi cho 5 USD tín dụng
GPT-6 Sol, không có truy cập bộ nhớ đệm 0,100 USD 50
GPT-6 Sol, 32k lời nhắc được lưu vào bộ nhớ đệm 0,042 USD 118
GPT-6 Luna, không có truy cập bộ nhớ đệm 0,005 USD 1.000
GPT-6 Luna, 32k lời nhắc được lưu vào bộ nhớ đệm 0,0021 USD 2.358

Dòng Sol được lưu vào bộ nhớ đệm là 32.000 token với giá 0,20 USD trên mỗi triệu token cộng 8.000 token với giá 2,00 USD cộng 2.000 token đầu ra với giá 10,00 USD. Việc lưu vào bộ nhớ đệm giúp tăng hơn gấp đôi những gì một số dư cố định có thể mua được, và chuyển cùng một khối lượng công việc sang Luna sẽ nhân lên gấp hai mươi lần.

Đối với công việc của tác tử, đơn vị lại khác. Sol ở nỗ lực cực cao có giá 0,27 USD cho mỗi tác vụ trên bộ công cụ AutomationBench của OpenAI, vì vậy số dư 5 USD chỉ đủ cho khoảng mười tám tác vụ dạng đó trước khi hết. Điều đó đủ để đo lường và hoàn toàn không đủ để vận hành, đây chính xác là ý nghĩa của một số dư dùng thử.

Để hình dung về quy mô, OpenAI tiết lộ rằng nhà nghiên cứu nội bộ trung bình của họ chi hơn 600 USD mỗi ngày cho các tác tử mã hóa, với mức phần trăm thứ 90 là 7.000 USD mỗi ngày. Các mức giá này được thiết kế cho mô hình đó, chứ không phải cho một cấp miễn phí.

Con đường rẻ không phải là con đường nhanh

Một sự đánh đổi nằm ẩn dưới tất cả những điều này. Artificial Analysis, một bên thứ ba chứ không phải nhà cung cấp, đo biến thể suy luận tối đa của GPT-6 Sol ở mức 115,2 token đầu ra mỗi giây với thời gian cho token đầu tiên là 102,15 giây, và biến thể tối đa của Luna ở mức 153,9 token mỗi giây với 124,23 giây cho token đầu tiên. [XÁC MINH] Nỗ lực cao đồng nghĩa với một khoảng dừng im lặng dài trước khi có bất kỳ điều gì đến. Nếu người dùng đang chờ đợi, hoặc nếu một thứ gì đó ở hạ nguồn có thời gian chờ, hãy giảm mức độ nỗ lực hoặc chọn một cấp khác. Chúng tôi phân tích điều đó chi tiết hơn trong bài Độ trễ của GPT-6 Sol.

Đo lường trước khi lên ngân sách

Các bảng chi phí của nhà cung cấp được đo trên các công cụ của nhà cung cấp dựa trên khối lượng công việc của nhà cung cấp, và của bạn sẽ khác. Bốn kiểm tra đáng để chạy trước khi bất kỳ điều này trở thành một con số trong bảng tính:

  1. Gửi các lời nhắc sản xuất thực tế và đọc usage từ phản hồi thay vì ước tính từ số lượng ký tự.
  2. Chạy cùng một lời nhắc với gpt-6-solgpt-6-luna và so sánh chi phí cho mỗi tác vụ hoàn thành, chứ không phải mỗi cuộc gọi. Dòng Luna ở trên chỉ là một khoản tiết kiệm nếu câu trả lời đủ tốt.
  3. Chạy hai mức độ nỗ lực và ghi lại token và thời gian thực tế cho cả hai.
  4. Đo riêng các trường hợp được lưu vào bộ nhớ đệm và không được lưu vào bộ nhớ đệm. Mức giảm giá 90% cho nửa sai của một lời nhắc có rất ít giá trị.

Đó là thử nghiệm yêu cầu HTTP thông thường. Xây dựng các cuộc gọi, lưu các biến thể Sol và Luna dưới dạng các yêu cầu riêng biệt, xác nhận hình dạng phản hồi và theo dõi thời gian trong Apidog thay vì trong một script tạm thời mà bạn sẽ vứt bỏ. Được giữ dưới dạng một bộ sưu tập đã lưu, việc so sánh sẽ tự chạy lại vào lần tới khi giá thay đổi, điều mà theo bằng chứng hiện tại sẽ sớm xảy ra.

Phiên bản tóm tắt

GPT-6 Sol không miễn phí, và không bài viết trung thực nào có thể nói điều ngược lại. Các tài khoản Free và Go có GPT-6 Luna trong ứng dụng dành cho máy tính để bàn, đây là câu trả lời thực sự cho hầu hết những người đến đây tìm kiếm một giải pháp. Tín dụng dùng thử và khuyến mãi đám mây sẽ giúp bạn đo lường, chứ không phải sản xuất. Và nếu bạn đang trả phí, mức giảm giá 90% cho việc đọc từ bộ nhớ đệm và mức độ nỗ lực được chọn đúng sẽ giúp bạn tiết kiệm hóa đơn nhiều hơn so với mức giảm giá khi ra mắt.

Vị trí của điều này trong một tuần cũng chứng kiến Claude Opus 5.5 được đề cập trong bài cuộc chiến giá mô hình tháng 9 năm 2026, và bảng phân tích giá đầy đủ có trong bài Giá GPT-6 Sol.

Thực hành thiết kế API trong Apidog

Khám phá cách dễ dàng hơn để xây dựng và sử dụng API