OpenAI Giảm Sốc Giá API GPT-5.6: Luna Rẻ Hơn 80%, Terra Rẻ Hơn 20% (Chi Tiết Bảng Giá Mới)

OpenAI đã giảm giá API GPT-5.6 vào ngày 30 tháng 7 năm 2026: Luna giảm 80% xuống còn 0,20 đô la / 1,20 đô la cho mỗi triệu token, Terra giảm 20% xuống còn 2 đô la / 12 đô la. Bảng giá đầy đủ cũ so với mới, lý do OpenAI giảm giá và cách định tuyến lại khối lượng công việc của bạn.

Ashley Innocent

Ashley Innocent

31 tháng 7 2026

OpenAI Giảm Sốc Giá API GPT-5.6: Luna Rẻ Hơn 80%, Terra Rẻ Hơn 20% (Chi Tiết Bảng Giá Mới)

Apidog cho doanh nghiệp

Triển khai tại chỗ

SSO & RBAC

Tuân thủ SOC 2

Khám phá Apidog Enterprise

OpenAI đã giảm giá API trên hai trong ba mô hình GPT-5.6 của mình vào ngày 30 tháng 7 năm 2026. GPT-5.6 Luna hiện có giá thấp hơn 80%: 0,20 đô la cho mỗi triệu token đầu vào và 1,20 đô la cho mỗi triệu token đầu ra. GPT-5.6 Terra giảm 20% xuống còn 2 đô la đầu vào và 12 đô la đầu ra. GPT-5.6 Sol, mô hình suy luận hàng đầu, duy trì mức giá 5 đô la và 30 đô la nhưng có thêm chế độ Fast mới chạy nhanh hơn 2,5 lần với giá gấp đôi mức tiêu chuẩn.

Nếu bạn xây dựng mô hình chi phí của mình dựa trên giá GPT-5.6 vào ngày ra mắt, thì các tính toán đó giờ đã lỗi thời. Bài đăng này sẽ đề cập đến bảng giá mới, lý do OpenAI giảm giá, cách các con số này so sánh với gói Gemini Flash của Google và những thay đổi cần thực hiện trong việc định tuyến API của bạn trong tuần này. Và vì cách nhanh nhất để so sánh chi phí mô hình là kiểm tra cùng một yêu cầu với từng gói, các công cụ như Apidog giúp bạn dễ dàng gửi một lời nhắc qua Sol, Terra và Luna song song để đo lường mức tiêu thụ token trước khi bạn cam kết.

Tải ứng dụng

Bảng giá GPT-5.6 mới

Dưới đây là bảng so sánh đầy đủ trước và sau, tính trên mỗi triệu token:

Mô hình Đầu vào cũ Đầu vào mới Đầu ra cũ Đầu ra mới Thay đổi
GPT-5.6 Sol $5.00 $5.00 $30.00 $30.00 Không thay đổi
GPT-5.6 Terra $2.50 $2.00 $15.00 $12.00 -20%
GPT-5.6 Luna $1.00 $0.20 $6.00 $1.20 -80%

Giá mới có hiệu lực từ ngày 30 tháng 7 năm 2026 và áp dụng cho gói API tiêu chuẩn. Khoảng cách giá giữa mô hình cao cấp nhất và thấp nhất trong dòng sản phẩm đã tăng từ 5 lần vào ngày 9 tháng 7 (khi ra mắt rộng rãi) lên 25 lần hiện nay. Khoảng cách đó thay đổi quyết định định tuyến. Ba tuần trước, gửi một tác vụ cho Luna thay vì Sol đã giúp bạn tiết kiệm 80% hóa đơn. Giờ đây, bạn tiết kiệm được 96%.

Các ưu đãi giảm giá bộ nhớ đệm lời nhắc vẫn được áp dụng ngoài các mức giá này. OpenAI chưa công bố giá đầu vào được lưu trong bộ nhớ đệm riêng cho các mức giá mới của Luna và Terra trong thông báo, vì vậy hãy kiểm tra trang giá chính thức trước khi bạn cập nhật dự báo thanh toán phụ thuộc vào việc đọc bộ nhớ đệm.

Điều gì đã xảy ra với Sol

Giá niêm yết của Sol không thay đổi, nhưng các tùy chọn tốc độ của nó đã thay đổi. OpenAI đã giới thiệu chế độ Fast cho Sol: tạo token nhanh hơn 2,5 lần với mức giá gấp đôi tiêu chuẩn. Chế độ Fast thay thế gói Xử lý ưu tiên trước đây, vì vậy nếu lưu lượng truy cập sản xuất của bạn hiện đang chạy trên Xử lý ưu tiên, bạn cần di chuyển cấu hình đó và kiểm tra lại dòng hóa đơn mà nó thuộc về.

Hiểu theo thực tế: OpenAI đang phân khúc Sol theo độ trễ thay vì giảm giá. Các nhóm cần khả năng suy luận hàng đầu với tốc độ tương tác sẽ phải trả thêm phí cho nó. Những người khác sẽ định tuyến xuống các mô hình cấp thấp hơn, đó chính xác là nơi mà việc giảm giá thúc đẩy bạn.

Tại sao OpenAI giảm giá

OpenAI coi việc cắt giảm giá là kết quả của việc đạt được hiệu quả cao hơn chứ không phải là một động thái "đánh bóng thương hiệu" để thu hút khách hàng. Thông báo đề cập đến bốn đòn bẩy:

Điểm cuối cùng đó là chi tiết đáng nhớ. OpenAI cho biết Sol đã tự động viết lại các nhân phục vụ (serving kernels), cắt giảm chi phí phục vụ từ đầu đến cuối 20% và cải thiện hiệu quả tạo token hơn 15%. “Làm cho trí tuệ tiên tiến trở nên phong phú và dễ tiếp cận hơn là trọng tâm sứ mệnh của OpenAI,” công ty cho biết trong thông báo. Bất kể bạn nghĩ gì về mục tiêu sứ mệnh, cơ chế này là cụ thể: mô hình giờ đây đủ rẻ để phục vụ đến mức OpenAI có thể giảm giá Luna 80% và vẫn bảo vệ được biên lợi nhuận.

Ngoài ra còn có một động lực cạnh tranh rõ ràng. Báo cáo của VentureBeat coi việc cắt giảm này là một phản ứng trực tiếp đối với gói Flash của Google. Giá niêm yết kết hợp của Luna (đầu vào cộng đầu ra) hiện là 1,40 đô la cho mỗi triệu token, thấp hơn cả Gemini 3.5 Flash-Lite với 2,80 đô la và Gemini 3.6 Flash với 9 đô la. Phân khúc giá rẻ là nơi có nhiều khách hàng nhất, và OpenAI muốn giành lại thị phần đó.

Việc giảm giá có ý nghĩa gì đối với khối lượng công việc của bạn

Việc cắt giảm 80% của Luna là yếu tố thay đổi các quyết định kiến trúc, chứ không phải việc giảm 20% của Terra. Một vài thay đổi cụ thể:

Cách kiểm tra lại các số liệu của bạn

Đừng tin vào các phần trăm một cách mù quáng; hãy đo lường lưu lượng truy cập thực tế của bạn. Quy trình làm việc giúp phát hiện bất ngờ sớm:

  1. Lấy một mẫu đại diện của các lời nhắc sản xuất.
  2. Gửi cùng một yêu cầu tới gpt-5.6-luna, gpt-5.6-terra và gpt-5.6-sol và ghi lại số lượng token trên mỗi phản hồi.
  3. Nhân với mức giá mới và so sánh với chất lượng trên bộ đánh giá của riêng bạn.

Apidog giúp bước 2 nhanh chóng: định nghĩa một lần điểm cuối hoàn thành cuộc trò chuyện, chuyển đổi ID mô hình bằng biến môi trường và chạy cùng một kịch bản kiểm tra trên cả ba gói. Trình xem phản hồi hiển thị khối usage cho mỗi cuộc gọi, vì vậy bạn nhận được số lượng token đầu vào và đầu ra thực tế thay vì ước tính. Nếu bạn đang tích hợp GPT-5.6 vào một ứng dụng lần đầu tiên, hướng dẫn của chúng tôi về cách sử dụng API GPT-5.6 sẽ hướng dẫn bạn qua xác thực, ID mô hình và cấu trúc yêu cầu. Bạn cũng có thể mô phỏng điểm cuối trong khi chờ phê duyệt ngân sách, sau đó chuyển sang lưu lượng truy cập trực tiếp mà không cần viết lại các bài kiểm tra. Tải Apidog miễn phí để chạy so sánh.

Bức tranh lớn hơn: cuộc chiến giá cả đang diễn ra

Đây là động thái giảm giá lớn thứ ba ở phân khúc giá rẻ trong mùa hè này. Google đã làm mới gói Flash của mình vào tháng 7, Anthropic đã ra mắt Claude Opus 5 với giá bằng một nửa so với Fable 5, và giờ đây OpenAI đã giảm giá Luna thấp hơn cả hai lựa chọn Gemini Flash. Chất lượng mô hình vẫn là yếu tố phân biệt các sản phẩm hàng đầu, nhưng gói làm việc đang hội tụ theo một quy tắc đơn giản: ai rẻ nhất tháng này sẽ thắng các công việc xử lý theo lô.

Đối với các nhóm API, điều đó có nghĩa là lựa chọn mô hình không còn là quyết định hàng năm nữa. Xây dựng tích hợp của bạn sao cho ID mô hình là một giá trị cấu hình, duy trì một bộ đánh giá tiêu chuẩn và chạy lại so sánh chi phí bất cứ khi nào một nhà cung cấp thay đổi. Các nhóm coi định tuyến mô hình là một phần của cơ sở hạ tầng, với các bài kiểm tra và giám sát xung quanh nó, sẽ tận dụng được mỗi lần giảm giá trong vòng vài ngày thay vì hàng quý.

Câu hỏi thường gặp

Giá API GPT-5.6 mới là bao nhiêu?

Tính đến ngày 30 tháng 7 năm 2026: Luna có giá 0,20 đô la cho mỗi triệu token đầu vào và 1,20 đô la cho mỗi triệu token đầu ra; Terra có giá 2 đô la và 12 đô la; Sol không thay đổi ở mức 5 đô la và 30 đô la. Sol cũng có thêm chế độ Fast với giá gấp đôi mức tiêu chuẩn để xử lý nhanh hơn 2,5 lần.

GPT-5.6 Sol có được giảm giá không?

Không. Mức giá tiêu chuẩn của Sol không thay đổi. Những thay đổi đối với Sol mang tính cấu trúc: một chế độ Fast mới thay thế gói Xử lý ưu tiên, đánh đổi mức giá gấp đôi để đạt tốc độ nhanh hơn 2,5 lần.

GPT-5.6 Luna giờ có rẻ hơn Gemini Flash không?

Về giá niêm yết, có. Mức giá kết hợp đầu vào cộng đầu ra của Luna là 1,40 đô la cho mỗi triệu token so với 2,80 đô la cho Gemini 3.5 Flash-Lite và 9 đô la cho Gemini 3.6 Flash. Tuy nhiên, giá cả không phải là chất lượng: hãy chạy cả hai trên bộ đánh giá của riêng bạn trước khi chuyển đổi. Nếu bạn muốn thử cách miễn phí trước, hãy xem cách sử dụng GPT-5.6 miễn phí.

Việc giảm giá có tự động áp dụng không?

Có. Mức giá mới áp dụng cho việc sử dụng API tiêu chuẩn từ ngày 30 tháng 7 năm 2026 mà không yêu cầu thay đổi mã nào. Bạn chỉ cần hành động nếu bạn đang sử dụng Xử lý ưu tiên trên Sol, gói này đang được thay thế bằng chế độ Fast.

Những việc cần làm trong tuần này

Bảng giá mới thưởng cho các nhóm hành động nhanh chóng. Chạy lại mô hình chi phí của bạn với các con số mới, đánh giá lại những khối lượng công việc nào Luna có thể đảm nhận với giá thấp hơn 96% so với Sol, và kiểm tra xem việc giảm 20% của Terra có thay đổi ngưỡng định tuyến nào không. Sau đó xác minh bằng lưu lượng truy cập thực tế thay vì tính toán giá niêm yết: một kịch bản kiểm tra trong Apidog, ba ID mô hình và các con số sử dụng sẽ cho bạn biết chính xác giá trị của việc giảm giá này đối với bạn.

Tải ứng dụng

Thực hành thiết kế API trong Apidog

Khám phá cách dễ dàng hơn để xây dựng và sử dụng API