OpenAI đã đưa GPT-5.6 ra thị trường rộng rãi vào ngày 9 tháng 7 năm 2026, và quyết định đầu tiên nó đặt ra không liên quan gì đến việc có nên nâng cấp hay không. Đó là một lựa chọn trong menu. Bản phát hành đi kèm với ba mô hình: gpt-5.6-sol, gpt-5.6-terra và gpt-5.6-luna, nằm ở ba điểm khác nhau trên đường cong chi phí-khả năng. Chọn quá cao, bạn sẽ phải trả giá của Sol cho những công việc mà Terra có thể xử lý tốt. Chọn quá thấp, tác nhân của bạn sẽ bị kẹt với những nhiệm vụ mà Luna không được thiết kế để làm.
Các tên gọi này tuân theo một hệ thống: số đánh dấu thế hệ, trong khi Sol, Terra và Luna là các cấp độ bền vững phát triển theo nhịp điệu riêng của chúng. Bài giải thích cách đặt tên GPT-5.6 của chúng tôi đi sâu vào cấu trúc đó, vì vậy hướng dẫn này sẽ bỏ qua phần lịch sử. Những gì bạn sẽ tìm thấy ở đây là quyết định mua hàng: mỗi cấp độ làm tốt điều gì, cạm bẫy giá ẩn ở đâu và cách giải quyết lựa chọn bằng các lời nhắc của riêng bạn thay vì dựa vào biểu đồ ngày ra mắt.
Trả lời nhanh trong 30 giây
| Mô hình | Giá trên 1 triệu token | Chọn khi |
|---|---|---|
gpt-5.6-sol |
5 USD đầu vào / 30 USD đầu ra | Nhiệm vụ thực sự khó: lập trình tác nhân, điều phối công cụ đa bước, nghiên cứu sâu |
gpt-5.6-terra |
2.50 USD đầu vào / 15 USD đầu ra | Hầu hết các công việc khác. Mặc định cho công việc sản xuất |
gpt-5.6-luna |
1 USD đầu vào / 6 USD đầu ra | Khi khối lượng và độ trễ là yếu tố then chốt: phân loại, trích xuất, định tuyến, bản nháp sơ bộ |
Terra là lựa chọn mặc định hợp lý. OpenAI định vị nó cạnh tranh với GPT-5.5 với mức giá chỉ bằng khoảng một nửa, điều này có nghĩa là lớp mô hình mà hầu hết các ứng dụng sản xuất đã chạy vào tháng trước giờ đây có chi phí chỉ bằng một nửa. Sol chỉ xứng đáng với mức giá cao cấp của nó khi nhiệm vụ đủ khó để tạo ra một khoảng cách đáng kể. Luna thắng thế bất cứ khi nào bạn nhân giá mỗi token với hàng triệu yêu cầu.
Nếu bạn muốn thử nghiệm hơn là tin tưởng, đó là một bản năng tốt. Cả ba mô hình đều chấp nhận các lệnh gọi API Phản hồi giống nhau, vì vậy bạn có thể chạy một bộ lời nhắc đối với mỗi cấp độ trong Apidog và để các kết quả đầu ra giải quyết tranh cãi. Thiết lập này mất mười phút; chi tiết hơn sẽ được trình bày bên dưới.
Mỗi cấp độ được xây dựng cho điều gì
Cả ba mô hình đều đã có sẵn trong API cho bất kỳ tài khoản nào. Quyền truy cập là tự phục vụ mà không bị giới hạn gói, và các ID mô hình ở trên lấy trực tiếp từ tài liệu dành cho nhà phát triển của OpenAI. Các tài liệu ban đầu báo cáo cửa sổ ngữ cảnh 1 triệu token, đầu ra tối đa 128K và ngày cắt kiến thức là 16 tháng 2 năm 2026 cho toàn bộ dòng sản phẩm; hãy coi những số liệu đó là báo cáo cho đến khi trang mô hình của OpenAI xác nhận chúng cho tài khoản của bạn.
Sol: mô hình chủ lực cho các vấn đề khó
Sol là cấp độ suy luận sâu, và các điểm chuẩn khi ra mắt tập trung vào những cải tiến chính xác ở những nơi bạn mong đợi: các công việc tác nhân có tầm nhìn dài. Theo OpenAI, Sol đạt khoảng 53 điểm trong Bài kiểm tra cuối cùng của Agent so với 46.9 của GPT-5.5, đạt 88.8% trên Terminal-Bench 2.1 và nhảy từ 47.5 lên 62.6 trên OSWorld 2.0. Đó là những tuyên bố vào ngày ra mắt, vì vậy hãy xem xét chúng một cách thận trọng. Nhưng mô hình này rất nhất quán: lập kế hoạch, sử dụng công cụ và phục hồi lỗi được cải thiện nhiều hơn đáng kể so với chất lượng văn bản thông thường.

Đây không phải là một thắng lợi hoàn toàn. Trên SWE-Bench Pro, Claude Fable 5 dẫn đầu với 80.3% so với 64.6% của Sol, vì vậy "mô hình chủ lực" không có nghĩa là "tốt nhất ở mọi thứ". Chúng tôi phân tích chi tiết nơi các con số thể hiện điểm mạnh và điểm yếu nhất trong phân tích điểm chuẩn GPT-5.6 Sol của chúng tôi.
Terra: mặc định cho công việc sản xuất
Lời chào hàng của Terra mang tính kinh tế hơn là anh hùng. OpenAI định vị nó cạnh tranh với GPT-5.5 với mức giá rẻ hơn khoảng 2 lần, và cách định vị này tự nó quyết định hầu hết các khối lượng công việc thực tế. Nếu sản phẩm của bạn chạy tốt trên GPT-5.5, Terra mang đến cho bạn cùng loại khả năng với một nửa chi phí. Trợ lý trò chuyện, tóm tắt, quy trình nội dung, hầu hết các thiết lập RAG: đây là cấp độ để bắt đầu, và là cấp độ mà bạn sẽ phải tranh luận để không chọn nó.
Luna: kinh tế đơn vị và tốc độ
Luna xử lý các công việc mà không ai đọc phần suy luận: phân loại, trích xuất thực thể, định tuyến yêu cầu, các bản nháp sơ bộ mà con người hoặc một mô hình lớn hơn sẽ chỉnh sửa lại. Với 1 USD đầu vào / 6 USD đầu ra, nó có chi phí bằng một phần năm của Sol ở cả hai chiều đo, và nó là mô hình nhanh nhất trong ba mô hình. Sai lầm phổ biến là do cảm tính, không phải kỹ thuật: các đội bỏ qua Luna vì "rẻ nhất" nghe có vẻ như "tệ nhất", sau đó trả giá của Terra cho các nhiệm vụ có đầu ra chỉ một từ.
Cạm bẫy trong cài đặt mặc định
Đây là chi tiết âm thầm làm tăng hóa đơn: bí danh trần gpt-5.6 sẽ dẫn đến Sol. Chọn chuỗi mô hình hiển nhiên và bạn đã chọn cấp độ đắt nhất mà không hề hay biết.
Chỉ định rõ ràng cấp độ trong mỗi lệnh gọi:
{
"model": "gpt-5.6-terra",
"input": "Phân loại phiếu hỗ trợ này theo mức độ khẩn cấp và lĩnh vực sản phẩm.",
"reasoning": { "effort": "medium" }
}
Sự khác biệt này tăng lên nhanh chóng. Một dịch vụ xử lý 50 triệu token đầu vào và 10 triệu token đầu ra mỗi tháng sẽ trả khoảng 275 USD trên Terra, 550 USD trên Sol và 110 USD trên Luna. Cùng một lượng truy cập, nhưng có sự chênh lệch gấp 5 lần, chỉ được quyết định bởi một chuỗi ký tự. Để xem bảng giá đầy đủ, bao gồm cả chiết khấu bộ nhớ đệm, hãy xem phân tích giá GPT-5.6 của chúng tôi. Bài viết ra mắt của Simon Willison cũng đáng để bạn dành thời gian đọc như là đánh giá ban đầu của một nhà phát triển độc lập về bản phát hành này.
Ghép mô hình với khối lượng công việc của bạn
Ba kịch bản sau đây bao quát hầu hết các không gian quyết định.
Một quy trình lập trình tác nhân. Chọn Sol. Các cải tiến điểm chuẩn nằm ở đây, và các tính năng GA cũng vậy: gọi công cụ theo chương trình cho phép mô hình viết JavaScript để điều phối các lệnh gọi công cụ của bạn, được thực thi trong môi trường chạy V8 bị cô lập không có truy cập mạng, và khả năng suy luận bền vững duy trì ngữ cảnh qua các lượt. Khi một lần chạy mất 40 bước và một quyết định sai ở bước 12 làm lãng phí 28 bước tiếp theo, chất lượng mô hình là hạng mục chi phí rẻ nhất trong quy trình. Hồ sơ Sol đầy đủ bao gồm những thay đổi khác của mô hình chủ lực này.
Một trợ lý trò chuyện sản xuất. Chọn Terra. Người dùng đánh giá độ trễ và sự hữu ích, chứ không phải sự khác biệt về điểm chuẩn, và đối với các câu hỏi thông thường, họ không thể phân biệt Sol với Terra. Chuyển các truy vấn khó hiếm gặp đến Sol bằng một heuristic nếu nhật ký của bạn chứng minh bạn cần nó; đừng trả mức giá cao cấp cho câu hỏi "làm thế nào để tôi đặt lại mật khẩu".
Một quy trình tài liệu khối lượng lớn. Chọn Luna, sau đó thêm bộ nhớ đệm lên trên. GPT-5.6 hỗ trợ các điểm ngắt bộ nhớ đệm rõ ràng (prompt_cache_options.mode: "explicit" với trường ttl); đọc từ bộ nhớ đệm giữ mức giảm giá 90%, ghi vào bộ nhớ đệm tính phí 1.25 lần tỷ lệ đầu vào, và nội dung được lưu trữ ít nhất 30 phút. Đối với các công việc trích xuất sử dụng lại một lời nhắc hệ thống dài trên hàng nghìn tài liệu, Luna cộng với bộ nhớ đệm rõ ràng thuộc một nhóm chi phí khác so với hai mô hình còn lại. Các cài đặt chi tiết tầm nhìn mới (original và auto) cũng bảo toàn kích thước hình ảnh nguồn, điều này quan trọng khi bạn trích xuất các trường từ các bản quét.
Mức độ nỗ lực thay đổi bài toán
Cấp độ chỉ là một nửa của vấn đề. GPT-5.6 cung cấp sáu cấp độ nỗ lực suy luận trên mỗi cấp độ: none, low, medium, high, xhigh và max. Điều đó biến ba mô hình thành một lưới, và so sánh ô thú vị nhất không phải là Sol với Terra ở cùng một cài đặt. Mà là Terra ở mức high so với Sol ở mức medium. Terra với nhiều thời gian suy nghĩ hơn có thể thu hẹp đáng kể khoảng cách chất lượng với một nửa giá token, và liệu nó có đủ để đáp ứng các tác vụ của bạn hay không là một câu hỏi thực nghiệm, chứ không phải là một câu hỏi trên bảng thông số kỹ thuật.
Hướng dẫn di chuyển của OpenAI cũng chỉ ra điều tương tự: hãy coi việc chuyển đổi như một lần điều chỉnh, chứ không phải là một thay đổi mô hình. Trước tiên, hãy đánh giá các tác vụ đại diện, và kiểm tra mức độ nỗ lực hiện tại của bạn cùng với một mức thấp hơn. Một lưu ý khác về lời nhắc từ tài liệu: GPT-5.6 viết các câu trả lời ngắn gọn hơn đáng kể với ít lời giới thiệu chung chung, vì vậy hãy loại bỏ cụm từ "hãy súc tích" khỏi các lời nhắc bạn sử dụng lại, nếu không bạn sẽ nhận được câu trả lời quá ngắn gọn đến mức vô ích.
Đối với các công việc ưu tiên chất lượng, nơi bạn muốn chờ đợi hơn là chạy lại, chế độ chuyên nghiệp (reasoning.mode: "pro") có sẵn trên cả ba mô hình. Đây là một cài đặt, không phải là một mô hình riêng biệt, vì vậy bạn có thể bật nó trên Terra dễ dàng như trên Sol.
Kiểm tra cả ba trước khi cam kết
Câu trả lời trung thực cho câu hỏi "bạn nên sử dụng mô hình nào" là: mô hình nào hoạt động tốt nhất với các lời nhắc của bạn. Các điểm chuẩn là tác vụ của OpenAI; lưu lượng truy cập sản xuất của bạn thì không.

Việc chạy thử nghiệm này rất rẻ. Thu thập 10 đến 20 tác vụ thực tế từ nhật ký của bạn, bao gồm cả những tác vụ phức tạp. Tải xuống Apidog, lưu URL cơ sở OpenAI và khóa API một lần, sau đó đặt ID mô hình vào một biến môi trường để một định nghĩa yêu cầu có thể bao phủ cả ba cấp độ. Chuyển đổi {{model}} giữa gpt-5.6-sol, gpt-5.6-terra và gpt-5.6-luna, chạy cùng một bộ lời nhắc, và so sánh hai điều song song: chất lượng đầu ra so với tiêu chuẩn của bạn, và số lượng token usage trong mỗi phản hồi. Nhân các số lượng đó với bảng giá và bảng chi phí cho mỗi tác vụ sẽ tự động được tạo ra.
Hai phát hiện xuất hiện trong hầu hết các cuộc thử nghiệm này. Terra phù hợp với Sol trên một tỷ lệ tác vụ lớn hơn so với khoảng cách giá ngụ ý. Và Luna vẫn xử lý tốt các công việc đầu ra có cấu trúc, như phân loại và trích xuất, thường xuyên hơn nhiều so với mức giá của nó. Bạn chỉ có thể biết khối lượng công việc của mình phá vỡ mô hình đó ở đâu bằng cách tự chạy thử nghiệm.
Vị trí của Ultra
Ultra là tùy chọn duy nhất trong dòng sản phẩm này không phải là ID mô hình API. Đó là một cài đặt đa tác nhân chạy bốn tác nhân song song theo mặc định, cố tình tiêu tốn nhiều token hơn để đổi lấy kết quả thời gian thực nhanh hơn cho các vấn đề khó. Theo OpenAI, Ultra nâng điểm Terminal-Bench 2.1 của Sol từ 88.8% lên 91.9%.
Khả năng truy cập bị giới hạn bởi gói ở phía sản phẩm: Ultra có mặt trong ChatGPT Work trên các gói Pro và Enterprise, và trong Codex từ gói Plus trở lên. Sản phẩm trò chuyện có bản đồ cấp độ riêng, theo trung tâm trợ giúp của OpenAI:
| Gói ChatGPT | Truy cập GPT-5.6 |
|---|---|
| Miễn phí / Go | Terra |
| Plus | Sol, Terra, và Luna với kiểm soát nỗ lực theo từng mô hình (Sol từ mức nỗ lực trung bình trở lên) |
| Pro / Doanh nghiệp / Enterprise | Tất cả các gói trên, cộng với Sol Pro |
| ChatGPT Work (Pro / Enterprise), Codex (Plus trở lên) | Ultra |
Nếu khối lượng công việc tác nhân song song của bạn nằm trong mã chứ không phải trò chuyện, hãy theo dõi phiên bản beta đa tác nhân trong API Phản hồi; đó là phiên bản API của cùng một ý tưởng.
Câu hỏi thường gặp
GPT-5.6 Terra có đủ tốt để thay thế GPT-5.5 trong môi trường sản xuất không?
Đối với hầu hết các khối lượng công việc, có. OpenAI định vị Terra cạnh tranh với GPT-5.5 với mức giá chỉ bằng khoảng một nửa, và cùng giao diện API Phản hồi có nghĩa là việc chuyển đổi có rủi ro thấp. Hãy chạy các đánh giá của bạn trước khi chuyển đổi, và chú ý đến độ dài đầu ra, vì các câu trả lời của GPT-5.6 được thiết kế ngắn gọn hơn.
Điều gì xảy ra nếu tôi gọi bí danh trần gpt-5.6?
Yêu cầu của bạn sẽ được chuyển đến Sol và tính phí theo mức của Sol, 5 USD cho 1 triệu token đầu vào và 30 USD cho 1 triệu token đầu ra. Không có gì bị lỗi, đó mới là vấn đề; chi phí sẽ xuất hiện sau trên hóa đơn. Hãy chỉ định rõ ràng gpt-5.6-terra hoặc gpt-5.6-luna ở bất cứ đâu một cấp độ rẻ hơn có thể thực hiện công việc.
Tôi có thể chuyển đổi cấp độ mà không cần thay đổi tích hợp không?
Có. Sol, Terra và Luna chia sẻ cùng một giao diện API Phản hồi, vì vậy việc chuyển đổi giữa chúng chỉ là một thay đổi chuỗi mô hình một dòng. Các mức độ nỗ lực và chế độ chuyên nghiệp cũng hoạt động trên cả ba. Hướng dẫn của chúng tôi về cách sử dụng API GPT-5.6 sẽ hướng dẫn bạn qua hình dạng yêu cầu từ đầu đến cuối.
Tôi có cần gói ChatGPT cụ thể để sử dụng các mô hình này trong API không?
Không. Quyền truy cập API là tự phục vụ cho bất kỳ tài khoản API nào, không có giới hạn gói đối với bất kỳ mô hình nào trong số ba mô hình. Các cấp độ gói ChatGPT chỉ kiểm soát sản phẩm trò chuyện, và Ultra là khả năng duy nhất nằm ở phía sản phẩm (ChatGPT Work và Codex) chứ không phải được cung cấp dưới dạng mô hình API.
Một giờ đầu tiên của bạn với các cấp độ
Bắt đầu với Terra và để các cấp độ khác tự chứng minh bản thân. Chỉ nâng cấp lên Sol khi các đánh giá của bạn cho thấy một khoảng cách đáng để trả gấp đôi, điều này thường có nghĩa là công việc tác nhân và có tầm nhìn dài. Giảm xuống Luna ở những nơi đầu ra ngắn và khối lượng cao. Chỉ định rõ ràng các ID mô hình ở khắp mọi nơi để bí danh Sol-mặc định không bao giờ lựa chọn thay bạn, và điều chỉnh mức độ nỗ lực trước khi bạn thay đổi cấp độ, bởi vì Terra ở mức high là bản nâng cấp chất lượng rẻ nhất trong dòng sản phẩm.
Sau đó, ngừng đọc và đo lường. Tải mười lời nhắc sản xuất khó nhất của bạn vào Apidog, hướng một yêu cầu đến cả ba ID mô hình bằng một biến môi trường, và để số lượng token và đầu ra của riêng bạn đưa ra quyết định. Toàn bộ bài tập này tốn chưa đến một đô la chi phí API và giải quyết một quyết định có thể tăng lên mỗi tháng.
