OpenAI는 2026년 9월 22일 GPT-6 Sol을 출시했으며, 금융권 엔지니어라면 누구나 주목할 만한 헤드라인을 내걸었습니다: "50% 저렴해졌습니다." 정확히 무엇보다 저렴하다는 것인지가 당신의 마이그레이션 스프레드시트가 맞는지 아니면 3분의 1이나 틀렸는지를 결정하는 부분입니다.
그 답은 OpenAI 자체의 문구에 있습니다. Sol은 GPT-5.6 프로모션 가격보다 50% 저렴합니다. 정가(목록 가격)가 아닙니다. 그 단 하나의 형용사가 기준선을 바꾸며, GPT-5.6 출시 당시 저희가 기록했던 정가 기준으로 다시 바꾸면 할인율은 헤드라인보다 작지 않고 오히려 더 큰 것으로 드러납니다. 이 두 가지 사실이 동시에 존재하기 때문에 이 문장은 두 번 읽을 가치가 있습니다.
그 아래에는 두 번째로 더 유용한 정정 사항이 있습니다. 토큰당 가격은 공급업체가 헤드라인으로 내세우고 송장에서 확인할 수 있는 부분입니다. 여기서 가장 크게 변한 것은 아닙니다. 솔(Sol)은 더 높은 추론 노력으로 더 적은 토큰으로 작업을 완료하기 때문에 완료된 작업당 비용이 더 크게 변했습니다. 이 글은 두 단위 모두를 나란히 비교합니다. 이틀 만에 세 가지 최첨단 기술이 출시된 더 넓은 맥락을 보려면 2026년 9월 모델 가격 전쟁을 참조하십시오.
GPT-6 Sol 가격 한눈에 보기
| 항목 | 값 |
|---|---|
| API 모델 ID | gpt-6-sol |
| 입력 | 1백만 토큰당 $2 |
| 출력 | 1백만 토큰당 $10 |
| 캐시된 입력 읽기 | 90% 할인 |
| 컨텍스트 윈도우 | 872,000 토큰 |
| 가용성 | ChatGPT Work 및 Plus, Pro, Business, Enterprise, Edu용 Codex |
| 아직 제공되지 않는 곳 | 채팅 |
2달러 입력 요금에 90% 할인을 적용하면 캐시된 입력 토큰 1백만 개당 0.20달러가 됩니다. 이는 OpenAI가 명시한 할인율에 대한 우리의 계산이며, 별도로 게시된 요율이 아닌 에이전트 루프에 가장 중요한 숫자입니다.
50% 할인은 프로모션 요율을 기준으로 측정됩니다
다음은 저희 자체 GPT-5.6 보도를 바탕으로 구축된 계보입니다. '목록(list)' 열은 GPT-5.6 가격 출시 당시 저희가 기록했던 내용입니다. '프로모션(promotional)' 열은 OpenAI가 새로운 모델을 비교하는 할인된 요율입니다.
| 티어 | GPT-5.6 정가 | GPT-5.6 프로모션 | GPT-6 |
|---|---|---|---|
| Sol | $5 / $30 | $4 / $20 | $2 / $10 |
| Terra | $2.50 / $15 | $2 / $12 | GPT-6 Terra 발표 없음 |
| Luna | $1 / $6 | $0.20 / $1.20 | $0.10 / $0.50 |
프로모션 요율과 비교했을 때, GPT-6 Sol의 $2/$10는 미터의 양쪽 모두에서 정확히 50% 할인된 가격입니다. 이는 OpenAI의 주장이며 확인되었습니다.
정가와 비교했을 때, 동일한 $2/$10는 입력에서 60%, 출력에서 67% 인하된 가격입니다. 만약 당신이 프로모션 대상이 아니었거나 프로모션을 인지하지 못해 현재 송장에 $5/$30가 청구되고 있다면, 당신의 절감액은 마케팅 수치보다 더 큽니다. 이미 프로모션 요율을 사용 중이었다면, 50% 할인을 받게 됩니다.
구조적 참고사항: GPT-6 테라는 없습니다. 패밀리는 Astra, Sol, Luna로 구성되며, GPT-5.6은 Sol, Terra, Luna였습니다. 구성 파일의 Terra ID에는 직접적인 후속 모델이 없으므로 Sol과 Luna 중에서 선택해야 합니다. Sol, Terra, Luna 명명법에 대한 저희 게시물은 이전 라인업을 다루고 있으며, 이제는 역사처럼 읽힙니다.
실제로 변동된 단위는 작업당 비용입니다
토큰 요율은 호출 비용을 알려주지, 답변 비용을 알려주지 않습니다. 왜냐하면 두 모델이 매우 다른 토큰 개수로 동일한 결과를 도출하기 때문입니다. OpenAI는 솔(Sol)을 완료된 작업당 비용으로 벤치마킹했으며, 이 지점에서 가격 인하가 아니라 작업 범주의 재가격 책정으로 변모합니다.
AutomationBench 1.0.6에서:
| 모델 및 노력 수준 | 점수 | 작업당 비용 |
|---|---|---|
| GPT-6 Sol, xhigh | 33.2% | $0.27 |
| GPT-6 Astra, low | 30.3% | Sol의 3.9배 |
| Claude Fable 5.1 (Opus 5 대체 포함), max | 31.4% | Sol의 8.9배 이상 |
| Claude Opus 5, max | 26.9% | Sol의 11.1배 |
맨 위 행과 맨 아래 행을 함께 읽어보십시오. 솔(Sol)은 매우 높은 추론 노력 수준에서 클로드 오푸스 5(Claude Opus 5)의 최대 노력 수준보다 더 높은 점수를 기록하면서도, 오푸스 5의 작업당 비용의 9% 수준입니다. 0.27달러를 기준선으로 했을 때, 이러한 승수는 Astra의 낮은 노력 수준에서는 작업당 약 1.05달러, Opus 5의 최대 노력 수준에서는 작업당 약 3.00달러가 되는데, 이는 OpenAI가 인쇄한 요율이 아닌 우리의 계산입니다.
OpenAI가 게시한 다른 평가에서도 동일한 패턴이 반복됩니다:
- Agents’ Last Exam V1: 솔(Sol)은 최대 노력 수준에서 56.4%를 기록하며 Claude Opus 5의 최고 결과보다 높고, 작업당 비용은 60% 더 낮습니다.
- DeepSWE 1.1: 솔(Sol)은 최대 노력 수준에서 68.8%를 기록하며, xhigh 수준의 Claude Fable 5 (69.9%)와 1.1% 포인트 이내이며, 작업당 비용은 약 80% 더 적습니다.
- OSWorld 2.0 오프라인: 솔(Sol)은 xhigh 수준에서 60.5%를 기록하며 중간 수준의 Claude Opus 5의 60.3%에 필적하며, 역시 작업당 비용은 약 80% 더 적습니다.
- 사실성(Factuality): 솔(Sol)은 이전 모델이 저지른 실수의 약 절반 정도를 저지릅니다.
여기에 한 가지 주의사항이 있습니다. OpenAI의 출시 자료에 있는 모든 Claude 비교는 Claude Opus 5를 대상으로 하는데, 이 게시물이 작성될 당시 Claude Opus 5.5는 존재하지 않았기 때문입니다. Anthropic은 같은 날 Opus 5의 $5/$25에서 인하된 $4/$20로 Opus 5.5를 출시했으므로, "Opus 5 작업당 비용의 9%"라는 문구는 몇 시간 내에 대체된 모델을 기준으로 측정된 것입니다. GPT-6 Sol 대 Claude Opus 5.5에서 그것이 의미하는 바와 의미하지 않는 바를 다룹니다. 어떤 공급업체도 Sol 대 Opus 5.5 표를 게시하지 않았으며, 소셜 미디어에서 유포되는 표들은 트윗을 통해 취합된 것입니다.
두 단위가 일치하지 않는 이유
만약 솔(Sol)이 프로모션 GPT-5.6 Sol보다 토큰당 50% 저렴하다면, 위 벤치마크 행에서 작업당 60%에서 91% 더 저렴한 이유는 무엇일까요? 이 범위는 OpenAI 자체 수치의 범위에서 파악한 것으로, Agents’ Last Exam에서 최소 60%, Opus 5의 9% 비용 라인의 반대편에서 최대 91%를 나타냅니다.
추론 노력은 토큰을 정확도와 맞바꾸며, 솔(Sol)은 그 곡선에서 더 나은 지점에 있기 때문입니다. 세 번의 시도가 필요한 더 저렴한 모델은 실제로 저렴한 것이 아닙니다. 이것이 OpenAI 테이블이 항상 점수와 노력 수준을 짝지어 보여주는 이유입니다. xhigh, max, medium, low는 단순한 수식어가 아니라 비용 축을 나타냅니다.
그 결과는 현재 토큰 볼륨에 새로운 요율을 곱하여 GPT-6 청구액을 추정할 수 없다는 것입니다. 선택하는 노력 수준에 따라 작업당 토큰 볼륨도 양방향으로 변하기 때문입니다.
캐싱이 실질적인 입력 요율을 변경합니다
GPT-6는 실제 프롬프트 캐싱 기능과 함께 출시되었으며, 가격 관련 기사에서는 한 가지 숫자가 중요합니다: 캐시된 입력 읽기는 90% 할인되어 솔(Sol)의 실질적인 입력 요율은 프롬프트의 캐시된 부분에서 1백만 토큰당 0.20달러가 됩니다.
모든 단계에서 크고 안정적인 접두사를 재전송하는 에이전트의 경우, 이는 실현 가능한 아키텍처와 실현 불가능한 아키텍처의 차이를 만듭니다. OpenAI는 또한 기본적으로 적중률이 더 높고, 추론 노력이나 도구 가용성을 변경해도 더 이상 캐시가 무효화되지 않으며, 명시적인 중단점을 통해 캐시된 접두사가 끝나는 지점을 선택할 수 있다고 말합니다. GitHub는 수십억 건의 요청에서 새로 처리해야 하는 프롬프트 토큰이 50% 이상 감소했다고 보고합니다.
한 가지 간극: 저희 자료에서는 GPT-6의 캐시 쓰기 요율을 명시하지 않습니다. Anthropic은 Opus 5.5에 대한 정보를 공개했지만, OpenAI의 Sol 자료에는 없으므로 쓰기가 무료라고 가정하지 마십시오. 캐시 적중 방식은 GPT-6 프롬프트 캐싱에서 다룹니다.
예시
일반적인 에이전트 단계를 예로 들어보겠습니다: 40,000 토큰 프롬프트와 2,000 토큰 완료를 한 달에 100,000회 실행합니다. 다음은 모두 위 요율에 대한 계산입니다.
| 시나리오 | 호출당 | 100,000회 호출당 |
|---|---|---|
| GPT-5.6 Sol 정가, $5 / $30 | $0.26 | $26,000 |
| GPT-5.6 Sol 프로모션, $4 / $20 | $0.20 | $20,000 |
| GPT-6 Sol, 캐시 적중 없음 | $0.10 | $10,000 |
| GPT-6 Sol, 프롬프트 32k 캐시됨 | $0.0424 | $4,240 |
프로모션 행에서 캐시되지 않은 GPT-6 행으로의 이동은 광고된 50%입니다. 정가 행에서 캐시된 행으로의 이동은 84%이며, 이 마지막 구간의 대부분은 가격 인하가 아닌 캐싱에서 비롯됩니다. 이 출시에서 한 가지 예산 책정 교훈을 얻는다면 바로 이것입니다.
규모는 다른 방향으로도 중요합니다. OpenAI는 자체 내부 연구원 중 중간값이 코딩 에이전트에 하루 600달러 이상을 지출하며, 90번째 백분위수는 하루 7,000달러를 초과한다고 밝혔습니다. 이는 이러한 요율이 설계된 사용 패턴이며, 귀하의 에이전트 지출이 놀랍게 보인다면 유용한 현실 점검입니다.
저렴한 가격으로 얻을 수 없는 것
솔(Sol)은 저렴하고 강력한 티어이지 빠른 티어가 아닙니다. 공급업체가 아닌 제3자인 Artificial Analysis는 GPT-6 Sol의 최대 추론 변형이 초당 115.2개의 출력 토큰을 생성하며, 첫 번째 토큰까지의 시간은 102.15초라고 측정했습니다. 이 수치는 특히 최대 변형에 대한 것이며 제3자 측정의 모든 주의사항을 수반하지만, 그 형태는 실제입니다: 높은 추론 노력은 첫 번째 토큰이 도착하기 전에 길고 조용한 일시 중지를 의미합니다. 사용자가 기다리는 모든 것에는 더 낮은 노력 설정 또는 다른 티어가 필요합니다. GPT-6 Sol 지연 시간에서 이를 자세히 분석합니다.
솔(Sol)은 또한 패밀리의 최상위 모델이 아닙니다. OpenAI는 GPT-6 Astra가 $10/$50 가격으로 "전반적으로 최고의 모델"임을 명확히 밝힙니다. 이미 Astra를 사용하는 팀에게는 어떤 워크로드가 하향 이동에서도 살아남을지가 질문이며, 이는 Astra에서 Sol로 마이그레이션의 주제입니다. 그리고 솔(Sol)은 아직 채팅에서 사용할 수 없습니다. ChatGPT Work 및 Plus, Pro, Business, Enterprise, Edu용 Codex를 통해, 그리고 API에서는 gpt-6-sol로 사용할 수 있습니다.
귀하의 트래픽으로 청구서를 확인하십시오
공급업체의 작업당 비용표는 공급업체 시스템에서 공급업체 워크로드를 기준으로 측정됩니다. 귀하의 경우는 다를 것입니다. 예산을 확정하기 전에:
gpt-6-sol에 실제 프로덕션 프롬프트를 보내고, 문자 수로 추정하는 대신 응답에서usage를 읽으십시오.- 동일한 프롬프트를 두 가지 노력 수준으로 실행하고, 각각의 토큰과 실제 소요 시간을 기록하십시오. 더 저렴한 설정이 항상 작업당 비용이 더 저렴한 것은 아닙니다.
- 캐시된 경우와 캐시되지 않은 경우를 별도로 측정하십시오. 프롬프트의 잘못된 절반에 대한 90% 할인은 거의 가치가 없습니다.
- 다운스트림에 시간 초과가 있는 경우, 총 지연 시간뿐만 아니라 첫 번째 토큰까지의 시간도 기록하십시오.
이것은 일반적인 HTTP 요청 테스트이므로, 호출을 만들고, 두 가지 노력 변형을 별도의 요청으로 저장하고, 응답 모양을 확인하며, 버리는 임시 스크립트가 아닌 Apidog에서 시간을 확인하십시오. 저장된 컬렉션으로 유지하면, 가격이 변경될 때마다 비교가 다시 실행될 것이며, 현재 증거로 볼 때 곧 그렇게 될 것입니다.
요약
GPT-6 Sol은 1백만 입력 토큰당 2달러, 1백만 출력 토큰당 10달러이며, 872,000 토큰의 컨텍스트와 90% 할인된 캐시된 읽기 기능을 제공합니다. 광고된 50% 할인은 GPT-5.6 프로모션 가격을 기준으로 측정되었으며, 출시 당시 우리가 기록했던 정가와 비교하면 입력에서 60%, 출력에서 67% 할인된 것입니다. 이 둘 중 어느 것도 이번 출시의 가장 큰 숫자는 아닙니다. 완료된 작업당 비용은 OpenAI가 벤치마킹한 모델에 비해 60%에서 91% 감소했으며, 프롬프트 캐싱은 나머지 비용을 또 한 번 크게 절감할 수 있습니다. 작업에 예산을 책정하고, 실제 트래픽으로 확인하며, 50%라는 수치에 '프로모션'이라는 단어를 항상 붙여두십시오.
