오픈AI GPT-5.6 API 가격 대폭 인하: 루나 80%, 테라 20% 인하 (신규 요금 분석)

OpenAI는 2026년 7월 30일에 GPT-5.6 API 가격을 인하했습니다. Luna는 백만 토큰당 $0.20/$1.20로 80% 하락했으며, Terra는 $2/$12로 20% 하락했습니다. 전체 이전 및 새 요금표, OpenAI가 가격을 인하한 이유, 그리고 워크로드를 재라우팅하는 방법을 확인하세요.

Ashley Innocent

Ashley Innocent

31 July 2026

오픈AI GPT-5.6 API 가격 대폭 인하: 루나 80%, 테라 20% 인하 (신규 요금 분석)

Apidog 엔터프라이즈

온프레미스 배포

SSO & RBAC

SOC 2 준수

Apidog Enterprise 살펴보기

2026년 7월 30일, OpenAI는 세 가지 GPT-5.6 모델 중 두 가지의 API 가격을 인하했습니다. GPT-5.6 Luna는 이제 80% 저렴해져서 백만 입력 토큰당 0.20달러, 백만 출력 토큰당 1.20달러입니다. GPT-5.6 Terra는 20% 인하되어 입력 2달러, 출력 12달러가 되었습니다. 플래그십 추론 모델인 GPT-5.6 Sol은 5달러와 30달러 요금을 유지하지만, 표준 가격의 두 배로 2.5배 더 빠르게 실행되는 새로운 Fast 모드를 얻게 됩니다.

GPT-5.6 출시 당시 가격을 기준으로 비용 모델을 구축했다면, 이제 그 계산은 시대에 뒤떨어진 것입니다. 이 게시물은 새로운 요금 카드, OpenAI가 가격을 인하한 이유, Google의 Gemini Flash 계층과 비교한 수치, 그리고 이번 주에 API 라우팅에서 변경해야 할 사항을 다룹니다. 모델 비용을 비교하는 가장 빠른 방법은 각 계층에 동일한 요청을 테스트하는 것이므로, Apidog와 같은 도구를 사용하면 확정하기 전에 Sol, Terra, Luna를 통해 하나의 프롬프트를 나란히 보내고 토큰 지출을 측정하는 것이 간단합니다.

버튼

새로운 GPT-5.6 요금 카드

다음은 백만 토큰당 전체 변경 전후입니다.

모델 이전 입력 새 입력 이전 출력 새 출력 변경 사항
GPT-5.6 Sol $5.00 $5.00 $30.00 $30.00 변경 없음
GPT-5.6 Terra $2.50 $2.00 $15.00 $12.00 -20%
GPT-5.6 Luna $1.00 $0.20 $6.00 $1.20 -80%

새로운 가격은 2026년 7월 30일부터 적용되며 표준 API 계층에 적용됩니다. 이 제품군의 최고가와 최저가 간의 차이는 7월 9일 일반 출시 당시 5배에서 오늘날 25배로 급증했습니다. 이러한 격차는 라우팅 결정을 변경합니다. 3주 전에는 Sol 대신 Luna로 작업을 보내면 청구서의 80%를 절약할 수 있었습니다. 이제는 96%를 절약할 수 있습니다.

이러한 요금 외에도 프롬프트 캐싱 할인이 계속 적용됩니다. OpenAI는 발표에서 새로운 Luna 및 Terra 요금에 대한 별도의 캐시된 입력 가격을 게시하지 않았으므로, 캐시 읽기에 의존하는 청구 예측을 업데이트하기 전에 공식 가격 페이지를 확인하세요.

Sol에 무슨 일이 있었는가

Sol의 정가는 변경되지 않았지만, 속도 옵션이 변경되었습니다. OpenAI는 Sol에 Fast 모드를 도입했습니다. 이는 표준 요금의 두 배로 2.5배 더 빠른 토큰 생성을 제공합니다. Fast 모드는 이전 Priority Processing 계층을 대체하므로, 현재 Priority Processing으로 프로덕션 트래픽을 실행하고 있다면 해당 구성을 마이그레이션하고 청구서 항목을 다시 확인해야 합니다.

실질적인 해석: OpenAI는 Sol을 할인하는 대신 지연 시간(latency)에 따라 세분화하고 있습니다. 대화형 속도로 플래그십 추론이 필요한 팀은 이에 대한 프리미엄을 지불합니다. 다른 모든 사람들은 가격 인하가 유도하는 대로 제품군의 하위 계층으로 라우팅합니다.

OpenAI가 가격을 인하한 이유

OpenAI는 이번 인하를 손실을 감수하는 미끼 상품 전략이 아닌, 효율성 개선을 통한 이점 전달로 보고 있습니다. 발표에서는 네 가지 주요 요인을 언급했습니다.

마지막 항목은 기억할 가치가 있는 세부 사항입니다. OpenAI는 Sol이 서빙 커널을 자율적으로 다시 작성하여, 엔드투엔드 서빙 오버헤드를 20% 줄이고 토큰 생성 효율성을 15% 이상 개선했다고 밝혔습니다. 회사 발표에서 "고급 지능을 더 풍부하고 저렴하게 만드는 것이 OpenAI의 사명의 핵심"이라고 말했습니다. 사명에 대한 해석이 어떻든 간에, 그 메커니즘은 분명합니다. 이제 모델을 제공하는 데 충분히 저렴해져 OpenAI는 Luna 가격을 80% 인하하면서도 마진을 보호할 수 있게 되었습니다.

또한 명백한 경쟁 요인도 있습니다. VentureBeat의 보도는 이번 인하를 Google의 Flash 계층에 대한 직접적인 대응으로 보고 있습니다. Luna의 결합된 정가(입력 + 출력)는 이제 백만 토큰당 1.40달러로, Gemini 3.5 Flash-Lite의 2.80달러와 Gemini 3.6 Flash의 9달러보다 저렴합니다. 저렴한 가격대의 선두 주자는 볼륨이 있는 곳이며, OpenAI는 이를 되찾기를 원합니다.

가격 인하가 워크로드에 미치는 영향

80%의 Luna 가격 인하가 아키텍처 결정을 변경하는 요인이며, 20%의 Terra 인하가 아닙니다. 몇 가지 구체적인 변화:

에이전트 루프가 저렴해집니다. 에이전트 워크로드는 긴 체인에서 토큰을 소모합니다: 계획, 도구 호출, 결과 읽기, 재시도. 입력 1달러, 출력 6달러일 때는 Luna에서 이러한 루프를 실행하는 것이 합리적이었습니다. 0.20달러와 1.20달러일 때는 기본값이 됩니다. OpenAI 자체 발표에서는 복잡한 에이전트 루프를 새로운 Luna 가격이 가능하게 하는 워크로드로 언급했습니다.

분류, 추출 및 요약 작업이 하위 계층으로 이동합니다. Luna의 품질 마진이 부족하다고 느껴져 Terra에 이 작업들을 유지했다면, 평가를 다시 실행해 보세요. 품질은 변하지 않았고, 가격만 변했습니다. Terra에서 하루 100달러가 들던 워크로드가 새 요금으로는 Luna에서 약 11달러가 듭니다.

기본값으로서의 Terra를 고수하는 것이 더 저렴해집니다. 저희의 Sol 대 Terra 대 Luna 비교 분석에서 Terra를 일상 업무를 위한 합리적인 기본값으로 추천했습니다. 그 조언은 여전히 유효하며, 이제 이를 따르는 데 20% 더 저렴합니다.

노력 다이얼은 여전히 요금 카드보다 더 중요합니다. GPT-5.6은 6가지 추론 노력 수준을 노출하며, 더 높은 노력은 더 많은 출력 측 토큰을 생성하는데, 이는 모든 계층에서 비용이 많이 드는 방향입니다. 가격 인하가 과도하게 설정된 노력 설정을 고치지는 않습니다.

자신의 수치를 다시 확인하는 방법

백분율을 맹목적으로 믿지 말고, 실제 트래픽을 측정하세요. 놀라움을 조기에 파악하는 워크플로우:

  1. 대표적인 프로덕션 프롬프트 샘플을 가져옵니다.
  2. 동일한 요청을 gpt-5.6-luna, gpt-5.6-terra, gpt-5.6-sol에 보내고 응답당 토큰 수를 캡처합니다.
  3. 새로운 요율을 곱하고 자체 평가 세트의 품질과 비교합니다.

Apidog는 2단계를 빠르게 만듭니다: 채팅 완료 엔드포인트를 한 번 정의하고, 환경 변수로 모델 ID를 전환한 다음, 세 가지 계층 모두에 대해 동일한 테스트 시나리오를 실행합니다. 응답 뷰어는 호출당 usage 블록을 보여주므로, 추정치가 아닌 실제 입력 및 출력 토큰 수를 얻을 수 있습니다. GPT-5.6을 앱에 처음 연결하는 경우, 저희의 GPT-5.6 API 사용 가이드는 인증, 모델 ID 및 요청 형태를 안내합니다. 예산 승인을 기다리는 동안 엔드포인트를 모의(mock)할 수 있으며, 나중에 테스트를 다시 작성할 필요 없이 실제 트래픽으로 전환할 수 있습니다. 비교를 실행하려면 Apidog를 무료로 다운로드하세요.

더 큰 그림: 가격 전쟁이 시작되다

올 여름, 이 분야의 저가 시장에서 세 번째 주요 가격 변동입니다. Google은 7월에 Flash 계층을 새로 고쳤고, Anthropic은 Fable 5 가격의 절반으로 Claude Opus 5를 출시했으며, 이제 OpenAI는 Luna 가격을 Gemini Flash 옵션보다 낮게 인하했습니다. 모델 품질은 여전히 플래그십 모델들을 구분하지만, 주력(workhorse) 계층은 간단한 규칙으로 수렴하고 있습니다. 즉, 이번 달에 가장 저렴한 모델이 배치 작업을 가져갑니다.

API 팀에게 이는 모델 선택이 더 이상 연간 결정이 아님을 의미합니다. 모델 ID가 구성 값인 통합을 구축하고, 상시 평가 스위트를 유지하며, 공급업체가 변경될 때마다 비용 비교를 다시 실행하십시오. 모델 라우팅을 테스트 및 모니터링을 갖춘 인프라로 취급하는 팀은 분기별이 아닌 며칠 내에 각 가격 인하의 이점을 얻을 수 있습니다.

자주 묻는 질문

새로운 GPT-5.6 API 가격은 얼마입니까?

2026년 7월 30일부로: Luna는 백만 입력 토큰당 0.20달러, 백만 출력 토큰당 1.20달러입니다. Terra는 2달러와 12달러입니다. Sol은 5달러와 30달러로 변경되지 않았습니다. Sol은 또한 표준 요금의 두 배로 2.5배 더 빠른 처리를 제공하는 Fast 모드를 얻었습니다.

GPT-5.6 Sol도 가격 인하가 있었나요?

아닙니다. Sol의 표준 요금은 변경되지 않았습니다. Sol의 변경 사항은 구조적입니다. 새로운 Fast 모드가 Priority Processing 계층을 대체하며, 두 배의 가격으로 2.5배 빠른 속도를 제공합니다.

GPT-5.6 Luna가 이제 Gemini Flash보다 저렴한가요?

정가 기준으로 그렇습니다. Luna의 결합된 입력-출력 요금은 백만 토큰당 1.40달러인 반면, Gemini 3.5 Flash-Lite는 2.80달러, Gemini 3.6 Flash는 9달러입니다. 하지만 가격이 곧 품질은 아닙니다. 전환하기 전에 자체 평가 세트에 대해 두 모델을 모두 실행해 보세요. 먼저 무료 경로를 원하시면, GPT-5.6을 무료로 사용하는 방법을 참조하십시오.

가격 인하가 자동으로 적용되나요?

예. 새로운 요금은 2026년 7월 30일부터 표준 API 사용에 적용되며 코드 변경이 필요하지 않습니다. Sol에서 Priority Processing을 사용하고 있다면 조치를 취해야 합니다. 이는 Fast 모드로 대체됩니다.

이번 주에 할 일

새로운 요금 카드는 빠르게 움직이는 팀에게 보상을 줍니다. 새로운 수치로 비용 모델을 다시 실행하고, Luna가 Sol 가격의 96% 더 저렴한 가격으로 어떤 워크로드를 흡수할 수 있는지 재평가하며, Terra의 20% 인하가 라우팅 임계값을 변경하는지 확인하십시오. 그런 다음 정가 계산 대신 실제 트래픽으로 확인하세요. Apidog에서 하나의 테스트 시나리오, 세 가지 모델 ID, 그리고 usage 수치가 가격 인하가 당신에게 얼마나 가치 있는지 정확히 알려줄 것입니다.

버튼

Apidog에서 API 설계-첫 번째 연습

API를 더 쉽게 구축하고 사용하는 방법을 발견하세요