Gemini 3.7 플래시 가격 가이드: 두 배 인상 전 요금 확정하기

Gemini 3.7 Flash 요금: 2026년 12월 31일까지 100만 토큰당 $0.75/$3.75, 이후 요금 2배 인상. 자세한 비용 예시와 토큰 비용 절감 5가지 방법을 확인하세요.

Ashley Innocent

Ashley Innocent

14 August 2026

Gemini 3.7 플래시 가격 가이드: 두 배 인상 전 요금 확정하기

Apidog 엔터프라이즈

온프레미스 배포

SSO & RBAC

SOC 2 준수

Apidog Enterprise 살펴보기

구글은 3.6 Flash 출시 3주 후인 2026년 8월 13일에 Gemini 3.7 Flash를 출시했으며, 이를 "가장 지능적인 워크호스 모델"이라고 부릅니다. API 비용을 지불하는 사람들에게 가장 중요한 세부 사항은 벤치마크가 아닌 가격표에 있습니다: 백만 입력 토큰당 $0.75, 백만 출력 토큰당 $3.75의 출시 가격은 2026년 12월 31일에 만료됩니다. 2027년 1월 1일부터 두 요율 모두 두 배가 됩니다.

이는 이 모델을 기반으로 구축하는 모든 작업 부하에 대해 예정된 2배의 비용 증가를 의미합니다. 오늘날 월 $790가 드는 챗봇은 코드, 트래픽 또는 프롬프트 변경 없이 1월에 월 $1,575가 들게 됩니다. 따라서 3.7 Flash 프로젝트 예산을 책정할 때는 정가 대신 두 가지 요금제를 모두 고려해야 합니다.

이 가이드에서는 두 가지 요금제, 세 가지 실제 작업 부하에 대한 토큰 계산 방식, 다른 모델 API와 비교했을 때의 가격, 그리고 요금이 두 배가 되기 전에 비용을 절감할 수 있는 방법을 설명합니다. 아직 첫 번째 요청을 보내지 않았다면 Gemini 3.7 Flash API 퀵스타트가 설정 방법을 안내합니다. 호출을 시작하면 Apidog는 모든 응답에서 usageMetadata 토큰 수를 표시하므로 아래의 각 추정치는 실제 트래픽과 비교하여 확인할 수 있는 숫자가 됩니다.

버튼

요약 (TL;DR)

두 가지 가격 등급

Gemini 3.7 Flash는 영구적인 가격 대신 한시적인 할인율로 출시되었습니다. 다음은 Gemini API의 전체 그림입니다.

등급 기간 입력 (1백만 토큰당) 출력 (1백만 토큰당)
출시 가격 2026년 8월 13일 ~ 2026년 12월 31일 $0.75 $3.75
표준 가격 2027년 1월 1일부터 $1.50 $7.50

두 가지 눈에 띄는 점이 있습니다. 첫째, 출시 가격은 Gemini 3.6 Flash 출시 당시 비용의 절반이며, 이는 이 모델 제품군이 지금까지 경험했던 가장 저렴한 4.5개월 기간을 제공합니다. 3.6에서 업그레이드를 고려 중이라면 3.6에서 3.7 Flash로의 마이그레이션 가이드에서 전환 방법을 다루고 있습니다. 가격 인하만으로도 회귀 테스트 비용을 상쇄할 수 있습니다.

둘째, 두 가지 등급 모두 출력 토큰 비용은 입력 토큰 비용의 5배입니다. 이 비율은 이 가이드의 후반부에 나오는 모든 최적화 결정에 영향을 미칩니다. 장황한 시스템 프롬프트를 줄이는 것은 몇 푼을 절약하지만, 폭주하는 출력을 제한하는 것은 상당한 금액을 절약합니다.

위 요금은 AI Studio 키를 통해 청구되는 Gemini API에 적용됩니다. Vertex AI는 자체 SKU를 사용하여 Google Cloud 청구를 통해 실행되며, 컨텍스트 캐싱 및 배치 처리와 같은 기능에는 자체 항목이 있습니다. 따라서 예산을 확정하기 전에 공식 가격 페이지에서 현재 숫자를 확인하십시오.

실제 작업 부하 비용

1백만 토큰당 가격은 트래픽과 곱해질 때까지는 의미가 없습니다. 다음은 가정이 명시된 세 가지 작업 부하 프로필이므로, 자신의 숫자로 바꿔 사용할 수 있습니다.

작업 부하 1: 고객 지원 챗봇

하루 10,000건의 요청을 가정합니다. 각 요청은 약 2,000개의 입력 토큰(시스템 프롬프트, 짧은 기록 창, 사용자 메시지)을 사용하고 약 300개의 출력 토큰을 반환합니다.

항목 일일 토큰 출시 가격/일 표준 가격/일
입력 20M $15.00 $30.00
출력 3M $11.25 $22.50
총계 23M $26.25 $52.50

이는 30일 기준으로 출시 가격으로는 월 약 $788, 표준 가격으로는 월 약 $1,575입니다. 대화 턴당 오늘날 약 0.25센트를 지불하고 있습니다.

작업 부하 2: PDF 문서 파이프라인

Gemini 3.7 Flash는 PDF를 기본적으로 읽을 수 있으며, GDP.pdf 벤치마크 점수가 3.6 Flash 대비 22.0%에서 34.0%로 상승했으므로 구글은 여기서 문서 추출 작업을 실행할 것으로 예상합니다. 하루 500개의 문서를 가정하며, 각 문서당 평균 40,000개의 입력 토큰(긴 계약서 또는 보고서)이 사용되고 1,000개의 토큰으로 구성된 구조화된 요약을 생성합니다.

항목 일일 토큰 출시 가격/일 표준 가격/일
입력 20M $15.00 $30.00
출력 0.5M $1.88 $3.75
총계 20.5M $16.88 $33.75

현재 월 약 $506, 1월부터는 $1,013입니다. 형태를 주목하십시오: 문서가 길고 요약이 짧기 때문에 입력이 대부분을 차지합니다. 캐싱과 배치 처리가 이 작업 부하에 가장 큰 영향을 미칩니다.

작업 부하 3: 에이전트 루프

에이전트는 호출을 증폭시킵니다. 하루 200개의 작업을 가정하며, 각 작업은 평균 12회의 모델 호출을 수행합니다. 각 호출은 8,000개의 입력 토큰(증가하는 컨텍스트 및 도구 결과)을 사용하고 400개의 출력 토큰을 반환합니다.

항목 일일 토큰 출시 가격/일 표준 가격/일
입력 19.2M $14.40 $28.80
출력 0.96M $3.60 $7.20
총계 20.16M $18.00 $36.00

이는 출시 가격으로는 월 $540, 표준 가격으로는 월 $1,080입니다. 에이전트 청구에서 얻을 수 있는 교훈: 컨텍스트는 단계마다 증가하므로 호출 횟수와 컨텍스트 길이가 복합적으로 작용합니다. 12회 호출에서 20회 호출로 늘어나는 작업은 67% 더 많은 비용이 들지만, 가격표에는 이에 대한 경고가 없습니다.

기억해야 할 또 다른 숫자는 64k 출력 제한이 현재 호출당 최악의 경우를 약 $0.24, 내년에는 $0.48로 제한한다는 것입니다. 모든 시도에서 출력을 최대로 사용하는 재시도 루프는 빠르게 비싸지지만, 무한정 비싸질 수는 없습니다.

3.7 Flash 가격 비교

공급업체 간의 정확한 토큰당 비교는 몇 주 내에 구식이 되므로, 이를 가격표가 아닌 포지셔닝으로 간주하십시오.

Gemini 3.7 Flash는 워크호스 등급에 속합니다. Gemini의 자체 Pro 라인, Claude의 대규모 모델, 또는 OpenAI의 플래그십 등급과 같은 최첨단 모델보다 훨씬 저렴하면서도, 얼마 전 플래그십 모델이 기록했던 벤치마크 점수(DeepSWE v1.1에서 65.3%, WebDev Arena Elo 1588점)와 겹칩니다. 구글의 생각은 대부분의 프로덕션 트래픽이 최첨단 모델을 필요로 하지 않으며, 출시 할인은 자체 워크로드에서 이러한 주장을 테스트할 수 있는 4개월간의 초대장이라는 것입니다.

경쟁 환경도 중요합니다. 보급형 공급업체들은 가격을 다른 방향으로 움직여왔습니다. DeepSeek는 API 요금을 인상하고 팀에게 토큰 예산을 재고하도록 촉구했으며, 이 이야기는 DeepSeek 가격 인상 및 비용 최적화 가이드에서 다루었습니다. 이 교훈은 Gemini에도 직접적으로 적용됩니다. 마진을 기반으로 하는 모든 가격은 변동될 수 있으며, 구글은 이미 날짜와 금액을 알려주었습니다. 이는 대부분의 공급업체가 제공하는 경고보다 더 많은 것입니다.

트래픽이 급증하거나 실험적인 경우, 두 배의 비용 증가는 지속적인 작업 부하에만 영향을 미친다는 점을 기억하십시오. 출시 기간 동안 $3가 드는 프로토타입은 나중에 $6가 듭니다. 아무도 신경 쓰지 않습니다. 월 $10,000가 드는 파이프라인이 $20,000가 되는 것은 재무팀이 2월에 문의할 항목이 될 것입니다.

토큰 지출을 줄이는 5가지 방법

5배의 출력 대 입력 가격 비율과 1월의 두 배 가격 인상은 동일한 지점에서 지렛대 역할을 합니다.

Apidog로 엔드포인트별 지출 추적

추정치는 예산을 세우는 데 도움을 주며, 요청별 측정은 예산 내에서 유지하도록 합니다. 모든 Gemini 응답에는 프롬프트 및 출력 토큰 수를 포함하는 usageMetadata 블록이 있어, API 테스트 계층이 비용 측정기 역할도 할 수 있음을 의미합니다.

Apidog에서 워크플로우는 다음과 같습니다.

  1. 각 프로덕션 엔드포인트(챗봇 턴, 문서 요약, 에이전트 단계)당 하나의 요청을 컬렉션에 저장하고, API 키를 GEMINI_API_KEY 환경 변수에 바인딩합니다.
  2. 각 요청을 실제 페이로드에 대해 실행하고 응답에서 usageMetadata.promptTokenCountusageMetadata.candidatesTokenCount를 추출하는 테스트 시나리오를 구축합니다.
  3. 이러한 카운트에 대한 어설션을 추가합니다. 예를 들어, 프롬프트 편집으로 인해 채팅 엔드포인트가 2,500개 입력 토큰을 초과하면, 변경 사항이 배포되기 전에 시나리오가 실패하여 조용히 청구서가 25% 인상되는 것을 방지합니다.
  4. 모든 프롬프트 또는 스키마 변경 시 시나리오를 다시 실행합니다. 토큰 카운트는 대기 시간과 동일한 방식으로 회귀합니다. 차이점은 토큰 회귀가 청구서로 도착한다는 것입니다.

측정된 카운트에 이 가이드의 등급별 가격을 곱하면 추측이 아닌 실제 응답에 기반한 엔드포인트별 비용 수치를 얻을 수 있습니다. 어설션 기반 API 스위트를 이미 실행하는 팀은 이 패턴을 인식할 것입니다. QA 엔지니어를 위한 API 테스트 가이드는 전체 서비스에 걸쳐 이러한 시나리오를 구성하는 방법을 다룹니다.

자주 묻는 질문

Gemini 3.7 Flash 가격은 언제 두 배가 되나요?

2027년 1월 1일입니다. 1백만 입력 토큰당 $0.75, 1백만 출력 토큰당 $3.75의 출시 가격은 2026년 12월 31일까지 적용되며, 이후 $1.50 및 $7.50의 표준 가격으로 변경됩니다. 구글은 출시 시점에 두 가지 등급을 모두 공개했으므로, 이 인상은 예정된 것이며 추측성 정보가 아닙니다.

Gemini 3.7 Flash가 Gemini 3.6 Flash보다 저렴한가요?

출시 시점에서는 그렇습니다. 3.7 Flash의 출시 가격은 3.6 Flash 출시 가격의 절반인 반면, 벤치마크는 전반적으로 향상되었습니다 (DeepSWE v1.1은 49.0%에서 65.3%로 상승). 자세한 사양 및 벤치마크 표는 Gemini 3.7 Flash 빠른 참조에서 확인할 수 있습니다.

Vertex AI에도 출시 가격이 적용되나요?

이 가이드의 요금은 AI Studio 키를 통해 청구되는 Gemini API 요금입니다. Vertex AI는 자체 SKU와 기업 약관으로 Google Cloud를 통해 청구됩니다. Vertex에서 프로덕션 트래픽을 실행하는 경우, 동일하게 적용된다고 가정하지 말고 GCP 청구 콘솔 및 공식 가격 페이지에서 현재 숫자를 확인하십시오.

입력 토큰 청구에 포함되는 것은 무엇인가요?

보내는 모든 것이 포함됩니다: 텍스트, 이미지, 비디오, 오디오 및 PDF 페이지는 모두 토큰으로 변환되어 입력 요율로 청구됩니다. 긴 문서와 미디어가 많은 요청에서 입력 비용이 예상 밖으로 발생하는 경우가 많으며, 이것이 위 파이프라인 예시에서 문서당 40,000개의 토큰을 가정한 이유입니다. 각 응답의 usageMetadata 블록은 실제 사용된 정확한 토큰 수를 알려줍니다.

요청을 보내기 전에 토큰을 어떻게 예측하나요?

API의 countTokens 엔드포인트를 사용하여 아무것도 생성하지 않고 페이로드를 측정하거나, 몇 개의 대표적인 요청을 보내고 응답에서 usageMetadata를 읽으십시오. 어떤 방법이든 실제 페이로드로 측정하십시오. 다른 공급업체의 토크나이저 직관은 모델 제품군마다 잘 전달되지 않습니다.

3.7 Flash가 스택에 들어가는 위치

출시 가격으로 제공되는 Gemini 3.7 Flash는 이만큼 강력한 모델이 지금까지 가장 저렴한 가격이며, 구글은 이 가격이 더 이상 사실이 아닐 정확한 날짜를 알려주었습니다. 합리적인 전략은 다음과 같습니다: 지금 워크호스 트래픽을 이 모델로 옮기고, 할인 기간 동안 엔드포인트별 실제 토큰 소비량을 측정하며, 그 4개월간의 데이터를 사용하여 3.7 Flash에 무엇을 유지할지, 더 가벼운 모델로 무엇을 전환할지, 그리고 표준 요금 청구서가 도착하기 전에 어떤 모습일지 결정하십시오.

이 계획의 측정 부분에는 도구가 필요합니다. Apidog를 다운로드하여 Gemini 요청, 환경, 토큰 어설션 및 비용 확인을 하나의 작업 공간에 유지하십시오. 그러면 1월 청구서가 나중에 발견하는 숫자가 아니라 예측한 숫자가 될 것입니다.

Apidog에서 API 설계-첫 번째 연습

API를 더 쉽게 구축하고 사용하는 방법을 발견하세요