구글은 2026년 8월 13일 Gemini 3.7 Flash를 출시했습니다. 이는 3.6 Flash 출시 3주 후이자 Gemini 3.5 Pro가 여전히 지연되는 가운데 출시되었습니다. 회사는 이를 “가장 지능적인 일꾼 모델”이라고 부르며, 공식 발표에서는 코딩 및 에이전트 작업에서 벤치마크 점수가 10점에서 16점 상승하며 이러한 주장을 뒷받침합니다. Gemini API를 사용하여 개발한다면, 향후 몇 달 동안 이 모델을 주로 사용하게 될 것입니다.
이 페이지는 참조 카드입니다. 모든 사양, 가격, 벤치마크 변화 및 액세스 채널이 한 곳에, 1분 안에 훑어볼 수 있는 표 형태로 정리되어 있습니다. 코드를 작성할 준비가 되면, Gemini 3.7 Flash API 퀵스타트 가이드가 cURL, Python, Node를 단계별로 안내하며, Apidog는 코드가 작성되기 전에 엔드포인트에 테스트 요청을 보낼 수 있는 작업 공간을 제공합니다.
이 페이지를 북마크해 두세요. 아래 숫자는 2027년 1월 1일, 초기 가격 적용 기간이 종료되면 변경되며, 저희는 표를 최신 상태로 유지할 것입니다.
요약
- 모델 ID는
gemini-3.7-flash이며, 2026년 8월 13일부터 Gemini API에서 사용 가능하며 160개 이상의 국가에서 제공됩니다. - 사양: 100만 토큰 입력 컨텍스트, 64k 토큰 출력 제한, 멀티모달 입력 (텍스트, 이미지, 비디오, 오디오, PDF), 텍스트 출력.
- 도구: 함수 호출, 도구로서의 검색, 컴퓨터 사용 모두 지원됩니다.
- 초기 가격: 2026년 12월 31일까지 입력 토큰 100만 개당 $0.75, 출력 토큰 100만 개당 $3.75. 표준 요금은 2027년 1월 1일부터 $1.50 및 $7.50으로 두 배 인상됩니다.
- 3.6 Flash 대비 벤치마크: DeepSWE v1.1 49.0%에서 65.3%로, AutomationBench 17.0%에서 30.4%로, WebDev Arena Elo 1538에서 1588로.
- Gemini API, Google AI Studio, Gemini 앱, Gemini Spark, Google Antigravity, Android Studio, Gemini Enterprise를 통해 액세스할 수 있습니다.
Gemini 3.7 Flash 사양 시트
구글의 Gemini Flash 모델 페이지 및 출시 자료에서 가져온 핵심 수치입니다.
| 사양 | 값 |
|---|---|
| 모델 ID | gemini-3.7-flash |
| 출시일 | 2026년 8월 13일 |
| 입력 컨텍스트 창 | 1,000,000 토큰 |
| 출력 토큰 제한 | 64,000 토큰 |
| 입력 모달리티 | 텍스트, 이미지, 비디오, 오디오, PDF |
| 출력 모달리티 | 텍스트 |
| 함수 호출 | 예 |
| 도구로서의 검색 | 예 |
| 컴퓨터 사용 | 예 |
| 긴 컨텍스트 검색 (128k 니들) | 97.0% |
| 안전성 | 업데이트된 CBRN 및 사이버 안전 조치 |
| 가용성 | 160개 이상 국가 |
| API 엔드포인트 | generativelanguage.googleapis.com (AI Studio 키) 또는 aiplatform.googleapis.com (Vertex, OAuth) |
두 가지 항목을 다시 살펴볼 가치가 있습니다. 64k 출력 제한은 Flash 클래스 모델치고는 관대한 편입니다. 이는 전체 파일 재작성과 긴 구조화된 출력이 단일 응답에 모두 들어갈 수 있음을 의미합니다. 또한 컴퓨터 사용 지원 덕분에 3.7 Flash는 브라우저를 직접 제어할 수 있는 소수의 모델 그룹에 속하지만, 대부분의 프로덕션 자동화에서는 구조화된 API 호출이 여전히 더 유리합니다. 이러한 장단점은 컴퓨터 사용 vs 구조화된 API 문서에서 다루고 있습니다.
가격 개요
구글은 3.6 Flash 출시 가격의 절반 수준으로 3.7 Flash를 출시했지만, 이 할인에는 만료일이 있습니다.
| 단계 | 입력 (100만 토큰당) | 출력 (100만 토큰당) | 유효 기간 |
|---|---|---|---|
| 초기 | $0.75 | $3.75 | 2026년 12월 31일까지 |
| 표준 | $1.50 | $7.50 | 2027년 1월 1일부터 |
새해 첫날 양쪽 모두 깨끗하게 2배 인상됩니다. 토큰 사용량이 많은 워크로드의 경우, 초기 기간은 실수가 절반의 비용만 들 때 벤치마크를 수행하고, 프롬프트를 조정하며, 캐싱 전략을 확정하기에 적합한 시기입니다. 비용 예시, 실제 워크로드에서의 토큰 계산, 표준 요금 적용 전 비용 절감 전략에 대해서는 Gemini 3.7 Flash 가격 설명 문서를 참조하세요. 최신 정보는 Gemini API 가격 페이지에서 확인할 수 있습니다.
벤치마크: 3.6 Flash vs 3.7 Flash
구글은 코딩, 웹 개발, 문서 이해, 에이전트 자동화 전반에 걸쳐 3.6 Flash 대비 변화를 공개했습니다. 선행 모델 출시 3주 만에 나온 포인트 릴리즈치고는 격차가 크며, 이는 9to5Google의 출시 보도에서도 지적된 바 있습니다.
| 벤치마크 | Gemini 3.6 Flash | Gemini 3.7 Flash | 차이 |
|---|---|---|---|
| DeepSWE v1.1 (에이전트 코딩) | 49.0% | 65.3% | +16.3 |
| FrontierCode 1.1 Main | 34.4% | 43.6% | +9.2 |
| WebDev Arena (Elo) | 1538 | 1588 | +50 |
| GDP.pdf (문서 이해) | 22.0% | 34.0% | +12.0 |
| AutomationBench (에이전트 자동화) | 17.0% | 30.4% | +13.4 |
| Harvey LAB-AA (법률) | 해당 없음 | 90.7% | 해당 없음 |
| 128k 니들 검색 | 해당 없음 | 97.0% | 해당 없음 |
표 전체의 패턴은 에이전트 워크로드가 가장 큰 이득을 얻었다는 것입니다. 구글이 밝힌 개선 사항은 더 나은 디버깅, 더 배포 가능한 첫 시도 코드, 다단계 계획 및 도구 호출에 대한 더 세심한 사고, 그리고 더 엄격한 지시 이행과 일치합니다. 이러한 수치들이 Anthropic 및 OpenAI 모델과 비교하여 어떤지는 별개의 질문이며, Gemini 3.7 Flash vs Claude vs GPT 문서에서 다루고 있습니다.
Gemini 3.7 Flash를 사용할 수 있는 곳
출시 시점에는 7가지 액세스 채널이 있습니다. 역할에 따라 선택하세요.
| 채널 | 용도 | 대상 |
|---|---|---|
| Gemini API | AI Studio 키를 통한 프로그래밍 방식 액세스 | 앱을 출시하는 개발자 |
| Google AI Studio | 브라우저 플레이그라운드, 프롬프트 반복, 키 관리 | 프로토타입을 만드는 개발자 |
| Gemini 앱 | 웹 및 모바일 소비자 채팅 | 최종 사용자 |
| Gemini Spark | 에이전트 코딩 환경 | AI Pro 및 Ultra 구독자 |
| Google Antigravity | 에이전트 우선 개발 플랫폼 | 자율 에이전트를 구축하는 팀 |
| Android Studio | 안드로이드 작업을 위한 IDE 통합 | 모바일 개발자 |
| Gemini Enterprise | 관리자 제어 기능이 있는 관리형 배포 | 기업 IT |
API 작업을 위해 AI Studio 키 경로를 사용하면 몇 분 안에 작동하는 요청을 보낼 수 있습니다. Vertex AI는 프로덕션 제어가 필요할 때 IAM, 감사 로그 및 지역 엔드포인트를 갖춘 OAuth 뒤에서 동일한 모델을 제공합니다.
최소한의 작동 요청
AI Studio에서 키를 가져와 내보낸 다음, 요청을 하나 보냅니다.
export GEMINI_API_KEY="AIza..."
curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.7-flash:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"contents": [{
"parts": [{ "text": "List the HTTP status codes an idempotent retry layer should handle." }]
}],
"generationConfig": {
"temperature": 0.4,
"maxOutputTokens": 1024
}
}'
스트리밍은 동일한 경로에서 메서드를 :streamGenerateContent?alt=sse로 바꿉니다. 응답은 텍스트 부분과 청구될 토큰 수를 포함하는 usageMetadata 블록이 있는 candidates 배열을 반환합니다.
터미널에서 JSON을 직접 편집하고 싶지 않다면, Apidog는 Generative Language API 사양을 가져오고, GEMINI_API_KEY를 x-goog-api-key 헤더의 환경 변수로 바인딩하며, SSE 스트림을 실시간으로 렌더링합니다. 좋은 응답을 한 번 예시로 저장하고, 유료 엔드포인트 대신 해당 픽스처를 대상으로 테스트를 다시 실행하세요.
속도 제한 및 티어
구글은 모델별 및 티어별 (무료, 종량제, 프로비저닝된 수준)로 속도 제한을 설정하며, 이러한 수치는 자주 변경되므로 여기에 인쇄된 어떤 표라도 금세 구식이 될 것입니다. gemini-3.7-flash의 현재 분당 요청 및 분당 토큰 제한은 공식 Gemini API 문서를 확인하세요.
두 가지 안정적인 경험 법칙. AI Studio를 통한 무료 티어 할당량은 프로토타입 제작에는 충분하지만 실제 출시에는 부족합니다. 그리고 상태 RESOURCE_EXHAUSTED와 함께 429 응답이 오면 분당 또는 일일 제한에 도달했다는 의미입니다. 지터를 사용하여 요청을 지연시키거나, 가능한 경우 일괄 처리하거나, 프로젝트를 유료 티어로 이동하세요.
빠른 링크
- 공식 발표: 구글의 주장과 벤치마크 차트가 담긴 출시 게시물
- Gemini API 문서: 엔드포인트 참조, SDK 가이드, 속도 제한
- 가격 페이지: 실시간 토큰당 요금
- 모델 페이지: 사양 및 모달리티 세부 정보
- API 키 받기: 두 번의 클릭으로 AI Studio 키 획득
자주 묻는 질문
Gemini 3.7 Flash의 사양을 한 문장으로 요약하면 무엇인가요?
Gemini API를 통해 gemini-3.7-flash로 접근 가능하며, 100만 토큰 입력 컨텍스트 창, 64k 토큰 출력 제한, 텍스트, 이미지, 비디오, 오디오, PDF를 아우르는 멀티모달 입력, 텍스트 출력, 그리고 함수 호출, 도구로서의 검색, 컴퓨터 사용을 지원합니다.
Gemini 3.7 Flash의 비용은 얼마인가요?
2026년 12월 31일까지 입력 토큰 100만 개당 $0.75, 출력 토큰 100만 개당 $3.75입니다. 2027년 1월 1일부터는 표준 요금이 적용되어 입력 $1.50, 출력 $7.50입니다. 초기 요금은 3.6 Flash 출시 당시의 절반 수준입니다.
3.6 Flash에서 업그레이드하려면 코드를 변경해야 하나요?
모델 ID를 gemini-3.7-flash로 변경하는 것이 전부입니다. 하지만 3.7이 다단계 도구 호출에 더 오래 생각하고 지시를 더 엄격하게 따르므로, 동작 변경 사항에 대한 작업이 중요합니다. 3.6에서 3.7 Flash로의 마이그레이션 가이드는 트래픽을 전환하기 전에 어떤 회귀 테스트를 해야 하는지 다룹니다.
구글은 왜 Gemini 3.5 Pro보다 3.7 Flash를 먼저 출시했나요?
Gemini 3.5 Pro는 여전히 지연되고 있으며, Axios는 구글이 다음 플래그십 모델을 기다리지 않고 Flash 업데이트를 먼저 출시하고 있다고 보도했습니다. 3.6 Flash와 3.7 Flash 사이의 3주 간격은 이러한 주기에 부합합니다.
무료로 사용해볼 방법이 있나요?
네, 있습니다. AI Studio의 무료 티어에는 gemini-3.7-flash에 대한 일일 할당량이 포함되어 있어 프롬프트 테스트 및 작은 프로토타입 제작에 충분하며, 더 높은 속도 제한이 필요하기 전까지는 결제 계정이 필요하지 않습니다. 무료 Gemini API 액세스 가이드는 무료 티어의 한계와 제한에 도달했을 때 어떻게 해야 하는지 설명합니다.
3.7 Flash가 스택에 적합한 위치
3.7 Flash는 에이전트 루프, 코딩 어시스턴트, 문서 파이프라인, 그리고 세션당 많은 도구 호출을 하는 모든 것에 대한 기본 Gemini 모델로 간주하세요. 벤치마크 개선 사항은 바로 이러한 워크로드에 적용되며, 초기 가격 책정으로 향후 4개월 반 동안은 개발하기에 가장 저렴한 기간이 될 것입니다. 플래그십 클래스 추론에 대한 판단은 Gemini 3.5 Pro가 출시될 때까지 유보하세요. 다른 모든 것에 대해서는 구글이 말하는 대로 이 모델이 바로 그 일꾼 모델입니다.
모델 ID가 프로덕션 코드에 적용되기 전에 엔드포인트를 테스트하세요. Apidog를 다운로드하여 Gemini 요청, 환경, 스트리밍 확인, 저장된 응답 픽스처를 평가 중인 다른 모든 제공업체의 컬렉션과 함께 하나의 작업 공간에 보관하세요.
