Gemini 3.8 Flash는 2026년 9월 2일에 출시되었으며, 올해 출시된 대부분의 최신 모델과 달리 실제 무료 경로를 제공합니다. Google AI Studio에서 무료로 채팅할 수 있으며, 약 1분 만에 생성할 수 있는 키를 사용하여 Gemini API의 무료 티어에서 호출할 수 있습니다. Google의 출시 게시물은 이를 "가장 지능적인 Flash 모델"이라고 부르며, 무료 티어는 유료 고객이 사용하는 것과 동일한 모델 ID(gemini-3.8-flash)를 제공하며, 기능이 축소된 변형이 아닙니다.
세 가지 단점이 있으며, 이 가이드에서 모두 다룹니다. 무료 티어는 속도 제한이 있습니다. Google은 무료 티어 데이터가 제품 개선에 사용된다고 말합니다. 그리고 Gemini 앱은 무료 요금제에 3.8 Flash를 포함하지 않습니다. 이를 위해서는 Google AI Pro 또는 Ultra 구독이 필요합니다. 먼저 전체 사양을 확인하려면 Gemini 3.8 Flash란 무엇인가를 참조하십시오. 5분 안에 요청을 실행하고 싶다면 계속 읽으십시오.
무료 액세스 한눈에 보기
| 인터페이스 | 비용 | Gemini 3.8 Flash 포함 여부 | 주의사항 |
|---|---|---|---|
| Google AI Studio (웹 플레이그라운드) | $0 | 예 | 속도 제한; 제품 개선에 데이터 사용 |
| Gemini API 무료 티어 | $0 | 예 | AI Studio 속도 제한 페이지에 표시된 것과 동일한 제한 |
| Gemini 앱, 무료 요금제 | $0 | 아니요 | 3.8 Flash는 Google AI Pro 또는 Ultra 필요 |
| Google 검색의 AI 모드 | $0 | 예 (소비자) | API 없음, 사고 수준 제어 불가 |
| Google 스프레드시트의 Gemini | 요금제에 따라 다름 | 예 (소비자) | API 없음 |
| Google 검색 접지(grounding) | 월 5,000회 요청 무료 | Gemini 3.x 전체 공유 | 이후 1,000회 요청당 $14 |
| 배치(Batch) API | 유료 요금의 50% 할인 | 예 | 무료 아님; 가장 저렴한 유료 경로 |
| Gemini 3.8 Flash Cyber | 판매되지 않음 | 아니요 | Fairwind 프로그램 전용, 어떤 가격에도 공개 API 없음 |

단계 1: AI Studio를 열고 gemini-3.8-flash 선택
Google AI Studio로 이동하여 Google 계정으로 로그인하십시오. 결제 계정이나 신용 카드는 필요하지 않습니다. 모델 선택기에서 `gemini-3.8-flash`를 선택하십시오. 이는 미리 보기 접미사가 없는 안정적인 ID입니다. 실행 설정은 사고 수준(thinking level)을 노출하며, 3.8 Flash에서는 `low`, `medium`, `high` 세 가지 값을 가집니다. `medium`이 기본값입니다. 이 모델에는 `minimal`이 없으며, API를 통해 `minimal`을 보내면 조용한 대체(fallback) 대신 유효성 검사 오류가 발생합니다. 사고 수준 가이드는 각 수준이 토큰과 시간 면에서 얼마나 비용이 드는지 설명합니다.
무료 사용에 중요한 두 가지 설정이 있습니다. 첫째, 온도는 그대로 두십시오. 모든 Gemini 3 모델에 대한 Google의 지침은 온도를 기본값인 1.0으로 유지하는 것입니다. 이를 낮추면 루프에 빠지거나 출력이 저하될 수 있기 때문입니다. 둘째, 탐색하는 동안 `low`로 시작하십시오. 3.8 Flash는 복잡한 작업을 "더 열심히" 처리하도록 설계되었으며, 더 작은 추론 단계를 거치고 도구를 반복적으로 호출합니다. Google은 "설계상 더 길게 실행되고 복잡한 작업에서 더 많은 토큰을 사용할 수 있습니다"라고 말합니다. 분당 토큰으로 측정되는 티어에서는 이러한 요구량이 3.7 Flash보다 할당량을 더 빨리 소모합니다. `low`는 실험 비용을 저렴하게 유지합니다.
단계 2: 무료 API 키 받기
AI Studio 내에서 API 키 페이지를 열고 새 프로젝트 또는 기존 프로젝트에서 키를 생성하십시오. 이 키는 무료이며 무료 티어에서 즉시 작동합니다. 가격 책정 페이지에는 3.8 Flash의 입력 및 출력이 해당 티어에서 "무료"로 나열되어 있으며, 유료 요금이 함께 표시됩니다. 저희의 Gemini API 키 사용법에는 처음 사용하는 경우를 위한 스크린샷이 있습니다.
키를 환경 변수로 저장하고 코드와 셸 기록에 노출되지 않도록 하십시오:
export GEMINI_API_KEY="여기에_키를_붙여넣으세요"
키를 비밀번호처럼 취급하십시오. 무료 티어에는 결제가 연결되어 있지 않으므로 유출된 키가 요금을 발생시키지는 않지만, 여러분이 사용하기 전에 일일 할당량을 소모할 수 있습니다.
단계 3: 첫 번째 무료 호출하기
Gemini 3.x는 이제 주로 Interactions API에서 실행됩니다. SDK가 필요 없는 하나의 요청:
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" -H 'Content-Type: application/json' \
-d '{"model":"gemini-3.8-flash","input":"HTTP 캐싱을 3문장으로 설명해 주세요.","generation_config":{"thinking_level":"low"}}'
응답은 텍스트가 포함된 `model_output` 단계로 끝나는 실행 단계(모델 생각, 도구 호출(있는 경우)) 목록입니다. 기존 `generateContent` 코드가 있다면 여전히 작동합니다. Google은 이를 레거시라고 부르지만 서비스 종료일 없이 "완전히 지원"되며, `generationConfig.thinkingConfig.thinkingLevel`은 해당 엔드포인트에서 수준이 지정되는 곳입니다. 이 두 가지 형식과 Python equivalents, 그리고 `previous_interaction_id`를 사용한 멀티턴은 Gemini 3.8 Flash API 가이드에 있습니다.
429 오류가 발생하면 무료 티어의 속도 제한에 도달한 것입니다. 기다리거나 Tier 1로 넘어가십시오.
무료 티어가 여러분에게 요구하는 것
금전적인 비용은 없습니다. 그 외에 세 가지가 있습니다.
속도 제한. 무료 티어는 모델당 분당 요청 수, 분당 토큰 수, 일일 요청 수를 제한합니다. Google은 정확한 수치를 문서 텍스트가 아닌 AI Studio 속도 제한 페이지에서만 게시하며, 변경 로그 항목 없이 변경될 수 있습니다. 이 블로그를 포함하여 블로그에서 읽은 어떤 숫자도 신뢰하지 말고 해당 페이지를 확인하십시오. 속도 제한 문서는 티어가 어떻게 중첩되는지 설명합니다.
사용자 데이터. Google은 무료 티어 프롬프트 및 출력이 제품 개선에 사용된다고 명시합니다. 이는 벤치마크 프롬프트나 장난감 앱에는 괜찮습니다. 하지만 고객 기록, 미출시 소스 코드 또는 NDA(비밀유지협약) 하의 모든 것에는 적합하지 않습니다. 유료 티어에는 다른 약관이 적용됩니다. 민감한 요청을 보내야 하는 경우, 요청을 보낸 후가 아니라 보내기 전에 결제를 연결하십시오.
토큰 사용량. Artificial Analysis는 3.8 Flash를 `high` 수준에서 사용했을 때 자사 인덱스에서 작업당 약 48k 출력 토큰을 사용한다고 측정했는데, 이는 3.7 Flash보다 30% 더 많습니다. 사고 토큰은 보이는 출력과 동일한 분당 토큰 제한에 포함됩니다. 더 열심히 추론하는 모델은 무료 할당량을 더 빨리 소모하는 모델입니다. 이는 헤드룸에 비용을 지불하기 전까지 `low` 또는 `medium`을 기본값으로 설정해야 하는 실제적인 이유입니다.
Gemini 앱은 무료 경로가 아닙니다
대부분의 "Gemini 3.8 Flash 무료" 검색이 잘못되는 지점입니다. 소비자 측면에서 3.8 Flash는 Google AI Pro 및 Ultra 구독자를 위한 Gemini 앱에서 사용할 수 있습니다. 출시 보도에 따르면 무료 앱 요금제에서는 사용할 수 없습니다. 구독 없이 앱을 열고 Flash 모델이 보인다면, 그것은 3.8이 아닙니다.
추가 비용 없이 3.8 Flash를 만날 수 있는 소비자 인터페이스는 Google 검색의 AI 모드와 Google 스프레드시트의 Gemini입니다. 둘 다 답변을 읽는 데 유용합니다. 하지만 둘 다 사고 수준 제어, 토큰 수 또는 API를 제공하지 않으므로, 개발이라고 부를 수 있는 어떤 작업이든 AI Studio와 무료 API 티어가 실제 무료 경로입니다.
무료 접지(grounding): 월 5,000회 Google 검색 요청
모델이 현재 웹 결과를 답변에 가져올 수 있도록 하는 Google 검색 접지는 모든 Gemini 3.x 모델에서 공유되는 월 5,000회의 무료 요청을 제공합니다. 그 이후에는 1,000회 요청당 $14입니다. 할당량은 모델당이 아닌 월별 풀이므로, 접지된 3 Pro 실험과 접지된 3.8 Flash 실험은 동일한 5,000회에서 차감됩니다. 신선한 데이터가 필요한 프로토타입의 경우 관대한 할당량이지만, 제품 기능의 경우 예산이 필요할 것입니다.
무료가 소진되었을 때: 가장 저렴한 유료 경로
그 순간을 알게 될 것입니다. 데모 도중에 429 오류가 발생하거나, 오후 3시에 일일 한도에 도달할 수 있습니다. 가장 저렴한 것부터 시작하는 네 가지 유료 단계입니다.
결제 계정 연결 (Tier 1). AI Studio에서 프로젝트에 결제를 연결하면 Tier 1으로 이동하며, 이는 속도 제한을 높이고 $250의 지출 한도를 설정합니다. Tier 2는 $100 지출 후 3일 뒤에 $2,000 한도로 열리며, Tier 3는 $1,000 지출 후 30일 뒤에 열립니다. Tier 1 잠금을 해제하기 위해 아무것도 지출할 필요는 없습니다. 결제 연결 자체로 충분합니다.
초기 요금 지불. 2026년 12월 31일까지 3.8 Flash는 백만 입력 토큰당 $0.75, 백만 출력 토큰당 $3.75가 부과되며, 사고 토큰은 출력으로 청구됩니다. 2027년 1월 1일부터는 둘 다 $1.50과 $7.50으로 두 배가 됩니다. 각 요청이 2,000 입력 토큰과 500 출력 토큰일 때 천 번의 요청은 초기 가격으로 약 $3.38이 됩니다. 가격 분석은 더 저렴한 토큰당 가격이 이 모델에서 더 저렴한 작업을 의미하지 않는 이유를 포함하여 작업당 계산을 보여줍니다.
기다릴 수 있는 것은 일괄 처리(Batch)하십시오. Batch API는 요율을 절반으로 줄입니다: 연말까지 백만 입력 토큰당 $0.375, 백만 출력 토큰당 $1.875. 동일한 천 번의 요청이 약 $1.69가 됩니다. Tier 1 계정은 한 번에 최대 3M 토큰을 큐에 넣을 수 있습니다. 평가, 백필, 야간 작업은 여기에 해당합니다. 저희의 Gemini 배치 모드 가이드는 요청 형태를 다룹니다.
안정적인 접두사를 캐싱하십시오. 컨텍스트 캐싱은 초기 요금으로 백만 캐시 토큰당 $0.075가 부과되며, 이는 새로운 입력의 10분의 1입니다. 긴 시스템 프롬프트나 매 턴마다 다시 보내는 문서는 먼저 고려해야 할 부분입니다.
무료로는 얻을 수 없는 것
이 주제에 대한 검색 결과가 부정직한 내용으로 가득하기 때문에, 정직한 목록을 제공합니다.
- Gemini 앱. 위에서 언급했듯이 Pro 또는 Ultra 전용입니다.
- 개인 정보 보호. 무료 티어 데이터는 Google 제품 개선에 사용됩니다. 무료 티어에는 토글 기능이 없습니다.
- 헤드룸. 제한 사항은 속도 제한 페이지에 표시되어 있으며 관대하지 않습니다. 무료는 평가 및 소규모 도구용이지, 출시용이 아닙니다.
- Gemini 3.8 Flash Cyber. 보안에 특화된 쌍둥이 모델은 정부, 인프라 운영자 및 소프트웨어 관리자를 위한 Fairwind 프로그램 뒤에 숨겨져 있습니다. 공개 API, 가격, 자체 호스팅은 없습니다. 해당 프로그램 외부의 누구도 무료 또는 유료로 사용할 수 없습니다.
- 라이브 API, 이미지 생성 또는 오디오 생성. 3.8 Flash는 어떤 티어에서도 이러한 기능을 지원하지 않습니다. 입력은 텍스트, 이미지, 비디오, 오디오 및 PDF일 수 있으며, 출력은 텍스트입니다.
- "무제한" 티어. 무제한 Gemini 액세스를 약속하는 사이트는 누군가의 키를 프록시하거나 다른 모델을 제공하는 것입니다. 무료 Gemini API 액세스 가이드는 이를 구별하는 방법을 설명하며, Gemini 3.6 Flash에서 작동했던 동일한 무료 티어 플레이북이 여기에도 적용됩니다.
Apidog로 무료 할당량 더 오래 사용하기
무료 티어는 규율에 보상합니다. 손으로 다시 입력하는 모든 요청, 실수로 유발하는 모든 429 오류, 그리고 필요 없었던 고수준 사고 호출은 모두 돌려받지 못하는 할당량입니다. Apidog는 이러한 규율을 저렴하게 만듭니다.
`GEMINI_API_KEY`를 Apidog 환경의 환경 변수로 저장하여, 키가 요청 본문이나 공유 컬렉션에 절대 나타나지 않도록 하십시오. Interactions 호출과 레거시 `generateContent` 호출을 프롬프트, 모델 및 `thinking_level`이 채워진 명명된 요청으로 저장하고, JSON을 편집하는 대신 변수로 수준을 전환하십시오. 상태 코드에 대한 어설션(assertion)을 추가하여 429 오류가 혼란스러운 빈 응답 대신 실패한 테스트로 표시되도록 하고, 레거시 엔드포인트의 `usageMetadata.thoughtsTokenCount`에 대한 어설션을 추가하여 사고에 얼마나 많은 할당량이 사용되었는지 확인할 수 있습니다.
그런 다음 작은 스모크 테스트를 예약하십시오: 하루에 한 번 `low` 요청. 이는 사용자가 알기 전에 모델의 동작이나 무료 제한이 변경될 때 알려줍니다. Apidog를 다운로드하여 설정하고, 타이밍 옵션에 대해 Apidog에서 API 테스트 예약 방법을 확인하십시오.
자주 묻는 질문
Gemini 3.8 Flash는 무료인가요? 예, Google AI Studio 및 Gemini API 무료 티어를 통해 속도 제한이 있으며, 사용자 데이터는 Google 제품 개선에 사용됩니다. 이 모델은 유료 티어에서 사용하는 것과 동일한 `gemini-3.8-flash`입니다.
Gemini 앱에서 Gemini 3.8 Flash를 무료로 사용할 수 있나요? 아니요. 이 앱은 Google AI Pro 및 Ultra 구독자에게 3.8 Flash를 제공합니다. Google 검색의 AI 모드와 스프레드시트의 Gemini는 구독 없이 사용할 수 있는 소비자 인터페이스입니다.
Gemini 3.8 Flash의 무료 티어 속도 제한은 어떻게 되나요? Google은 문서 텍스트가 아닌 AI Studio 속도 제한 페이지에 모델별로 표시하며, 이는 변경됩니다. 프로젝트에 대한 해당 페이지를 확인하십시오. 더 많은 것이 필요한 경우, 결제 계정을 연결하면 지출 없이 Tier 1로 이동합니다.
무료 티어에 사고(thinking) 기능이 포함되어 있나요? 예. 세 가지 수준(`low`, `medium`, `high`) 모두 무료 티어에서 작동하며, `medium`이 기본값입니다. `minimal`은 3.8 Flash에서 오류를 반환합니다. 사고 토큰은 토큰 제한에 포함되므로, `low`가 무료 할당량을 가장 오래 사용할 수 있도록 합니다. 수준별 측정 비용은 사고 수준 비교를 참조하십시오.
Gemini 3.8 Flash Cyber는 무료인가요? Fairwind 프로그램 외부에서는 전혀 사용할 수 없습니다. 일반 개발자는 3.8 Flash를 사용하여 자체 API 보안 테스트를 실행할 수 있습니다.
무료로 시작하고, 그 다음에 결정하세요
무료 티어는 Gemini 3.8 Flash의 실제 평가 환경이며, 단순한 맛보기가 아닙니다. 키를 생성하고, `low` 수준에서 사고를 유지하고, 민감한 데이터를 넣지 말고, 추측 대신 속도 제한 페이지를 읽으십시오. 429 오류가 시간을 낭비하기 시작하면 Tier 1에 대한 결제를 연결하고 비동기적인 모든 작업에 배치를 사용하십시오. 12월까지 백만 입력 토큰당 $0.375이므로, 첫 유료 월 요금은 무료 티어 재설정을 기다리며 마신 커피 값보다 저렴할 것입니다.
