제미니 4 아르곤 가격: 출시가 $2/$10, 일반가 $4/$20, 100만 토큰 답변 비용

Gemini 4 Argon 가격: 1백만 토큰당 초기 $2/$10, 이후 $4/$20 (입력/출력). 캐시된 입력은 95% 할인됩니다. 1백만 토큰 답변을 기준으로 비용을 계산하고 경쟁사 가격을 검토했습니다.

INEZA Felin-Michel

INEZA Felin-Michel

2 October 2026

제미니 4 아르곤 가격: 출시가 $2/$10, 일반가 $4/$20, 100만 토큰 답변 비용

Apidog 엔터프라이즈

온프레미스 배포

SSO & RBAC

SOC 2 준수

Apidog Enterprise 살펴보기

Gemini 4 Argon은 도입 기간 동안 100만 입력 토큰당 2달러, 100만 출력 토큰당 10달러이며, 이후에는 각각 4달러와 20달러입니다. 캐시된 입력은 입력 가격에서 95% 할인되어, 도입 기간에는 100만 토큰당 0.10달러, 이후에는 0.20달러가 됩니다. 구글은 도입 기간이 얼마나 지속될지는 밝히지 않았으며, 아직 Argon을 구매할 수는 없습니다. 발표는 되었지만 일반에 공개되지 않았으며, 현재는 Fairwind Program 사이버 방어자에게만 제공됩니다.

버튼

이 게시물은 그 가격표를 예산 수치로 변환합니다: 7가지 현재 모델과의 비교, 4가지 시나리오 분석, 제3자 태스크당 비용, 그리고 지금 설정해야 할 비용 통제. 모델 자체에 대해서는 Gemini 4 Argon이 무엇인지부터 시작하고, 접근에 대해서는 Gemini 4 Argon이 무료인지를 참조하세요. Apidog에서 현재 호출할 수 있는 모델에 대해 비용 주장을 구성하고 나중에 모델 이름을 교체할 수 있습니다.

fe

가격표

구글은 Gemini 4 Argon 출시 게시물에 가격을 게시했으며, 도입 후 요율은 각주 1에 "도입 기간 만료 후, 100만 입력 토큰당 4달러, 100만 출력 토큰당 20달러의 가격이 적용됩니다."라고 명시되어 있습니다.

Gemini 4 Argon, 100만 토큰당 도입 기간 표준 (도입 기간 후)
입력 $2.00 $4.00
캐시된 입력 (입력 가격에서 95% 할인) $0.10 $0.20
출력 $10.00 $20.00
응답당 최대 출력 (Google) 100만 토큰 100만 토큰
100만 토큰 전체 출력 비용 $10.00 $20.00

캐시 요금은 구글의 95% 규칙($2 x 0.05 및 $4 x 0.05)에 따른 계산입니다. 구글은 입력 컨텍스트 창이나 모델 ID를 게시하지 않았습니다. 출력 제한이 "이전 64K 토큰에서 증가한" 100만 토큰이라고 밝혔습니다. 적어도 한 타사 평가 기관인 Vals AI는 테스트한 구성에 대해 262K의 최대 출력을 나열했습니다.

Argon vs 현재 최첨단 및 Gemini 모델

모든 가격은 100만 토큰당입니다.

모델 입력 캐시된 입력 출력 최대 출력
Gemini 4 Argon (도입 기간) $2 $0.10 $10 1M
Gemini 4 Argon (표준) $4 $0.20 $20 1M
GPT-6 Astra $10 $1 $50 128,000
Claude Opus 5.5 $4 $0.20 $20 128K (Batch에서 300K, 베타)
Claude Sonnet 5.5 $2 $0.20 $10 128K (Batch에서 300K, 베타)
GPT-6.1 Sol $2 $0.10 $10 128,000
Claude Fable 5.1 $10 $0.25 $50 128K
gemini-3.1-pro-preview (프롬프트 <=200K / >200K) $2 / $4 $0.20 / $0.40 $12 / $18 65,536
gemini-3.8-flash (도입 기간 / 2027년 1월 1일부터) $0.75 / $1.50 $0.075 / $0.15 $3.75 / $7.50 65,536

경쟁사 가격은 공급업체 자체 페이지에서 가져온 것입니다: OpenAI의 GPT-6 Astra 페이지, Anthropic의 가격 페이지, 그리고 Google의 Gemini API 가격 페이지.

가격과 함께 성능에 대해서는 Gemini 4 Argon vs GPT-6 Astra vs Claude Opus 5.5를 참조하세요.

사고 토큰은 출력으로 청구됨

현재 Gemini 모델에서는 사고 토큰이 출력으로 청구됩니다. 구글의 사고 문서에 따르면 "응답 가격은 출력 토큰과 사고 토큰의 합계"입니다. 구글은 Argon에 대해 특별히 문서화하지 않았지만, 동일한 규칙이 적용될 것으로 예상됩니다. 구글은 "가장 높은 사고 설정"으로 Argon의 평가를 실행했으므로, "$10 per 1M output tokens"는 답변과 추론을 모두 포함하는 것으로 해석됩니다.

4가지 시나리오 분석

아래의 모든 수치는 토큰 수를 100만으로 나눈 값에 100만 토큰당 요율을 곱한 것입니다. 시나리오 1부터 3까지는 캐싱이 없다고 가정합니다.

1. 일반적인 API 호출: 입력 20K, 출력 5K

하루에 1,000번 호출하면 도입 기간에는 $90, 표준 기간에는 $180입니다. 동일한 호출은 Claude Opus 5.5에서 $0.18, GPT-6 Astra에서 $0.45 ($0.20 + $0.25), gemini-3.1-pro-preview에서 $0.10 ($0.04 + $0.06), gemini-3.8-flash의 도입 기간 요율에서는 약 $0.034 ($0.015 + $0.019)입니다.

2. 긴 에이전트 턴: 입력 200K, 출력 50K

GPT-6 Astra는 $4.50 ($2.00 + $2.50)를 청구할 것입니다. gemini-3.1-pro-preview는 $1.00 ($0.40 + $0.60)를 청구하지만, 200K는 그 모델의 계층 구분선입니다. 더 긴 프롬프트는 $4/$18로 청구됩니다. 만약 Argon이 유사한 계층을 가진다면, 더 긴 턴은 더 많은 비용이 듭니다.

3. 최대 출력 응답 한 번: 100만 출력 토큰

출력만 따지면 도입 기간에는 1,000,000 / 100만 x $10 = $10.00, 표준 기간에는 $20.00입니다. 여기에 100K 토큰 프롬프트($0.20 도입 기간, $0.40 표준)를 추가하면 호출 비용은 $10.20 또는 $20.40입니다.

테이블의 다른 모델은 이 정도를 하나의 동기식 응답으로 생성하지 못합니다. 경쟁사들은 128K로 제한되며, 이전 Gemini Pro는 65,536이었습니다. Vals에 나열된 262K 최대 출력에서, 전체 응답 비용은 도입 기간에 약 $2.62, 표준 기간에 $5.24입니다. 엔지니어링 측면 (타임아웃, 스트리밍, 게이트웨이)은 Gemini 4 Argon의 100만 출력 토큰에 있습니다.

4. 캐시된 500K 토큰 프롬프트를 10번 재사용

동일한 500K 토큰 코드베이스 또는 계약 세트를 10번 전송하고, 각 호출에서 5K 토큰의 출력이 나온다고 가정합니다. 첫 번째 호출은 캐시를 구축하기 위해 전체 입력 가격을 지불하고, 다음 9번의 호출은 캐시에서 읽는다고 가정합니다.

10회 호출, 500K 프롬프트, 각 5K 출력 도입 기간 표준
입력, 캐싱 없음 (10 x 500K) $10.00 $20.00
입력, 캐시됨 (1회 전체 + 9회 캐시) $1.00 + 9 x $0.05 = $1.45 $2.00 + 9 x $0.10 = $2.90
출력 (10 x 5K) $0.50 $1.00
캐싱 포함 총계 $1.95 $3.90
캐싱 없음 총계 $10.50 $21.00

캐싱은 입력 요금을 85.5% 절감합니다. 두 가지 주의사항: 구글은 Argon이 캐시 저장 비용을 청구하는지 여부를 밝히지 않았고 (gemini-3.1-pro-preview는 500K 토큰을 한 시간 동안 보관하는 데 시간당 100만 토큰당 $4.50를 청구하며, 이는 $2.25가 추가될 것입니다), 500K 프롬프트는 3.1 Pro의 200K 기준선을 넘어섭니다. Argon의 표준 캐시 요율은 Opus 5.5의 $0.20와 일치하므로, Claude Opus 5.5 프롬프트 캐싱 비용 계산의 손익분기점 논리가 그대로 적용됩니다.

토큰당 가격이 태스크당 비용은 아니다

Artificial Analysis는 Gemini 4 Argon (High)에서 Intelligence Index를 실행하는 데 도입 가격으로 태스크당 $1.99를, The Decoder는 표준 가격으로 동일한 실행에 $3.98를 나열합니다. AA는 Argon을 53점으로 평가했으며, 이는 GPT-6 Astra (최대)와 동일하며, Astra의 태스크당 비용은 $3.26입니다.

문제는 토큰 볼륨입니다. AA는 Argon (high)의 태스크당 약 62K 출력 토큰을 계산하며, Astra의 최대 설정에서는 약 27K로, 약 2.3배입니다. 도입 기간의 태스크당 출력: 62,000 / 100만 x $10 = $0.62, Astra는 27,000 / 100만 x $50 = $1.35. 표준 기간에서 The Decoder의 Argon 전체 태스크 비용($3.98)은 Astra의 표준 요율보다 60% 낮음에도 불구하고 AA의 Astra (최대) 비용($3.26)을 상회합니다.

Vals AI도 동일한 패턴을 보여줍니다. Vals Index에서 Argon의 테스트당 비용은 $15.68이며, Claude Opus 5.5는 $32.14, Claude Sonnet 5.5는 $21.34, GPT-6.1 Sol은 $3.24로 Argon은 $4/$20 표준 요율로 나열되어 있습니다. Sonnet 5.5와 GPT-6.1 Sol은 서류상으로는 Argon의 도입 가격과 같지만, 테스트당 비용은 6배 이상 차이가 납니다.

요율표가 아닌 자신의 토큰 수를 기준으로 예산을 세우십시오.

Argon 출시 전 설정해야 할 비용 통제

그 어설션의 계산식:

cost = uncached_input / 1,000,000 x input_rate
     + cached_input   / 1,000,000 x cached_rate
     + (output + thinking) / 1,000,000 x output_rate

구글이 아직 가격을 책정하지 않은 것

도입 기간의 길이 및 $4/$20 요율이 시작되는 날짜; 200K를 초과하는 프롬프트가 더 많은 비용이 드는지 여부; Batch 또는 Flex 가격 (3.1 Pro는 둘 다 있으며, 입력 $1/$2, 출력 $6/$9); 캐시 저장 요금; 요율 제한; 그리고 무료 계층이 있는지 여부.

FAQ

Gemini 4 Argon은 100만 토큰당 얼마인가요? 도입 기간 동안 입력 2달러, 출력 10달러이며, 이후에는 4달러와 20달러입니다. 캐시된 입력은 95% 할인되어 0.10달러, 이후에는 0.20달러입니다.

도입 가격은 얼마나 오래 지속되나요? 구글은 밝히지 않았습니다. 출시 게시물에는 종료 날짜나 기간이 없습니다.

사고 토큰도 출력으로 청구되나요? 현재 Gemini 모델에서는 그렇습니다. 구글은 Argon의 규칙을 특별히 문서화하지 않았습니다.

100만 토큰 출력 응답 비용은 얼마인가요? 입력 비용을 제외하고 도입 가격으로 10달러, 표준 가격으로 20달러입니다.

Argon이 Claude Opus 5.5나 GPT-6 Astra보다 저렴한가요? 토큰당 가격으로 보면, 표준 Argon은 Opus 5.5와 같고 Astra보다 60% 저렴합니다. 태스크당 비용은 토큰 볼륨에 따라 다릅니다: Artificial Analysis는 Argon이 Astra 출력 토큰의 약 2.3배를 사용한다고 측정했습니다. 더 저렴한 Gemini를 원하시면 Gemini 3.8 Flash 가격을 참조하십시오.

오늘 Argon을 구매할 수 있나요? 아니요. 현재 Fairwind Program 파트너에게만 제공됩니다. 유료 API 고객과 Google AI Ultra 구독자는 다음 순서이지만 날짜는 정해지지 않았습니다.

지금 예산을 세우고 나중에 측정하세요

현재 트래픽의 토큰 수를 $2/$10 및 $4/$20로 곱하면 Argon의 도입 및 표준 범위를 알 수 있습니다. 그런 다음 측정을 구축하십시오: Apidog 다운로드, GEMINI_MODEL을 변수로 하여 gemini-3.8-flash에 대한 요청을 저장하고, usageMetadata에 비용 어설션을 추가하십시오. 구글이 모델 ID를 게시하면, 변수 하나를 교체하고 첫날부터 실제 호출당 비용을 확인할 수 있습니다.

Apidog에서 API 설계-첫 번째 연습

API를 더 쉽게 구축하고 사용하는 방법을 발견하세요