Gemini 4 Argon은 도입 기간 동안 100만 입력 토큰당 2달러, 100만 출력 토큰당 10달러이며, 이후에는 각각 4달러와 20달러입니다. 캐시된 입력은 입력 가격에서 95% 할인되어, 도입 기간에는 100만 토큰당 0.10달러, 이후에는 0.20달러가 됩니다. 구글은 도입 기간이 얼마나 지속될지는 밝히지 않았으며, 아직 Argon을 구매할 수는 없습니다. 발표는 되었지만 일반에 공개되지 않았으며, 현재는 Fairwind Program 사이버 방어자에게만 제공됩니다.
이 게시물은 그 가격표를 예산 수치로 변환합니다: 7가지 현재 모델과의 비교, 4가지 시나리오 분석, 제3자 태스크당 비용, 그리고 지금 설정해야 할 비용 통제. 모델 자체에 대해서는 Gemini 4 Argon이 무엇인지부터 시작하고, 접근에 대해서는 Gemini 4 Argon이 무료인지를 참조하세요. Apidog에서 현재 호출할 수 있는 모델에 대해 비용 주장을 구성하고 나중에 모델 이름을 교체할 수 있습니다.

가격표
구글은 Gemini 4 Argon 출시 게시물에 가격을 게시했으며, 도입 후 요율은 각주 1에 "도입 기간 만료 후, 100만 입력 토큰당 4달러, 100만 출력 토큰당 20달러의 가격이 적용됩니다."라고 명시되어 있습니다.
| Gemini 4 Argon, 100만 토큰당 | 도입 기간 | 표준 (도입 기간 후) |
|---|---|---|
| 입력 | $2.00 | $4.00 |
| 캐시된 입력 (입력 가격에서 95% 할인) | $0.10 | $0.20 |
| 출력 | $10.00 | $20.00 |
| 응답당 최대 출력 (Google) | 100만 토큰 | 100만 토큰 |
| 100만 토큰 전체 출력 비용 | $10.00 | $20.00 |
캐시 요금은 구글의 95% 규칙($2 x 0.05 및 $4 x 0.05)에 따른 계산입니다. 구글은 입력 컨텍스트 창이나 모델 ID를 게시하지 않았습니다. 출력 제한이 "이전 64K 토큰에서 증가한" 100만 토큰이라고 밝혔습니다. 적어도 한 타사 평가 기관인 Vals AI는 테스트한 구성에 대해 262K의 최대 출력을 나열했습니다.
Argon vs 현재 최첨단 및 Gemini 모델
모든 가격은 100만 토큰당입니다.
| 모델 | 입력 | 캐시된 입력 | 출력 | 최대 출력 |
|---|---|---|---|---|
| Gemini 4 Argon (도입 기간) | $2 | $0.10 | $10 | 1M |
| Gemini 4 Argon (표준) | $4 | $0.20 | $20 | 1M |
| GPT-6 Astra | $10 | $1 | $50 | 128,000 |
| Claude Opus 5.5 | $4 | $0.20 | $20 | 128K (Batch에서 300K, 베타) |
| Claude Sonnet 5.5 | $2 | $0.20 | $10 | 128K (Batch에서 300K, 베타) |
| GPT-6.1 Sol | $2 | $0.10 | $10 | 128,000 |
| Claude Fable 5.1 | $10 | $0.25 | $50 | 128K |
| gemini-3.1-pro-preview (프롬프트 <=200K / >200K) | $2 / $4 | $0.20 / $0.40 | $12 / $18 | 65,536 |
| gemini-3.8-flash (도입 기간 / 2027년 1월 1일부터) | $0.75 / $1.50 | $0.075 / $0.15 | $3.75 / $7.50 | 65,536 |
경쟁사 가격은 공급업체 자체 페이지에서 가져온 것입니다: OpenAI의 GPT-6 Astra 페이지, Anthropic의 가격 페이지, 그리고 Google의 Gemini API 가격 페이지.
- 표준 Argon = Claude Opus 5.5. 동일한 $4/$20, 동일한 $0.20 캐시된 입력.
- 도입 기간 Argon = Claude Sonnet 5.5 및 GPT-6.1 Sol. 동일한 $2/$10; $0.10 도입 기간 캐시 요율은 GPT-6.1 Sol과 일치.
- GPT-6 Astra 및 Claude Fable 5.1은 도입 기간 Argon의 5배, 표준 Argon의 2.5배. Claude Fable 5.1 가격 참조.
- Argon의 도입 기간 출력($10)은 gemini-3.1-pro-preview($12)보다 낮습니다 (구글의 이전 최고 Pro 모델).
- 긴 프롬프트는 계산을 변경합니다. OpenAI는 272K 입력 토큰을 초과하는 프롬프트에 대해 전체 요청에 대해 입력 및 캐시 비용은 2배, 출력 비용은 1.5배로 청구합니다. Gemini 3.1 Pro는 200K를 초과하면 더 많이 청구하지만, Anthropic은 그렇지 않습니다. 구글은 Argon에 긴 프롬프트 계층이 있는지 여부를 밝히지 않았습니다.
가격과 함께 성능에 대해서는 Gemini 4 Argon vs GPT-6 Astra vs Claude Opus 5.5를 참조하세요.
사고 토큰은 출력으로 청구됨
현재 Gemini 모델에서는 사고 토큰이 출력으로 청구됩니다. 구글의 사고 문서에 따르면 "응답 가격은 출력 토큰과 사고 토큰의 합계"입니다. 구글은 Argon에 대해 특별히 문서화하지 않았지만, 동일한 규칙이 적용될 것으로 예상됩니다. 구글은 "가장 높은 사고 설정"으로 Argon의 평가를 실행했으므로, "$10 per 1M output tokens"는 답변과 추론을 모두 포함하는 것으로 해석됩니다.
4가지 시나리오 분석
아래의 모든 수치는 토큰 수를 100만으로 나눈 값에 100만 토큰당 요율을 곱한 것입니다. 시나리오 1부터 3까지는 캐싱이 없다고 가정합니다.
1. 일반적인 API 호출: 입력 20K, 출력 5K
- 도입 기간: 20,000 / 100만 x $2 = $0.04 (입력) + 5,000 / 100만 x $10 = $0.05 (출력). 총 $0.09.
- 표준: $0.08 + $0.10 = $0.18.
하루에 1,000번 호출하면 도입 기간에는 $90, 표준 기간에는 $180입니다. 동일한 호출은 Claude Opus 5.5에서 $0.18, GPT-6 Astra에서 $0.45 ($0.20 + $0.25), gemini-3.1-pro-preview에서 $0.10 ($0.04 + $0.06), gemini-3.8-flash의 도입 기간 요율에서는 약 $0.034 ($0.015 + $0.019)입니다.
2. 긴 에이전트 턴: 입력 200K, 출력 50K
- 도입 기간: 200,000 / 100만 x $2 = $0.40 + 50,000 / 100만 x $10 = $0.50. 총 $0.90.
- 표준: $0.80 + $1.00 = $1.80.
GPT-6 Astra는 $4.50 ($2.00 + $2.50)를 청구할 것입니다. gemini-3.1-pro-preview는 $1.00 ($0.40 + $0.60)를 청구하지만, 200K는 그 모델의 계층 구분선입니다. 더 긴 프롬프트는 $4/$18로 청구됩니다. 만약 Argon이 유사한 계층을 가진다면, 더 긴 턴은 더 많은 비용이 듭니다.
3. 최대 출력 응답 한 번: 100만 출력 토큰
출력만 따지면 도입 기간에는 1,000,000 / 100만 x $10 = $10.00, 표준 기간에는 $20.00입니다. 여기에 100K 토큰 프롬프트($0.20 도입 기간, $0.40 표준)를 추가하면 호출 비용은 $10.20 또는 $20.40입니다.
테이블의 다른 모델은 이 정도를 하나의 동기식 응답으로 생성하지 못합니다. 경쟁사들은 128K로 제한되며, 이전 Gemini Pro는 65,536이었습니다. Vals에 나열된 262K 최대 출력에서, 전체 응답 비용은 도입 기간에 약 $2.62, 표준 기간에 $5.24입니다. 엔지니어링 측면 (타임아웃, 스트리밍, 게이트웨이)은 Gemini 4 Argon의 100만 출력 토큰에 있습니다.
4. 캐시된 500K 토큰 프롬프트를 10번 재사용
동일한 500K 토큰 코드베이스 또는 계약 세트를 10번 전송하고, 각 호출에서 5K 토큰의 출력이 나온다고 가정합니다. 첫 번째 호출은 캐시를 구축하기 위해 전체 입력 가격을 지불하고, 다음 9번의 호출은 캐시에서 읽는다고 가정합니다.
| 10회 호출, 500K 프롬프트, 각 5K 출력 | 도입 기간 | 표준 |
|---|---|---|
| 입력, 캐싱 없음 (10 x 500K) | $10.00 | $20.00 |
| 입력, 캐시됨 (1회 전체 + 9회 캐시) | $1.00 + 9 x $0.05 = $1.45 | $2.00 + 9 x $0.10 = $2.90 |
| 출력 (10 x 5K) | $0.50 | $1.00 |
| 캐싱 포함 총계 | $1.95 | $3.90 |
| 캐싱 없음 총계 | $10.50 | $21.00 |
캐싱은 입력 요금을 85.5% 절감합니다. 두 가지 주의사항: 구글은 Argon이 캐시 저장 비용을 청구하는지 여부를 밝히지 않았고 (gemini-3.1-pro-preview는 500K 토큰을 한 시간 동안 보관하는 데 시간당 100만 토큰당 $4.50를 청구하며, 이는 $2.25가 추가될 것입니다), 500K 프롬프트는 3.1 Pro의 200K 기준선을 넘어섭니다. Argon의 표준 캐시 요율은 Opus 5.5의 $0.20와 일치하므로, Claude Opus 5.5 프롬프트 캐싱 비용 계산의 손익분기점 논리가 그대로 적용됩니다.
토큰당 가격이 태스크당 비용은 아니다
Artificial Analysis는 Gemini 4 Argon (High)에서 Intelligence Index를 실행하는 데 도입 가격으로 태스크당 $1.99를, The Decoder는 표준 가격으로 동일한 실행에 $3.98를 나열합니다. AA는 Argon을 53점으로 평가했으며, 이는 GPT-6 Astra (최대)와 동일하며, Astra의 태스크당 비용은 $3.26입니다.
문제는 토큰 볼륨입니다. AA는 Argon (high)의 태스크당 약 62K 출력 토큰을 계산하며, Astra의 최대 설정에서는 약 27K로, 약 2.3배입니다. 도입 기간의 태스크당 출력: 62,000 / 100만 x $10 = $0.62, Astra는 27,000 / 100만 x $50 = $1.35. 표준 기간에서 The Decoder의 Argon 전체 태스크 비용($3.98)은 Astra의 표준 요율보다 60% 낮음에도 불구하고 AA의 Astra (최대) 비용($3.26)을 상회합니다.
Vals AI도 동일한 패턴을 보여줍니다. Vals Index에서 Argon의 테스트당 비용은 $15.68이며, Claude Opus 5.5는 $32.14, Claude Sonnet 5.5는 $21.34, GPT-6.1 Sol은 $3.24로 Argon은 $4/$20 표준 요율로 나열되어 있습니다. Sonnet 5.5와 GPT-6.1 Sol은 서류상으로는 Argon의 도입 가격과 같지만, 테스트당 비용은 6배 이상 차이가 납니다.
요율표가 아닌 자신의 토큰 수를 기준으로 예산을 세우십시오.
Argon 출시 전 설정해야 할 비용 통제
- 출력 제한. generateContent에서
generationConfig.maxOutputTokens는 상한선을 설정합니다. 구글은 새 모델이 Interactions API에서 출시된다고 밝혔으므로, Argon에 대한 문서가 나오면 그곳에 해당하는 제한을 설정하십시오. 100만 토큰 제한은 표준 요율에서 호출당 $20의 출력 제한입니다. - 안정적인 콘텐츠 캐싱. 호출 전반에 걸쳐 반복되는 시스템 지침, 스키마 및 참조 문서는 95% 할인이 효과를 발휘하는 부분입니다.
- 사고 수준을 의도적으로 선택. 구글은 Argon의 수준을 공개하지 않았습니다. 현재 gemini-3.1-pro-preview는 기본적으로
high로, gemini-3.8-flash는medium으로 설정되어 있습니다. Argon의 문서가 나오면, 더 낮은 수준이 작업에서 품질을 유지하는지 테스트하십시오. - 사용량에 대한 주장. 모든 generateContent 응답은
usageMetadata로 끝납니다. Apidog에서GEMINI_MODEL환경 변수에 모델을 포함하여 요청을 저장하고,usageMetadata의 토큰 수에서 비용을 계산하는 응답 후 어설션을 추가하고, 호출이 설정한 상한선을 초과하면 테스트를 실패하도록 하십시오. 오늘 gemini-3.8-flash에 대해 실행하고, Argon의 ID가 출시되면 변수 하나를 변경하고 스위트를 다시 실행하십시오.
그 어설션의 계산식:
cost = uncached_input / 1,000,000 x input_rate
+ cached_input / 1,000,000 x cached_rate
+ (output + thinking) / 1,000,000 x output_rate
구글이 아직 가격을 책정하지 않은 것
도입 기간의 길이 및 $4/$20 요율이 시작되는 날짜; 200K를 초과하는 프롬프트가 더 많은 비용이 드는지 여부; Batch 또는 Flex 가격 (3.1 Pro는 둘 다 있으며, 입력 $1/$2, 출력 $6/$9); 캐시 저장 요금; 요율 제한; 그리고 무료 계층이 있는지 여부.
FAQ
Gemini 4 Argon은 100만 토큰당 얼마인가요? 도입 기간 동안 입력 2달러, 출력 10달러이며, 이후에는 4달러와 20달러입니다. 캐시된 입력은 95% 할인되어 0.10달러, 이후에는 0.20달러입니다.
도입 가격은 얼마나 오래 지속되나요? 구글은 밝히지 않았습니다. 출시 게시물에는 종료 날짜나 기간이 없습니다.
사고 토큰도 출력으로 청구되나요? 현재 Gemini 모델에서는 그렇습니다. 구글은 Argon의 규칙을 특별히 문서화하지 않았습니다.
100만 토큰 출력 응답 비용은 얼마인가요? 입력 비용을 제외하고 도입 가격으로 10달러, 표준 가격으로 20달러입니다.
Argon이 Claude Opus 5.5나 GPT-6 Astra보다 저렴한가요? 토큰당 가격으로 보면, 표준 Argon은 Opus 5.5와 같고 Astra보다 60% 저렴합니다. 태스크당 비용은 토큰 볼륨에 따라 다릅니다: Artificial Analysis는 Argon이 Astra 출력 토큰의 약 2.3배를 사용한다고 측정했습니다. 더 저렴한 Gemini를 원하시면 Gemini 3.8 Flash 가격을 참조하십시오.
오늘 Argon을 구매할 수 있나요? 아니요. 현재 Fairwind Program 파트너에게만 제공됩니다. 유료 API 고객과 Google AI Ultra 구독자는 다음 순서이지만 날짜는 정해지지 않았습니다.
지금 예산을 세우고 나중에 측정하세요
현재 트래픽의 토큰 수를 $2/$10 및 $4/$20로 곱하면 Argon의 도입 및 표준 범위를 알 수 있습니다. 그런 다음 측정을 구축하십시오: Apidog 다운로드, GEMINI_MODEL을 변수로 하여 gemini-3.8-flash에 대한 요청을 저장하고, usageMetadata에 비용 어설션을 추가하십시오. 구글이 모델 ID를 게시하면, 변수 하나를 교체하고 첫날부터 실제 호출당 비용을 확인할 수 있습니다.
