Gemini 4 Argon มีค่าใช้จ่าย $2 ต่อโทเค็นอินพุต 1 ล้านโทเค็น และ $10 ต่อโทเค็นเอาต์พุต 1 ล้านโทเค็นในช่วงโปรโมชัน หลังจากนั้นจะมีราคา $4 และ $20 ตามลำดับ อินพุตที่แคชไว้จะลด 95% จากราคาอินพุต ซึ่งคิดเป็น $0.10 ต่อโทเค็น 1 ล้านโทเค็นในอัตราโปรโมชัน และ $0.20 หลังจากนั้น Google ยังไม่ได้ระบุว่าช่วงโปรโมชันจะนานแค่ไหน และคุณยังไม่สามารถซื้อ Argon ได้: มีการประกาศแล้วแต่ยังไม่เปิดให้ใช้งานทั่วไป และวันนี้กำลังเปิดให้ใช้งานเฉพาะผู้ป้องกันภัยทางไซเบอร์ของโครงการ Fairwind เท่านั้น
โพสต์นี้เปลี่ยนตารางราคาให้เป็นตัวเลขงบประมาณ: การเปรียบเทียบกับโมเดลปัจจุบันเจ็ดรุ่น สถานการณ์จำลองสี่แบบที่ดำเนินการไปแล้ว ค่าใช้จ่ายต่อภารกิจของบุคคลที่สาม และการควบคุมค่าใช้จ่ายที่ต้องตั้งค่าตอนนี้ สำหรับตัวโมเดลเอง เริ่มต้นด้วย Gemini 4 Argon คืออะไร; สำหรับการเข้าถึง ดูที่ Gemini 4 Argon ฟรีหรือไม่ คุณสามารถสร้างการยืนยันค่าใช้จ่ายใน Apidog กับโมเดลที่คุณสามารถเรียกใช้ได้วันนี้ และสลับชื่อโมเดลในภายหลัง

ตารางราคา
Google ได้เผยแพร่ราคาใน โพสต์เปิดตัว Gemini 4 Argon โดยมีอัตราราคาหลังช่วงโปรโมชันอยู่ในเชิงอรรถ 1: “หลังจากช่วงโปรโมชันสิ้นสุดลง ราคา $4 ต่อโทเค็นอินพุต 1 ล้านโทเค็น และ $20 ต่อโทเค็นเอาต์พุต 1 ล้านโทเค็นจะมีผลบังคับใช้”
| Gemini 4 Argon, ต่อโทเค็น 1 ล้านโทเค็น | ช่วงโปรโมชัน | มาตรฐาน (หลังช่วงโปรโมชัน) |
|---|---|---|
| อินพุต | $2.00 | $4.00 |
| อินพุตที่แคช (ลด 95% จากอินพุต) | $0.10 | $0.20 |
| เอาต์พุต | $10.00 | $20.00 |
| เอาต์พุตสูงสุดต่อการตอบสนอง (Google) | 1M tokens | 1M tokens |
| ค่าใช้จ่ายสำหรับเอาต์พุต 1 ล้านโทเค็นเต็ม | $10.00 | $20.00 |
อัตราที่แคชไว้คำนวณจากกฎ 95% ของ Google ($2 x 0.05 และ $4 x 0.05) Google ยังไม่ได้เผยแพร่ขนาดหน้าต่างบริบทอินพุตหรือรหัสโมเดล ระบุว่าขีดจำกัดเอาต์พุตคือ 1 ล้านโทเค็น “เพิ่มขึ้นจากเดิม 64K โทเค็น”; อย่างน้อยผู้ประเมินบุคคลที่สามรายหนึ่งคือ Vals AI ระบุว่ามีเอาต์พุตสูงสุด 262K สำหรับการกำหนดค่าที่ทดสอบ
Argon เทียบกับโมเดล Frontier และ Gemini ปัจจุบัน
ราคาทั้งหมดเป็นต่อโทเค็น 1 ล้านโทเค็น
| โมเดล | อินพุต | อินพุตที่แคช | เอาต์พุต | เอาต์พุตสูงสุด |
|---|---|---|---|---|
| Gemini 4 Argon (ช่วงโปรโมชัน) | $2 | $0.10 | $10 | 1M |
| Gemini 4 Argon (มาตรฐาน) | $4 | $0.20 | $20 | 1M |
| GPT-6 Astra | $10 | $1 | $50 | 128,000 |
| Claude Opus 5.5 | $4 | $0.20 | $20 | 128K (300K on Batch, beta) |
| Claude Sonnet 5.5 | $2 | $0.20 | $10 | 128K (300K on Batch, beta) |
| GPT-6.1 Sol | $2 | $0.10 | $10 | 128,000 |
| Claude Fable 5.1 | $10 | $0.25 | $50 | 128K |
| gemini-3.1-pro-preview (พร้อมท์ <=200K / >200K) | $2 / $4 | $0.20 / $0.40 | $12 / $18 | 65,536 |
| gemini-3.8-flash (ช่วงโปรโมชัน / ตั้งแต่ 2027-01-01) | $0.75 / $1.50 | $0.075 / $0.15 | $3.75 / $7.50 | 65,536 |
ราคาของคู่แข่งมาจากหน้าเว็บของผู้ให้บริการเอง: หน้า GPT-6 Astra ของ OpenAI, หน้าการกำหนดราคาของ Anthropic และ หน้าการกำหนดราคา Gemini API ของ Google
- Standard Argon = Claude Opus 5.5. ราคา $4/$20 เท่ากัน อินพุตที่แคชไว้ $0.20 เท่ากัน
- Intro Argon = Claude Sonnet 5.5 และ GPT-6.1 Sol. ราคา $2/$10 เท่ากัน; อัตราแคชช่วงโปรโมชัน $0.10 ตรงกับ GPT-6.1 Sol.
- GPT-6 Astra และ Claude Fable 5.1 มีราคาเป็น 5 เท่าของ Intro Argon และ 2.5 เท่าของ Standard Argon ดู การกำหนดราคา Claude Fable 5.1
- เอาต์พุตช่วงโปรโมชันของ Argon ($10) ต่ำกว่าของ gemini-3.1-pro-preview ($12) ซึ่งเป็นโมเดล Pro ระดับสูงสุดก่อนหน้าของ Google
- พร้อมท์ที่ยาวขึ้นเปลี่ยนการคำนวณ. OpenAI คิดค่าบริการพร้อมท์ที่เกิน 272K โทเค็นอินพุตเป็น 2 เท่าของอินพุตและแคช และ 1.5 เท่าของเอาต์พุตสำหรับการร้องขอทั้งหมด Gemini 3.1 Pro คิดค่าบริการเพิ่มขึ้นเมื่อเกิน 200K; ส่วน Anthropic ไม่คิด Google ยังไม่ได้ระบุว่า Argon มีระดับราคาสำหรับพร้อมท์ที่ยาวหรือไม่
สำหรับความสามารถควบคู่ไปกับราคา ดูที่ Gemini 4 Argon เทียบกับ GPT-6 Astra เทียบกับ Claude Opus 5.5
โทเค็นการคิดคำนวณเป็นเอาต์พุต
ในโมเดล Gemini ปัจจุบัน โทเค็นการคิดจะถูกเรียกเก็บเงินเป็นเอาต์พุต: เอกสารเกี่ยวกับการคิดของ Google ระบุว่า “ราคาการตอบสนองคือผลรวมของโทเค็นเอาต์พุตและโทเค็นการคิด” Google ยังไม่ได้จัดทำเอกสารเกี่ยวกับ Argon โดยเฉพาะ แต่ให้ถือตามกฎเดียวกัน Google ดำเนินการประเมิน Argon “ด้วยการตั้งค่าการคิดสูงสุด” ดังนั้น ให้ตีความ “$10 ต่อโทเค็นเอาต์พุต 1 ล้านโทเค็น” ว่าเป็นการตอบและเหตุผล
สี่สถานการณ์จำลองที่ดำเนินการไปแล้ว
ตัวเลขทุกตัวด้านล่างคือโทเค็นหารด้วย 1 ล้าน คูณด้วยอัตราต่อ 1 ล้านโทเค็น สถานการณ์ที่ 1 ถึง 3 ถือว่าไม่มีการแคช
1. การเรียกใช้ API ทั่วไป: อินพุต 20K, เอาต์พุต 5K
- ช่วงโปรโมชัน: 20,000 / 1M x $2 = อินพุต $0.04, บวก 5,000 / 1M x $10 = เอาต์พุต $0.05. รวม $0.09.
- มาตรฐาน: $0.08 + $0.10 = $0.18.
ที่ 1,000 การเรียกต่อวัน นั่นคือ $90 ในช่วงโปรโมชัน หรือ $180 ในอัตรามาตรฐาน การเรียกใช้เดียวกันมีค่าใช้จ่าย $0.18 บน Claude Opus 5.5, $0.45 บน GPT-6 Astra ($0.20 + $0.25), $0.10 บน gemini-3.1-pro-preview ($0.04 + $0.06) และประมาณ $0.034 บน gemini-3.8-flash ในอัตราโปรโมชัน ($0.015 + $0.019)
2. การทำงานของเอเจนต์ที่ยาวนาน: อินพุต 200K, เอาต์พุต 50K
- ช่วงโปรโมชัน: 200,000 / 1M x $2 = $0.40, บวก 50,000 / 1M x $10 = $0.50. รวม $0.90.
- มาตรฐาน: $0.80 + $1.00 = $1.80.
GPT-6 Astra จะคิดค่าบริการ $4.50 ($2.00 + $2.50) gemini-3.1-pro-preview คิดค่าบริการ $1.00 ($0.40 + $0.60) แต่ 200K เป็นขีดจำกัดของระดับราคา: พร้อมท์ที่ยาวขึ้นจะถูกคิดค่าบริการที่ $4/$18 หาก Argon มีระดับราคาที่คล้ายกัน การทำงานที่ยาวขึ้นก็จะมีค่าใช้จ่ายมากขึ้น
3. การตอบสนองที่ใช้เอาต์พุตสูงสุดหนึ่งครั้ง: เอาต์พุต 1 ล้านโทเค็น
เอาต์พุตอย่างเดียวคือ 1,000,000 / 1M x $10 = $10.00 ในช่วงโปรโมชัน และ $20.00 ในอัตรามาตรฐาน เพิ่มพร้อมท์ 100K โทเค็น (ช่วงโปรโมชัน $0.20, มาตรฐาน $0.40) และการเรียกใช้จะมีค่าใช้จ่าย $10.20 หรือ $20.40
ไม่มีโมเดลอื่นในตารางที่สามารถสร้างสิ่งนี้ในการตอบสนองแบบซิงโครนัสครั้งเดียวได้: คู่แข่งมีขีดจำกัดที่ 128K, Gemini Pro รุ่นก่อนหน้าที่ 65,536 ที่เอาต์พุตสูงสุด 262K ที่ Vals ระบุไว้ การตอบสนองเต็มรูปแบบมีค่าใช้จ่ายประมาณ $2.62 ในช่วงโปรโมชัน หรือ $5.24 ในอัตรามาตรฐาน ด้านวิศวกรรม (การหมดเวลา, การสตรีม, เกตเวย์) อยู่ใน โทเค็นเอาต์พุต 1 ล้านโทเค็นของ Gemini 4 Argon
4. พร้อมท์ 500K โทเค็นที่แคชไว้และนำกลับมาใช้ใหม่ 10 ครั้ง
สมมติว่าคุณส่ง codebase หรือชุดสัญญา 500K โทเค็นเดียวกัน 10 ครั้ง โดยมีเอาต์พุต 5K โทเค็นในแต่ละครั้ง สมมติว่าการเรียกใช้ครั้งแรกจ่ายราคาอินพุตเต็มเพื่อสร้างแคช และอีกเก้าครั้งที่เหลืออ่านจากแคช
| 10 การเรียกใช้, พร้อมท์ 500K, เอาต์พุต 5K ในแต่ละครั้ง | ช่วงโปรโมชัน | มาตรฐาน |
|---|---|---|
| อินพุต, ไม่มีแคช (10 x 500K) | $10.00 | $20.00 |
| อินพุต, แคช (1 เต็ม + 9 แคช) | $1.00 + 9 x $0.05 = $1.45 | $2.00 + 9 x $0.10 = $2.90 |
| เอาต์พุต (10 x 5K) | $0.50 | $1.00 |
| รวมพร้อมแคช | $1.95 | $3.90 |
| รวมโดยไม่มีแคช | $10.50 | $21.00 |
การแคชช่วยลดค่าใช้จ่ายอินพุตได้ 85.5% ข้อควรระวังสองประการ: Google ยังไม่ได้ระบุว่า Argon คิดค่าบริการสำหรับการจัดเก็บแคชหรือไม่ (gemini-3.1-pro-preview คิดค่าบริการ $4.50 ต่อ 1 ล้านโทเค็นต่อชั่วโมง ซึ่งจะเพิ่ม $2.25 สำหรับการเก็บ 500K โทเค็นเป็นเวลาหนึ่งชั่วโมง) และพร้อมท์ 500K นั้นเกินกว่าขีดจำกัด 200K ของ 3.1 Pro อัตราแคชมาตรฐานของ Argon ตรงกับ $0.20 ของ Opus 5.5 ดังนั้น ตรรกะการคุ้มทุนใน การคำนวณต้นทุนการแคชพร้อมท์ของ Claude Opus 5.5 จึงยังคงใช้ได้
ราคาต่อโทเค็นไม่ใช่ต้นทุนต่อภารกิจ
Artificial Analysis ระบุราคา $1.99 ต่อภารกิจสำหรับการรัน Intelligence Index บน Gemini 4 Argon (สูง) ในราคาช่วงโปรโมชัน; The Decoder ระบุว่าการรันเดียวกันมีราคา $3.98 ในราคามาตรฐาน AA ให้คะแนน Argon 53 ซึ่งเท่ากับ GPT-6 Astra (สูงสุด) ซึ่งระบุราคาไว้ที่ $3.26 ต่อภารกิจ
จุดสำคัญคือปริมาณโทเค็น AA นับโทเค็นเอาต์พุตประมาณ 62K ต่อภารกิจสำหรับ Argon (สูง) เทียบกับประมาณ 27K สำหรับ Astra ที่การตั้งค่าสูงสุด ซึ่งประมาณ 2.3 เท่า เอาต์พุตต่อภารกิจในช่วงโปรโมชัน: 62,000 / 1M x $10 = $0.62 เทียบกับ 27,000 / 1M x $50 = $1.35 สำหรับ Astra ที่อัตรามาตรฐาน ตัวเลขเต็มภารกิจของ The Decoder สำหรับ Argon ($3.98) สูงกว่า $3.26 ของ AA สำหรับ Astra (สูงสุด) แม้ว่าอัตรามาตรฐานของ Argon จะต่ำกว่า Astra ถึง 60% ก็ตาม
Vals AI แสดงรูปแบบเดียวกัน ระบุราคา $15.68 ต่อการทดสอบสำหรับ Argon บน Vals Index เทียบกับ $32.14 สำหรับ Claude Opus 5.5, $21.34 สำหรับ Claude Sonnet 5.5 และ $3.24 สำหรับ GPT-6.1 Sol และระบุ Argon ที่อัตรามาตรฐาน $4/$20 Sonnet 5.5 และ GPT-6.1 Sol มีราคาช่วงโปรโมชันเท่ากับ Argon บนกระดาษ แต่ค่าใช้จ่ายต่อการทดสอบของพวกเขากลับแตกต่างกันมากกว่า 6 เท่า
จัดงบประมาณจากจำนวนโทเค็นของคุณเอง ไม่ใช่จากตารางราคา
การควบคุมค่าใช้จ่ายที่ต้องตั้งค่าก่อนที่ Argon จะเปิดตัว
- จำกัดเอาต์พุต. บน generateContent,
generationConfig.maxOutputTokensกำหนดเพดาน Google กล่าวว่าโมเดลใหม่จะเปิดตัวบน Interactions API ดังนั้นให้ตั้งค่าขีดจำกัดที่เทียบเท่ากันที่นั่นเมื่อเอกสารระบุสำหรับ Argon เพดาน 1 ล้านโทเค็นคือเพดานเอาต์พุต $20 ต่อการเรียกใช้ในอัตรามาตรฐาน - แคชเนื้อหาที่เสถียร. คำแนะนำระบบ, สคีมา และเอกสารอ้างอิงที่ซ้ำกันในการเรียกใช้ต่างๆ คือส่วนที่การลดราคา 95% จะให้ผลตอบแทนที่ดี
- เลือกระดับการคิดอย่างตั้งใจ. Google ยังไม่ได้เผยแพร่ระดับของ Argon วันนี้ gemini-3.1-pro-preview มีค่าเริ่มต้นเป็น
highและ gemini-3.8-flash เป็นmediumเมื่อ Argon มีเอกสารกำกับแล้ว ให้ทดสอบว่าระดับที่ต่ำกว่ายังคงรักษาคุณภาพในการทำงานของคุณได้หรือไม่ - ยืนยันการใช้งาน. การตอบสนอง generateContent ทุกครั้งจะสิ้นสุดด้วย
usageMetadataใน Apidog ให้บันทึกคำขอพร้อมโมเดลในตัวแปรสภาพแวดล้อมGEMINI_MODELเพิ่มการยืนยันหลังการตอบสนองที่คำนวณค่าใช้จ่ายจากจำนวนโทเค็นในusageMetadataและทำให้การทดสอบล้มเหลวเมื่อการเรียกใช้เกินขีดจำกัดของคุณ รันกับ gemini-3.8-flash วันนี้; เมื่อ ID ของ Argon ถูกปล่อยออกมา ให้เปลี่ยนตัวแปรเดียวและรันชุดการทดสอบใหม่
การคำนวณสำหรับการยืนยันนั้น:
cost = uncached_input / 1,000,000 x input_rate
+ cached_input / 1,000,000 x cached_rate
+ (output + thinking) / 1,000,000 x output_rate
สิ่งที่ Google ยังไม่ได้กำหนดราคา
ระยะเวลาของช่วงโปรโมชันและวันที่ราคา $4/$20 เริ่มต้น; ไม่ว่าพร้อมท์ที่เกิน 200K จะมีค่าใช้จ่ายมากขึ้นหรือไม่; ราคาแบบ Batch หรือ Flex (3.1 Pro มีทั้งสองแบบ โดยอินพุต $1/$2 และเอาต์พุต $6/$9); ค่าธรรมเนียมการจัดเก็บแคช; ข้อจำกัดอัตรา; และไม่ว่าจะมีระดับฟรีเลยหรือไม่
คำถามที่พบบ่อย
Gemini 4 Argon มีค่าใช้จ่ายเท่าไรต่อ 1 ล้านโทเค็น? อินพุต $2 และเอาต์พุต $10 ในช่วงโปรโมชัน หลังจากนั้น $4 และ $20 อินพุตที่แคชไว้ลด 95%: $0.10 และหลังจากนั้น $0.20
ราคาช่วงโปรโมชันจะนานแค่ไหน? Google ยังไม่ได้ระบุ โพสต์เปิดตัวไม่ได้ให้วันสิ้นสุดหรือระยะเวลา
โทเค็นการคิดถูกเรียกเก็บเป็นเอาต์พุตหรือไม่? ในโมเดล Gemini ปัจจุบัน ใช่ Google ยังไม่ได้จัดทำเอกสารกฎของ Argon โดยเฉพาะ
การตอบสนองเอาต์พุต 1 ล้านโทเค็นมีค่าใช้จ่ายเท่าไร? $10 ในราคาช่วงโปรโมชัน และ $20 ในราคามาตรฐาน ก่อนอินพุต
Argon ถูกกว่า Claude Opus 5.5 หรือ GPT-6 Astra หรือไม่? เมื่อคิดต่อโทเค็น Argon มาตรฐานเท่ากับ Opus 5.5 และต่ำกว่า Astra 60% เมื่อคิดต่อภารกิจ ขึ้นอยู่กับปริมาณโทเค็น: Artificial Analysis วัดว่า Argon ใช้โทเค็นเอาต์พุตประมาณ 2.3 เท่าของ Astra สำหรับ Gemini ที่ถูกกว่าในวันนี้ ดู การกำหนดราคา Gemini 3.8 Flash
ฉันสามารถชำระเงินสำหรับ Argon ได้วันนี้หรือไม่? ไม่ได้ กำลังเปิดตัวเฉพาะพันธมิตรโครงการ Fairwind เท่านั้น ลูกค้า API แบบชำระเงินและสมาชิก Google AI Ultra จะเป็นลำดับถัดไป แต่ยังไม่มีกำหนดวันที่
จัดงบประมาณตอนนี้ วัดผลในภายหลัง
คูณจำนวนโทเค็นการใช้งานปัจจุบันของคุณด้วย $2/$10 และ $4/$20 แล้วคุณก็จะได้ช่วงราคาโปรโมชันและมาตรฐานของ Argon จากนั้นสร้างการวัดผล: ดาวน์โหลด Apidog, บันทึกคำขอของคุณกับ gemini-3.8-flash โดยใช้ GEMINI_MODEL เป็นตัวแปร และเพิ่มการยืนยันค่าใช้จ่ายบน usageMetadata เมื่อ Google เผยแพร่ ID โมเดล คุณก็สามารถเปลี่ยนค่าเดียวและเห็นค่าใช้จ่ายจริงต่อการเรียกใช้ของคุณได้ตั้งแต่วันแรก
