เจมินี 3.8 แฟลช พร้อมใช้งานแล้ววันนี้: โมเดลที่เสถียรพร้อมแพ็คเกจฟรี ราคา 0.75 ดอลลาร์สำหรับการป้อนข้อมูลและ 3.75 ดอลลาร์สำหรับการส่งออกต่อ 1 ล้านโทเค็นจนถึงวันที่ 31 ธันวาคม 2569 หลังจากนั้นราคาจะเปลี่ยนเป็น 1.50 ดอลลาร์และ 7.50 ดอลลาร์ ตามลำดับ โดยมีขีดจำกัดการส่งออกที่ 64K โทเค็น ส่วนเจมินี 4 อาร์กอนยังไม่พร้อมใช้งาน โพสต์เปิดตัวของ Google ระบุราคาไว้ที่ 2 ดอลลาร์และ 10 ดอลลาร์ในช่วงแนะนำที่ไม่ได้ระบุระยะเวลา จากนั้นเป็น 4 ดอลลาร์และ 20 ดอลลาร์ Google ระบุว่ามีขีดจำกัดการส่งออกที่ 1 ล้านโทเค็น และพร้อมใช้งานในวันนี้สำหรับผู้เข้าร่วมโครงการ Fairwind เท่านั้น หากคุณจำเป็นต้องเปิดตัวในไตรมาสนี้ ให้ใช้ Flash และเตรียม Argon ให้พร้อมสำหรับการเปลี่ยนค่าคอนฟิกได้ง่ายๆ
โพสต์นี้จะเปรียบเทียบทั้งสองโมเดลในด้านคุณสมบัติ แถวเกณฑ์มาตรฐานที่โพสต์เปิดตัวทั้งสองระบุไว้ คะแนนด้านความปลอดภัยทางไซเบอร์ และค่าใช้จ่ายของการเรียกใช้งานที่เหมือนกัน จากนั้นจะให้หลักเกณฑ์ในการตัดสินใจ สำหรับข้อมูลเบื้องต้น โปรดดู Gemini 4 Argon คืออะไร และ Gemini 3.8 Flash คืออะไร ส่วนสุดท้ายจะแสดงการตั้งค่า Apidog ที่ทำให้การสลับโมเดลเป็นเพียงการเปลี่ยนตัวแปรเดียว
เปรียบเทียบ: สิ่งที่คุณสามารถเรียกใช้งานได้แล้ววันนี้
| Gemini 3.8 Flash | Gemini 4 Argon | |
|---|---|---|
| ความพร้อมใช้งาน | เสถียรบน Gemini API, AI Studio, Antigravity และ Gemini Enterprise | กลุ่มพาร์ทเนอร์โครงการ Fairwind บางราย ในฐานะโมเดลที่ได้รับการจัดการบน Gemini Enterprise |
| Model ID | gemini-3.8-flash |
ยังไม่เผยแพร่ |
| ราคาต่อ 1 ล้านโทเค็น (อินพุต / เอาต์พุต) | 0.75 ดอลลาร์ / 3.75 ดอลลาร์ จนถึง 31 ธ.ค. 2569 จากนั้น 1.50 ดอลลาร์ / 7.50 ดอลลาร์ | 2 ดอลลาร์ / 10 ดอลลาร์ ช่วงแนะนำ (ไม่ได้ระบุวันสิ้นสุด) จากนั้น 4 ดอลลาร์ / 20 ดอลลาร์ |
| อินพุตที่แคชต่อ 1 ล้าน | 0.075 ดอลลาร์, จากนั้น 0.15 ดอลลาร์ | 0.10 ดอลลาร์ ช่วงแนะนำ, จากนั้น 0.20 ดอลลาร์ (ลด 95% สำหรับอินพุต) |
| ขีดจำกัดเอาต์พุต | 65,536 โทเค็น | 1 ล้านโทเค็น (ขีดจำกัดที่ Google ระบุ) |
| Input window | 1,048,576 โทเค็น | ยังไม่เผยแพร่ |
| ระดับการคิด | low, medium (ค่าเริ่มต้น), high; minimal จะคืนค่า HTTP 400 |
ไม่ได้ระบุในเอกสาร |
| แพ็คเกจ API ฟรี | มี, จำกัดอัตราการใช้งาน | ยังไม่มีประกาศ |
| การเข้าถึงสำหรับผู้ใช้งาน | แอป Gemini บน AI Pro และ Ultra, โหมด AI ในการค้นหา | ยังไม่พร้อมใช้งาน; ผู้สมัครสมาชิก AI Ultra อยู่ในกลุ่มแรก, ยังไม่มีวันที่ |
เซลล์บางส่วนจำเป็นต้องมีบริบท Google ยังไม่ได้เผยแพร่ Input window ของ Argon แม้ว่าการประเมิน context แบบยาวของตนเองจะใช้ prompts สูงสุดถึง 1 ล้านโทเค็นก็ตาม Google ระบุว่าขีดจำกัดการส่งออกของ Argon คือ 1 ล้านโทเค็น; อย่างน้อยหนึ่งผู้ประเมินภายนอก, Vals AI, ระบุเอาต์พุตสูงสุดที่ 262K สำหรับการตั้งค่าที่พวกเขาทำการทดสอบ การประเมินของ Argon ดำเนินการด้วย "การตั้งค่าการคิดสูงสุด" ดังนั้นระดับสูงน่าจะมีอยู่จริง แต่ Google ยังไม่ได้ตั้งชื่อระดับหรือค่าเริ่มต้น ระดับการคิดของ Flash อยู่ใน เอกสารเกี่ยวกับการคิดของ Google และใน คู่มือระดับการคิดของ 3.8 Flash ของเรา
แพ็คเกจฟรีของ Flash มีการจำกัดอัตราการใช้งาน และ Google ระบุว่าข้อมูลจากแพ็คเกจฟรี "ถูกนำไปใช้เพื่อปรับปรุงผลิตภัณฑ์ของเรา" Google ยังไม่ได้ประกาศวิธีการใช้งาน Argon ฟรีใดๆ; คำอธิบายการเข้าถึง Argon ฟรี ของเราจะครอบคลุมถึงสิ่งที่คุณสามารถใช้แทนได้
แถวเกณฑ์มาตรฐานที่โพสต์เปิดตัวทั้งสองฉบับระบุไว้
ตารางเปิดตัวของ Google สำหรับโมเดลทั้งสองมีสองแถวที่ระบุในข้อความ ตัวเลขเหล่านี้เป็นรายงานของ Google และระเบียบวิธีของ Argon อ้างอิงทั้งสองแถวจาก Vals AI
| เกณฑ์มาตรฐาน | Gemini 3.8 Flash (ตาราง 2 ก.ย.) | Gemini 4 Argon (ตาราง 30 ก.ย.) |
|---|---|---|
| Vals Finance Agent v2 | 61.4% | 65.4% |
| Harvey Legal Agent Benchmark | 10.0% | 19.6% |
Google เผยแพร่ตารางเหล่านี้ห่างกันหนึ่งเดือน โดยเปรียบเทียบกับคู่แข่งที่ต่างกัน ดังนั้นควรอ่านช่องว่างเป็นแนวทางมากกว่าเป็นการทดสอบที่ควบคุมได้ อย่างไรก็ตาม แถวที่เกี่ยวกับกฎหมายนั้นโดดเด่น: 19.6% ของ Argon เกือบเป็นสองเท่าของ 10.0% ของ Flash ส่วนช่องว่างด้านการเงินคือ 4 คะแนน
ส่วนอื่นๆ ทั้งหมดในตารางของ Argon ไม่มีข้อมูลที่ตรงกับ 3.8 Flash ในข้อความ ตาราง 3.8 Flash ของ Google รายงาน HLE-Verified ซึ่งตารางของ Argon ไม่มี และคะแนน DeepSWE ของ Flash ปรากฏเฉพาะในภาพของการ์ดโมเดลเท่านั้น บนกระดานผู้นำ Text ของ Arena ซึ่งเป็นการจัดอันดับของบุคคลที่สาม Argon (High) อยู่ที่อันดับ 1 ในผลโหวตเบื้องต้น ในขณะที่ Gemini 3.8 Flash (High) อยู่ที่อันดับ 11 ตาราง Argon แบบเต็ม 19 แถว พร้อมระบุผู้ที่วัดแต่ละแถว อยู่ใน รายละเอียดเกณฑ์มาตรฐานของ Argon ของเรา
ความปลอดภัยไซเบอร์: Argon เทียบกับ 3.8 Flash Cyber
หน้าความปลอดภัยไซเบอร์ของ DeepMind เปรียบเทียบ Argon กับ Gemini 3.8 Flash Cyber ซึ่งเป็นน้องชายด้านความปลอดภัยไซเบอร์ของ Flash ที่มีการควบคุมการเข้าถึงผ่าน Fairwind:
| การประเมินความปลอดภัยไซเบอร์ | Gemini 4 Argon | Gemini 3.8 Flash Cyber |
|---|---|---|
| การค้นพบช่องโหว่ในโลกจริง | 85.8% | 71.0% |
| Wiz Penetration Test Benchmark | 70.9% | 58.2% |
โมเดลทั้งสองมีการควบคุมการเข้าถึง Gemini 3.8 Flash Cyber เปิดให้ใช้งานทั่วไปโดยต้องอยู่ในบัญชีขาว (allowlist) บน Gemini Enterprise Agent Platform และ Argon มีให้เฉพาะ Fairwind เท่านั้น หากคุณไม่ใช่พันธมิตรของ Fairwind ตัวเลขทั้งสองนี้ไม่ได้เปลี่ยนแปลงสิ่งที่คุณสามารถเรียกใช้งานได้ในวันนี้ โมเดล 3.8 Flash ทั่วไปคือสิ่งที่คุณสามารถนำไปพัฒนาได้
ค่าใช้จ่ายของการเรียกใช้งานแบบเดียวกันในทั้งสองโมเดล
สมมติว่ามีการเรียกใช้งานหนึ่งครั้งด้วย 100,000 โทเค็นอินพุต และ 8,000 โทเค็นเอาต์พุต โมเดล Gemini ปัจจุบัน รวมถึง 3.8 Flash จะคิดค่าบริการโทเค็นการคิด (thinking tokens) เป็นเอาต์พุต ดังนั้น 8,000 โทเค็นจึงรวมโทเค็นเหล่านี้ด้วย Google ยังไม่ได้ระบุว่า Argon คิดค่าบริการอย่างไรสำหรับโทเค็นเหล่านี้ แถวของ Argon จึงถือว่าดำเนินการตามโมเดล Gemini ปัจจุบัน
| โมเดลและช่วงเวลา | ค่าใช้จ่ายอินพุต | ค่าใช้จ่ายเอาต์พุต | รวมต่อการเรียกใช้งาน |
|---|---|---|---|
| 3.8 Flash, ช่วงแนะนำ | 0.1M x $0.75 = $0.075 | 0.008M x $3.75 = $0.030 | $0.105 |
| 3.8 Flash, ตั้งแต่ 2027-01-01 | 0.1M x $1.50 = $0.150 | 0.008M x $7.50 = $0.060 | $0.210 |
| Argon, ช่วงแนะนำ | 0.1M x $2 = $0.200 | 0.008M x $10 = $0.080 | $0.280 |
| Argon, มาตรฐาน | 0.1M x $4 = $0.400 | 0.008M x $20 = $0.160 | $0.560 |
อัตราต่อโทเค็นของ Argon คือ 8/3 (ประมาณ 2.67 เท่า) ของ Flash ทั้งในราคาช่วงแนะนำและราคามาตรฐาน หากมีการเรียกใช้งานแบบนี้ 1,000 ครั้งต่อวัน จะมีค่าใช้จ่าย 105 ดอลลาร์ต่อวันสำหรับ Flash เทียบกับ 280 ดอลลาร์สำหรับ Argon ในอัตราช่วงแนะนำ
สามสิ่งต่อไปนี้ที่ทำให้อัตราส่วนที่ดูสมบูรณ์แบบนั้นแตกต่างออกไป:
- จำนวนโทเค็นจะไม่ตรงกัน การป้อนข้อความ (prompt) เดียวกันจะสร้างจำนวนโทเค็นเอาต์พุตและโทเค็นการคิดที่แตกต่างกันในแต่ละโมเดล การประเมินที่เผยแพร่ของ Argon ดำเนินการด้วยการตั้งค่าการคิดสูงสุด และสำหรับ 3.8 Flash นั้น Google เตือนว่าระดับความพยายามที่สูงขึ้นอาจใช้โทเค็นมากขึ้น
- เอาต์พุตที่ยาวจะเปลี่ยนการคำนวณ คำตอบที่มี 200,000 โทเค็นไม่สามารถใส่ในขีดจำกัด 65,536 โทเค็นของ Flash ได้ ดังนั้นคุณจะต้องแบ่งออกเป็นหลายการเรียกใช้งาน ภายใต้ขีดจำกัดที่ระบุของ Argon จะเป็นการตอบกลับเดียว: 0.2M x 10 ดอลลาร์ = 2.00 ดอลลาร์ในอัตราช่วงแนะนำ หรือ 4.00 ดอลลาร์ในอัตรามาตรฐาน คำตอบ 1 ล้านโทเค็นเต็มๆ มีค่าใช้จ่าย 10 ดอลลาร์ช่วงแนะนำ หรือ 20 ดอลลาร์มาตรฐาน
- ทราบวันสิ้นสุดช่วงแนะนำเพียงหนึ่งเดียวเท่านั้น ราคาช่วงแนะนำของ Flash จะสิ้นสุดในวันที่ 31 ธันวาคม 2569 Google ยังไม่ได้ระบุว่าช่วงแนะนำของ Argon จะสิ้นสุดเมื่อใด
Flash ยังมี Batch ในราคาลด 50% (0.375 ดอลลาร์และ 1.875 ดอลลาร์จนถึงวันที่ 31 ธันวาคม) ตาม หน้าการกำหนดราคา Gemini API Google ยังไม่ได้เผยแพร่ราคา Batch สำหรับ Argon คู่มือการกำหนดราคา Argon และ คู่มือการกำหนดราคา 3.8 Flash ของเราให้ข้อมูลที่ลึกซึ้งยิ่งขึ้น
คุณควรรอ Argon หรือใช้งาน Flash?
ใช้งาน 3.8 Flash ตอนนี้เมื่อ
- คุณมีข้อจำกัดด้านงบประมาณ Flash มีราคา 3/8 ของ Argon ต่อโทเค็น และ Batch ลดราคาลงอีกครึ่งหนึ่ง
- คุณมีการใช้งานปริมาณมาก การจัดหมวดหมู่, การดึงข้อมูล, การกำหนดเส้นทาง และการแชทในปริมาณมากจะเพิ่มขึ้นอย่างรวดเร็วที่ 10 ดอลลาร์ต่อ 1 ล้านโทเค็นเอาต์พุต
- คุณต้องการใช้งานวันนี้ Flash มี Model ID ที่เสถียร, แพ็คเกจฟรีสำหรับการสร้างต้นแบบ, และตารางราคาที่เผยแพร่แล้ว
- การตอบกลับของคุณอยู่ภายใน 65,536 โทเค็น งาน API ส่วนใหญ่ทำได้
วางแผนสำหรับ Argon เมื่อ
- งานนั้นมีขอบเขตระยะยาว Google กล่าวว่า Argon "สร้างขึ้นเพื่อรองรับการให้เหตุผลเชิงลึกในเวิร์กโฟลว์ที่ซับซ้อนและมีขอบเขตระยะยาว"
- คุณต้องการเอาต์พุตเกิน 64K การเขียนโมดูลใหม่ทั้งหมด, รายงานยาวๆ และการย้ายข้อมูลขนาดใหญ่เป็นกรณีที่เหมาะกับขีดจำกัดเอาต์พุต 1 ล้านโทเค็น
- คุณใช้งานตัวแทนด้านกฎหมายหรือการเงิน นี่คือสองแถวที่ Google เผยแพร่โมเดลทั้งสอง และ Argon เหนือกว่าทั้งคู่
- คุณเป็นผู้เข้าร่วมโครงการ Fairwind ที่มีคุณสมบัติเหมาะสม Argon คือโมเดลที่โครงการนี้นำเสนออยู่ในขณะนี้
คุณไม่จำเป็นต้องเลือกเพียงครั้งเดียว กำหนดเส้นทางการรับส่งข้อมูลส่วนใหญ่ไปยัง Flash และส่งส่วนที่ยากไปยัง Argon เมื่อเปิดตัว โดยทั้งสองอยู่ภายใต้การตั้งค่าเดียวกัน
หนึ่งคำขอที่บันทึกไว้, สองโมเดล
นี่คือรูปแบบ เก็บชื่อโมเดลไว้ในตัวแปรสภาพแวดล้อม เรียกใช้คำขอจริงของคุณกับ 3.8 Flash ตอนนี้ และสลับตัวแปรในวันที่ Model ID ของ Argon เปิดตัว Google ยังไม่ได้เผยแพร่ ID นั้น ดังนั้นอย่าคาดเดาเอาเอง
MODEL="${GEMINI_MODEL:-gemini-3.8-flash}"
curl -s -X POST \
"https://generativelanguage.googleapis.com/v1beta/models/${MODEL}:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"contents":[{"parts":[{"text":"Summarize this contract clause in 3 bullets."}]}],
"generationConfig":{"thinkingConfig":{"thinkingLevel":"medium"},"maxOutputTokens":8192}}'
การตอบกลับ generateContent ทุกครั้งจะลงท้ายด้วย usageMetadata ใน Apidog ให้จัดเก็บ GEMINI_API_KEY และ GEMINI_MODEL ไว้ในสภาพแวดล้อม บันทึกคำขอนี้ และเพิ่มการยืนยัน: สถานะ 200, ฟิลด์ที่แอปของคุณอ่าน และขีดจำกัดสูงสุดสำหรับ usageMetadata.thoughtsTokenCount ที่ปรับขนาดตามงบประมาณของคุณ ตั้งค่า maxOutputTokens เพื่อไม่ให้คำตอบที่ยาวเกินไปทำให้งบประมาณของคุณหมด เพิ่มสิ่งนี้ในสถานการณ์ทดสอบ รันบน Flash และเก็บรายงานไว้เป็นข้อมูลพื้นฐาน
ข้อควรระวังสองประการสำหรับวันเปิดตัว Google ระบุว่า "โมเดลใหม่ทั้งหมด" จะเปิดตัวบน Interactions API และยังไม่ได้บอกว่า Argon รองรับ generateContent หรือไม่ ดังนั้นให้บันทึกเวอร์ชัน Interactions (POST https://generativelanguage.googleapis.com/v1beta/interactions พร้อม generation_config.thinking_level) ไว้ถัดจากนี้ และชื่อระดับการคิดของ Argon ยังไม่ได้ระบุในเอกสาร ดังนั้น medium อาจไม่สามารถใช้งานได้ เมื่อ Argon เปิดตัว ให้เปลี่ยนตัวแปรเดียว รันใหม่ และเปรียบเทียบเอาต์พุตและ usageMetadata เคียงข้างกัน
คำถามที่พบบ่อย
Gemini 4 Argon ดีกว่า Gemini 3.8 Flash หรือไม่? จากสองแถวที่ตารางเปิดตัวทั้งสองระบุไว้ในข้อความ ใช่: 65.4% เทียบกับ 61.4% สำหรับ Vals Finance Agent v2 และ 19.6% เทียบกับ 10.0% สำหรับ Harvey’s Legal Agent Benchmark นอกจากนี้ยังมีค่าใช้จ่ายประมาณ 2.67 เท่าต่อโทเค็น และคุณยังไม่สามารถเรียกใช้งานได้
ควรรอ Gemini 4 Argon หรือไม่? ไม่ หากคุณจำเป็นต้องเปิดตัว Google ยังไม่ได้ระบุวันวางจำหน่าย เพียงแค่ "เร็วที่สุดเท่าที่จะเป็นไปได้" โดยเริ่มจากลูกค้า API แบบชำระเงินและผู้สมัครสมาชิก AI Ultra
สำหรับโครงการใหม่ ควรเลือก Gemini 3.8 Flash หรือ Argon? เริ่มต้นด้วย 3.8 Flash โดยเก็บชื่อโมเดลไว้ในตัวแปร ย้ายคำขอที่ต้องการเอาต์พุตยาวๆ หรืองานด้านกฎหมายและการเงินที่ซับซ้อนไปยัง Argon เมื่อคุณได้ทดสอบด้วย prompts ของคุณเองแล้ว
มีวิธีใช้งาน Argon ฟรีหรือไม่? ไม่มี Google ยังไม่ได้ประกาศแพ็คเกจฟรี โปรดดู คำอธิบายการเข้าถึง Argon ฟรี ของเราสำหรับโมเดล Gemini ฟรีที่คุณสามารถใช้ได้ในวันนี้
Argon จะมาแทนที่ Gemini 3.8 Flash หรือไม่? Google ยังไม่ได้กล่าวถึง Google เรียก Argon ว่าเป็นโมเดลแนวหน้าใหม่ และ Reuters รายงานว่ามีขนาดใหญ่กว่า Pro line ก่อนหน้านี้ ดังนั้นจึงเป็นระดับที่แตกต่างจาก Flash
ขั้นตอนถัดไป
ตั้งค่าคำขอวันนี้ รันบน 3.8 Flash และบันทึกรายงาน เมื่อ Argon เปิดตัว คุณจะทราบได้ภายในไม่กี่นาทีว่าคุ้มค่ากับราคาสำหรับปริมาณการใช้งานของคุณหรือไม่ ดาวน์โหลด Apidog เพื่อสร้างการเปรียบเทียบ
