Gemini 3.6 Flash มีค่าใช้จ่าย 1.50 ดอลลาร์ต่อโทเค็นนำเข้า 1 ล้านโทเค็น และ 7.50 ดอลลาร์ต่อโทเค็นส่งออก 1 ล้านโทเค็น ซึ่งถูกกว่าโมเดลที่เข้ามาแทนที่ Google ได้เปิดตัวเวอร์ชันปรับปรุงเมื่อวันที่ 21 กรกฎาคม 2026 และสำหรับใครก็ตามที่คอยดูบิล API ข่าวดีก็คือ: Flash ระดับเรือธงนี้ทำงานเร็วขึ้นและมีราคาถูกลงไปพร้อมๆ กัน
คู่มือนี้จะสรุปตัวเลขทั้งหมดที่คุณต้องใช้ในการวางแผนงบประมาณ: อัตราค่าบริการต่อโทเค็น, สิ่งที่แคชบริบท (context caching) เพิ่มเข้ามา, สิ่งที่แพ็กเกจฟรีครอบคลุม และตัวอย่างที่ใช้งานจริงเพื่อให้คุณสามารถคาดการณ์ค่าใช้จ่ายรายเดือนได้ก่อนที่คุณจะเขียนโค้ดแม้แต่บรรทัดเดียว ตัวเลขทุกตัวในที่นี้มาจาก เอกสารราคา Gemini API ของ Google เองและ ประกาศเปิดตัว หากคุณต้องการภาพรวมโมเดลทั้งหมดก่อน โปรดอ่าน Gemini 3.6 Flash คืออะไร
ข้อสังเกตเกี่ยวกับการตั้งชื่อก่อนจะไปดูตัวเลข โมเดลหลักได้ข้ามไปเวอร์ชัน 3.6 แต่ Flash-Lite ซึ่งเป็นระดับที่ถูกกว่ายังคงอยู่ที่เวอร์ชัน 3.5 การเปิดตัวพร้อมกัน แต่มีเวอร์ชันที่แตกต่างกัน ทำความเข้าใจตรงนี้ให้ชัดเจน แล้วคุณจะเห็นว่าราคาเข้ากันได้อย่างลงตัว
ราคา Gemini 3.6 Flash โดยสรุป
| รายการ | ค่าใช้จ่าย |
|---|---|
| อินพุต | 1.50 ดอลลาร์ต่อ 1 ล้านโทเค็น |
| เอาต์พุต (รวมโทเค็นสำหรับการประมวลผล) | 7.50 ดอลลาร์ต่อ 1 ล้านโทเค็น |
| แคชบริบท, การอ่านอินพุตที่แคชไว้ | 0.15 ดอลลาร์ต่อ 1 ล้านโทเค็น |
| แคชบริบท, การจัดเก็บ | 1.00 ดอลลาร์ต่อ 1 ล้านโทเค็นต่อชั่วโมง |
| แพ็กเกจฟรี | มี, ผ่าน Google AI Studio (มีการจำกัดอัตรา) |
มีสองสิ่งสำคัญที่ควรทราบทันที ราคาเอาต์พุตรวมโทเค็นสำหรับการประมวลผล (thinking tokens) ดังนั้นการให้เหตุผลที่โมเดลทำก่อนที่จะตอบจะถูกคิดค่าบริการในอัตราเอาต์พุต 7.50 ดอลลาร์ ไม่ใช่แยกรายการ และการแคชบริบท (context caching) มีสองส่วน: อัตราการอ่านที่ถูกสำหรับการป้อนข้อมูลที่แคชไว้ บวกกับค่าธรรมเนียมการจัดเก็บรายชั่วโมงตราบเท่าที่คุณยังคงแคชนั้นไว้ใช้งาน การแคชช่วยประหยัดเงินในการใช้บริบทซ้ำๆ แต่มันไม่ใช่บริการฟรี ดังนั้นการประหยัดค่าใช้จ่ายจะเกิดขึ้นเมื่อคุณใช้คำนำหน้า (prompt prefix) ซ้ำๆ บ่อยครั้งเท่านั้น
เปรียบเทียบกับ Gemini 3.5 Flash
อัตราเอาต์พุตลดลงจาก 9.00 ดอลลาร์ต่อ 1 ล้านโทเค็นใน 3.5 Flash เป็น 7.50 ดอลลาร์ใน 3.6 Flash เพียงแค่นี้ก็ถูกลงประมาณ 17% ต่อโทเค็นเอาต์พุตแล้ว
เรื่องราวที่ใหญ่กว่าคือสิ่งที่ Google รายงานใน หน้าโมเดล DeepMind Flash: 3.6 Flash สร้างโทเค็นเอาต์พุตน้อยลงประมาณ 17% สำหรับงานเดียวกัน มันให้เหตุผลด้วยขั้นตอนที่น้อยลงและเรียกใช้เครื่องมือน้อยลงสำหรับงานที่มีหลายขั้นตอน ดังนั้นคุณจึงจ่ายในอัตราที่ถูกลงสำหรับจำนวนโทเค็นที่น้อยลง กลไกทั้งสองอย่างนี้รวมกัน ซึ่งเราจะแสดงด้วยการคำนวณจริงด้านล่าง
หากคุณยังคงจัดทำงบประมาณโดยอ้างอิงจากโมเดลเก่า การดูรายละเอียด ราคา Gemini 3.5 Flash ควบคู่กันไปนั้นคุ้มค่า สำหรับการเปรียบเทียบคุณสมบัติและประสิทธิภาพทั้งหมด โปรดดูที่ Gemini 3.6 Flash vs 3.5 Flash สรุปสั้นๆ เพื่อกระเป๋าเงินของคุณ: 3.6 Flash มีค่าใช้จ่ายในการรันน้อยกว่าโมเดลที่เข้ามาแทนที่ และส่วนต่างจะยิ่งมากขึ้นในงานที่มีความยาวมากขึ้นและมีลักษณะการทำงานแบบเอเจนต์ ซึ่งการประหยัดโทเค็นจะสะสมเพิ่มขึ้น
แพ็กเกจฟรีให้อะไรคุณบ้าง
มีแพ็กเกจฟรีจริง ซึ่งใช้งานได้ผ่าน Google AI Studio คุณสามารถเรียกใช้ Gemini 3.6 Flash ได้โดยไม่ต้องใช้บัตรเครดิต และสร้างต้นแบบได้ฟรี
จงซื่อสัตย์กับตัวเองเกี่ยวกับข้อจำกัด แพ็กเกจฟรีมีการจำกัดอัตราการใช้งาน ดังนั้นจึงเหมาะสำหรับการสร้างต้นแบบและการทดสอบเล็กน้อย ไม่ใช่สำหรับการใช้งานจริง (production traffic) และ Google อาจใช้ข้อมูลจากแพ็กเกจฟรีเพื่อปรับปรุงผลิตภัณฑ์ของตน ซึ่งหมายความว่าแพ็กเกจฟรีไม่ใช่ที่ที่เหมาะสมสำหรับข้อมูลที่ละเอียดอ่อน, เป็นกรรมสิทธิ์ หรือข้อมูลลูกค้า เมื่อคุณจะใช้งานจริง ให้เปลี่ยนไปใช้คีย์แบบชำระเงินที่เงื่อนไขการใช้ข้อมูลเหล่านั้นไม่มีผลบังคับใช้
สำหรับขั้นตอนการใช้งานแพ็กเกจฟรีทั้งหมดและวิธีการตั้งค่า โปรดดูที่ วิธีใช้ Gemini 3.6 Flash ฟรี ไม่มีตัวเลือก "ฟรีไม่จำกัด" ที่นี่ ดังนั้นวางแผนที่จะเปลี่ยนไปใช้แบบชำระเงินเมื่อคุณนำไปใช้งานจริง
ตัวอย่างค่าใช้จ่ายจริง
สมมติว่าคุณใช้งานเอเจนต์ที่อ่านข้อมูลจำนวนมากและเขียนข้อมูลเล็กน้อย: โทเค็นนำเข้า 2 ล้านโทเค็น และโทเค็นส่งออก 500,000 โทเค็นต่อวัน นี่คือรูปแบบที่สมจริงสำหรับผู้ช่วยที่เน้นการดึงข้อมูล ซึ่งดึงเอกสารเข้ามาและส่งคืนคำตอบสั้นๆ
นี่คือค่าใช้จ่ายรายวันของ Gemini 3.6 Flash:
- อินพุต: 2 ล้านโทเค็น คูณ 1.50 ดอลลาร์ต่อ 1 ล้าน = 3.00 ดอลลาร์
- เอาต์พุต: 500,000 โทเค็น คูณ 7.50 ดอลลาร์ต่อ 1 ล้าน = 3.75 ดอลลาร์
- รวมรายวัน: 6.75 ดอลลาร์
- รายเดือน (30 วัน): ประมาณ 202.50 ดอลลาร์
ทีนี้มาดูผลลัพธ์แบบทบต้น สมมติว่างานเดียวกันบน 3.5 Flash ปล่อยโทเค็นเอาต์พุตออกมา 600,000 โทเค็น บน 3.6 Flash การลดลง 17% ทำให้ลดลงเหลือประมาณ 500,000 โทเค็น ซึ่งเป็นจำนวนที่เราประมาณการไว้ข้างต้น เปรียบเทียบเฉพาะส่วนเอาต์พุต:
- เอาต์พุต 3.5 Flash: 600,000 คูณ 9.00 ดอลลาร์ต่อ 1 ล้าน = 5.40 ดอลลาร์ต่อวัน
- เอาต์พุต 3.6 Flash: 500,000 คูณ 7.50 ดอลลาร์ต่อ 1 ล้าน = 3.75 ดอลลาร์ต่อวัน
นั่นคือลดลง 1.65 ดอลลาร์ต่อวัน หรือประมาณ 49.50 ดอลลาร์ต่อเดือน เฉพาะในส่วนของเอาต์พุตเท่านั้น ค่าใช้จ่ายเอาต์พุตลดลงประมาณ 31% แม้ว่าการลดราคาและการลดโทเค็นจะอยู่ที่ประมาณ 17% เท่านั้นในแต่ละส่วน โทเค็นที่ถูกลงคูณด้วยจำนวนโทเค็นที่น้อยลง คือจุดที่การประหยัดค่าใช้จ่ายที่แท้จริงเกิดขึ้น
Flash-Lite ถูกกว่ายิ่งขึ้นไปอีก
หากงานของคุณไม่ซับซ้อน ยังมีแพ็กเกจที่ต่ำกว่าโมเดลหลัก Gemini 3.5 Flash-Lite มีค่าใช้จ่าย 0.30 ดอลลาร์ต่อโทเค็นนำเข้า 1 ล้านโทเค็น และ 2.50 ดอลลาร์ต่อโทเค็นส่งออก 1 ล้านโทเค็น โดยมีการแคชในราคา 0.03 ดอลลาร์ต่อ 1 ล้านโทเค็น บวกกับค่าจัดเก็บ 1.00 ดอลลาร์ต่อ 1 ล้านโทเค็นต่อชั่วโมงเท่าเดิม มันยังทำงานได้เร็วอีกด้วย ประมาณ 350 โทเค็นเอาต์พุตต่อวินาที
ลองใช้งาน Flash-Lite ด้วยปริมาณงานอินพุต 2 ล้านและเอาต์พุต 500,000 โทเค็นเท่าเดิม แล้วค่าใช้จ่ายรายวันจะอยู่ที่ประมาณ 1.85 ดอลลาร์ หรือประมาณ 55.50 ดอลลาร์ต่อเดือน นั่นถูกกว่า 3.6 Flash ประมาณ 70% สำหรับจำนวนโทเค็นที่เท่ากัน
ข้อควรพิจารณาคือคุณภาพ Flash-Lite ถูกปรับแต่งมาสำหรับงานที่มีปริมาณมากและมีความซับซ้อนต่ำ: การจัดหมวดหมู่, การดึงข้อมูล, การกำหนดเส้นทาง, การตอบกลับแบบมีโครงสร้างสั้นๆ มันไม่ใช่เวอร์ชันที่อ่อนแอลงของสิ่งเดียวกัน แต่มันเป็นจุดที่แตกต่างกันบนเส้นโค้งของต้นทุน, คุณภาพ และความหน่วง เลือกใช้ Flash-Lite เมื่องานไม่ซับซ้อนและมีปริมาณมาก และเก็บ 3.6 Flash ไว้สำหรับงานที่ต้องใช้การให้เหตุผลที่ซับซ้อนกว่า สำหรับภาพรวมทั้งหมด โปรดอ่าน Gemini 3.5 Flash-Lite คืออะไร จากนั้น Gemini 3.5 Flash-Lite vs 3.6 Flash เพื่อเลือกแพ็กเกจที่เหมาะสมสำหรับแต่ละเส้นทาง
วิธีควบคุมและวัดค่าใช้จ่ายของคุณ
สี่กลไกที่จะช่วยลดค่าใช้จ่าย:
- แคชบริบทที่ใช้ซ้ำ. หากทุกคำขอใช้พรอมต์ระบบที่ยาวหรือเอกสารอ้างอิงเดียวกัน การแคชบริบทจะคิดค่าบริการ 0.15 ดอลลาร์ต่อ 1 ล้านสำหรับการอ่านที่แคชไว้ แทนที่จะเป็น 1.50 ดอลลาร์ แค่จำค่าธรรมเนียมการจัดเก็บ 1.00 ดอลลาร์ต่อ 1 ล้านต่อชั่วโมงไว้ ดังนั้นการแคชจึงคุ้มค่าเมื่อคุณใช้คำนำหน้าซ้ำๆ บ่อยครั้งภายในหนึ่งชั่วโมง ไม่ใช่แค่ครั้งเดียว
- ตัดแต่งพรอมต์. เอาต์พุตมีราคาแพงกว่าอินพุตห้าเท่า แต่การป้อนข้อมูลที่เกินความจำเป็นก็ยังคงสะสมเป็นจำนวนมากเมื่อใช้งานในขนาดใหญ่ ตัดส่วนที่ไม่จำเป็นออก และจำกัดจำนวนโทเค็นเอาต์พุตสูงสุดเพื่อไม่ให้การตอบกลับที่ควบคุมไม่ได้ทำให้คุณประหลาดใจ
- กำหนดเส้นทางงานง่ายๆ ไปยัง Flash-Lite. ส่งงานการจัดหมวดหมู่และการดึงข้อมูลไปยังแพ็กเกจที่ถูกกว่า และสงวน 3.6 Flash ไว้สำหรับงานที่ต้องใช้การให้เหตุผลหลายขั้นตอน การกำหนดเส้นทางแบบผสมมักจะดีกว่าการเลือกโมเดลเดียวสำหรับทุกสิ่ง
- วัดการใช้งานโทเค็นจริง. การประมาณการอาจไม่ถูกต้อง
usageMetadataในการตอบกลับ Gemini ทุกครั้งจะบอกคุณอย่างละเอียดว่าการเรียกใช้หนึ่งครั้งใช้โทเค็นนำเข้า, โทเค็นส่งออก และโทเค็นสำหรับการประมวลผลไปกี่โทเค็น และนั่นคือตัวเลขที่ใช้ในการออกใบแจ้งหนี้ของคุณ
ประเด็นสุดท้ายนี้คือสิ่งที่ไคลเอนต์ API แสดงคุณค่าของมัน ใน Apidog คุณสามารถสร้างคำขอ POST ไปยัง Gemini API จัดเก็บคีย์ของคุณในตัวแปรสภาพแวดล้อม และส่งคำขอจริงตามพรอมต์จริงของคุณ อ่านฟิลด์ usageMetadata จากการตอบกลับโดยตรงเพื่อดูจำนวนโทเค็นจริงต่อคำขอ จากนั้นเพิ่มการยืนยัน (assertions) เพื่อให้การเปลี่ยนแปลงพรอมต์ที่ทำให้โทเค็นเอาต์พุตเพิ่มขึ้นเป็นสองเท่าทำให้การทดสอบล้มเหลว แทนที่จะทำให้ค่าใช้จ่ายของคุณเพิ่มขึ้นเป็นสองเท่าอย่างเงียบๆ คุณยังสามารถ กำหนดเวลาการทดสอบ API เหล่านั้น ให้รันเป็นรอบและตรวจจับการเพิ่มขึ้นของค่าใช้จ่ายได้ตั้งแต่เนิ่นๆ ต้องการทำตามหรือไม่? ดาวน์โหลด Apidog และชี้คำขอไปยังปลายทาง Gemini ก่อนที่คุณจะนำไปใช้งานจริง
คำถามที่พบบ่อย (FAQ)
Gemini 3.6 Flash มีค่าใช้จ่ายเท่าไรต่อ 1 ล้านโทเค็น? 1.50 ดอลลาร์สำหรับอินพุต และ 7.50 ดอลลาร์สำหรับเอาต์พุต การอ่านแคชบริบทมีค่าใช้จ่าย 0.15 ดอลลาร์ต่อ 1 ล้านโทเค็น พร้อมค่าธรรมเนียมการจัดเก็บ 1.00 ดอลลาร์ต่อ 1 ล้านโทเค็นต่อชั่วโมง
ราคาเอาต์พุตรวมโทเค็นสำหรับการประมวลผล (thinking tokens) ด้วยหรือไม่? ใช่ การให้เหตุผลที่โมเดลทำก่อนที่จะตอบจะถูกคิดค่าบริการในอัตราเอาต์พุต 7.50 ดอลลาร์ ไม่มีการคิดค่าบริการแยกสำหรับโทเค็นสำหรับการประมวลผล แต่จะนับรวมในยอดรวมเอาต์พุตของคุณ ดังนั้นการให้เหตุผลที่มากขึ้นหมายถึงค่าใช้จ่ายที่สูงขึ้น
มีแพ็กเกจฟรีจริงหรือไม่? ใช่ มีให้ใช้งานผ่าน Google AI Studio และมีการจำกัดอัตราการใช้งาน เหมาะสำหรับการสร้างต้นแบบและการทดสอบ ไม่ใช่สำหรับการใช้งานจริง (production) Google อาจใช้ข้อมูลจากแพ็กเกจฟรีเพื่อปรับปรุงผลิตภัณฑ์ของตน ดังนั้นโปรดเก็บข้อมูลที่ละเอียดอ่อนไว้ในคีย์แบบชำระเงิน
Gemini 3.6 Flash ถูกกว่า 3.5 Flash หรือไม่? ใช่ อัตราเอาต์พุตลดลงจาก 9.00 ดอลลาร์เป็น 7.50 ดอลลาร์ และ 3.6 Flash ใช้โทเค็นเอาต์พุตน้อยลงประมาณ 17% สำหรับงานเดียวกัน ผลลัพธ์ทั้งสองอย่างนี้รวมกัน ทำให้ค่าใช้จ่ายเอาต์พุตจริงสามารถลดลงได้ประมาณ 31%
เมื่อใดที่ควรใช้ Flash-Lite แทน? เมื่อภารกิจไม่ซับซ้อนและมีปริมาณมาก ด้วยอินพุต 0.30 ดอลลาร์และเอาต์พุต 2.50 ดอลลาร์ Flash-Lite จึงถูกกว่าประมาณ 70% สำหรับจำนวนโทเค็นที่เท่ากัน และยังทำงานได้เร็ว แต่ 3.6 Flash จัดการการให้เหตุผลที่ซับซ้อนได้ดีกว่า
Gemini 3.6 Flash เป็นการอัปเดตราคากรณีที่หาได้ยาก ซึ่งตัวเลขลดลงและโมเดลก็ดีขึ้นไปพร้อมๆ กัน จัดงบประมาณที่ 1.50 ดอลลาร์สำหรับอินพุตและ 7.50 ดอลลาร์สำหรับเอาต์พุต จำไว้ว่าโทเค็นสำหรับการประมวลผลจะถูกคิดรวมอยู่ในอัตราเอาต์พุต และใช้ประโยชน์จากการแคชและการกำหนดเส้นทางไป Flash-Lite เพื่อลดค่าใช้จ่ายส่วนที่เหลือ สำหรับบริบททางประวัติศาสตร์ว่าค่าใช้จ่าย Gemini API มีการเปลี่ยนแปลงอย่างไรในแต่ละเวอร์ชัน รายละเอียด ค่าใช้จ่าย Gemini 3.0 API เป็นจุดอ้างอิงที่มีประโยชน์ จากนั้นวัดการเรียกใช้ของคุณเองใน Apidog เพื่อให้จำนวนโทเค็นที่คุณวางแผนไว้เป็นจำนวนที่คุณต้องจ่ายจริง
