Gemini 3.6 Flash คืออะไร

Gemini 3.6 Flash เป็นโมเดลหลักรุ่นใหม่ที่ทรงประสิทธิภาพของ Google พร้อมให้บริการทั่วไปในวันที่ 21 กรกฎาคม 2569 มีราคาถูกลงและใช้โทเคนได้อย่างมีประสิทธิภาพมากกว่ารุ่น 3.5 Flash ข้อมูลจำเพาะ ผลการทดสอบเกณฑ์มาตรฐาน ราคา และการเข้าถึง

Ashley Innocent

Ashley Innocent

22 July 2026

Gemini 3.6 Flash คืออะไร

Apidog สำหรับองค์กร

การติดตั้งแบบ On-Premises

SSO & RBAC

รองรับมาตรฐาน SOC 2

สำรวจ Apidog Enterprise

Gemini 3.6 Flash เป็นโมเดลหลักตัวใหม่ของ Google เปิดให้ใช้งานทั่วไปในวันที่ 21 กรกฎาคม 2026 และมีราคาถูกลงและใช้โทเค็นได้อย่างมีประสิทธิภาพมากขึ้นกว่า Gemini 3.5 Flash ที่ถูกแทนที่ หากคุณส่งปริมาณการใช้งาน API สูงและต้องการคุณภาพที่เชื่อถือได้โดยไม่ต้องจ่ายในราคาเรือธง นี่คือระดับที่ Google สร้างมาเพื่อคุณ

คู่มือนี้ครอบคลุมถึงโมเดลนี้คืออะไร สิ่งที่เปลี่ยนแปลงไปจากเวอร์ชันที่แล้ว ข้อมูลจำเพาะทั้งหมด คะแนนในการทดสอบเปรียบเทียบ ค่าใช้จ่าย และวิธีการเข้าถึง คุณยังจะได้เห็นวิธีส่งและทดสอบการถดถอย (regression-test) การเรียก API ด้วยตัวเอง เพื่อให้ตัวเลขบนหน้าของ Google ตรงกับสิ่งที่คุณได้รับจริง

ปุ่ม

Gemini 3.6 Flash คืออะไร?

Gemini 3.6 Flash เป็นโมเดลระดับกลางที่มีปริมาณงานสูงในตระกูล Gemini ของ Google คำว่า "Workhorse" (โมเดลหลักที่ทำงานหนัก) เหมาะสมที่สุดสำหรับโมเดลนี้ โมเดลนี้ได้รับการปรับแต่งสำหรับงานประจำวันที่เป็นส่วนใหญ่ของปริมาณการใช้งานในการผลิต เช่น การสรุป, การดึงข้อมูล, การจัดหมวดหมู่, การสนทนา และการเรียกใช้เครื่องมือแบบหลายขั้นตอน มีความรวดเร็ว ราคาไม่แพง และสามารถอ่านข้อความ รูปภาพ วิดีโอ เสียง และ PDF ได้ในการเรียกครั้งเดียว

Google เปิดตัวโมเดลนี้เป็นหนึ่งในสามโมเดลเมื่อวันที่ 21 กรกฎาคม 2026 อีกสองโมเดลคือ Gemini 3.5 Flash-Lite ซึ่งเป็นระดับที่ถูกกว่าและเร็วกว่าสำหรับงานที่มีปริมาณมาก และ Gemini 3.5 Flash Cyber ซึ่งเป็นโมเดลความปลอดภัยแบบจำกัดการเข้าถึงที่รัฐบาลและพันธมิตรที่เชื่อถือได้เท่านั้นที่สามารถเข้าถึงได้ คุณสามารถอ่านรายละเอียดทั้งหมดของระดับราคาถูกได้ในบทความอธิบาย Gemini 3.5 Flash-Lite คืออะไร ของเรา และโมเดลความปลอดภัยแบบจำกัดการเข้าถึงได้ใน Gemini 3.5 Flash Cyber คืออะไร

นี่คือส่วนที่ทำให้คนสับสน: การกำหนดเวอร์ชันนั้นผสมกัน โมเดลหลักได้กระโดดไปที่เวอร์ชัน 3.6 แต่ Flash-Lite และ Flash Cyber ยังคงอยู่ที่ 3.5 ดังนั้น "โมเดล Flash ใหม่" จึงไม่ได้อยู่ในหมายเลขเวอร์ชันเดียวกันทั้งหมด เมื่อคุณเลือก ID โมเดล โปรดอ่านอย่างละเอียด gemini-3.6-flash และ gemini-3.5-flash-lite เป็นระดับที่แตกต่างกัน ไม่ใช่การพิมพ์ผิด

Google ได้เผยแพร่ประกาศบน บล็อกของ Google และข้อมูลโมเดล (model card) สามารถดูได้ที่ หน้า DeepMind Flash

มีอะไรใหม่เมื่อเทียบกับ Gemini 3.5 Flash

การเปลี่ยนแปลงที่สำคัญคือประสิทธิภาพ Gemini 3.6 Flash ใช้โทเค็นขาออกน้อยกว่า 3.5 Flash ประมาณ 17% ในการทำงานเดียวกัน โทเค็นที่น้อยลงหมายถึงค่าใช้จ่ายที่ลดลงและการตอบสนองที่เร็วขึ้น เนื่องจากโทเค็นขาออกคือสิ่งที่คุณจ่ายแพงที่สุดและใช้เวลานานที่สุดในการสตรีม

Google ยังได้ลดราคาโทเค็นขาออกอีกด้วย สำหรับ 3.5 Flash คุณจ่าย $9.00 ต่อล้านโทเค็นขาออก แต่สำหรับ 3.6 Flash คุณจ่าย $7.50 เมื่อรวมกับการประหยัดโทเค็นแล้ว ต้นทุนที่แท้จริงต่องานลดลงมากกว่าตัวเลขที่ระบุไว้เพียงอย่างเดียว

โมเดลนี้ยังทำงานได้ดีขึ้นในการเขียนโค้ดและการใช้งานคอมพิวเตอร์ และสามารถหาคำตอบได้ด้วยขั้นตอนการให้เหตุผลที่น้อยลงและการเรียกใช้เครื่องมือที่น้อยลงในขั้นตอนการทำงานแบบหลายขั้นตอน สิ่งนี้สำคัญสำหรับเอเจนต์ การวนลูปการให้เหตุผลและการเรียกใช้เครื่องมือที่เพิ่มขึ้นแต่ละครั้งจะเพิ่มความล่าช้าและค่าใช้จ่าย ดังนั้นการลดสิ่งเหล่านี้จะทำให้การทำงานของเอเจนต์ถูกลงและเร็วขึ้นตั้งแต่ต้นจนจบ

หากคุณกำลังตัดสินใจว่าจะย้ายปริมาณการใช้งานที่มีอยู่หรือไม่ เราจะอธิบายข้อดีข้อเสียในบทความ Gemini 3.6 Flash เทียบกับ 3.5 Flash

ข้อมูลจำเพาะของ Gemini 3.6 Flash

คุณสมบัติ Gemini 3.6 Flash
รหัสโมเดล gemini-3.6-flash
ขนาดหน้าต่างบริบทอินพุต 1M tokens
เอาต์พุตสูงสุด 64k tokens
รูปแบบอินพุต ข้อความ, รูปภาพ, วิดีโอ, เสียง, PDF
เอาต์พุต ข้อความเท่านั้น
ราคาอินพุต $1.50 per 1M tokens
ราคาเอาต์พุต $7.50 per 1M tokens (รวมโทเค็นการคิด)
ระดับฟรี มี, ผ่าน Google AI Studio (จำกัดอัตรา)
เปิดตัวเมื่อ July 21, 2026

ตัวเลขสองตัวควรค่าแก่การสังเกต หน้าต่างบริบทอินพุตขนาด 1M หมายความว่าคุณสามารถป้อนเอกสารขนาดใหญ่ ข้อความถอดความยาวๆ หรือโค้ดเบสทั้งหมดให้โมเดลได้ในการเรียกใช้ครั้งเดียว ขีดจำกัดเอาต์พุตสูงสุด 64k คือเพดานในการตอบกลับครั้งเดียว ดังนั้นหากคุณต้องการสร้างข้อความความยาวเท่าหนังสือ คุณจะต้องแบ่งงานออกเป็นการเรียกใช้หลายครั้ง

ประสิทธิภาพเป็นอย่างไร

การทดสอบเปรียบเทียบเป็นเพียงตัวแทน ไม่ใช่คำสัญญา แต่จะบอกคุณได้ว่าโมเดลมีความแข็งแกร่งในด้านใด นี่คือคะแนนของ Gemini 3.6 Flash ในชุดการทดสอบสาธารณะที่ Google รายงาน

ในด้านการเขียนโค้ด ทำคะแนนได้ 58.7% ใน SWE-Bench Pro ซึ่งเป็นการทดสอบที่ตรวจสอบว่าโมเดลสามารถแก้ไขปัญหา GitHub จริงในคลังโค้ดที่ใช้งานได้หรือไม่ ทำคะแนนได้ 49% ใน DeepSWE v1.1 ซึ่งเป็นการทดสอบเปรียบเทียบด้านวิศวกรรมซอฟต์แวร์อีกตัวหนึ่ง ใน Terminal-bench 2.1 ซึ่งวัดการรันคำสั่งในเทอร์มินัลจริง ทำคะแนนได้ 78.0%

การใช้งานคอมพิวเตอร์คือจุดที่เห็นการพัฒนามากที่สุด ใน OSWorld-Verified ซึ่งประเมินโมเดลที่ควบคุมเดสก์ท็อปและแอปพลิเคชันต่างๆ 3.6 Flash ทำได้ 83.0% เพิ่มขึ้นจาก 78.4% ใน 3.5 Flash นี่คือการพัฒนาที่มีความหมายสำหรับทุกคนที่สร้างเอเจนต์ที่ใช้งานอินเทอร์เฟซจริง

ในด้านคุณภาพโดยรวม ทำคะแนน GDPVal-AA v2 Elo ได้ 1421 GDPVal วัดประสิทธิภาพในงานระดับมืออาชีพในโลกจริง และคะแนน Elo จะจัดอันดับโมเดลแบบตัวต่อตัวคล้ายกับการจัดอันดับหมากรุก ดังนั้นตัวเลขที่สูงกว่าหมายความว่าโมเดลชนะการจับคู่ได้มากกว่า

บริบทที่ยาวนั้นมีความหลากหลายและควรพูดถึงอย่างตรงไปตรงมา ที่ 128k โทเค็น โมเดลมีค่าเฉลี่ย 91.8% ในการเรียกคืนข้อมูล ซึ่งถือว่าแข็งแกร่ง เมื่อผลักดันไปที่หน้าต่างบริบท 1M โทเค็นเต็มรูปแบบด้วยการเรียกคืนข้อมูลแบบจุดต่อจุด ความแม่นยำจะลดลงเหลือ 54.0% พูดง่ายๆ คือ โมเดลยังคงคมชัดเมื่อป้อนข้อมูลขนาดใหญ่ แต่อย่าคาดหวังการจดจำที่สมบูรณ์แบบเมื่อคุณกรอกหน้าต่างบริบททั้งหมด ทดสอบการเรียกคืนข้อมูลของคุณเองที่ความยาวที่คุณใช้จริง

ราคาโดยสรุป

Gemini 3.6 Flash มีค่าใช้จ่าย $1.50 ต่อล้านโทเค็นขาเข้า และ $7.50 ต่อล้านโทเค็นขาออก ราคาโทเค็นขาออกรวมถึงโทเค็นการคิดด้วย ดังนั้นการให้เหตุผลที่คุณไม่เห็นในคำตอบสุดท้ายก็ยังถูกนับรวมในบิล การแคชบริบทมีค่าใช้จ่าย $0.15 ต่อล้านโทเค็น บวกกับ $1.00 ต่อล้านโทเค็นต่อชั่วโมงสำหรับการจัดเก็บ ซึ่งมีประโยชน์เมื่อคุณส่งพร้อมต์ขนาดใหญ่เดิมซ้ำๆ

มีระดับฟรีผ่าน Google AI Studio ซึ่งมีการจำกัดอัตราการใช้งาน และ Google อาจใช้ข้อมูลจากระดับฟรีเพื่อปรับปรุงผลิตภัณฑ์ ดังนั้นจึงเหมาะสำหรับการสร้างต้นแบบ ไม่ใช่สำหรับการผลิต เราครอบคลุมข้อจำกัดและรายละเอียดปลีกย่อยในบทความ วิธีใช้ Gemini 3.6 Flash ฟรี และรายละเอียดค่าใช้จ่ายทั้งหมดพร้อมตัวอย่างในบทความ ราคา Gemini 3.6 Flash ตัวเลขของ Google เองอยู่ใน หน้าการกำหนดราคา Gemini API

วิธีเข้าถึง Gemini 3.6 Flash

คุณมีช่องทางเข้าถึงหลายช่องทาง:

สำหรับนักพัฒนาส่วนใหญ่ API คือช่องทางที่สำคัญที่สุด เรามีคำแนะนำทีละขั้นตอนในบทความ วิธีใช้ Gemini 3.6 Flash API และหากคุณมาจากเวอร์ชันเก่ากว่า คู่มือ Google Gemini 3 API ของเรายังคงครอบคลุมรูปแบบการเรียกและวิธีการยืนยันตัวตน (auth) เอกสารอ้างอิงอย่างเป็นทางการอยู่ที่ ai.google.dev

ตำแหน่งในผลิตภัณฑ์ของ Google

ลองนึกภาพการอัปเดต Flash เป็นบันไดด้านต้นทุนและคุณภาพ Gemini 3.5 Flash-Lite อยู่ต่ำกว่า 3.6 Flash: มีราคาถูกกว่าที่ $0.30 สำหรับอินพุตและ $2.50 สำหรับเอาต์พุตต่อล้านโทเค็น และมีความเร็วประมาณ 350 โทเค็นขาออกต่อวินาที เลือกใช้ Flash-Lite สำหรับงานที่มีปริมาณมากและต้องการความหน่วงต่ำ ซึ่งคุณไม่ต้องการคุณภาพเต็มรูปแบบของโมเดลหลัก เลือกใช้ 3.6 Flash เมื่อเป็นงานที่ยากขึ้น หรือผลลัพธ์ต้องมีความน่าเชื่อถือมากขึ้น

ทีนี้มาดูข้อควรระวังอย่างตรงไปตรงมา Gemini 3.5 Pro ยังไม่เปิดตัว Google กล่าวว่ายังคงทดสอบกับพันธมิตร ดังนั้นจึงไม่มีโมเดล Pro สาธารณะในการเปิดตัวครั้งนี้ และสื่อส่วนใหญ่ก็เน้นที่จุดนี้ นอกจากนี้ Google ยังได้แย้มเกี่ยวกับการฝึกโมเดล Gemini 4 ล่วงหน้าและเรียกว่าเป็นโมเดลที่มีความทะเยอทะยานที่สุดเท่าที่เคยมีมา แต่การแย้มไม่ได้หมายความว่าจะมีการจัดส่งโมเดลดังกล่าว โมเดลทั้งสองนี้ไม่ใช่สิ่งที่คุณสามารถเรียกใช้ได้ในวันนี้ หากคุณต้องการโมเดลเรือธงที่ทันสมัยที่สุดในตอนนี้ 3.6 Flash ไม่ใช่คำตอบ โมเดลนี้เป็นโมเดลระดับกลางที่รวดเร็ว สร้างขึ้นเพื่อให้มีราคาถูกและรวดเร็วในวงกว้าง และนั่นคือสิ่งที่โมเดลนี้มอบให้

สำหรับรุ่นก่อนหน้า บทความอธิบาย Gemini 3.5 คืออะไร ของเราจะให้ข้อมูลพื้นฐานที่โมเดลเหล่านี้ได้รับการปรับปรุงต่อยอด

การทดสอบ Gemini 3.6 Flash ใน Apidog

หน้าโมเดลจะอ้างถึงตัวเลขที่ดีที่สุดเท่านั้น วิธีเดียวที่จะรู้ว่า 3.6 Flash คืนค่าอะไรสำหรับพร้อมต์ของคุณ ที่ความยาวบริบทของคุณ คือการส่งการเรียกใช้และตรวจสอบการตอบกลับ นั่นคือจุดที่ไคลเอนต์ API มีประโยชน์

Apidog เป็นไคลเอนต์ API และแพลตฟอร์มทดสอบ และมันถือว่าปลายทาง Gemini เป็นการเรียกใช้ REST ทั่วไป นี่คือการตั้งค่าที่ง่ายดาย:

  1. สร้างคำขอ POST ไปยังปลายทาง Gemini API และตั้งค่าโมเดลเป็น gemini-3.6-flash
  2. จัดเก็บคีย์ API ของคุณไว้ในตัวแปรสภาพแวดล้อมของ Apidog แทนที่จะวางลงใน URL จากนั้นคุณสามารถสลับระหว่างคีย์ทดสอบและคีย์การผลิตได้โดยไม่ต้องแก้ไขคำขอ
  3. ส่งการเรียกใช้และอ่านการตอบกลับ เพิ่มการยืนยัน (assertions) บนรหัสสถานะและฟิลด์ JSON ที่คุณสนใจ เพื่อให้เพย์โหลดที่ไม่ถูกต้องหรือการเปลี่ยนแปลงสคีมาเกิดข้อผิดพลาดที่ชัดเจน แทนที่จะเล็ดลอดไปได้
  4. บันทึกเป็น regression test และ กำหนดเวลาให้รัน เพื่อให้คุณตรวจจับได้เมื่อรูปแบบการตอบกลับหรือความหน่วงเวลาเปลี่ยนแปลงหลังจากการอัปเดตโมเดล

โปรดทำความเข้าใจให้ชัดเจนว่าสิ่งนี้ทำอะไรได้และทำอะไรไม่ได้ Apidog ไม่ได้รันโมเดลและไม่ใช่เฟรมเวิร์ก AI แต่เป็นเครื่องมือที่คุณใช้สร้างคำขอ ส่งคำขอ และรักษาการตอบกลับให้เป็นไปตามมาตรฐานที่คุณกำหนด เมื่อ Google เปิดตัวการอัปเดต Flash ครั้งต่อไป การทดสอบที่คุณบันทึกไว้จะบอกคุณได้ภายในไม่กี่นาทีว่ามีสิ่งใดที่คุณต้องพึ่งพาเปลี่ยนไปหรือไม่ ดาวน์โหลด Apidog หากคุณต้องการตั้งค่าคำขอแรกนั้น

คำถามที่พบบ่อย (FAQ)

Gemini 3.6 Flash ฟรีหรือไม่? มีระดับฟรีผ่าน Google AI Studio แต่มีการจำกัดอัตราการใช้งานและมีวัตถุประสงค์เพื่อการสร้างต้นแบบ Google อาจใช้ข้อมูลจากระดับฟรีเพื่อปรับปรุงผลิตภัณฑ์ สำหรับปริมาณการใช้งานในการผลิต คุณจะต้องจ่ายเป็นโทเค็น: $1.50 ต่อล้านโทเค็นขาเข้า, $7.50 ต่อล้านโทเค็นขาออก

Gemini 3.6 Flash ดีกว่า 3.5 Flash หรือไม่? สำหรับงานส่วนใหญ่ ใช่ ใช้โทเค็นขาออกน้อยลงประมาณ 17% ราคาโทเค็นขาออกลดลงจาก $9.00 เหลือ $7.50 ต่อล้าน และมีความแข็งแกร่งขึ้นในการเขียนโค้ดและการใช้งานคอมพิวเตอร์ รวมถึงคะแนนที่เพิ่มขึ้นเป็น 83.0% ใน OSWorld-Verified จาก 78.4% เป็นโมเดลหลักที่มาแทนที่ 3.5 Flash

Gemini 3.5 Pro เปิดตัวแล้วหรือยัง? ยัง Google กล่าวว่ายังคงทดสอบ 3.5 Pro กับพันธมิตร ดังนั้นจึงไม่มีโมเดล Pro สาธารณะในการเปิดตัวครั้งนี้ การฝึกโมเดล Gemini 4 ล่วงหน้าถูกแย้มออกมาแต่ยังไม่มีการจัดส่ง

รหัสโมเดลคืออะไร? คือ gemini-3.6-flash อย่าสับสนกับ gemini-3.5-flash-lite ซึ่งเป็นระดับ Flash-Lite ที่ราคาถูกกว่าและมีหมายเลขเวอร์ชันที่แตกต่างกัน

Gemini 3.6 Flash ทำอะไรไม่ได้บ้าง? มันสร้างได้แค่ข้อความเท่านั้น ดังนั้นจึงไม่สามารถสร้างรูปภาพ เสียง หรือวิดีโอได้ แม้ว่าจะสามารถอ่านสิ่งเหล่านี้เป็นอินพุตได้ก็ตาม ความสามารถในการจดจำข้อมูลลดลงเมื่อเข้าใกล้ขีดจำกัดของหน้าต่าง 1M โทเค็น โดยอยู่ที่ประมาณ 54.0% ในการเรียกคืนข้อมูลแบบจุดต่อจุดที่ความยาวเต็ม และเป็นโมเดลหลักระดับกลาง ไม่ใช่โมเดลเรือธงที่ทันสมัยที่สุด ดังนั้นควรเลือกระดับที่เหมาะสมสำหรับงานที่ต้องการการให้เหตุผลที่ซับซ้อนอย่างแท้จริง

Gemini 3.6 Flash เป็นโมเดลที่ปริมาณการใช้งาน Gemini API ส่วนใหญ่ควรใช้ในตอนนี้: ราคาถูกลง, ใช้โทเค็นมีประสิทธิภาพมากขึ้น และทำงานด้านเอเจนต์ได้ดีกว่าเวอร์ชันที่มาแทนที่ ยืนยันส่วนที่คุณต้องพึ่งพาด้วยการทดสอบ API ที่บันทึกไว้สองสามครั้งก่อนที่คุณจะย้ายระบบในวงกว้าง เมื่อ Flash-Lite, Cyber หรือ Pro และ Gemini 4 เปิดตัวในที่สุด คุณจะรู้ได้อย่างชัดเจนว่ามีการเปลี่ยนแปลงอะไรในผลตอบกลับของคุณบ้าง

ฝึกการออกแบบ API แบบ Design-first ใน Apidog

ค้นพบวิธีที่ง่ายขึ้นในการสร้างและใช้ API