Gemini 3.8 Flash คือโมเดลระดับ Flash ใหม่ล่าสุดของ Google เปิดตัวเมื่อวันที่ 2 กันยายน 2026 พร้อมกับ Gemini 3.8 Flash Cyber ซึ่งเป็นโมเดลคู่แฝดด้านความปลอดภัยแบบจำกัดการเข้าถึง นี่เป็นการเปิดตัวโมเดล Flash ครั้งที่สามในหกสัปดาห์ ถัดจาก Gemini 3.6 Flash เมื่อวันที่ 21 กรกฎาคม และ 3.7 Flash เมื่อวันที่ 13 สิงหาคม โดยมีราคาเปิดตัวเท่ากับ 3.7 Flash: 0.75 ดอลลาร์ต่อล้านโทเค็นอินพุต และ 3.75 ดอลลาร์ต่อล้านโทเค็นเอาต์พุต จนถึงวันที่ 31 ธันวาคม 2026 Google เรียกว่าเป็น “โมเดล Flash ที่ชาญฉลาดที่สุดของเรา ซึ่งออกแบบมาสำหรับวิศวกรรมซอฟต์แวร์ที่มีขอบเขตยาวนาน, เอเจนต์อัตโนมัติ และเวิร์กโฟลว์องค์กรที่ซับซ้อน”
การเปลี่ยนแปลงที่สำคัญไม่ใช่ราคาใหม่หรือหน้าต่างบริบทที่ใหญ่ขึ้น แต่เป็นการทำงาน Google ได้ออกแบบ 3.8 Flash ให้ “ทำงานหนักขึ้น” ในงานที่ยากลำบาก: โดยจะใช้ขั้นตอนการให้เหตุผลที่เล็กลง ตรวจสอบงานของตัวเองไปพร้อมกัน และเรียกใช้เครื่องมือซ้ำๆ ซึ่งทำให้ได้ผลลัพธ์ที่วัดผลได้บนเกณฑ์มาตรฐานของเอเจนต์ และหมายความว่าโมเดลจะใช้โทเค็นต่อภารกิจมากขึ้นตามการออกแบบ Artificial Analysis วัดได้ว่ามีการใช้โทเค็นเอาต์พุตเพิ่มขึ้นประมาณ 30% เมื่อเทียบกับ 3.7 Flash หากคุณใช้งบประมาณตามโทเค็น ราคาจะคงที่ แต่ถ้าคุณใช้งบประมาณตามภารกิจ ค่าใช้จ่ายก็จะเพิ่มขึ้น
คู่มือนี้ครอบคลุมการเปิดตัวทั้งหมด: คุณสมบัติ, การแลกเปลี่ยน “ทำงานหนักขึ้น”, เกณฑ์มาตรฐาน, ราคา, ความพร้อมใช้งาน, โมเดล Cyber คู่แฝด, และสิ่งที่โมเดลนี้ทำไม่ได้ ทุกคำขอในที่นี้เป็น HTTP แบบธรรมดาพร้อม JSON ดังนั้นคุณสามารถสร้างและตรวจสอบได้ใน Apidog ก่อนที่จะนำไปใช้ในโค้ดแอปพลิเคชัน โพสต์เปิดตัว ของ Google และ หน้าโมเดล เป็นแหล่งข้อมูลหลัก
Gemini 3.8 Flash โดยย่อ
| คุณสมบัติ | ค่า |
|---|---|
| ID โมเดล API | gemini-3.8-flash (เสถียร, ไม่มีส่วนต่อท้าย preview) |
| เปิดตัวเมื่อ | 2 กันยายน 2026 |
| พัฒนาบนพื้นฐานของ | Gemini 3.7 Flash (ตาม DeepMind model card) |
| หน้าต่างบริบท | อินพุต 1,048,576 โทเค็น |
| เอาต์พุตสูงสุด | 65,536 โทเค็น |
| รูปแบบอินพุต | ข้อความ, รูปภาพ, วิดีโอ, เสียง, PDF |
| รูปแบบเอาต์พุต | ข้อความเท่านั้น |
| ระดับการคิด | low, medium (ค่าเริ่มต้น), high; minimal จะคืนค่าข้อผิดพลาด |
| ราคาเปิดตัว (ถึง 31 ธ.ค. 2026) | 0.75 ดอลลาร์อินพุต / 3.75 ดอลลาร์เอาต์พุต ต่อล้านโทเค็น; การคิดคำนวณจะถูกคิดเป็นเอาต์พุต |
| ราคามาตรฐาน (ตั้งแต่ 1 ม.ค. 2027) | 1.50 ดอลลาร์อินพุต / 7.50 ดอลลาร์เอาต์พุต ต่อล้านโทเค็น |
| การแคชบริบท | 0.075 ดอลลาร์ต่อล้านโทเค็นที่แคช (เปิดตัว), 0.15 ดอลลาร์มาตรฐาน |
| Batch API | ลด 50%: 0.375 ดอลลาร์ / 1.875 ดอลลาร์ (เปิดตัว) |
| ข้อมูลที่ถูกตัด | มีนาคม 2026 |
| ความพร้อมใช้งานสำหรับนักพัฒนา | Gemini API, Google AI Studio, Android Studio, Google Antigravity, Stitch, Gemini Enterprise |
| ความพร้อมใช้งานสำหรับผู้บริโภค | แอป Gemini (สำหรับสมาชิก AI Pro และ Ultra), AI Mode ใน Search, Gemini ใน Google Sheets |
| สถานะของ 3.7 Flash | ยังคงได้รับการสนับสนุนอย่างเต็มที่; ไม่มีวันสิ้นสุดการสนับสนุน |
สามแถวนี้ควรค่าแก่การพิจารณาอีกครั้ง ระดับการคิดเริ่มต้นคือ medium ไม่ใช่ high เหมือน Gemini 3 Pro ดังนั้นพรอมต์ที่ปรับแต่งบน Pro จะให้เหตุผลน้อยลงที่นี่ เว้นแต่คุณจะกำหนดระดับเอง ระดับ minimal จะคืนค่าข้อผิดพลาดในการตรวจสอบความถูกต้อง แทนที่จะแมปอย่างเงียบ ๆ ไปยัง low; คู่มือระดับการคิด ครอบคลุมการแก้ไขนี้ และข้อมูลที่ถูกตัดในเดือนมีนาคม 2026 มีข้อควรระวังใน Model Card ว่า: ในบางโดเมน ข้อมูลอาจจำกัดอยู่แค่เดือนมกราคม 2025
Gemini 3.8 Flash คืออะไร
Flash คือระดับการทำงานหลักของ Google: โมเดลที่ออกแบบมาเพื่อจัดการทราฟฟิกการผลิตส่วนใหญ่ ในขณะที่ Pro จัดการปัญหาที่ยากที่สุด Google เรียก 3.8 Flash ว่า “โมเดลหลักที่ชาญฉลาดที่สุด” และ DeepMind model card อธิบายว่ามันพัฒนามาจาก 3.7 Flash ไม่ใช่โมเดลพื้นฐานใหม่ ดังนั้น การอธิบายที่ซื่อสัตย์คือการปรับปรุงโมเดลที่เปิดตัวเมื่อสามสัปดาห์ก่อนหน้านี้ ซึ่งปรับแต่งมาสำหรับงานวิศวกรรมซอฟต์แวร์ที่ใช้เวลานานและงานของเอเจนต์

จังหวะการออกรุ่นนี้ไม่ปกติ 3.6 Flash เปิดตัวเมื่อวันที่ 21 กรกฎาคม ในราคา 1.50 ดอลลาร์ / 7.50 ดอลลาร์, 3.7 Flash เมื่อวันที่ 13 สิงหาคม ในราคาเปิดตัว 0.75 ดอลลาร์ / 3.75 ดอลลาร์ และ 3.8 Flash เมื่อวันที่ 2 กันยายน ในราคาเดียวกัน Google ใช้คำว่า “การเปิดตัว Flash ครั้งที่สามในหกสัปดาห์”; Artificial Analysis นับเป็นโมเดล Flash ตัวที่สี่ในเวลาไม่ถึงสี่เดือน เนื่องจากพวกเขานับรวม 3.5 Flash-Lite ด้วย สำหรับทุกคนที่ดูแลการตั้งค่าโมเดล โพสต์ข่าวใหม่ของ 3.7 Flash มีอายุสามสัปดาห์และได้อธิบายถึงรุ่นก่อนหน้าไปแล้ว ไม่มี Gemini 3.8 Pro, Gemini 4 หรือ Flash-Lite ใหม่ที่จัดส่งมาพร้อมกับการเปิดตัวครั้งนี้ และ Google ยังไม่ได้ระบุว่าจะมีการอัปเดต Pro เมื่อใด
การออกแบบ “ทำงานหนักขึ้น” และผลลัพธ์ด้านค่าใช้จ่าย
คำอธิบายของการเปลี่ยนแปลงของ Google นั้นเฉพาะเจาะจง ในงานที่ซับซ้อน 3.8 Flash “ดำเนินการขั้นตอนการให้เหตุผลเพิ่มเติม และเรียกใช้เครื่องมือซ้ำๆ” โดยจะใช้ “ขั้นตอนการให้เหตุผลที่เล็กลง” และ “ตรวจสอบงานของตัวเองไปพร้อมกัน” Google ชี้ให้เห็นถึงผลที่ตามมาโดยตรง: โมเดล “สามารถใช้โทเค็นมากขึ้นในงานที่ใช้เวลานานและซับซ้อน ตามการออกแบบ” โดยเฉพาะอย่างยิ่งในระดับความพยายามที่สูงขึ้น
Artificial Analysis ได้วัดผลดังกล่าวใน รายงานอิสระ ของพวกเขา เมื่อรัน Intelligence Index ของพวกเขา 3.8 Flash ที่ระดับการให้เหตุผลสูงใช้โทเค็นเอาต์พุตเฉลี่ย 48,000 โทเค็นต่อภารกิจ เพิ่มขึ้น 30% จาก 3.7 Flash ราคาต่อโทเค็นไม่เปลี่ยนแปลง ดังนั้นต้นทุนต่อภารกิจจึงเพิ่มขึ้นจาก 0.40 ดอลลาร์สำหรับ 3.7 Flash (สูง) เป็น 0.58 ดอลลาร์สำหรับ 3.8 Flash (สูง) เวลาต่อภารกิจก็เพิ่มขึ้นเช่นกัน: 2.5 นาที เทียบกับ 2.2 นาที
รายงานเดียวกันนี้แสดงให้เห็นถึงกลไกที่คุณมี ที่ medium ต้นทุนต่อภารกิจลดลงเหลือ 0.41 ดอลลาร์ ใกล้เคียงกับ 3.7 Flash ที่ระดับสูง ที่ low ต้นทุนลดลงเหลือ 0.24 ดอลลาร์ โดยใช้เวลา 0.8 นาทีต่อภารกิจ ดังนั้นระดับการคิดตอนนี้จึงเป็นการตัดสินใจด้านการกำหนดเส้นทาง ไม่ใช่การตั้งค่าทั่วโลก: ปลายทางที่ไวต่อเวลาแฝงใช้ low, ลูปเอเจนต์ที่ต้องทำงานให้เสร็จใช้ medium หรือ high รายละเอียดราคา แสดงตัวอย่างสำหรับ 1,000 ภารกิจเอเจนต์ต่อวันในแต่ละระดับ
ความเร็วไม่เปลี่ยนแปลง Logan Kilpatrick จาก Google อธิบายว่า 3.8 Flash “ราคาเท่ากับ 3.7, ความเร็วใกล้เคียงกัน” และ Artificial Analysis วัดความเร็วได้ 302.1 โทเค็นเอาต์พุตต่อวินาทีที่ระดับการให้เหตุผลสูง เวลา Time-to-first-token ที่ 13.30 วินาทีในการรันนั้นแสดงถึงการที่โมเดลกำลังคิดก่อนที่จะตอบ ไม่ใช่ปัญหาเครือข่ายที่ช้า
สิ่งที่เกณฑ์มาตรฐานบอก
Google ได้เผยแพร่ตารางเกณฑ์มาตรฐานสามตารางในรูปแบบข้อความบน หน้า DeepMind Flash ตัวเลขเหล่านี้เป็นผลลัพธ์ที่ Google ได้ดำเนินการเอง
| เกณฑ์มาตรฐาน | 3.8 Flash | 3.7 Flash | Claude Opus 5 | GPT-5.6 Sol | GPT-5.6 Terra | Claude Sonnet 5 |
|---|---|---|---|---|---|---|
| Vals Finance Agent v2 | 61.4% | 59.0% | 58.6% | 53.8% | 54.4% | 53.9% |
| Harvey Legal Agent Benchmark | 10.0% | 8.8% | 6.7% | 2.5% | 0.8% | 5.0% |
| HLE-Verified | 54.9% | 53.6% | 54.4% | 54.5% | 51.1% | 31.0% |
การเพิ่มขึ้นเมื่อเทียบกับ 3.7 Flash คือ 2.4, 1.2 และ 1.3 จุด ซึ่งอาจไม่มากนัก แต่แถวในหมวดการเงินและกฎหมายแสดงให้เห็นว่าโมเดลราคา Flash แซงหน้า Opus 5 และ GPT-5.6 Sol ซึ่งมีราคาต่อโทเค็นแพงกว่าหลายเท่า Claude Fable 5.1 ซึ่งเปิดตัวไปเมื่อวันก่อนหน้า ไม่ปรากฏในตารางของ Google; การเปรียบเทียบสามทาง ใช้แถว Opus 5 และ Sonnet 5 ของ Anthropic เป็นข้อมูลที่ใกล้เคียงที่สุดที่เผยแพร่
Google อ้างสิทธิ์อีกสามประการโดยไม่มีตัวเลขในรูปแบบข้อความ บน DeepSWE v1.1, 3.8 Flash “มีประสิทธิภาพเหนือกว่าโมเดลฟรอนเทียร์ขนาดใหญ่ส่วนใหญ่” ในราคาเพียง “เศษเสี้ยวของต้นทุน”; เปอร์เซ็นต์นี้ปรากฏเฉพาะในตารางรูปภาพของ model card เท่านั้น เราจึงไม่พิมพ์ออกมา (3.7 Flash ได้คะแนน 65.3%) ในเวิร์กโฟลว์ที่เน้นเอกสารและใช้เวลานาน การประเมินภายในแสดงให้เห็นว่ามัน “ทำงานเสร็จสิ้นได้มากกว่า Gemini 3.7 Flash ถึงสามเท่า” ในการฉีดพรอมต์ Gray Swan, Google รายงานว่ามีการ “ก้าวกระโดดครั้งสำคัญ” โดยไม่มีตัวเลข ผลลัพธ์ SWE-Bench Pro, Terminal-bench และ OSWorld ไม่ได้ถูกเผยแพร่ในรูปแบบข้อความสำหรับ 3.8 Flash
มุมมองที่เป็นอิสระสอดคล้องกัน Artificial Analysis ให้คะแนน 3.8 Flash (สูง) ที่ 59 ใน Intelligence Index ของพวกเขา เพิ่มขึ้นจาก 56 สำหรับ 3.7 Flash และ 52 สำหรับ 3.6 Flash ซึ่งเทียบเท่ากับ GPT-5.6 Sol (xhigh) และ Grok 4.6 (medium) และสูงกว่า GPT-5.6 Terra (max), Claude Fable 5.1 (medium) และ Muse Spark 1.2 (xhigh) ซึ่งทั้งหมดได้ 57 คะแนน ในการประเมินการใช้เครื่องมือ τ³-Banking ของพวกเขา 3.8 Flash ได้คะแนน 45% ซึ่งสูงกว่า 3.7 Flash 12 จุด การเปรียบเทียบ 3.8 เทียบกับ 3.7 Flash ได้ชั่งน้ำหนักผลกำไรเหล่านั้นเทียบกับต้นทุนโทเค็นตามปริมาณงาน
ราคา: เท่ากันต่อโทเค็น, เพิ่มขึ้นต่อภารกิจ
หน้าการกำหนดราคา แสดง 3.8 Flash อยู่ในแถวเดียวกันกับ 3.6 และ 3.7 Flash และทั้งสามราคาจะเพิ่มขึ้นเป็นสองเท่าในวันที่ 1 มกราคม 2027
| รายการ | ถึง 31 ธันวาคม 2026 | ตั้งแต่วันที่ 1 มกราคม 2027 |
|---|---|---|
| อินพุต | $0.75 / 1M | $1.50 / 1M |
| เอาต์พุต (รวมการคิด) | $3.75 / 1M | $7.50 / 1M |
| อินพุตที่แคช | $0.075 / 1M | $0.15 / 1M |
| ที่เก็บแคช | $0.50 / 1M โทเค็น / ชั่วโมง | $1.00 / 1M โทเค็น / ชั่วโมง |
| Batch อินพุต / เอาต์พุต | $0.375 / $1.875 | $0.75 / $3.75 |
มีสองรายละเอียดที่ทำให้ผู้คนสับสน โทเค็นสำหรับการคิดคือโทเค็นเอาต์พุต: คิดค่าบริการตามอัตราเอาต์พุตและรายงานแยกต่างหากใน usageMetadata.thoughtsTokenCount ดังนั้นคำตอบสั้นๆ ที่ high อาจมีค่าใช้จ่ายมากกว่าคำตอบยาวๆ ที่ low และการค้นหาข้อมูลจาก Google Search มีมิเตอร์ของตัวเอง: 5,000 คำขอฟรีต่อเดือนซึ่งใช้ร่วมกันระหว่างโมเดล Gemini 3.x ทั้งหมด หลังจากนั้นคิดค่าบริการ 14 ดอลลาร์ต่อ 1,000 คำขอ
มีระดับฟรีแบบจำกัดอัตราใน AI Studio และ API โดย Google ระบุว่าข้อมูลจากระดับฟรีจะ “ใช้เพื่อปรับปรุงผลิตภัณฑ์ของเรา” ขีดจำกัดอัตราต่อโมเดลจะแสดงใน AI Studio แทนที่จะอยู่ในเอกสาร ระดับ 1 จะปลดล็อกโดยการเชื่อมโยงบัญชีการเรียกเก็บเงิน ระดับ 2 หลังจากใช้จ่าย 100 ดอลลาร์และสามวัน ระดับ 3 หลังจากใช้จ่าย 1,000 ดอลลาร์และ 30 วัน คู่มือการเข้าถึงฟรี ครอบคลุมสิ่งที่เส้นทางฟรีให้หรือไม่ให้คุณ และ คู่มือ Batch API ครอบคลุมส่วนลด 50% สำหรับงานที่รอได้
วิธีการเรียกใช้งาน
Google ตอนนี้ถือว่า Interactions API เป็นเส้นทางหลักสำหรับ Gemini 3.x. generateContent นั้น "ถือว่าเป็นเวอร์ชันเก่า" แต่ "ยังคงได้รับการสนับสนุนอย่างเต็มที่" โดยไม่มีวันสิ้นสุดการสนับสนุน และโค้ดที่มีอยู่ส่วนใหญ่ยังคงใช้งานอยู่ คำขอ Interactions ขั้นต่ำ:
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{"model":"gemini-3.8-flash","input":"Explain HTTP caching in 3 sentences.","generation_config":{"thinking_level":"medium"}}'
การสนทนาแบบหลายเทิร์นจะส่งผ่าน previous_interaction_id และให้เซิร์ฟเวอร์รักษาสถานะไว้ การเรียกใช้ฟังก์ชันจะประกาศเครื่องมือด้วย JSON schema รับขั้นตอน function_call และคาดว่าจะได้รับ function_result ที่มีทั้ง call_id และ name ซึ่งจำเป็นสำหรับ 3.8 Flash (generateContent แบบเก่าสะกดฟิลด์ id) คำแนะนำการใช้งาน API แสดงทั้งสองปลายทางในรูปแบบ REST และ Python และ คู่มือการเรียกใช้ฟังก์ชัน ครอบคลุมลูปเครื่องมือแบบวนซ้ำที่การออกแบบ "ทำงานหนักขึ้น" สร้างขึ้นและวิธีจำกัดการใช้งาน
หากคุณกำลังย้ายจาก 3.7 Flash การเปลี่ยนแปลงมีเพียงเล็กน้อยแต่สามารถทำให้เกิดข้อผิดพลาดได้: minimal thinking จะถูกปฏิเสธ, thinking_budget เปลี่ยนเป็น thinking_level, candidate_count ไม่ได้รับการสนับสนุน และ Google แนะนำให้ตั้ง temperature เป็นค่าเริ่มต้น 1.0 เพราะการลดค่าลง “อาจทำให้เกิดการวนซ้ำหรือประสิทธิภาพลดลง” คู่มือการย้ายข้อมูล ได้เปลี่ยนบันทึก "มีอะไรใหม่" ของ Google ให้กลายเป็นรายการตรวจสอบพร้อม JSON ทั้งก่อนและหลัง
สิ่งที่ Gemini 3.8 Flash ทำไม่ได้
หน้าโมเดลระบุไว้อย่างชัดเจนว่าไม่รองรับ: การสร้างเสียง, Live API และการสร้างภาพ ผลลัพธ์เป็นเพียงข้อความเท่านั้น แม้ว่าอินพุตจะรับข้อความ, รูปภาพ, วิดีโอ, เสียง และ PDF การแบ่งส่วนภาพก็ไม่รองรับในโมเดล Gemini 3 เช่นกัน หากผลิตภัณฑ์ของคุณต้องการเสียงหรือภาพแบบเรียลไทม์ โมเดลนี้จะเป็นชั้นการให้เหตุผลและการเรียกใช้เครื่องมือ ไม่ใช่ส่วนทั้งหมดของระบบ สำหรับข้อความที่มีปริมาณงานสูงในราคาถูกโดยไม่มีการให้เหตุผลที่ซับซ้อน Gemini 3.5 Flash-Lite ยังคงอยู่ในรายการราคาที่ 0.30 ดอลลาร์ / 2.50 ดอลลาร์ รายการตรวจสอบที่เหลือได้รับการสนับสนุนทั้งหมด รวมถึงการเรียกใช้ฟังก์ชัน, เอาต์พุตที่มีโครงสร้าง, การแคชบริบท, การดำเนินการโค้ด, การค้นหาและการเชื่อมโยงกับแผนที่, Batch API และการใช้งานคอมพิวเตอร์ในโหมดพรีวิว
Gemini 3.8 Flash Cyber: โมเดลคู่แฝดแบบจำกัดการเข้าถึง
Gemini 3.8 Flash Cyber เปิดตัวในวันเดียวกัน แต่คุณไม่สามารถลงทะเบียนใช้งานได้ การเข้าถึงจะทำได้ผ่าน Fairwind Program ใหม่เท่านั้น ซึ่งเปิดให้ "หน่วยงานภาครัฐที่เชื่อถือได้, ผู้ประกอบการโครงสร้างพื้นฐานที่สำคัญ และผู้ดูแลซอฟต์แวร์" โดยต้องมีการตรวจสอบประวัติและข้อกำหนดต่างๆ เช่น MFA ที่ป้องกันการฟิชชิ่ง ไม่มี API สาธารณะ ไม่มีราคาที่เปิดเผยต่อสาธารณะ และไม่มีการโฮสต์ด้วยตนเอง โมเดลนี้มาแทนที่ 3.5 Flash Cyber ที่เป็นรุ่นทดลองแบบจำกัด
Google อ้างสิทธิ์อย่างยิ่งใหญ่: อัตราความสำเร็จในการค้นหาช่องโหว่ในโลกจริงสูงกว่า 70% ใน 20 ภาษาโปรแกรม และรายงานจากทีมรักษาความปลอดภัยของ Chrome ระบุว่า “แก้ไขช่องโหว่ใน Chrome ได้ถูกต้องมากกว่าโมเดลเชิงพาณิชย์ขนาดใหญ่กว่ามากถึง 2.6 เท่า” ทั้งสองเป็นรายงานจาก Google คำอธิบาย Cyber ครอบคลุมคุณสมบัติ, ข้อผูกพัน และความหมายสำหรับทีมงานจำนวนมากที่จะไม่ได้รับสิทธิ์เข้าถึง
การทดสอบคำขอ Gemini 3.8 Flash ใน Apidog
เนื่องจากเรื่องค่าใช้จ่ายคิดเป็นต่อภารกิจ แทนที่จะเป็นต่อโทเค็น การทดสอบที่มีประโยชน์จึงไม่ใช่ "การเรียกสำเร็จหรือไม่" แต่เป็น "ใช้โทเค็นไปเท่าไหร่" Apidog จัดการสิ่งนี้ได้เหมือนการทดสอบ API ทั่วไป จัดเก็บ GEMINI_API_KEY เป็นตัวแปรสภาพแวดล้อม บันทึกคำขอ Interactions และ generateContent เป็นปลายทาง และยืนยันสถานะ 200, ฟิลด์ JSON ที่แอปของคุณอ่าน และเพดานของ usageMetadata.thoughtsTokenCount เรียกใช้พรอมต์เดียวกันที่ low, medium และ high ในสถานการณ์การทดสอบเดียว และคุณจะได้รับข้อมูลการกระจายโทเค็นต่อระดับสำหรับพรอมต์ของคุณเอง แทนที่จะเป็นค่าเฉลี่ยของ Artificial Analysis
การตอบสนองแบบสตรีมจะแสดงเป็น SSE ซึ่งเป็นประโยชน์เมื่อแก้ไขข้อบกพร่องสรุปความคิดด้วย includeThoughts: true; คู่มือการทดสอบ SSE จะอธิบายรายละเอียด กำหนดเวลาให้สถานการณ์ทำงานทุกวัน และการถดถอยของโทเค็นจะทำให้การยืนยันล้มเหลวก่อนที่จะปรากฏในใบแจ้งหนี้ ดาวน์โหลด Apidog เพื่อตั้งค่าบนแผนฟรี
คำถามที่พบบ่อย
Gemini 3.8 Flash เป็นโมเดลใหม่ หรือเป็นการอัปเดตของ 3.7 Flash? DeepMind model card ระบุว่าพัฒนาบนพื้นฐานของ Gemini 3.7 Flash ถือว่าเป็นการปรับปรุงรุ่น: ราคา, ความเร็ว และหน้าต่างบริบทเท่าเดิม แต่มีการให้เหตุผลและขั้นตอนการเรียกใช้เครื่องมือมากขึ้นในงานที่ยาก 3.7 Flash ยังคงได้รับการสนับสนุนอย่างเต็มที่ โดยไม่มีวันสิ้นสุดการสนับสนุน
เหตุใด Gemini 3.8 Flash จึงใช้โทเค็นมากกว่า 3.7 Flash? ตามการออกแบบ Google กล่าวว่า “สามารถใช้โทเค็นมากขึ้นในงานที่ใช้เวลานานและซับซ้อน” และ Artificial Analysis วัดได้ว่ามีการใช้โทเค็นเอาต์พุตเพิ่มขึ้น 30% ในดัชนีของพวกเขา ลด thinking_level เป็น medium หรือ low ในเส้นทางที่ไม่ต้องการการให้เหตุผลเพิ่มเติม; คู่มือระดับการคิด มีตารางค่าใช้จ่ายต่อระดับ
หน้าต่างบริบทของ Gemini 3.8 Flash คือเท่าไร? อินพุต 1,048,576 โทเค็น และเอาต์พุต 65,536 โทเค็น พร้อมการแคชบริบทที่ 0.075 ดอลลาร์ต่อล้านโทเค็นที่แคชจนถึงวันที่ 31 ธันวาคม 2026
ฉันสามารถใช้ Gemini 3.8 Flash ในแอป Gemini ฟรีได้หรือไม่? ข้อมูลการเปิดตัวระบุว่าแอป Gemini สำหรับสมาชิก Google AI Pro และ Ultra ไม่ใช่แอป Gemini เวอร์ชันฟรี นักพัฒนาจะได้รับระดับฟรีแบบจำกัดอัตราใน AI Studio และ API
Gemini 3.8 Flash เปรียบเทียบกับ Claude Fable 5.1 ได้อย่างไร? Artificial Analysis ให้คะแนนพวกเขาที่ 59 และ 57 ในด้านราคา Claude Fable 5.1 มีราคา 10 ดอลลาร์ / 50 ดอลลาร์ต่อล้านโทเค็น ซึ่งประมาณ 13 เท่าของอัตราเปิดตัวของ 3.8 Flash ทั้งอินพุตและเอาต์พุต ส่วนต่างจะแคบลงเมื่อคุณนับโทเค็นต่อภารกิจ
จะไปที่ไหนต่อ
Gemini 3.8 Flash คือโมเดลหลักที่คิดได้ยาวนานขึ้น และการแลกเปลี่ยนก็ชัดเจน: ได้คะแนนเพิ่มขึ้นเล็กน้อยบนเกณฑ์มาตรฐานของเอเจนต์ และเพิ่มขึ้น 12 จุดในการใช้เครื่องมือ แลกกับการใช้โทเค็นเอาต์พุตเพิ่มขึ้นประมาณ 30% ที่ระดับการให้เหตุผลสูง หากเอเจนต์ของคุณติดขัดบน 3.7 Flash การอัปเกรดนี้มีต้นทุนต่อโทเค็นเท่าเดิม หากทราฟฟิกของคุณคือการสนทนาที่ไวต่อเวลาแฝง ให้ตั้งค่า low หรือใช้ 3.7 Flash ซึ่งยังคงรองรับอยู่ เริ่มต้นด้วย คำแนะนำการใช้งาน API ส่งคำขอแรกของคุณจาก Apidog พร้อมกับการยืนยันจำนวนโทเค็นที่แนบมา และให้ตัวเลขเป็นผู้ตัดสินระดับการคิดสำหรับแต่ละเส้นทาง ไม่ใช่โพสต์เปิดตัว
