Gemini Omni 1.1 Flash: มีอะไรใหม่ในโมเดล AI วิดีโอ GA ของ Google

จีมินี่ ออมนิ 1.1 แฟลช เปิดตัวพร้อมใช้งานทั่วไปเมื่อวันที่ 27 สิงหาคม 2569 มาพร้อมกับการขยายฉาก 40 วินาที, การควบคุมคีย์เฟรม, การร่างภาพความละเอียด 360p และการปรับเพิ่มความละเอียดเป็น 4K สิ่งที่เปลี่ยนแปลงไป, ค่าใช้จ่าย และกำหนดเวลาสิ้นสุดการรองรับเวอร์ชันพรีวิว

Ashley Innocent

Ashley Innocent

28 August 2026

Gemini Omni 1.1 Flash: มีอะไรใหม่ในโมเดล AI วิดีโอ GA ของ Google

Apidog สำหรับองค์กร

การติดตั้งแบบ On-Premises

SSO & RBAC

รองรับมาตรฐาน SOC 2

สำรวจ Apidog Enterprise

Google ได้เปิดตัวโมเดลวิดีโอสนทนาของตนให้ใช้งานทั่วไปเมื่อวันที่ 27 สิงหาคม 2026 รหัสโมเดลคือ gemini-omni-1.1-flash และจะมาแทนที่เอนด์พอยต์ gemini-omni-flash-preview ที่เปิดให้ใช้งานในเวอร์ชันพรีวิวสาธารณะเมื่อวันที่ 30 มิถุนายน หากคุณพัฒนาสิ่งใดก็ตามโดยใช้เวอร์ชันพรีวิว คุณมีกำหนดเวลา: Google จะปิดใช้งานเอนด์พอยต์พรีวิวในวันที่ 30 กันยายน 2026

การเปิดตัวเวอร์ชัน GA ไม่ใช่แค่การอัปเดตเวอร์ชันที่ไม่มีอะไรเปลี่ยนแปลงจริงจัง มีความสามารถใหม่สี่ประการที่มาพร้อมกับการเปิดตัวนี้ ซึ่งแต่ละอย่างช่วยแก้ไขช่องว่างที่ทำให้เวอร์ชันพรีวิวยากต่อการนำไปใช้งานจริง: การขยายฉากได้นานถึง 40 วินาที, การควบคุมเฟรมแรกและเฟรมสุดท้าย, โหมดร่าง 360p ราคาประหยัด และการอัปสเกล 4K โพสต์นี้ครอบคลุมถึงสิ่งที่เปลี่ยนแปลงไป ค่าใช้จ่าย สถานที่ที่โมเดลทำงาน และสิ่งที่โมเดลยังไม่สามารถทำได้

หากคุณต้องการทราบภูมิหลังว่าตระกูล Omni คืออะไร และเหตุใด Google จึงสร้างโมเดลวิดีโอที่เน้นการให้เหตุผลเป็นอันดับแรก โปรดเริ่มที่ Gemini Omni คืออะไร โพสต์นี้ถือว่าคุณทราบข้อมูลส่วนนั้นแล้ว และต้องการรายละเอียดของเวอร์ชัน 1.1

Gemini Omni 1.1 Flash ทำอะไรได้บ้าง

Omni 1.1 Flash รับข้อความ รูปภาพ และวิดีโอเป็นอินพุต และส่งคืนวิดีโอ ทำงานบน Interactions API แทน generateContent ซึ่งเป็นพื้นผิวเดียวกับที่ Google ใช้สำหรับการสร้างแบบหลายเทิร์นที่มีสถานะ สิ่งนี้มีความสำคัญมากกว่าที่คิด: คุณสามารถสร้างคลิป จากนั้นส่งเทิร์นติดตามผลเพื่อแก้ไขคลิปที่คุณเพิ่งสร้าง โดยไม่ต้องอัปโหลดซ้ำอีกครั้ง

รูปแบบงานห้าอย่างที่โมเดลรองรับ:

เสียงในคลิปอ้างอิงจะถูกละเว้น โมเดลจะอ่านเพื่อการเคลื่อนไหวและรูปลักษณ์เท่านั้น

การขยายฉากขณะนี้อ่านบริบท 10 วินาที

นี่คือการเปลี่ยนแปลงที่สำคัญ โมเดลเวอร์ชันพรีวิวจะพิจารณาวินาทีสุดท้ายของคลิปก่อนที่จะดำเนินการต่อ ซึ่งเป็นบริบทที่เพียงพอสำหรับการรักษาระดับสีให้คงที่เท่านั้น ตัวละครเคลื่อนไหวออกนอกแนว การเคลื่อนไหวของกล้องจะถูกรีเซ็ต คุณสามารถขยายวิดีโอได้ แต่คุณไม่สามารถขยาย ฉาก ได้

Omni 1.1 วิเคราะห์บริบทก่อนหน้าได้สูงสุด 10 วินาที และ Google อธิบายผลลัพธ์ว่า “ความสอดคล้องทางภาพที่ดีขึ้นและการเล่าเรื่องที่ยึดติดกันมากขึ้น” คุณสามารถขยายได้ทีละ 10 วินาที จนถึงรวม 40 วินาที

มีข้อจำกัดสองประการที่ต้องวางแผนไว้ การขยายจะเพิ่มเฉพาะส่วนท้ายของคลิปเท่านั้น: คุณไม่สามารถเพิ่มฟุตเทจข้างหน้าหรือแทรกกลางได้ และวิดีโอที่อัปโหลดจะจำกัดอินพุตสูงสุดที่ 10 วินาที เว้นแต่คุณจะยังคงอยู่ในการโต้ตอบแบบหลายเทิร์น ซึ่งโมเดลจะเก็บสถานะก่อนหน้าไว้แล้ว

คำแนะนำการขยายฉาก 40 วินาที ครอบคลุมรูปแบบคำขอและจุดที่รอยต่อปรากฏ

การควบคุมคีย์เฟรมระหว่างสองภาพ

ตอนนี้คุณสามารถให้โมเดลมีเฟรมแรกและเฟรมสุดท้าย พร้อมกับข้อความแจ้งที่อธิบายการเคลื่อนไหวระหว่างเฟรมทั้งสอง และมันจะสร้างฟุตเทจที่เชื่อมโยงทั้งสองเข้าด้วยกัน Google ชี้ให้เห็นการเคลื่อนที่ของกล้องแบบวงโคจร การเปลี่ยนฉากแบบซูม และคลิปแบบวนซ้ำเป็นการใช้งานที่ชัดเจน

สำหรับผู้ที่กำลังสร้างเครื่องมือวิดีโอมากกว่าแค่ของเล่น คุณสมบัตินี้คือสิ่งที่ทำให้ผลลัพธ์สามารถคาดเดาได้ การแปลงข้อความเป็นวิดีโอเปรียบเสมือนเครื่องสล็อตแมชชีน การประมาณค่าเฟรมให้คุณมีจุดคงที่สองจุดและให้โมเดลแก้ไขส่วนตรงกลาง ซึ่งเป็นพื้นที่ที่ผิดพลาดได้น้อยกว่ามาก

การร่างแบบ 360p และเหตุใดจึงเปลี่ยนการคำนวณต้นทุน

Omni 1.1 สร้างพรีวิว 360p ได้เร็วกว่า 720p ถึง 60% และมีค่าใช้จ่ายเพียงหนึ่งในสาม Google ระบุชัดเจนเกี่ยวกับขั้นตอนการทำงานที่ตั้งใจไว้: ร่างที่ 360p จนกว่าข้อความแจ้งจะถูกต้อง จากนั้นจึงเรนเดอร์เวอร์ชันสุดท้ายที่ 720p, 1080p หรือ 4K

การเปลี่ยนแปลงเพียงอย่างเดียวนั้นมีค่ามากกว่าสำหรับงบประมาณการผลิตมากกว่ารายการอื่น ๆ ในการเปิดตัว การสร้างวิดีโอมีค่าใช้จ่ายสูงต่อวินาที และส่วนใหญ่ของสิ่งที่คุณสร้างขึ้นในระหว่างการวนซ้ำพร้อมท์จะถูกทิ้งไป การจ่ายเงินเพียงหนึ่งในสามสำหรับเวอร์ชันที่ทิ้งไปคือความแตกต่างระหว่างการสำรวจได้อย่างอิสระกับการจำกัดความพยายามของคุณ รายละเอียดราคาฉบับเต็ม มีการคำนวณต่อวินาที

ความละเอียดถูกกำหนดในรูปแบบการตอบสนอง และ 1080p กับ 4k เป็นการอัปสเกลของเฟรมที่สร้างขึ้น แทนที่จะเป็นการเรนเดอร์แบบเนทีฟ

ทำงานที่ไหน

Omni 1.1 Flash มีให้ใช้งานผ่าน:

Google ยังได้ประกาศชื่อพันธมิตรผู้เปิดตัวที่รันโมเดลนี้ภายในผลิตภัณฑ์ของตนเอง ได้แก่ Adobe Firefly, Figma Weave, Runway และ GMI Cloud หากคุณใช้เครื่องมือเหล่านี้ คุณกำลังส่งทราฟฟิกไปยังโมเดลนี้แล้ว

ไม่มีระดับบริการฟรีบน API ซึ่งแตกต่างจากโมเดลข้อความ Flash ที่ AI Studio ให้บริการฟรีแบบจำกัดอัตรา ทุกวินาทีของเอาต์พุต Omni จะถูกเรียกเก็บเงินตั้งแต่คำขอแรก ตัวโมเดลเองนั้นใช้งานได้ฟรีบน YouTube Shorts และ YouTube Create ซึ่งเป็นผลิตภัณฑ์ที่แตกต่างกันโดยมีข้อจำกัดที่ต่างกัน; ข้อมูลสรุปการเข้าถึงฟรี ครอบคลุมสิ่งที่คุณจะได้รับจากแต่ละช่องทาง

สิ่งที่ยังทำไม่ได้

อ่านรายการนี้ก่อนที่คุณจะกำหนดขอบเขตคุณสมบัติที่เกี่ยวข้องกับโมเดล

ทุกเอาต์พุตมี ลายน้ำ SynthID ซึ่งมองไม่เห็นสำหรับผู้ดูและสามารถตรวจจับได้ด้วยโปรแกรม วางแผนสำหรับเรื่องนี้หากผลิตภัณฑ์ของคุณมีการอ้างสิทธิ์ในแหล่งกำเนิด

Omni 1.1 Flash หรือ Veo 3.1?

ตอนนี้ Google มีโมเดลสร้างวิดีโอสองตระกูลที่ใช้ API คีย์เดียวกัน ซึ่งเป็นสถานการณ์ที่สับสนอย่างแท้จริง กล่าวโดยย่อคือ Veo 3.1 เป็นตัวเรนเดอร์ภาพยนตร์พร้อมเสียงในตัว และ Omni 1.1 Flash เป็นโมเดลสนทนาที่คุณสามารถโต้ตอบได้หลายเทิร์น วิดีโอ Omni ขนาด 720p หนึ่งวินาทีมีราคาประมาณหนึ่งในสี่ของ Veo 3.1 มาตรฐาน และ Veo ไม่มีสิ่งใดเทียบเท่ากับการแก้ไขแบบวนซ้ำหลายเทิร์น

การเปรียบเทียบแบบเคียงข้างกัน จะอธิบายกรณีที่แต่ละโมเดลมีความได้เปรียบ หากคุณมีการผสานรวมกับ Veo อยู่แล้ว คู่มือ API ของ Veo 3.1 ยังคงถูกต้อง ไม่มีสิ่งใดในการเปิดตัวนี้ที่ทำให้มันเลิกใช้งาน

การย้ายออกจากเอนด์พอยต์พรีวิว

สิ่งใดก็ตามที่ชี้ไปยัง gemini-omni-flash-preview จะหยุดทำงานหลังจากวันที่ 30 กันยายน 2026 การย้ายข้อมูลมักเป็นการเปลี่ยนแปลงสตริงโมเดลเพียงบรรทัดเดียว แต่มีสองสิ่งที่คุณควรตรวจสอบก่อนที่จะสรุปว่ามีเพียงเท่านี้:

  1. ค่าเริ่มต้นของความละเอียด ตอนนี้ 720p เป็นค่าเริ่มต้น และตัวเลือก 360p และ 4K เป็นของใหม่ หากโค้ดของคุณคาดการณ์ขนาดเอาต์พุตที่ตายตัว ให้ยืนยันสิ่งที่คุณได้รับกลับมาจริง ๆ
  2. ขนาดการตอบกลับ วิดีโอที่มีขนาดเกิน 4MB จะถูกส่งคืนเป็น URI แทนที่จะเป็น base64 แบบอินไลน์ หากตัวจัดการของคุณอ่านเฉพาะ output_video.data ความละเอียดที่สูงขึ้นจะส่งคืนค่าว่างให้คุณโดยไม่มีการแจ้งเตือน

วิธีที่ง่ายที่สุดในการตรวจสอบทั้งสองอย่างคือการบันทึกคำขอในไคลเอนต์ API และเปรียบเทียบการตอบกลับระหว่างรหัสโมเดลทั้งสองก่อนที่คุณจะเปลี่ยนไปใช้ Apidog จัดการสิ่งนี้ได้ดี: ใส่รหัสโมเดลในตัวแปรสภาพแวดล้อม เก็บคําขอที่บันทึกไว้หนึ่งรายการ สลับสภาพแวดล้อม และเปรียบเทียบ คู่มือการใช้งาน API จะตั้งค่านี้ทีละขั้นตอน

คำถามที่พบบ่อย

รหัสโมเดลสำหรับ Gemini Omni 1.1 Flash คืออะไร? gemini-omni-1.1-flash รหัสพรีวิวที่กำลังจะเลิกใช้งานคือ gemini-omni-flash-preview

Gemini Omni 1.1 Flash เปิดตัวเมื่อใด? วันที่ 27 สิงหาคม 2026 เป็นเวอร์ชัน GA (General Availability) เวอร์ชันพรีวิวเปิดตัวเมื่อวันที่ 30 มิถุนายน 2026

Gemini Omni 1.1 Flash ใช้งานได้ฟรีหรือไม่? ไม่ใช่ ไม่มีระดับบริการฟรีสำหรับ Omni ดังนั้นทุกการสร้างจะถูกเรียกเก็บเงิน โมเดลข้อความอย่าง Gemini 3.6 Flash ยังคงมีช่องทางฟรีใน AI Studio; แต่โมเดลนี้ไม่มี

วิดีโอ Gemini Omni สามารถยาวได้เท่าใด? คลิปจะสร้างขึ้นที่ 10 วินาที และการขยายฉากจะทำให้ยาวได้สูงสุด 40 วินาที โดยเพิ่มขึ้นทีละ 10 วินาที

Gemini Omni สร้างเสียงได้หรือไม่? เอกสารครอบคลุมเอาต์พุตวิดีโอและละเว้นเสียงบนคลิปอ้างอิง Veo 3.1 เป็นโมเดลที่มีการสร้างเสียงในตัว หากเสียงมีความสำคัญ เริ่มที่นั่น

ฉันสามารถแก้ไขวิดีโอที่ถ่ายเองได้หรือไม่? ได้ สูงสุด 10 วินาทีของอินพุต นอกเขตเศรษฐกิจยุโรป สวิตเซอร์แลนด์ และสหราชอาณาจักร อัปโหลดด้วย Files API และส่ง URI เป็นอินพุต

Omni 1.1 Flash เป็นเวอร์ชันแรกของโมเดลนี้ที่มีรูปร่างเหมือนผลิตภัณฑ์ที่คุณพร้อมจะจัดส่ง การขยายฉากที่รักษามุมมองให้ต่อเนื่อง คีย์เฟรมที่ทำให้ผลลัพธ์คาดเดาได้ และโหมดร่างที่ทำให้การวนซ้ำมีราคาไม่แพง เชื่อมต่อคำขอที่บันทึกไว้หนึ่งรายการกับรหัสโมเดล GA ตรวจสอบรูปแบบการตอบกลับที่ความละเอียดทุกระดับที่คุณวางแผนจะใช้ และย้ายออกจากเอนด์พอยต์พรีวิวก่อนสิ้นเดือนกันยายน ดาวน์โหลด Apidog หากคุณต้องการบันทึกการตรวจสอบนั้นก่อนถึงกำหนดเวลาแทนที่จะเป็นหลังจากนั้น

ฝึกการออกแบบ API แบบ Design-first ใน Apidog

ค้นพบวิธีที่ง่ายขึ้นในการสร้างและใช้ API