Gemini Omni 1.1 Flash: Apa yang Baru di Model Video GA Google

Gemini Omni 1.1 Flash dirilis secara umum pada 27 Agustus 2026 dengan ekstensi adegan 40 detik, kontrol keyframe, penyusunan draf 360p, dan peningkatan skala 4K. Apa yang berubah, berapa biayanya, dan batas waktu penghentian pratinjau.

Ashley Innocent

Ashley Innocent

28 August 2026

Gemini Omni 1.1 Flash: Apa yang Baru di Model Video GA Google

Apidog untuk Perusahaan

Penerapan On-Premises

SSO & RBAC

Sesuai SOC 2

Jelajahi Apidog Enterprise

Google menyediakan model video percakapannya secara umum pada 27 Agustus 2026. ID modelnya adalah gemini-omni-1.1-flash, dan ini menggantikan endpoint gemini-omni-flash-preview yang dirilis dalam pratinjau publik pada 30 Juni. Jika Anda membangun sesuatu menggunakan pratinjau tersebut, Anda memiliki tenggat waktu: Google mematikan endpoint pratinjau pada 30 September 2026.

Rilis GA bukanlah kenaikan versi tanpa substansi di baliknya. Empat kemampuan ditambahkan bersamanya, dan setiap kemampuan mengisi celah yang membuat pratinjau sulit digunakan dalam produksi: ekstensi adegan hingga 40 detik, kontrol bingkai pertama dan terakhir, mode draf 360p yang murah, dan peningkatan resolusi 4K. Artikel ini membahas apa yang berubah, berapa biayanya, di mana model berjalan, dan apa yang masih tidak dapat dilakukannya.

Jika Anda ingin latar belakang tentang apa itu keluarga Omni dan mengapa Google membangun model video yang mengutamakan penalaran sejak awal, mulailah dengan apa itu Gemini Omni. Artikel ini mengasumsikan Anda sudah mengetahui bagian itu dan menginginkan detail versi 1.1.

Apa yang dilakukan Gemini Omni 1.1 Flash

Omni 1.1 Flash mengambil teks, gambar, dan video sebagai masukan, dan mengembalikan video. Ini berjalan pada Interactions API daripada generateContent, yang merupakan permukaan yang sama yang digunakan Google untuk generasi multi-giliran yang berstatus. Itu lebih penting daripada kedengarannya: Anda dapat membuat klip, lalu mengirim giliran lanjutan yang mengedit klip yang baru saja Anda buat, tanpa mengunggah ulang apa pun.

Lima bentuk tugas yang didukung model:

Audio pada klip referensi diabaikan. Model membacanya hanya untuk gerakan dan penampilan.

Ekstensi adegan sekarang membaca konteks 10 detik

Ini adalah perubahan utama. Model pratinjau melihat detik terakhir sebuah klip sebelum melanjutkannya, yang kira-kira cukup konteks untuk menjaga palet warna tetap stabil dan tidak banyak lagi. Karakter melayang. Gerakan kamera diatur ulang. Anda dapat memperpanjang video, tetapi Anda tidak dapat memperpanjang sebuah shot.

Omni 1.1 menganalisis hingga 10 detik konteks sebelumnya, dan Google menggambarkan hasilnya sebagai “konsistensi visual dan kepatuhan naratif yang ditingkatkan”. Anda memperpanjang dalam kelipatan 10 detik hingga kumulatif 40 detik.

Dua batasan untuk direncanakan. Ekstensi hanya ditambahkan ke akhir klip: Anda tidak dapat menambahkan rekaman atau memotong ke tengah. Dan video yang diunggah maksimal 10 detik masukan kecuali Anda tetap berada dalam interaksi multi-giliran, di mana model sudah menyimpan status sebelumnya.

Panduan ekstensi adegan 40 detik mencakup bentuk permintaan dan di mana batasannya muncul.

Kontrol keyframe antara dua gambar

Anda sekarang dapat memberikan model bingkai pertama dan bingkai terakhir, ditambah prompt yang menjelaskan gerakan di antaranya, dan itu menghasilkan rekaman yang menghubungkan keduanya. Google menunjukkan orbit kamera, transisi zoom, dan klip berulang sebagai penggunaan yang jelas.

Untuk siapa pun yang membangun alat video daripada mainan, ini adalah fitur yang membuat hasil dapat diprediksi. Teks-ke-video adalah mesin slot. Interpolasi bingkai memberi Anda dua titik tetap dan membiarkan model mencari bagian tengah, yang merupakan ruang yang jauh lebih kecil untuk menjadi salah.

Draf 360p, dan mengapa itu mengubah perhitungan biaya

Omni 1.1 menghasilkan pratinjau 360p hingga 60% lebih cepat daripada 720p, dengan sepertiga biaya. Google secara eksplisit menjelaskan alur kerja yang dimaksud: draf pada 360p sampai prompt benar, lalu render ulang yang utama pada 720p, 1080p, atau 4K.

Perubahan tunggal itu lebih berharga bagi anggaran produksi daripada item lain dalam rilis. Pembuatan video mahal per detik, dan sebagian besar yang Anda buat selama iterasi prompt akan dibuang. Membayar sepertiga lebih sedikit untuk hasil percobaan yang dibuang adalah perbedaan antara menjelajah secara bebas dan menjatah percobaan Anda. Rincian harga lengkap memiliki perhitungan per detik.

Resolusi diatur dalam format respons, dan 1080p dan 4k adalah peningkatan skala dari bingkai yang dihasilkan daripada render asli.

Di mana ia berjalan

Omni 1.1 Flash tersedia melalui:

Google juga menyebutkan mitra peluncuran yang menjalankan model di dalam produk mereka sendiri: Adobe Firefly, Figma Weave, Runway, dan GMI Cloud. Jika Anda menggunakan salah satu alat tersebut, Anda sudah mengirimkan lalu lintas ke model ini.

Tidak ada tingkatan gratis di API. Tidak seperti model Flash teks, di mana AI Studio memberi Anda jalur gratis terbatas tarif, setiap detik output Omni dikenakan biaya sejak permintaan pertama. Model itu sendiri gratis di YouTube Shorts dan YouTube Create, yang merupakan produk berbeda dengan batasan berbeda; ringkasan akses gratis mencakup apa yang Anda dapatkan dari setiap jalur.

Apa yang masih tidak bisa dilakukannya

Baca daftar ini sebelum Anda membuat fitur di sekitar model.

Setiap output membawa tanda air SynthID, tidak terlihat oleh pemirsa dan dapat dideteksi secara terprogram. Rencanakan untuk itu jika produk Anda membuat klaim asal.

Omni 1.1 Flash atau Veo 3.1?

Google sekarang mengirimkan dua keluarga pembuatan video dengan kunci API yang sama, yang merupakan situasi yang benar-benar membingungkan. Versi singkatnya: Veo 3.1 adalah renderer sinematik dengan audio asli, dan Omni 1.1 Flash adalah model percakapan yang Anda ajak bicara melalui giliran. Satu detik 720p Omni berharga sekitar seperempat dari satu detik Veo 3.1 standar, dan Veo tidak memiliki padanan untuk putaran edit multi-giliran.

Perbandingan berdampingan membahas kasus-kasus di mana masing-masing menang. Jika Anda sudah memiliki integrasi Veo, panduan API Veo 3.1 masih akurat; tidak ada dalam rilis ini yang menurunkannya.

Migrasi dari endpoint pratinjau

Apa pun yang menunjuk ke gemini-omni-flash-preview berhenti berfungsi setelah 30 September 2026. Migrasi itu sendiri biasanya merupakan perubahan satu baris pada string model, tetapi ada dua hal yang perlu diperiksa sebelum Anda berasumsi hanya itu:

  1. Default resolusi. 720p adalah default sekarang, dan opsi 360p serta 4K adalah baru. Jika kode Anda mengasumsikan ukuran output tetap, konfirmasikan apa yang sebenarnya Anda dapatkan kembali.
  2. Ukuran respons. Video di atas 4MB akan dikembalikan sebagai URI alih-alih inline base64. Jika penangan Anda hanya membaca output_video.data, resolusi yang lebih tinggi akan secara diam-diam tidak memberikan apa-apa kepada Anda.

Cara paling bersih untuk menangkap keduanya adalah dengan menyimpan permintaan di klien API dan membandingkan respons antara dua ID model sebelum Anda beralih. Apidog menanganinya dengan baik: masukkan ID model ke dalam variabel lingkungan, simpan satu permintaan tersimpan, ganti lingkungan, dan bandingkan. Panduan API mengaturnya langkah demi langkah.

FAQ

Apa ID model untuk Gemini Omni 1.1 Flash? gemini-omni-1.1-flash. ID pratinjau yang akan dihentikan adalah gemini-omni-flash-preview.

Kapan Gemini Omni 1.1 Flash dirilis? 27 Agustus 2026, sebagai rilis GA. Pratinjau dikirimkan pada 30 Juni 2026.

Apakah Gemini Omni 1.1 Flash gratis? Tidak. Tidak ada tingkatan gratis untuk Omni, jadi setiap generasi dikenakan biaya. Model teks seperti Gemini 3.6 Flash masih memiliki jalur gratis AI Studio; yang ini tidak.

Berapa lama video Gemini Omni bisa? Klip dihasilkan pada 10 detik, dan ekstensi adegan membawanya hingga 40 detik kumulatif dalam langkah 10 detik.

Apakah Gemini Omni menghasilkan audio? Dokumen mencakup output video dan mengabaikan audio pada klip referensi. Veo 3.1 adalah model dengan pembuatan audio asli. Jika suara penting, mulai dari sana.

Dapatkah saya mengedit video yang saya rekam sendiri? Ya, hingga 10 detik masukan, di luar EEA, Swiss, dan Inggris Raya. Unggah dengan Files API dan berikan URI sebagai masukan.

Omni 1.1 Flash adalah versi pertama model ini yang berbentuk sesuatu yang akan Anda kirimkan. Ekstensi adegan yang menjaga kesatuan shot, keyframe yang membuat output dapat diprediksi, dan mode draf yang membuat iterasi terjangkau. Sambungkan satu permintaan tersimpan terhadap ID model GA, periksa bentuk respons pada setiap resolusi yang ingin Anda gunakan, dan tinggalkan endpoint pratinjau sebelum akhir September. Unduh Apidog jika Anda ingin pemeriksaan itu disimpan sebelum tenggat waktu daripada sesudahnya.

Mengembangkan API dengan Apidog

Apidog adalah alat pengembangan API yang membantu Anda mengembangkan API dengan lebih mudah dan efisien.