Apa Itu Gemini 3.6 Flash

Gemini 3.6 Flash adalah model andalan baru Google, Tersedia Umum 21 Juli 2026. Lebih murah dan lebih hemat token dibandingkan 3.5 Flash. Spesifikasi, tolok ukur, harga, dan akses.

Ashley Innocent

Ashley Innocent

22 July 2026

Apa Itu Gemini 3.6 Flash

Apidog untuk Perusahaan

Penerapan On-Premises

SSO & RBAC

Sesuai SOC 2

Jelajahi Apidog Enterprise

Gemini 3.6 Flash adalah model andalan baru Google. Model ini tersedia secara umum pada 21 Juli 2026, dan lebih murah serta lebih efisien token dibandingkan Gemini 3.5 Flash yang digantikannya. Jika Anda mengirim lalu lintas API bervolume tinggi dan menginginkan kualitas yang solid tanpa membayar harga model unggulan, ini adalah tingkatan yang dibangun Google untuk Anda.

Panduan ini membahas apa itu model tersebut, apa yang berubah dari versi terakhir, spesifikasi lengkapnya, bagaimana performanya dalam tolok ukur, berapa biayanya, dan cara mendapatkan akses. Anda juga akan melihat cara mengirim dan menguji regresi panggilan API sendiri, sehingga angka di halaman Google sesuai dengan apa yang Anda dapatkan.

button

Apa itu Gemini 3.6 Flash?

Gemini 3.6 Flash adalah model tingkat menengah berdaya pemrosesan tinggi dalam keluarga Gemini Google. "Andalan" adalah kata yang tepat untuk itu. Model ini disesuaikan untuk tugas sehari-hari yang membentuk sebagian besar lalu lintas produksi: merangkum, mengekstraksi, mengklasifikasi, mengobrol, dan panggilan alat multi-langkah. Ini cepat, terjangkau, dan dapat membaca teks, gambar, video, audio, serta PDF dalam satu panggilan.

Google merilisnya sebagai salah satu dari tiga model pada 21 Juli 2026. Dua lainnya adalah Gemini 3.5 Flash-Lite, tingkatan yang lebih murah dan lebih cepat untuk pekerjaan bervolume tinggi, dan Gemini 3.5 Flash Cyber, model keamanan berpagar (gated) yang hanya dapat diakses oleh pemerintah dan mitra tepercaya. Anda dapat membaca perincian lengkap mengenai tingkatan murah dalam penjelasan apa itu Gemini 3.5 Flash-Lite kami, dan model keamanan berpagar dalam apa itu Gemini 3.5 Flash Cyber.

Inilah bagian yang sering membingungkan orang: penomoran versinya campur aduk. Model andalan melonjak ke 3.6, tetapi Flash-Lite dan Flash Cyber tetap pada 3.5. Jadi "model Flash baru" tidak semuanya pada nomor versi yang sama. Ketika Anda memilih ID model, bacalah dengan cermat. gemini-3.6-flash dan gemini-3.5-flash-lite adalah tingkatan yang berbeda, bukan salah ketik.

Google menerbitkan pengumuman di blog Google, dan kartu model tersedia di halaman DeepMind Flash.

Apa yang Baru Dibandingkan Gemini 3.5 Flash

Perubahan utamanya adalah efisiensi. Gemini 3.6 Flash menggunakan sekitar 17% lebih sedikit token keluaran daripada 3.5 Flash untuk menyelesaikan pekerjaan yang sama. Lebih sedikit token berarti tagihan lebih rendah dan respons lebih cepat, karena token keluaran adalah yang paling mahal dan yang membutuhkan waktu paling lama untuk mengalir.

Google juga memangkas harga keluaran. Pada 3.5 Flash Anda membayar $9,00 per juta token keluaran. Pada 3.6 Flash Anda membayar $7,50. Gabungkan pemotongan harga dengan penghematan token, dan biaya efektif per tugas turun lebih dari yang ditunjukkan oleh angka tertera saja.

Model ini juga lebih baik dalam pengkodean dan penggunaan komputer, dan mencapai jawaban dalam langkah penalaran yang lebih sedikit dan panggilan alat yang lebih sedikit pada alur kerja multi-langkah. Ini penting bagi agen. Setiap langkah penalaran dan panggilan alat tambahan menambah latensi dan biaya, jadi memangkasnya membuat eksekusi agen lebih murah dan cepat dari awal hingga akhir.

Jika Anda memutuskan apakah akan memindahkan lalu lintas yang sudah ada, kami membahas pertimbangan pro dan kontra dalam Gemini 3.6 Flash vs 3.5 Flash.

Spesifikasi Gemini 3.6 Flash

Atribut Gemini 3.6 Flash
ID Model gemini-3.6-flash
Jendela konteks masukan 1M token
Keluaran Maks 64k token
Modalitas Masukan Teks, gambar, video, audio, PDF
Keluaran Hanya teks
Harga Masukan $1,50 per 1M token
Harga Keluaran $7,50 per 1M token (termasuk token berpikir)
Tingkat Gratis Ya, via Google AI Studio (terbatas laju)
Diluncurkan 21 Juli 2026

Dua angka perlu dicatat. Jendela konteks masukan 1 juta berarti Anda dapat memasukkan dokumen besar, transkrip panjang, atau seluruh basis kode ke model dalam satu permintaan. Batas keluaran maksimal 64 ribu adalah batas atas untuk satu respons, jadi jika Anda memerlukan pembuatan seukuran buku, Anda akan membagi pekerjaan menjadi beberapa panggilan.

Bagaimana Performanya

Tolok ukur adalah proksi, bukan janji, tetapi mereka memberi tahu Anda di mana model itu kuat. Berikut adalah skor Gemini 3.6 Flash pada suite publik yang dilaporkan Google.

Dalam pengkodean, ia mencapai 58,7% pada SWE-Bench Pro, sebuah tes yang memeriksa apakah model dapat menyelesaikan masalah GitHub nyata di repositori produksi. Ini mencetak 49% pada DeepSWE v1.1, tolok ukur rekayasa perangkat lunak lainnya. Pada Terminal-bench 2.1, yang mengukur eksekusi perintah di terminal nyata, ia mencapai 78,0%.

Penggunaan komputer adalah tempat lompatan paling terlihat. Pada OSWorld-Verified, yang memberi skor model yang menggerakkan desktop dan aplikasinya, 3.6 Flash mencapai 83,0%, naik dari 78,4% pada 3.5 Flash. Itu adalah peningkatan yang signifikan bagi siapa pun yang membangun agen yang berinteraksi melalui antarmuka nyata.

Dalam kualitas keseluruhan, ia mencatat Elo GDPVal-AA v2 sebesar 1421. GDPVal mengukur kinerja pada tugas profesional dunia nyata, dan skor Elo menilai model secara head-to-head seperti cara kerja peringkat catur, jadi angka yang lebih tinggi berarti ia memenangkan lebih banyak pertandingan.

Konteks panjang memiliki gambaran yang beragam, dan penting untuk jujur tentang hal itu. Pada 128 ribu token, model rata-rata mencapai 91,8% dalam pengambilan, yang sangat kuat. Dorong ke jendela 1 juta token penuh dengan pengambilan titik demi titik dan akurasi turun menjadi 54,0%. Secara sederhana, model tetap tajam dalam masukan besar, tetapi jangan berasumsi ingatan sempurna saat Anda mengisi seluruh jendela konteks. Uji pengambilan Anda sendiri pada panjang yang benar-benar Anda gunakan.

Sekilas Harga

Gemini 3.6 Flash berharga $1,50 per juta token masukan dan $7,50 per juta token keluaran. Harga keluaran termasuk token berpikir, jadi penalaran yang tidak pernah Anda lihat dalam jawaban akhir masih dihitung dalam tagihan. Caching konteks dikenakan biaya $0,15 per juta token ditambah $1,00 per juta token per jam penyimpanan, yang membantu saat Anda mengirimkan prompt besar yang sama berulang kali.

Ada tingkatan gratis melalui Google AI Studio. Tingkatan ini terbatas laju, dan Google dapat menggunakan data tingkatan gratis untuk meningkatkan produknya, jadi ini untuk pembuatan prototipe, bukan produksi. Kami membahas batas dan detail kecilnya dalam cara menggunakan Gemini 3.6 Flash secara gratis, dan perincian biaya lengkap dengan contoh yang dijelaskan dalam harga Gemini 3.6 Flash. Angka-angka Google sendiri ada di halaman harga API Gemini.

Cara Mengakses Gemini 3.6 Flash

Anda memiliki beberapa cara akses:

Bagi sebagian besar pengembang, API adalah jalur yang penting. Kami memiliki panduan langkah demi langkah dalam cara menggunakan Gemini 3.6 Flash API, dan jika Anda berasal dari rilis yang lebih lama, panduan Google Gemini 3 API kami masih mencakup bentuk permintaan dan otentikasi. Referensi resmi tersedia di ai.google.dev.

Posisi dalam Jajaran Produk Google

Anggap pembaruan Flash sebagai tangga biaya-dan-kualitas. Gemini 3.5 Flash-Lite berada di bawah 3.6 Flash: ini lebih murah, dengan $0,30 masukan dan $2,50 keluaran per juta token, dan cepat, sekitar 350 token keluaran per detik. Gunakan Flash-Lite untuk pekerjaan bervolume tinggi, yang sensitif terhadap latensi, di mana Anda tidak memerlukan kualitas penuh dari model andalan. Gunakan 3.6 Flash ketika tugas lebih sulit atau keluaran harus lebih andal.

Sekarang, beberapa catatan penting. Gemini 3.5 Pro belum dirilis. Google mengatakan masih menguji 3.5 Pro dengan mitra, jadi tidak ada model Pro publik dalam gelombang ini, dan sebagian besar liputan menyoroti kesenjangan tersebut. Google juga mengisyaratkan uji pra-pelatihan Gemini 4 dan menyebutnya yang paling ambisius, tetapi diisyaratkan belum berarti dirilis. Keduanya bukan sesuatu yang dapat Anda panggil hari ini. Jika Anda membutuhkan model unggulan mutakhir saat ini, 3.6 Flash bukanlah jawabannya. Ini adalah model tingkat menengah yang cepat, dibangun agar murah dan cepat dalam skala besar, dan itulah yang tepatnya ditawarkannya.

Untuk generasi sebelumnya, penjelasan apa itu Gemini 3.5 kami memberi Anda dasar yang ditingkatkan oleh model-model ini.

Menguji Gemini 3.6 Flash di Apidog

Halaman model mengutip angka-angka terbaik. Satu-satunya cara untuk mengetahui apa yang dikembalikan 3.6 Flash untuk prompt Anda, pada panjang konteks Anda, adalah dengan mengirim panggilan dan memeriksa responsnya. Di sinilah klien API membuktikan kegunaannya.

Apidog adalah klien API dan platform pengujian, dan ia memperlakukan titik akhir Gemini seperti panggilan REST lainnya. Berikut adalah pengaturan yang bersih:

  1. Buat permintaan `POST` ke titik akhir Gemini API dan atur modelnya ke `gemini-3.6-flash`.
  2. Simpan kunci API Anda dalam variabel lingkungan Apidog daripada menempelkannya ke URL. Kemudian Anda dapat beralih antara kunci pengujian dan kunci produksi tanpa mengedit permintaan.
  3. Kirim panggilan dan baca responsnya. Tambahkan pernyataan pada kode status dan bidang JSON yang Anda pedulikan, agar payload yang buruk atau perubahan skema gagal dengan jelas daripada terlewat.
  4. Simpan sebagai uji regresi dan jadwalkan untuk berjalan agar Anda dapat mengetahuinya saat bentuk respons atau latensi berubah setelah pembaruan model.

Jelaskan apa yang dapat dan tidak dapat dilakukan ini. Apidog tidak menjalankan model dan bukan kerangka kerja AI. Ini adalah alat yang Anda gunakan untuk membangun permintaan, mengirimkannya, dan menahan respons sesuai standar yang Anda tetapkan. Ketika Google merilis pembaruan Flash berikutnya, pengujian tersimpan Anda akan memberi tahu Anda dalam hitungan menit apakah ada yang Anda andalkan berubah. Unduh Apidog jika Anda ingin menyiapkan permintaan pertama itu.

FAQ

Apakah Gemini 3.6 Flash gratis? Ada tingkatan gratis melalui Google AI Studio, tetapi terbatas laju dan ditujukan untuk pembuatan prototipe. Google dapat menggunakan data tingkatan gratis untuk meningkatkan produknya. Untuk lalu lintas produksi, Anda membayar per token: $1,50 per juta masukan, $7,50 per juta keluaran.

Apakah Gemini 3.6 Flash lebih baik dari 3.5 Flash? Untuk sebagian besar pekerjaan, ya. Ini menggunakan sekitar 17% lebih sedikit token keluaran, harga keluaran turun dari $9,00 menjadi $7,50 per juta, dan lebih kuat dalam pengkodean dan penggunaan komputer, termasuk peningkatan menjadi 83,0% pada OSWorld-Verified dari 78,4%. Ini menggantikan 3.5 Flash sebagai model andalan default.

Apakah Gemini 3.5 Pro sudah dirilis? Tidak. Google mengatakan masih menguji 3.5 Pro dengan mitra, jadi tidak ada model Pro publik dalam rilis ini. Uji pra-pelatihan Gemini 4 diisyaratkan tetapi belum dirilis.

Apa ID modelnya? Ini adalah `gemini-3.6-flash`. Jangan bingung dengan `gemini-3.5-flash-lite`, yang merupakan tingkatan Flash-Lite yang lebih murah dengan nomor versi yang berbeda.

Apa yang tidak bisa dilakukan Gemini 3.6 Flash? Ia hanya mengeluarkan teks, jadi ia tidak akan menghasilkan gambar, audio, atau video meskipun dapat membacanya sebagai masukan. Ingatannya menurun mendekati ujung jendela 1 juta token, sekitar 54,0% pada pengambilan titik demi titik pada panjang penuh. Dan ini adalah model andalan tingkat menengah, bukan model unggulan mutakhir, jadi pilih tingkatan yang tepat untuk penalaran yang benar-benar sulit.

Gemini 3.6 Flash adalah model yang sebagian besar lalu lintas API Gemini harus gunakan sekarang: lebih murah, lebih efisien token, dan lebih baik dalam pekerjaan agentik daripada versi yang digantikannya. Konfirmasi bagian-bagian yang Anda andalkan dengan beberapa pengujian API yang tersimpan sebelum Anda bermigrasi dalam skala besar. Ketika Flash-Lite, Cyber, atau Pro dan Gemini 4 akhirnya tiba, Anda akan tahu persis apa yang berubah dalam respons Anda sendiri.

Mengembangkan API dengan Apidog

Apidog adalah alat pengembangan API yang membantu Anda mengembangkan API dengan lebih mudah dan efisien.