Gemini 3.7 Flash Terbaru: Fitur, Benchmark, dan Akses API

Apa yang baru di Gemini 3.7 Flash? Tabel benchmark lengkap vs 3.6, pengenalan harga API, peningkatan pengkodean dan agen, semua saluran akses, dan uji cURL 5 menit.

Ashley Innocent

Ashley Innocent

14 August 2026

Gemini 3.7 Flash Terbaru: Fitur, Benchmark, dan Akses API

Apidog untuk Perusahaan

Penerapan On-Premises

SSO & RBAC

Sesuai SOC 2

Jelajahi Apidog Enterprise

Gemini 3.7 Flash adalah model AI pekerja keras terbaru Google, dirilis pada 13 Agustus 2026, tiga minggu setelah Gemini 3.6 Flash. Model ini mempertahankan jendela konteks 1 juta token dan input multimodal dari pendahulunya, sembari menunjukkan peningkatan besar pada tolok ukur pengkodean dan agen, serta diluncurkan dengan harga API perkenalan $0,75 per 1 juta token input. Google menyebutnya "model pekerja keras kami yang paling cerdas."

Jeda tiga minggu antara rilis tersebut adalah intinya. Google mengirimkan pembaruan Flash dengan cepat sementara Gemini 3.5 Pro tetap tertunda, yang berarti model tingkat menengah kini menjadi tempat pendaratan rekayasa menarik pertama. Perbedaan tolok ukur mendukung hal itu: DeepSWE melonjak 16 poin, AutomationBench hampir berlipat ganda, dan harga perkenalan memotong harga peluncuran 3.6 Flash hingga separuhnya.

Postingan ini mencakup semua yang berubah: tabel tolok ukur lengkap yang disebar Google di seluruh pengumumannya, jendela harga yang perlu Anda catat, setiap tempat di mana Anda dapat mengakses model hari ini, dan permintaan cURL yang berfungsi yang dapat Anda jalankan dalam lima menit. Jika Anda ingin panduan endpoint yang lebih mendalam, panduan cepat Gemini 3.7 Flash API cocok dengan penjelasan ini, dan Apidog memberi Anda ruang kerja untuk menguji model baru ini terhadap prompt Anda yang sudah ada sebelum Anda berkomitmen untuk beralih.

TL;DR

Apa itu Gemini 3.7 Flash

Flash adalah tingkatan menengah dari lini Gemini: lebih murah dan lebih cepat dari Pro, lebih cerdas dari Flash-Lite, dan disetel untuk beban kerja bervolume tinggi yang membentuk sebagian besar lalu lintas AI produksi. Gemini 3.7 Flash adalah rilis Flash ketiga dalam lini 3.x, dan pembingkaian Google telah bergeser dengannya. Pengumuman resmi memposisikannya sebagai model pengkodean dan agen terlebih dahulu, model obrolan kedua.

Lembar spesifikasi sama dengan 3.6 Flash:

Yang berubah adalah perilaku, bukan arsitektur. Google mengatakan 3.7 Flash lebih baik dalam debug, lebih sering menghasilkan kode siap pakai yang dapat di-deploy pada percobaan pertama, beradaptasi ketika menemui hambatan, mengajukan pertanyaan klarifikasi ketika maksudnya ambigu, dan mengikuti instruksi dengan fidelitas yang lebih tinggi. Itulah klaimnya. Tolok ukur di bawah ini adalah buktinya.

Peningkatan Tolok Ukur: 3.6 vs 3.7

Google menyebarkan angka-angka ini di seluruh postingan blog dan kartu model. Berikut adalah dalam satu tabel, dengan perbedaan yang penting:

Tolok Ukur Gemini 3.6 Flash Gemini 3.7 Flash Perubahan
DeepSWE v1.1 (pengkodean agenik) 49.0% 65.3% +16.3 poin
FrontierCode 1.1 Utama 34.4% 43.6% +9.2 poin
WebDev Arena (Elo) 1538 1588 +50 Elo
GDP.pdf (penalaran dokumen) 22.0% 34.0% +12.0 poin
AutomationBench (tugas agen) 17.0% 30.4% +13.4 poin

Dua skor mandiri melengkapi gambaran: 90,7% pada Harvey LAB-AA, sebuah tolok ukur penalaran hukum, dan 97,0% pada pengambilan konteks panjang 128k-needle. Angka kedua itu penting jika Anda memberikan dokumen panjang ke model; kualitas pengambilan pada kedalaman adalah di mana banyak model diam-diam gagal.

Pola di seluruh tabel konsisten. Lonjakan terbesar terjadi pada tolok ukur agenik, yang mengukur pekerjaan multi-langkah daripada jawaban sekali tembak. AutomationBench yang bergerak dari 17,0% menjadi 30,4% adalah jenis perbedaan yang mengubah tugas apa yang dapat Anda berikan kepada model tingkat menengah sama sekali. Liputan peluncuran menyoroti peningkatan DeepSWE sebagai hasil utama, dan untuk alasan yang baik: lonjakan 16 poin pada pengkodean agenik dalam tiga minggu tidak biasa untuk lini model apa pun. Sebagai konteks tentang bagaimana perbedaan tolok ukur diterjemahkan di seluruh model yang bersaing, perbandingan Grok 4.6 vs GPT 5.6 vs Claude menunjukkan bagaimana kesenjangan serupa berperan dalam beban kerja nyata.

Peningkatan Pengkodean dan Agen

Tabel tolok ukur memberi tahu Anda apa yang ditingkatkan. Catatan rilis Google memberi tahu Anda bagaimana hal itu muncul dalam praktik, dan klaimnya cukup spesifik untuk diuji:

Tumpukan alat sama pentingnya dengan skor mentah. Panggilan fungsi dan pencarian-sebagai-alat dibawa dari 3.6, dan dukungan penggunaan komputer berarti model dapat mengemudikan browser ketika tidak ada API yang ada untuk tugas tersebut. Kemampuan terakhir itu berada di tempat yang aneh bagi pengembang: kuat, tetapi lebih lambat dan kurang deterministik daripada endpoint terstruktur. Analisis penggunaan komputer vs API terstruktur mencakup kapan setiap pendekatan menghasilkan keuntungan.

Harga: setengah harga hingga 31 Desember 2026

Gemini 3.7 Flash diluncurkan dengan jadwal harga dua fase pada Gemini API:

Periode Input (per 1 Juta token) Output (per 1 Juta token)
Hingga 31 Desember 2026 $0,75 $3,75
Mulai 1 Januari 2027 $1,50 $7,50

Tarif perkenalan adalah setengah dari biaya Gemini 3.6 Flash saat diluncurkan, yang menjadikan empat setengah bulan ke depan sebagai jendela termurah yang pernah ada untuk keluarga model ini. Penangkapnya adalah penggandaan pada 1 Januari. Jika Anda membuat anggaran sekitar $0,75 token input, anggaran itu akan rusak dalam lima bulan kecuali Anda merencanakannya sekarang.

Dua pelajaran praktis. Pertama, verifikasi tarif saat ini di halaman harga resmi sebelum Anda mengirimkan apa pun; jendela perkenalan telah bergeser sebelumnya. Kedua, modelkan biaya tahun 2027 Anda dengan tarif standar, bukan tarif promo. Contoh lengkap yang telah dikerjakan, termasuk perhitungan token untuk chatbot, pipeline dokumen, dan loop agen, ada di analisis harga Gemini 3.7 Flash.

Di mana Anda dapat menggunakannya hari ini

Google mengirimkan 3.7 Flash di seluruh area permukaannya pada hari pertama, di lebih dari 160 negara:

Untuk akses API dalam skala besar, Anda juga mendapatkan jalur Vertex AI di aiplatform.googleapis.com dengan OAuth, IAM, dan pencatatan audit. Model yang sama, skema permintaan yang sama, jaminan otentikasi dan hosting yang berbeda.

Mengapa Google Mengirimkan Flash Sebelum Gemini 3.5 Pro

Urutan rilisnya tidak biasa. Model flagship biasanya memimpin dan tier yang lebih murah mengikuti. Google membalikkan itu: 3.6 Flash pada akhir Juli, 3.7 Flash tiga minggu kemudian, dan Gemini 3.5 Pro masih tanpa tanggal. Axios melaporkan bahwa Google sengaja mengirimkan pembaruan Flash sebelum flagship berikutnya sementara Pro tetap tertunda.

Dibaca sebagai strategi daripada keterlambatan jadwal, langkah ini masuk akal. Sebagian besar lalu lintas produksi berjalan pada model tingkat menengah karena di situlah biaya per token memenuhi kualitas yang dapat diterima. Meningkatkan Flash meningkatkan model yang paling sering digunakan pelanggan setiap hari. Ini juga membuat Google tetap dalam percakapan siklus rilis selama periode di mana setiap lab besar mengirimkan dengan cepat, tanpa membakar pengumuman flagship.

Bagi pengembang, konsekuensi praktisnya adalah tier Flash tidak lagi menjadi yang terakhir. Kemampuan agen mendarat di sini terlebih dahulu. Jika Anda menunda memindahkan beban kerja dari 3.6 karena Anda menunggu Pro, panduan migrasi 3.6 ke 3.7 Flash mencakup pertukaran, yang untuk sebagian besar basis kode adalah perubahan ID model satu baris ditambah lolos regresi.

Cara mencoba API dalam lima menit

Anda memerlukan kunci API dari AI Studio. Buat satu, ekspor, dan kirim permintaan pertama Anda:

export GEMINI_API_KEY="AIza..."

curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.7-flash:generateContent" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "contents": [{
      "parts": [{ "text": "Review this function for bugs: def dedupe(items): return list(set(items))" }]
    }],
    "generationConfig": {
      "temperature": 0.4,
      "maxOutputTokens": 1024
    }
  }'

Respons kembali sebagai array candidates dengan teks yang dihasilkan di content.parts, ditambah blok usageMetadata yang melaporkan jumlah token input dan output yang tepat. Perhatikan blok itu sejak hari pertama; itu adalah pengukur biaya Anda. Untuk streaming, tukar :generateContent dengan :streamGenerateContent?alt=sse dan API mengembalikan peristiwa yang dikirim server.

Setelah panggilan pertama berhasil, pindahkan eksperimen keluar dari terminal Anda. Di Apidog, impor spesifikasi Generative Language API, ikat GEMINI_API_KEY ke header x-goog-api-key sebagai variabel lingkungan, dan simpan ID model sebagai variabel jalur. Sekarang Anda dapat menjalankan kembali prompt yang sama terhadap gemini-3.6-flash dan gemini-3.7-flash secara berdampingan, melihat aliran SSE dirender secara langsung, dan menyimpan respons sebagai contoh sehingga pemeriksaan regresi tidak membakar token. Ini adalah cara tercepat untuk memverifikasi klaim "mengikuti instruksi yang lebih baik" Google terhadap prompt Anda sendiri daripada menerima pernyataan postingan peluncuran.

FAQ

Apakah Gemini 3.7 Flash gratis untuk digunakan?

Gemini API memiliki tingkat gratis melalui AI Studio dengan kuota harian, yang mencakup pembuatan prototipe. Penggunaan berbayar dimulai dengan tarif perkenalan $0,75 per 1 juta token input hingga 31 Desember 2026. Jika Anda ingin memperpanjang kuota gratis lebih jauh, panduan akses Gemini API gratis mencakup batasan dan cara bekerja di dalamnya.

Apa perbedaan antara Gemini 3.6 Flash dan 3.7 Flash?

Spesifikasi yang sama, perilaku yang lebih baik. Jendela konteks, batas output, modalitas, dan dukungan alat tidak berubah. Peningkatannya ada pada tolok ukur pengkodean dan agen: DeepSWE naik 16,3 poin, AutomationBench naik 13,4 poin, WebDev Arena naik 50 Elo. Google juga mengklaim debug yang lebih baik, mengikuti instruksi, dan perencanaan multi-langkah.

Apakah Gemini 3.7 Flash menggantikan Gemini 3.5 Pro?

Tidak. Pro tetap menjadi tingkat flagship untuk tugas penalaran tersulit, dan Gemini 3.5 Pro masih dalam pengembangan. Flash 3.7 adalah model yang direkomendasikan Google untuk pekerjaan produksi bervolume tinggi di mana biaya dan latensi sama pentingnya dengan kualitas.

Apa yang terjadi dengan harga pada 1 Januari 2027?

Tarif perkenalan berakhir dan harga standar berlaku: $1,50 per 1 juta token input dan $7,50 per 1 juta token output, dua kali lipat tarif peluncuran. Anggaran sesuai tarif standar untuk beban kerja apa pun yang bertahan melewati tahun 2026.

Dapatkah Gemini 3.7 Flash memproses gambar dan PDF?

Ya. Modalitas input mencakup teks, gambar, video, audio, dan PDF dalam array contents yang sama. Output hanya teks. Skor tolok ukur GDP.pdf sebesar 34,0%, naik dari 22,0%, adalah bukti Google bahwa pemahaman dokumen meningkat bersamaan dengan peningkatan pengkodean.

Di mana 3.7 Flash cocok dalam tumpukan Anda

Gemini 3.7 Flash adalah model tingkat menengah dengan skor tolok ukur tingkat agen dan diskon harga empat bulan. Kombinasi itu membuat keputusan bukan lagi tentang apakah akan mengevaluasinya, melainkan seberapa cepat. Peningkatan agenik adalah angka nyata pada tolok ukur publik, spesifikasi cocok dengan apa yang Anda jalankan hari ini pada 3.6, dan harga perkenalan berarti mengujinya sekarang berbiaya setengah dari evaluasi yang sama pada bulan Januari.

Urutan yang masuk akal: jalankan suite prompt Anda yang sudah ada terhadap gemini-3.7-flash, bandingkan output dan penggunaan token dengan model Anda saat ini, dan biarkan hasilnya memilih pemenang. Unduh Apidog untuk menjalankan perbandingan itu dalam satu ruang kerja; simpan respons 3.6 Anda sebagai contoh, putar ulang permintaan yang sama terhadap 3.7, dan Anda akan tahu dalam satu sore apakah kisah tolok ukur berlaku untuk beban kerja Anda.

button

Mengembangkan API dengan Apidog

Apidog adalah alat pengembangan API yang membantu Anda mengembangkan API dengan lebih mudah dan efisien.