Google mengirimkan Gemini 3.7 Flash pada tanggal 13 Agustus 2026, tiga minggu setelah 3.6 Flash dan sementara Gemini 3.5 Pro masih tertunda. Perusahaan menyebutnya sebagai “model pekerja keras kami yang paling cerdas,” dan pengumuman resminya mendukung klaim tersebut dengan lompatan benchmark 10 hingga 16 poin pada tugas-tugas pengkodean dan agen. Jika Anda membangun dengan Gemini API, inilah model yang akan Anda gunakan selama beberapa bulan ke depan.
Halaman ini adalah kartu referensi. Setiap spesifikasi, harga, delta benchmark, dan saluran akses di satu tempat, dalam tabel yang dapat Anda pindai dalam waktu kurang dari satu menit. Ketika Anda siap untuk menulis kode, panduan singkat Gemini 3.7 Flash API akan memandu langkah demi langkah dengan cURL, Python, dan Node, dan Apidog memberi Anda ruang kerja untuk mengirim permintaan pengujian ke endpoint sebelum kode apa pun dibuat.
Tandai ini. Angka-angka di bawah ini akan berubah pada tanggal 1 Januari 2027, ketika jendela harga perkenalan ditutup, dan kami akan terus memperbarui tabelnya.
TL;DR
- ID Model adalah
gemini-3.7-flash, tersedia di Gemini API mulai 13 Agustus 2026, di 160+ negara. - Spesifikasi: konteks input 1 juta token, batas output 64 ribu token, input multimodal (teks, gambar, video, audio, PDF), output teks.
- Alat: panggilan fungsi, pencarian sebagai alat, dan penggunaan komputer semuanya didukung.
- Harga perkenalan: $0,75 per 1 juta token input dan $3,75 per 1 juta token output hingga 31 Desember 2026. Tarif standar menjadi dua kali lipat menjadi $1,50 dan $7,50 pada 1 Januari 2027.
- Benchmark di atas 3.6 Flash: DeepSWE v1.1 49,0% menjadi 65,3%, AutomationBench 17,0% menjadi 30,4%, WebDev Arena Elo 1538 menjadi 1588.
- Akses melalui Gemini API, Google AI Studio, aplikasi Gemini, Gemini Spark, Google Antigravity, Android Studio, dan Gemini Enterprise.
Lembar Spesifikasi Gemini 3.7 Flash
Angka-angka inti, langsung dari halaman model Gemini Flash Google dan materi peluncuran.
| Spesifikasi | Nilai |
|---|---|
| ID Model | gemini-3.7-flash |
| Tanggal rilis | 13 Agustus 2026 |
| Jendela konteks input | 1.000.000 token |
| Batas token output | 64.000 token |
| Modalitas input | Teks, gambar, video, audio, PDF |
| Modalitas output | Teks |
| Panggilan fungsi | Ya |
| Pencarian sebagai alat | Ya |
| Penggunaan komputer | Ya |
| Retrieval konteks panjang (128 ribu jarum) | 97,0% |
| Keamanan | Pembaruan pengaman CBRN dan siber |
| Ketersediaan | 160+ negara |
| Endpoint API | generativelanguage.googleapis.com (kunci AI Studio) atau aiplatform.googleapis.com (Vertex, OAuth) |
Dua baris patut diperhatikan. Batas output 64 ribu sangat murah hati untuk model kelas Flash; ini berarti penulisan ulang file lengkap dan output terstruktur panjang muat dalam satu respons. Dan dukungan penggunaan komputer menempatkan 3.7 Flash dalam kelompok kecil model yang dapat menggerakkan browser secara langsung, meskipun untuk sebagian besar otomatisasi produksi, panggilan API terstruktur masih lebih unggul. Kompromi dibahas dalam penggunaan komputer vs. API terstruktur.
Harga Sekilas
Google meluncurkan 3.7 Flash dengan harga setengah dari harga peluncuran 3.6 Flash, tetapi diskon ini memiliki tanggal kedaluwarsa.
| Tingkat | Input (per 1 Juta token) | Output (per 1 Juta token) | Berlaku |
|---|---|---|---|
| Perkenalan | $0.75 | $3.75 | Hingga 31 Desember 2026 |
| Standar | $1.50 | $7.50 | Mulai 1 Januari 2027 |
Itu adalah lonjakan 2x bersih di kedua sisi pada Hari Tahun Baru. Jika beban kerja Anda berat token, jendela perkenalan adalah waktu untuk melakukan benchmark, menyempurnakan prompt, dan mengunci strategi caching sementara kesalahan biayanya setengah lebih murah. Untuk contoh biaya yang dihitung, perhitungan token pada beban kerja nyata, dan strategi untuk memangkas pengeluaran sebelum tarif standar berlaku, lihat harga Gemini 3.7 Flash dijelaskan. Sumber kebenaran langsung adalah halaman harga Gemini API.
Benchmark: 3.6 Flash vs 3.7 Flash
Google menerbitkan delta terhadap 3.6 Flash di seluruh pengkodean, pengembangan web, pemahaman dokumen, dan otomatisasi agen. Perbedaannya besar untuk rilis titik yang diluncurkan tiga minggu setelah pendahulunya, sebuah poin yang juga disoroti liputan peluncuran 9to5Google.
| Benchmark | Gemini 3.6 Flash | Gemini 3.7 Flash | Delta |
|---|---|---|---|
| DeepSWE v1.1 (pengkodean agen) | 49.0% | 65.3% | +16.3 |
| FrontierCode 1.1 Utama | 34.4% | 43.6% | +9.2 |
| WebDev Arena (Elo) | 1538 | 1588 | +50 |
| GDP.pdf (pemahaman dokumen) | 22.0% | 34.0% | +12.0 |
| AutomationBench (otomatisasi agen) | 17.0% | 30.4% | +13.4 |
| Harvey LAB-AA (hukum) | n/a | 90.7% | n/a |
| Retrieval 128k-jarum | n/a | 97.0% | n/a |
Pola di seluruh tabel: beban kerja agen paling banyak meningkat. Peningkatan yang dinyatakan Google cocok, debugging yang lebih baik, kode percobaan pertama yang lebih dapat digunakan, pemikiran yang lebih cermat tentang perencanaan multi-langkah dan panggilan alat, serta kepatuhan instruksi yang lebih ketat. Bagaimana angka-angka tersebut dibandingkan dengan model Anthropic dan OpenAI adalah pertanyaan terpisah, dijawab dalam Gemini 3.7 Flash vs Claude vs GPT.
Di mana Anda dapat menggunakan Gemini 3.7 Flash
Tujuh saluran akses saat diluncurkan. Pilih berdasarkan peran.
| Saluran | Untuk apa | Siapa yang dilayani |
|---|---|---|
| Gemini API | Akses terprogram dengan kunci AI Studio | Pengembang yang mengirimkan aplikasi |
| Google AI Studio | Browser playground, iterasi prompt, manajemen kunci | Pengembang yang membuat prototipe |
| Aplikasi Gemini | Obrolan konsumen di web dan seluler | Pengguna akhir |
| Gemini Spark | Lingkungan pengkodean agen | Pelanggan AI Pro dan Ultra |
| Google Antigravity | Platform pengembangan yang berorientasi agen | Tim yang membangun agen otonom |
| Android Studio | Integrasi IDE untuk pekerjaan Android | Pengembang seluler |
| Gemini Enterprise | Penyebaran terkelola dengan kontrol admin | TI Perusahaan |
Untuk pekerjaan API, jalur kunci AI Studio memberi Anda permintaan yang berfungsi dalam beberapa menit. Vertex AI membawa model yang sama di belakang OAuth dengan IAM, log audit, dan endpoint regional ketika Anda membutuhkan kontrol produksi.
Permintaan Kerja Minimal
Ambil kunci dari AI Studio, ekspor, dan kirim satu permintaan.
export GEMINI_API_KEY="AIza..."
curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.7-flash:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"contents": [{
"parts": [{ "text": "List the HTTP status codes an idempotent retry layer should handle." }]
}],
"generationConfig": {
"temperature": 0.4,
"maxOutputTokens": 1024
}
}'
Streaming menukar metode untuk :streamGenerateContent?alt=sse pada jalur yang sama. Respons mengembalikan array candidates dengan bagian teks dan blok usageMetadata dengan jumlah token yang akan ditagih kepada Anda.
Jika Anda lebih suka tidak mengedit JSON secara manual di terminal, Apidog mengimpor spesifikasi Generative Language API, mengikat GEMINI_API_KEY sebagai variabel lingkungan pada header x-goog-api-key, dan merender aliran SSE secara langsung. Simpan respons yang baik sebagai contoh sekali dan jalankan kembali pengujian terhadap fixture alih-alih endpoint berbayar.
Batasan dan Tingkatan Tarif
Google menetapkan batas tarif per model dan per tingkatan (gratis, bayar sesuai penggunaan, dan tingkat yang disediakan), dan angka-angka sering bergeser sehingga tabel apa pun yang dicetak di sini akan menjadi usang. Periksa dokumen resmi Gemini API untuk batas permintaan per menit dan token per menit saat ini pada gemini-3.7-flash.
Dua aturan praktis yang stabil. Kuota tingkat gratis melalui AI Studio cukup untuk prototipe tetapi tidak untuk pengiriman. Dan 429 dengan status RESOURCE_EXHAUSTED berarti Anda telah mencapai batas per menit atau per hari; lakukan back off dengan jitter, batch di mana Anda bisa, atau pindahkan proyek ke tingkat berbayar.
Tautan Cepat
- Pengumuman resmi: posting peluncuran dengan klaim Google dan bagan benchmark
- Dokumen Gemini API: referensi endpoint, panduan SDK, batas tarif
- Halaman harga: tarif langsung per token
- Halaman model: spesifikasi dan detail modalitas
- Dapatkan kunci API: Kunci AI Studio dalam dua klik
FAQ
Apa spesifikasi Gemini 3.7 Flash dalam satu kalimat?
Jendela konteks input 1 Juta token, batas output 64 ribu token, input multimodal di seluruh teks, gambar, video, audio, dan PDF, output teks, dan dukungan untuk panggilan fungsi, pencarian sebagai alat, dan penggunaan komputer, dapat diakses sebagai gemini-3.7-flash melalui Gemini API.
Berapa biaya Gemini 3.7 Flash?
$0,75 per 1 Juta token input dan $3,75 per 1 Juta token output hingga 31 Desember 2026. Mulai 1 Januari 2027 berlaku tarif standar: $1,50 input dan $7,50 output. Tarif perkenalan adalah setengah dari harga peluncuran 3.6 Flash.
Apakah saya perlu mengubah kode saya untuk mengupgrade dari 3.6 Flash?
Perubahan itu sendiri hanya satu baris: ubah ID model menjadi gemini-3.7-flash. Perubahan perilaku adalah pekerjaan sebenarnya, karena 3.7 berpikir lebih lama pada panggilan alat multi-langkah dan mengikuti instruksi lebih ketat. Panduan migrasi 3.6 ke 3.7 Flash mencakup apa yang harus diuji regresi sebelum Anda memindahkan lalu lintas.
Mengapa Google mengirimkan 3.7 Flash sebelum Gemini 3.5 Pro?
Gemini 3.5 Pro masih tertunda, dan Axios melaporkan bahwa Google mengirimkan pembaruan Flash sebelum model andalannya berikutnya daripada menahan peningkatan. Jeda tiga minggu antara 3.6 dan 3.7 Flash sesuai dengan irama tersebut.
Apakah ada cara gratis untuk mencobanya?
Ya. Tingkat gratis AI Studio mencakup kuota harian untuk gemini-3.7-flash, cukup untuk pengujian prompt dan prototipe kecil, dan tidak diperlukan akun penagihan sampai Anda membutuhkan batas tarif yang lebih tinggi. Panduan akses Gemini API gratis mencakup seberapa jauh tingkat gratis dapat digunakan dan apa yang harus dilakukan ketika Anda mencapai batasnya.
Di mana 3.7 Flash Cocok dalam Tumpukan Anda
Perlakukan 3.7 Flash sebagai model Gemini default untuk loop agen, asisten pengkodean, pipeline dokumen, dan apa pun yang melakukan banyak panggilan alat per sesi. Peningkatan benchmark tepat berada di tempat beban kerja tersebut berada, dan harga perkenalan menjadikan empat setengah bulan ke depan sebagai jendela termurah untuk membangun. Tunda penilaian tentang penalaran kelas unggulan sampai Gemini 3.5 Pro diluncurkan; untuk hal lainnya, inilah model pekerja keras yang dikatakan Google.
Sebelum ID model masuk ke kode produksi mana pun, uji endpoint. Unduh Apidog untuk menyimpan permintaan Gemini Anda, lingkungan, pemeriksaan streaming, dan fixture respons yang tersimpan dalam satu ruang kerja, di samping koleksi untuk setiap penyedia lain yang sedang Anda evaluasi.
