Gemini 3.7 Flash Spesifikasi dan Harga

Sekilas spesifikasi Gemini 3.7 Flash: konteks 1 juta, keluaran 64 ribu, input multimodal, dukungan alat, tolok ukur vs 3.6 Flash, tingkat harga, dan saluran akses API.

Ashley Innocent

Ashley Innocent

19 August 2026

Gemini 3.7 Flash Spesifikasi dan Harga

Apidog untuk Perusahaan

Penerapan On-Premises

SSO & RBAC

Sesuai SOC 2

Jelajahi Apidog Enterprise

Google mengirimkan Gemini 3.7 Flash pada tanggal 13 Agustus 2026, tiga minggu setelah 3.6 Flash dan sementara Gemini 3.5 Pro masih tertunda. Perusahaan menyebutnya sebagai “model pekerja keras kami yang paling cerdas,” dan pengumuman resminya mendukung klaim tersebut dengan lompatan benchmark 10 hingga 16 poin pada tugas-tugas pengkodean dan agen. Jika Anda membangun dengan Gemini API, inilah model yang akan Anda gunakan selama beberapa bulan ke depan.

Halaman ini adalah kartu referensi. Setiap spesifikasi, harga, delta benchmark, dan saluran akses di satu tempat, dalam tabel yang dapat Anda pindai dalam waktu kurang dari satu menit. Ketika Anda siap untuk menulis kode, panduan singkat Gemini 3.7 Flash API akan memandu langkah demi langkah dengan cURL, Python, dan Node, dan Apidog memberi Anda ruang kerja untuk mengirim permintaan pengujian ke endpoint sebelum kode apa pun dibuat.

Tandai ini. Angka-angka di bawah ini akan berubah pada tanggal 1 Januari 2027, ketika jendela harga perkenalan ditutup, dan kami akan terus memperbarui tabelnya.

TL;DR

Lembar Spesifikasi Gemini 3.7 Flash

Angka-angka inti, langsung dari halaman model Gemini Flash Google dan materi peluncuran.

Spesifikasi Nilai
ID Model gemini-3.7-flash
Tanggal rilis 13 Agustus 2026
Jendela konteks input 1.000.000 token
Batas token output 64.000 token
Modalitas input Teks, gambar, video, audio, PDF
Modalitas output Teks
Panggilan fungsi Ya
Pencarian sebagai alat Ya
Penggunaan komputer Ya
Retrieval konteks panjang (128 ribu jarum) 97,0%
Keamanan Pembaruan pengaman CBRN dan siber
Ketersediaan 160+ negara
Endpoint API generativelanguage.googleapis.com (kunci AI Studio) atau aiplatform.googleapis.com (Vertex, OAuth)

Dua baris patut diperhatikan. Batas output 64 ribu sangat murah hati untuk model kelas Flash; ini berarti penulisan ulang file lengkap dan output terstruktur panjang muat dalam satu respons. Dan dukungan penggunaan komputer menempatkan 3.7 Flash dalam kelompok kecil model yang dapat menggerakkan browser secara langsung, meskipun untuk sebagian besar otomatisasi produksi, panggilan API terstruktur masih lebih unggul. Kompromi dibahas dalam penggunaan komputer vs. API terstruktur.

Harga Sekilas

Google meluncurkan 3.7 Flash dengan harga setengah dari harga peluncuran 3.6 Flash, tetapi diskon ini memiliki tanggal kedaluwarsa.

Tingkat Input (per 1 Juta token) Output (per 1 Juta token) Berlaku
Perkenalan $0.75 $3.75 Hingga 31 Desember 2026
Standar $1.50 $7.50 Mulai 1 Januari 2027

Itu adalah lonjakan 2x bersih di kedua sisi pada Hari Tahun Baru. Jika beban kerja Anda berat token, jendela perkenalan adalah waktu untuk melakukan benchmark, menyempurnakan prompt, dan mengunci strategi caching sementara kesalahan biayanya setengah lebih murah. Untuk contoh biaya yang dihitung, perhitungan token pada beban kerja nyata, dan strategi untuk memangkas pengeluaran sebelum tarif standar berlaku, lihat harga Gemini 3.7 Flash dijelaskan. Sumber kebenaran langsung adalah halaman harga Gemini API.

Benchmark: 3.6 Flash vs 3.7 Flash

Google menerbitkan delta terhadap 3.6 Flash di seluruh pengkodean, pengembangan web, pemahaman dokumen, dan otomatisasi agen. Perbedaannya besar untuk rilis titik yang diluncurkan tiga minggu setelah pendahulunya, sebuah poin yang juga disoroti liputan peluncuran 9to5Google.

Benchmark Gemini 3.6 Flash Gemini 3.7 Flash Delta
DeepSWE v1.1 (pengkodean agen) 49.0% 65.3% +16.3
FrontierCode 1.1 Utama 34.4% 43.6% +9.2
WebDev Arena (Elo) 1538 1588 +50
GDP.pdf (pemahaman dokumen) 22.0% 34.0% +12.0
AutomationBench (otomatisasi agen) 17.0% 30.4% +13.4
Harvey LAB-AA (hukum) n/a 90.7% n/a
Retrieval 128k-jarum n/a 97.0% n/a

Pola di seluruh tabel: beban kerja agen paling banyak meningkat. Peningkatan yang dinyatakan Google cocok, debugging yang lebih baik, kode percobaan pertama yang lebih dapat digunakan, pemikiran yang lebih cermat tentang perencanaan multi-langkah dan panggilan alat, serta kepatuhan instruksi yang lebih ketat. Bagaimana angka-angka tersebut dibandingkan dengan model Anthropic dan OpenAI adalah pertanyaan terpisah, dijawab dalam Gemini 3.7 Flash vs Claude vs GPT.

Di mana Anda dapat menggunakan Gemini 3.7 Flash

Tujuh saluran akses saat diluncurkan. Pilih berdasarkan peran.

Saluran Untuk apa Siapa yang dilayani
Gemini API Akses terprogram dengan kunci AI Studio Pengembang yang mengirimkan aplikasi
Google AI Studio Browser playground, iterasi prompt, manajemen kunci Pengembang yang membuat prototipe
Aplikasi Gemini Obrolan konsumen di web dan seluler Pengguna akhir
Gemini Spark Lingkungan pengkodean agen Pelanggan AI Pro dan Ultra
Google Antigravity Platform pengembangan yang berorientasi agen Tim yang membangun agen otonom
Android Studio Integrasi IDE untuk pekerjaan Android Pengembang seluler
Gemini Enterprise Penyebaran terkelola dengan kontrol admin TI Perusahaan

Untuk pekerjaan API, jalur kunci AI Studio memberi Anda permintaan yang berfungsi dalam beberapa menit. Vertex AI membawa model yang sama di belakang OAuth dengan IAM, log audit, dan endpoint regional ketika Anda membutuhkan kontrol produksi.

Permintaan Kerja Minimal

Ambil kunci dari AI Studio, ekspor, dan kirim satu permintaan.

export GEMINI_API_KEY="AIza..."

curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.7-flash:generateContent" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "contents": [{
      "parts": [{ "text": "List the HTTP status codes an idempotent retry layer should handle." }]
    }],
    "generationConfig": {
      "temperature": 0.4,
      "maxOutputTokens": 1024
    }
  }'

Streaming menukar metode untuk :streamGenerateContent?alt=sse pada jalur yang sama. Respons mengembalikan array candidates dengan bagian teks dan blok usageMetadata dengan jumlah token yang akan ditagih kepada Anda.

Jika Anda lebih suka tidak mengedit JSON secara manual di terminal, Apidog mengimpor spesifikasi Generative Language API, mengikat GEMINI_API_KEY sebagai variabel lingkungan pada header x-goog-api-key, dan merender aliran SSE secara langsung. Simpan respons yang baik sebagai contoh sekali dan jalankan kembali pengujian terhadap fixture alih-alih endpoint berbayar.

Batasan dan Tingkatan Tarif

Google menetapkan batas tarif per model dan per tingkatan (gratis, bayar sesuai penggunaan, dan tingkat yang disediakan), dan angka-angka sering bergeser sehingga tabel apa pun yang dicetak di sini akan menjadi usang. Periksa dokumen resmi Gemini API untuk batas permintaan per menit dan token per menit saat ini pada gemini-3.7-flash.

Dua aturan praktis yang stabil. Kuota tingkat gratis melalui AI Studio cukup untuk prototipe tetapi tidak untuk pengiriman. Dan 429 dengan status RESOURCE_EXHAUSTED berarti Anda telah mencapai batas per menit atau per hari; lakukan back off dengan jitter, batch di mana Anda bisa, atau pindahkan proyek ke tingkat berbayar.

Tautan Cepat

FAQ

Apa spesifikasi Gemini 3.7 Flash dalam satu kalimat?

Jendela konteks input 1 Juta token, batas output 64 ribu token, input multimodal di seluruh teks, gambar, video, audio, dan PDF, output teks, dan dukungan untuk panggilan fungsi, pencarian sebagai alat, dan penggunaan komputer, dapat diakses sebagai gemini-3.7-flash melalui Gemini API.

Berapa biaya Gemini 3.7 Flash?

$0,75 per 1 Juta token input dan $3,75 per 1 Juta token output hingga 31 Desember 2026. Mulai 1 Januari 2027 berlaku tarif standar: $1,50 input dan $7,50 output. Tarif perkenalan adalah setengah dari harga peluncuran 3.6 Flash.

Apakah saya perlu mengubah kode saya untuk mengupgrade dari 3.6 Flash?

Perubahan itu sendiri hanya satu baris: ubah ID model menjadi gemini-3.7-flash. Perubahan perilaku adalah pekerjaan sebenarnya, karena 3.7 berpikir lebih lama pada panggilan alat multi-langkah dan mengikuti instruksi lebih ketat. Panduan migrasi 3.6 ke 3.7 Flash mencakup apa yang harus diuji regresi sebelum Anda memindahkan lalu lintas.

Mengapa Google mengirimkan 3.7 Flash sebelum Gemini 3.5 Pro?

Gemini 3.5 Pro masih tertunda, dan Axios melaporkan bahwa Google mengirimkan pembaruan Flash sebelum model andalannya berikutnya daripada menahan peningkatan. Jeda tiga minggu antara 3.6 dan 3.7 Flash sesuai dengan irama tersebut.

Apakah ada cara gratis untuk mencobanya?

Ya. Tingkat gratis AI Studio mencakup kuota harian untuk gemini-3.7-flash, cukup untuk pengujian prompt dan prototipe kecil, dan tidak diperlukan akun penagihan sampai Anda membutuhkan batas tarif yang lebih tinggi. Panduan akses Gemini API gratis mencakup seberapa jauh tingkat gratis dapat digunakan dan apa yang harus dilakukan ketika Anda mencapai batasnya.

Di mana 3.7 Flash Cocok dalam Tumpukan Anda

Perlakukan 3.7 Flash sebagai model Gemini default untuk loop agen, asisten pengkodean, pipeline dokumen, dan apa pun yang melakukan banyak panggilan alat per sesi. Peningkatan benchmark tepat berada di tempat beban kerja tersebut berada, dan harga perkenalan menjadikan empat setengah bulan ke depan sebagai jendela termurah untuk membangun. Tunda penilaian tentang penalaran kelas unggulan sampai Gemini 3.5 Pro diluncurkan; untuk hal lainnya, inilah model pekerja keras yang dikatakan Google.

Sebelum ID model masuk ke kode produksi mana pun, uji endpoint. Unduh Apidog untuk menyimpan permintaan Gemini Anda, lingkungan, pemeriksaan streaming, dan fixture respons yang tersimpan dalam satu ruang kerja, di samping koleksi untuk setiap penyedia lain yang sedang Anda evaluasi.

Mengembangkan API dengan Apidog

Apidog adalah alat pengembangan API yang membantu Anda mengembangkan API dengan lebih mudah dan efisien.