Cara Menggunakan Gemini 3.8 Flash Gratis

Gemini 3.8 Flash gratis di Google AI Studio dan di tingkatan gratis Gemini API. Cara mendapatkan kunci, melakukan panggilan pertama, dan apa yang tidak akan Anda dapatkan dari jalur gratis.

Ashley Innocent

Ashley Innocent

3 September 2026

Cara Menggunakan Gemini 3.8 Flash Gratis

Apidog untuk Perusahaan

Penerapan On-Premises

SSO & RBAC

Sesuai SOC 2

Jelajahi Apidog Enterprise

Gemini 3.8 Flash dikirimkan pada 2 September 2026, dan tidak seperti sebagian besar peluncuran frontier tahun ini, ia hadir dengan jalur gratis yang nyata. Anda dapat mengobrol dengannya di Google AI Studio secara gratis, dan Anda dapat memanggilnya dari Gemini API di tingkat gratis dengan kunci yang hanya membutuhkan waktu sekitar satu menit untuk dibuat. Postingan peluncuran Google menyebutnya "model Flash paling cerdas kami," dan tingkat gratis memberi Anda ID model yang sama (gemini-3.8-flash) yang digunakan pelanggan berbayar, bukan varian yang dipangkas.

Ada tiga batasan, dan panduan ini mencakup semuanya. Tingkat gratis dibatasi laju. Google mengatakan data tingkat gratis digunakan untuk meningkatkan produknya. Dan aplikasi Gemini tidak menyertakan 3.8 Flash pada paket gratisnya; Anda memerlukan langganan Google AI Pro atau Ultra untuk itu. Jika Anda ingin melihat lembar spesifikasi lengkap terlebih dahulu, mulailah dengan apa itu Gemini 3.8 Flash. Jika Anda ingin menjalankan permintaan dalam lima menit ke depan, teruslah membaca.

Akses gratis sekilas

Permukaan Biaya Gemini 3.8 Flash disertakan? Kendalanya
Google AI Studio (web playground) $0 Ya Dibatasi laju; data digunakan untuk meningkatkan produk
Gemini API tingkat gratis $0 Ya Batasan yang sama, ditampilkan di halaman batas laju AI Studio
Aplikasi Gemini, paket gratis $0 Tidak 3.8 Flash membutuhkan Google AI Pro atau Ultra
Mode AI di Google Search $0 Ya (konsumen) Tidak ada API, tidak ada kontrol atas tingkat pemikiran
Gemini di Google Sheets Tergantung paket Ya (konsumen) Tidak ada API
Grounding Google Search 5.000 permintaan/bulan gratis Berbagi di Gemini 3.x Lalu $14 per 1.000 permintaan
API Batch Diskon 50% dari harga berbayar Ya Tidak gratis; jalur berbayar termurah
Gemini 3.8 Flash Cyber Tidak dijual Tidak Hanya untuk Fairwind Program, tidak ada API publik dengan harga berapa pun

Langkah 1: buka AI Studio dan pilih gemini-3.8-flash

Buka Google AI Studio dan masuk dengan akun Google. Tidak perlu akun penagihan, tidak perlu kartu kredit. Di pemilih model, pilih gemini-3.8-flash; ini adalah ID stabil tanpa sufiks pratinjau. Pengaturan jalankan mengekspos tingkat pemikiran, yang pada 3.8 Flash memiliki tiga nilai: low, medium, dan high. Medium adalah default. Tidak ada minimal pada model ini, dan jika Anda mengirimkannya melalui API, Anda akan mendapatkan kesalahan validasi alih-alih fallback diam. Panduan tingkat pemikiran menjelaskan berapa biaya setiap tingkat dalam token dan waktu.

Dua pengaturan penting untuk penggunaan gratis. Pertama, biarkan suhu apa adanya. Panduan Google untuk setiap model Gemini 3 adalah menjaganya pada nilai default 1.0, karena menurunkannya dapat menyebabkan pengulangan atau output yang terdegradasi. Kedua, mulailah dengan low saat Anda bereksperimen. 3.8 Flash dirancang untuk "bekerja lebih keras" pada tugas-tugas kompleks, mengambil langkah penalaran yang lebih kecil dan memanggil alat secara berulang, dan Google mengatakan ia "dapat menggunakan lebih banyak token pada tugas yang berjalan lebih lama dan kompleks, sesuai desain." Pada tingkat yang diukur dalam token per menit, nafsu makan itu menghabiskan kuota Anda lebih cepat daripada 3.7 Flash. Low menjaga eksperimen tetap murah.

Langkah 2: dapatkan kunci API gratis

Di dalam AI Studio, buka halaman kunci API dan buat kunci di proyek baru atau yang sudah ada. Kunci ini gratis dan segera berfungsi terhadap tingkat gratis. Halaman harga mencantumkan input dan output 3.8 Flash sebagai "Gratis" pada tingkat tersebut, dengan harga berbayar di sampingnya. Panduan kunci Gemini API kami memiliki tangkapan layar jika Anda belum pernah melakukannya.

Simpan kunci sebagai variabel lingkungan dan jauhkan dari kode dan riwayat shell Anda:

export GEMINI_API_KEY="paste-your-key-here"

Perlakukan kunci seperti kata sandi. Tingkat gratis tidak memiliki penagihan, sehingga kunci yang bocor tidak dapat menimbulkan tagihan, tetapi dapat menghabiskan kuota harian Anda sebelum Anda menggunakannya.

Langkah 3: lakukan panggilan gratis pertama Anda

Gemini 3.x kini berjalan terutama pada Interactions API. Satu permintaan, tidak memerlukan SDK:

curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
  -H "x-goog-api-key: $GEMINI_API_KEY" -H 'Content-Type: application/json' \
  -d '{"model":"gemini-3.8-flash","input":"Jelaskan caching HTTP dalam 3 kalimat.","generation_config":{"thinking_level":"low"}}'

Responsnya adalah daftar langkah eksekusi (pemikiran model, panggilan alat jika ada) yang diakhiri dengan langkah model_output dengan teksnya. Jika Anda memiliki kode yang ada pada generateContent, itu masih berfungsi; Google menyebutnya warisan tetapi "didukung sepenuhnya" tanpa tanggal penghentian, dan generationConfig.thinkingConfig.thinkingLevel adalah tempat tingkat tersebut berada pada titik akhir itu. Kedua bentuk, ditambah ekuivalen Python dan multi-turn dengan previous_interaction_id, ada dalam panduan API Gemini 3.8 Flash.

Jika Anda mendapatkan 429, Anda telah mencapai batas laju tingkat gratis. Tunggu, atau terus baca ke Tingkat 1.

Apa yang harus Anda bayar dari tingkat gratis

Tidak ada dalam dolar. Tiga hal lainnya.

Batas laju. Tingkat gratis membatasi permintaan per menit, token per menit, dan permintaan per hari per model. Google mempublikasikan angka persisnya hanya di halaman batas laju AI Studio, bukan dalam teks dokumen, dan angka tersebut berubah tanpa entri changelog. Periksa halaman tersebut daripada mempercayai angka apa pun yang Anda baca di blog, termasuk yang ini. Dokumen batas laju menjelaskan bagaimana tingkat-tingkat tersebut bertumpuk.

Data Anda. Google menyatakan bahwa prompt dan output tingkat gratis digunakan untuk meningkatkan produknya. Itu baik-baik saja untuk prompt benchmark atau aplikasi mainan. Itu tidak baik untuk catatan pelanggan, kode sumber yang belum dirilis, atau apa pun di bawah NDA. Tingkat berbayar memiliki ketentuan yang berbeda; jika Anda membutuhkannya, hubungkan penagihan sebelum Anda mengirim permintaan sensitif, bukan setelahnya.

Nafsu token. Artificial Analysis mengukur 3.8 Flash pada tingkat tinggi menggunakan sekitar 48 ribu token output per tugas pada indeks mereka, 30% lebih banyak dari 3.7 Flash. Token pemikiran dihitung terhadap batas token-per-menit yang sama dengan output yang terlihat. Model yang bernalar lebih keras adalah model yang menghabiskan kuota gratis Anda lebih cepat, yang merupakan alasan praktis untuk default ke low atau medium sampai Anda membayar untuk headroom.

Aplikasi Gemini bukan jalur gratis

Di sinilah sebagian besar pencarian "Gemini 3.8 Flash gratis" salah. Di sisi konsumen, 3.8 Flash tersedia di aplikasi Gemini untuk pelanggan Google AI Pro dan Ultra. Paket aplikasi gratis tidak mendapatkannya, sesuai liputan peluncuran. Jika Anda membuka aplikasi tanpa langganan dan melihat model Flash, itu bukan 3.8.

Permukaan konsumen di mana Anda dapat menemukan 3.8 Flash tanpa biaya tambahan adalah Mode AI di Google Search dan Gemini di Google Sheets. Keduanya berguna untuk membaca jawabannya. Keduanya tidak memberi Anda kontrol tingkat pemikiran, jumlah token, atau API, jadi untuk apa pun yang Anda sebut pengembangan, AI Studio dan tingkat API gratis adalah jalur gratis yang sebenarnya.

Grounding gratis: 5.000 permintaan Google Search sebulan

Grounding Google Search, yang memungkinkan model menarik hasil web saat ini ke dalam jawabannya, hadir dengan 5.000 permintaan gratis per bulan yang dibagikan di semua model Gemini 3.x. Setelah itu biayanya $14 per 1.000 permintaan. Kuota adalah kumpulan bulanan, bukan per model, jadi eksperimen 3 Pro yang di-grounding dan eksperimen 3.8 Flash yang di-grounding diambil dari 5.000 yang sama. Untuk prototipe yang membutuhkan data segar, ini adalah tunjangan yang murah hati; untuk fitur produksi, Anda akan memerlukan anggaran.

Saat gratis habis: jalur berbayar termurah

Anda akan tahu saatnya. Sebuah 429 tiba di tengah demo, atau batas harian tercapai pada jam 3 sore. Empat langkah berbayar, termurah terlebih dahulu.

Hubungkan akun penagihan (Tingkat 1). Melampirkan penagihan ke proyek Anda di AI Studio memindahkan Anda ke Tingkat 1, yang meningkatkan batas laju dan menetapkan batas pengeluaran $250. Tingkat 2 terbuka setelah pengeluaran $100 ditambah tiga hari, dengan batas $2.000; Tingkat 3 setelah $1.000 dan 30 hari. Anda tidak perlu mengeluarkan uang untuk membuka Tingkat 1; tautan penagihan itu sendiri yang melakukannya.

Bayar harga perkenalan. Hingga 31 Desember 2026, 3.8 Flash berharga $0,75 per juta token input dan $3,75 per juta token output, dengan token pemikiran ditagih sebagai output. Mulai 1 Januari 2027, keduanya berlipat ganda menjadi $1,50 dan $7,50. Seribu permintaan dengan 2.000 token input dan 500 token output masing-masing sekitar $3,38 dengan harga perkenalan. Rincian harga menghitung matematika per tugas, termasuk mengapa harga per token yang lebih murah tidak berarti tugas yang lebih murah pada model ini.

Batch apa pun yang bisa menunggu. API Batch membagi dua laju: $0,375 input dan $1,875 output per juta hingga akhir tahun. Seribu permintaan yang sama, sekitar $1,69. Akun Tingkat 1 dapat memiliki hingga 3M token yang diantrekan sekaligus. Evaluasi, pengisian ulang, dan pekerjaan malam hari termasuk di sini; panduan mode batch Gemini kami mencakup bentuk permintaan.

Cache prefiks stabil. Cache konteks berharga $0,075 per juta token yang di-cache pada tingkat perkenalan, sepersepuluh dari input segar. Prompt sistem yang panjang atau dokumen yang Anda kirim ulang di setiap giliran adalah tempat pertama yang harus dicari.

Apa yang tidak akan Anda dapatkan secara gratis

Daftar yang jujur, karena hasil pencarian untuk topik ini penuh dengan yang tidak jujur.

Maksimalkan kuota gratis dengan Apidog

Tingkat gratis menghargai kedisiplinan. Setiap permintaan yang Anda ketik ulang secara manual, setiap 429 yang Anda picu secara tidak sengaja, dan setiap panggilan pemikiran tinggi yang tidak Anda butuhkan adalah kuota yang tidak akan Anda dapatkan kembali. Apidog membuat kedisiplinan menjadi murah.

Simpan GEMINI_API_KEY sebagai variabel lingkungan di lingkungan Apidog, sehingga kunci tidak pernah muncul di badan permintaan atau koleksi bersama. Simpan panggilan Interaksi dan panggilan generateContent lama sebagai permintaan bernama dengan prompt, model, dan thinking_level terisi, dan ganti tingkat dengan variabel alih-alih mengedit JSON. Tambahkan pernyataan pada kode status sehingga 429 muncul sebagai tes yang gagal alih-alih respons kosong yang membingungkan, dan satu pada usageMetadata.thoughtsTokenCount pada titik akhir lama sehingga Anda dapat melihat berapa banyak kuota Anda yang digunakan untuk pemikiran.

Kemudian jadwalkan uji asap kecil: satu permintaan low sehari. Ini memberitahu Anda kapan perilaku model atau batas gratis berubah sebelum pengguna Anda mengetahuinya. Unduh Apidog untuk mengaturnya, dan lihat cara menjadwalkan tes API di Apidog untuk opsi waktu.

FAQ

Apakah Gemini 3.8 Flash gratis? Ya, melalui Google AI Studio dan tingkat gratis Gemini API, dengan batas laju dan dengan data Anda digunakan untuk meningkatkan produk Google. Modelnya sama dengan gemini-3.8-flash yang digunakan tingkat berbayar.

Bisakah saya menggunakan Gemini 3.8 Flash di aplikasi Gemini secara gratis? Tidak. Aplikasi ini menawarkan 3.8 Flash kepada pelanggan Google AI Pro dan Ultra. Mode AI di Google Search dan Gemini di Sheets adalah permukaan konsumen di mana Anda dapat menggunakannya tanpa langganan.

Apa batas laju tingkat gratis untuk Gemini 3.8 Flash? Google menunjukkannya per model di halaman batas laju AI Studio alih-alih dalam teks dokumentasi, dan batas tersebut berubah. Periksa halaman tersebut untuk proyek Anda. Ketika Anda membutuhkan lebih banyak, menghubungkan akun penagihan memindahkan Anda ke Tingkat 1 tanpa perlu pengeluaran.

Apakah tingkat gratis mencakup pemikiran? Ya. Ketiga tingkat (low, medium, high) berfungsi pada tingkat gratis, dan medium adalah default. minimal mengembalikan kesalahan pada 3.8 Flash. Karena token pemikiran dihitung terhadap batas token Anda, low paling jauh meregangkan kuota gratis; lihat perbandingan tingkat pemikiran untuk biaya terukur per tingkat.

Apakah Gemini 3.8 Flash Cyber gratis? Itu tidak tersedia sama sekali di luar Program Fairwind. Pengembang reguler mendapatkan 3.8 Flash dan dapat menjalankan tes keamanan API mereka sendiri terhadapnya.

Mulai gratis, lalu putuskan

Tingkat gratis adalah lingkungan evaluasi nyata untuk Gemini 3.8 Flash, bukan penggoda. Buat kunci, pertahankan pemikiran pada low, jauhkan data sensitif darinya, dan baca halaman batas laju daripada menebak-nebak. Ketika 429 mulai merugikan waktu Anda, hubungkan penagihan untuk Tingkat 1 dan gunakan batch untuk apa pun yang asinkron; dengan $0,375 per juta token input hingga Desember, bulan berbayar pertama kemungkinan akan lebih murah daripada kopi yang Anda minum sambil menunggu tingkat gratis diatur ulang.

Mengembangkan API dengan Apidog

Apidog adalah alat pengembangan API yang membantu Anda mengembangkan API dengan lebih mudah dan efisien.