Réponse courte : oui, vous pouvez utiliser Gemini 3.6 Flash gratuitement, et il existe deux façons de le faire. Vous pouvez discuter avec dans l'application Gemini, et vous pouvez l'appeler via le niveau gratuit de l'API Gemini dans Google AI Studio. Les deux sont réels. Les deux viennent avec de réelles limites. Aucun n'est illimité, et le niveau gratuit de l'API comporte une clause d'utilisation des données que vous devriez lire avant d'y coller quoi que ce soit de privé.
Gemini 3.6 Flash est le modèle phare rafraîchi de Google, annoncé le 21 juillet 2026. Il est moins cher et plus rapide que le 3.5 Flash qu'il remplace, ce qui fait du niveau gratuit un bon endroit pour prototyper avant de dépenser un centime. Voici comment l'obtenir, ce que vous obtenez réellement et quand il est temps de passer au niveau supérieur.

Pouvez-vous utiliser Gemini 3.6 Flash gratuitement ?
Oui, de deux manières, destinées à deux types de personnes différentes.
- L'application Gemini, pour le chat. Connectez-vous avec un compte Google et commencez à taper. C'est le chemin pour les consommateurs. Pas de code, pas de clé API, pas de configuration de facturation.
- Le niveau gratuit de l'API Gemini, pour les développeurs. Vous générez une clé API dans Google AI Studio et envoyez des requêtes au modèle depuis votre propre code. Le niveau gratuit est limité en débit, mais vous ne payez rien pour commencer.
Une note sur la nomenclature pour que vous ne vous perdiez pas. La mise à jour a été livrée avec des numéros de version mixtes. Le modèle phare est Gemini 3.6 Flash. Le niveau le moins cher qui l'accompagne est Gemini 3.5 Flash-Lite. Même lancement, numéros différents. Si vous voulez la ventilation complète, consultez qu'est-ce que Gemini 3.6 Flash.
Utiliser Gemini 3.6 Flash gratuitement dans l'application Gemini
C'est le moyen le plus rapide d'essayer le modèle. Allez sur l'application Gemini, connectez-vous avec un compte Google et posez-lui une question. Gemini 3.6 Flash est le modèle derrière les réponses rapides et quotidiennes, donc la majeure partie de ce que vous tapez passe par lui ou un de ses proches.
L'application est excellente pour les questions ponctuelles, la rédaction et les vérifications rapides de raisonnement. Ce qu'elle ne peut pas faire, c'est s'intégrer à votre produit. Il n'y a pas de corps de requête, aucun moyen de définir des paramètres comme la température, et aucune manière propre d'envoyer le même appel mille fois. Pour cela, vous voulez l'API.
Utiliser le niveau gratuit de l'API dans Google AI Studio
Voici le parcours du développeur, du début à la fin.
- Ouvrez Google AI Studio et connectez-vous.
- Cliquez sur Obtenir une clé API et créez une clé. Copiez-la dans un endroit sûr.
- Envoyez votre première requête. L'ID du modèle est
gemini-3.6-flash.
Un appel minimal ressemble à ceci :
curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"contents": [
{ "parts": [ { "text": "Explain what a REST API is in two sentences." } ] }
]
}'
C'est la même forme que vous utiliserez partout ailleurs, il vaut donc la peine de la faire fonctionner une fois. Placez votre clé dans une variable d'environnement au lieu de la coller en ligne, et vous êtes prêt à construire. Pour le guide complet, incluant les paramètres et une boucle de test, lisez comment utiliser l'API Gemini 3.6 Flash.
Le niveau gratuit accepte les mêmes entrées que le niveau payant : texte, images, vidéo, audio et PDF. La sortie est du texte. Vous bénéficiez également de la fenêtre de contexte de 1 million de tokens du modèle, vous pouvez donc lui soumettre un long document et poser des questions.
Les limites honnêtes du niveau gratuit
Gratuit ne signifie pas illimité. Deux limites comptent.
Plafonds de débit et de quota. Le niveau gratuit plafonne le nombre de requêtes que vous pouvez envoyer par minute et par jour. Atteignez la limite et l'API renvoie HTTP 429, « trop de requêtes ». Google ajuste ces chiffres au fil du temps, donc au lieu de citer un chiffre qui pourrait devenir obsolète, vérifiez les limites de débit de l'API Gemini en direct pour connaître le quota exact de votre clé. Le point à retenir : le niveau gratuit est dimensionné pour le prototypage et l'utilisation personnelle légère, pas pour servir un trafic réel.
Utilisation des données. C'est ce que les gens oublient. Au niveau gratuit, Google peut utiliser vos invites et les réponses du modèle pour améliorer ses produits. C'est la contrepartie de ne rien payer. Ne transmettez donc pas de données clients, de secrets, de code propriétaire ou quoi que ce soit que vous regretteriez de partager. Traitez le niveau gratuit comme un bac à sable public : parfait pour apprendre l'API et construire une preuve de concept, incorrect pour les données de production. Si vos entrées sont sensibles, cela seul est une raison de passer au niveau payant.
Si vous avez utilisé la génération précédente, les mêmes règles s'y appliquaient, et le modèle est documenté dans comment utiliser Gemini 3.5 gratuitement.
Quand passer au niveau payant
Vous passez au niveau supérieur lorsque l'une de ces conditions devient vraie :
- Vous avez besoin de limites plus élevées. Les applications réelles dépassent rapidement les plafonds de débit du niveau gratuit. Le niveau payant augmente le plafond afin qu'une affluence d'utilisateurs ne se transforme pas en un mur de 429.
- Vous avez besoin que Google ne touche pas à vos données. L'utilisation payante est gérée différemment du niveau gratuit. Si vous traitez des informations privées ou destinées aux clients, c'est la limite que vous franchissez.
- Vous passez en production. Dès l'instant où les utilisateurs payants dépendent de la réponse, vous voulez un débit prévisible et les conditions de données payantes qui l'accompagnent.
La bonne nouvelle est que Gemini 3.6 Flash est peu coûteux à utiliser. Il coûte 1,50 $ par million de tokens d'entrée et 7,50 $ par million de tokens de sortie, et ce prix de sortie est en baisse par rapport aux 9,00 $ de 3.5 Flash. Le modèle a également tendance à utiliser moins de tokens de sortie pour le même travail, de sorte que votre facture réelle est souvent inférieure à ce que le tarif affiché suggère. Nous détaillons le calcul complet dans la tarification de Gemini 3.6 Flash.
Encore moins cher : Gemini 3.5 Flash-Lite
Si votre problème est le volume, pas la profondeur, il existe une option moins chère dans la même famille. Gemini 3.5 Flash-Lite fonctionne à 0,30 $ par million de tokens d'entrée et 2,50 $ par million de tokens de sortie, bien en dessous de Flash, et il diffuse à environ 350 tokens de sortie par seconde. Il a également son propre niveau gratuit.
Flash-Lite est le bon choix pour les tâches à volume élevé et sensibles à la latence : classification, étiquetage, extractions courtes, routage simple. Flash est le meilleur choix lorsque la tâche nécessite un raisonnement plus solide ou l'utilisation d'outils. Optez pour Flash-Lite lorsque vous faites beaucoup de petites choses et que vous voulez que la facture reste stable. Consultez qu'est-ce que Gemini 3.5 Flash-Lite pour savoir où il s'insère.
Testez vos appels de niveau gratuit dans Apidog
Le niveau gratuit est précisément là où l'API vous surprend. Votre clé fonctionne, puis une rafale d'appels déclenche un 429. Une réponse revient un peu différemment de ce que vous attendiez. Vous voulez voir tout cela avant que cela n'atteigne votre application, et c'est pour ce genre de travail qu'Apidog est conçu.
Configurez-le une fois et cela portera ses fruits sur l'ensemble du cluster :
- Construisez la requête une fois. Créez une requête
POSTversgenerativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent, et stockez votre clé comme variable d'environnement pour qu'elle ne se trouve jamais dans le corps de la requête. - Surveillez les 429 de limite de débit. Envoyez l'appel, ou un lot d'appels, et surveillez les codes d'état. Lorsque le niveau gratuit vous limite, vous verrez le 429 dans Apidog au lieu de vous demander pourquoi votre application est devenue silencieuse.
- Ajoutez des assertions. Affirmez que le statut est 200 et que les champs JSON attendus sont présents. Maintenant, un changement dans la forme de la réponse échoue bruyamment au lieu de passer inaperçu.
- Planifiez-le comme un test de régression. Transformez la requête en un test API planifié afin de détecter les changements de quota ou les dérives contractuelles sur le niveau gratuit sans avoir à le surveiller constamment.
Rien de tout cela ne fait d'Apidog le modèle. C'est le client et le banc d'essai autour du modèle, afin que les appels que vous expédiez se comportent comme vous le pensez. Téléchargez Apidog et pointez-le sur votre clé gratuite pour l'essayer.
FAQ
Gemini 3.6 Flash est-il gratuit et illimité ? Non. Le niveau gratuit a des plafonds de débit par minute et par jour, et il renvoie HTTP 429 lorsque vous les dépassez. Vérifiez la documentation de l'API Gemini pour connaître le quota actuel de votre clé. Il est dimensionné pour le prototypage, pas pour le trafic de production.
Mes données du niveau gratuit sont-elles privées ? Non. Au niveau gratuit, Google peut utiliser vos invites et les sorties du modèle pour améliorer ses produits. Ne transmettez pas de données sensibles, propriétaires ou clients par ce biais. Passez au niveau payant lorsque vos entrées doivent rester privées.
Ai-je besoin d'une carte de crédit pour utiliser le niveau gratuit ? Non. Vous générez une clé dans Google AI Studio et commencez à appeler l'API sans configuration de facturation. Vous n'ajoutez un mode de paiement que lorsque vous passez au niveau payant pour des limites plus élevées.
L'application Gemini est-elle la même que le niveau gratuit de l'API ? Non. L'application est un chat consommateur sans code. Le niveau gratuit de l'API vous donne une clé et un accès programmatique. Les deux vous permettent d'utiliser le modèle gratuitement, mais seule l'API s'intègre à votre propre logiciel.
Avec quel modèle gratuit devrais-je commencer, Flash ou Flash-Lite ? Commencez avec Gemini 3.6 Flash pour le raisonnement général et les tâches lourdes en outils. Passez à Gemini 3.5 Flash-Lite lorsque vous effectuez des appels simples et à volume élevé et que vous souhaitez le coût le plus bas par requête.
Où aller à partir d'ici
Commencez par l'application Gemini si vous voulez juste vous familiariser avec le modèle. Passez au niveau gratuit de l'API dans Google AI Studio dès que vous voulez développer avec, en gardant les données réelles à l'écart jusqu'à ce que vous passiez au niveau supérieur. Lorsque votre prototype génère un trafic réel, le niveau payant est bon marché et le passage ne nécessite qu'un simple changement de facturation. Acheminéz les appels via Apidog dès la première requête, et les 429 et les bizarreries du niveau gratuit apparaîtront sur votre banc d'essai au lieu de devant vos utilisateurs.
