Gemini 3.8 Flash a été lancé le 2 septembre 2026, et contrairement à la plupart des lancements de pointe cette année, il offre une véritable voie d'accès gratuite. Vous pouvez discuter avec lui dans Google AI Studio gratuitement, et l'appeler via l'API Gemini sur le niveau gratuit avec une clé qui ne prend qu'une minute à créer. Le billet de blog de lancement de Google le qualifie de « notre modèle Flash le plus intelligent », et le niveau gratuit vous donne le même ID de modèle (gemini-3.8-flash) que celui utilisé par les clients payants, et non une variante allégée.
Il y a trois inconvénients, et ce guide les couvre tous. Le niveau gratuit est soumis à des limites de débit. Google indique que les données du niveau gratuit sont utilisées pour améliorer ses produits. Et l'application Gemini n'inclut pas 3.8 Flash dans son plan gratuit ; vous avez besoin d'un abonnement Google AI Pro ou Ultra pour cela. Si vous souhaitez d'abord la fiche technique complète, commencez par ce qu'est Gemini 3.8 Flash. Si vous souhaitez exécuter une requête dans les cinq prochaines minutes, continuez à lire.
Accès gratuit en un coup d'œil
| Surface | Coût | Gemini 3.8 Flash inclus ? | L'inconvénient |
|---|---|---|---|
| Google AI Studio (environnement de test web) | 0 $ | Oui | Limité en débit ; données utilisées pour améliorer les produits |
| Niveau gratuit de l'API Gemini | 0 $ | Oui | Mêmes limites, affichées sur la page des limites de débit d'AI Studio |
| Application Gemini, plan gratuit | 0 $ | Non | 3.8 Flash nécessite Google AI Pro ou Ultra |
| Mode IA dans Google Search | 0 $ | Oui (consommateur) | Pas d'API, pas de contrôle sur le niveau de réflexion |
| Gemini dans Google Sheets | Dépend du plan | Oui (consommateur) | Pas d'API |
| Ancrage Google Search | 5 000 requêtes/mois gratuites | Partagé entre les modèles Gemini 3.x | Puis 14 $ par 1 000 requêtes |
| API de traitement par lots | 50 % de réduction sur les tarifs payants | Oui | Non gratuit ; le chemin payant le moins cher |
| Gemini 3.8 Flash Cyber | Non vendu | Non | Programme Fairwind uniquement, pas d'API publique à aucun prix |

Étape 1 : ouvrez AI Studio et choisissez gemini-3.8-flash
Allez sur Google AI Studio et connectez-vous avec un compte Google. Pas de compte de facturation, pas de carte de crédit. Dans le sélecteur de modèle, choisissez gemini-3.8-flash ; c'est l'ID stable sans suffixe de prévisualisation. Les paramètres d'exécution exposent le niveau de réflexion, qui sur 3.8 Flash a trois valeurs : faible, moyen et élevé. Moyen est la valeur par défaut. Il n'y a pas de minimal sur ce modèle, et si vous l'envoyez via l'API, vous obtenez une erreur de validation au lieu d'un retour silencieux. Le guide des niveaux de réflexion explique ce que chaque niveau coûte en jetons et en temps.
Deux paramètres sont importants pour l'utilisation gratuite. Premièrement, ne touchez pas à la température. La recommandation de Google pour chaque modèle Gemini 3 est de la maintenir à la valeur par défaut de 1.0, car la réduire peut entraîner des boucles ou une dégradation de la sortie. Deuxièmement, commencez par faible pendant que vous explorez. 3.8 Flash est conçu pour « travailler plus dur » sur des tâches complexes, en effectuant des étapes de raisonnement plus petites et en appelant des outils de manière itérative, et Google dit qu'il « peut utiliser plus de jetons sur des tâches plus longues et complexes, par conception ». Sur un niveau mesuré en jetons par minute, cet appétit consomme votre quota plus rapidement que ne le faisait 3.7 Flash. Le niveau faible permet de maintenir les expériences à faible coût.
Étape 2 : obtenez une clé API gratuite
Dans AI Studio, ouvrez la page des clés API et créez une clé dans un projet nouveau ou existant. La clé est gratuite et fonctionne immédiatement avec le niveau gratuit. La page de tarification liste les entrées et sorties de 3.8 Flash comme « Gratuit » sur ce niveau, avec les tarifs payants à côté. Notre tutoriel sur la clé API Gemini contient des captures d'écran si vous ne l'avez jamais fait.
Stockez la clé comme variable d'environnement et gardez-la hors de votre code et de votre historique de shell :
export GEMINI_API_KEY="paste-your-key-here"
Traitez la clé comme un mot de passe. Le niveau gratuit n'a pas de facturation associée, donc une clé divulguée ne peut pas générer de facture, mais elle peut épuiser votre quota quotidien avant vous.
Étape 3 : effectuez votre premier appel gratuit
Gemini 3.x fonctionne désormais principalement sur l'API Interactions. Une seule requête, aucun SDK requis :
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" -H 'Content-Type: application/json' \
-d '{"model":"gemini-3.8-flash","input":"Explain HTTP caching in 3 sentences.","generation_config":{"thinking_level":"low"}}'
La réponse est une liste d'étapes d'exécution (pensées du modèle, appels d'outils le cas échéant) se terminant par une étape model_output avec le texte. Si vous avez du code existant utilisant generateContent, cela fonctionne toujours ; Google le qualifie de « hérité » mais « entièrement supporté » sans date de fin de support, et generationConfig.thinkingConfig.thinkingLevel est l'endroit où le niveau est défini sur ce point de terminaison. Les deux formats, plus les équivalents Python et les conversations à plusieurs tours avec previous_interaction_id, se trouvent dans le guide de l'API Gemini 3.8 Flash.
Si vous obtenez un 429, vous avez atteint la limite de débit du niveau gratuit. Attendez, ou lisez la suite pour le Niveau 1.
Ce que le niveau gratuit vous coûte
Rien en dollars. Trois choses autrement.
Limites de débit. Le niveau gratuit plafonne les requêtes par minute, les jetons par minute et les requêtes par jour par modèle. Google ne publie les chiffres exacts que sur la page des limites de débit d'AI Studio, et non dans le texte de la documentation, et ils changent sans entrée de journal des modifications. Consultez cette page au lieu de faire confiance à un chiffre que vous lisez sur un blog, y compris celui-ci. Le document sur les limites de débit explique comment les niveaux s'empilent.
Vos données. Google déclare que les requêtes et les sorties du niveau gratuit sont utilisées pour améliorer ses produits. C'est acceptable pour une requête de benchmark ou une application de démonstration. Ce n'est pas acceptable pour les dossiers clients, le code source non publié ou tout ce qui est sous NDA. Les niveaux payants ont des conditions différentes ; si vous en avez besoin, liez la facturation avant d'envoyer la requête sensible, pas après.
Appétit en jetons. Artificial Analysis a mesuré que 3.8 Flash, réglé sur élevé, utilisait environ 48 000 jetons de sortie par tâche sur leur indice, soit 30 % de plus que 3.7 Flash. Les jetons de réflexion sont comptabilisés dans les mêmes limites de jetons par minute que la sortie visible. Un modèle qui raisonne plus intensément est un modèle qui consomme votre quota gratuit plus rapidement, ce qui est la raison pratique de choisir faible ou moyen par défaut jusqu'à ce que vous ayez payé pour plus de marge.
L'application Gemini n'est pas une voie gratuite
C'est là que la plupart des recherches « Gemini 3.8 Flash gratuit » échouent. Du côté grand public, 3.8 Flash est disponible dans l'application Gemini pour les abonnés Google AI Pro et Ultra. Le plan gratuit de l'application ne l'inclut pas, selon la couverture du lancement. Si vous ouvrez l'application sans abonnement et que vous voyez un modèle Flash, ce n'est pas 3.8.
Les interfaces grand public où vous pouvez rencontrer 3.8 Flash sans frais supplémentaires sont le Mode IA dans Google Search et Gemini dans Google Sheets. Les deux sont utiles pour lire ses réponses. Aucun des deux ne vous donne un contrôle du niveau de réflexion, un décompte de jetons ou une API. Donc, pour tout ce que vous appelleriez du développement, AI Studio et le niveau gratuit de l'API sont la véritable voie gratuite.
Ancrage gratuit : 5 000 requêtes Google Search par mois
L'ancrage Google Search, qui permet au modèle d'incorporer les résultats web actuels dans sa réponse, est livré avec 5 000 requêtes gratuites par mois partagées entre tous les modèles Gemini 3.x. Après cela, c'est 14 $ par 1 000 requêtes. Le quota est un pool mensuel, non par modèle, donc une expérience 3 Pro ancrée et une expérience 3.8 Flash ancrée puisent dans les mêmes 5 000. Pour un prototype qui a besoin de données fraîches, c'est une allocation généreuse ; pour une fonctionnalité de production, vous voudrez une ligne budgétaire.
Quand le gratuit ne suffit plus : les chemins payants les moins chers
Vous reconnaîtrez le moment. Une 429 arrive en plein milieu d'une démonstration, ou le plafond quotidien est atteint à 15h. Quatre étapes payantes, la moins chère d'abord.
Lier un compte de facturation (Niveau 1). Lier la facturation à votre projet dans AI Studio vous fait passer au Niveau 1, ce qui augmente les limites de débit et fixe un plafond de dépenses de 250 $. Le Niveau 2 s'ouvre après 100 $ de dépenses plus trois jours, avec un plafond de 2 000 $ ; le Niveau 3 après 1 000 $ et 30 jours. Vous n'avez pas à dépenser quoi que ce soit pour débloquer le Niveau 1 ; le simple fait de lier la facturation le fait.
Payez le tarif de lancement. Jusqu'au 31 décembre 2026, 3.8 Flash coûte 0,75 $ par million de jetons d'entrée et 3,75 $ par million de jetons de sortie, les jetons de réflexion étant facturés comme sortie. À partir du 1er janvier 2027, les deux tarifs doubleront pour atteindre 1,50 $ et 7,50 $. Mille requêtes de 2 000 jetons d'entrée et 500 jetons de sortie chacune reviennent à environ 3,38 $ au tarif de lancement. La ventilation des prix calcule le coût par tâche, y compris pourquoi un prix par jeton moins cher ne signifie pas une tâche moins chère sur ce modèle.
Traitez par lots tout ce qui peut attendre. L'API de traitement par lots réduit le tarif de moitié : 0,375 $ pour l'entrée et 1,875 $ pour la sortie par million de jetons jusqu'à la fin de l'année. Mille requêtes similaires, environ 1,69 $. Les comptes de Niveau 1 peuvent avoir jusqu'à 3 millions de jetons en file d'attente à la fois. Les évaluations, les remplissages de données (backfills) et les tâches nocturnes y trouvent leur place ; notre guide du mode de traitement par lots Gemini couvre la forme de la requête.
Mettez en cache le préfixe stable. La mise en cache du contexte coûte 0,075 $ par million de jetons mis en cache au tarif de lancement, soit un dixième d'une nouvelle entrée. Un long prompt système ou un document que vous renvoyez à chaque tour est le premier endroit où regarder.
Ce que le gratuit ne vous apportera pas
Une liste honnête, car les résultats de recherche sur ce sujet sont pleins de mensonges.
- L'application Gemini. Pro ou Ultra uniquement, comme mentionné ci-dessus.
- Confidentialité. Les données du niveau gratuit sont utilisées pour améliorer les produits de Google. Il n'y a pas d'option de confidentialité sur le niveau gratuit.
- Marge de manœuvre. Les limites sont affichées sur la page des limites de débit et ne sont pas généreuses. Le gratuit est destiné à l'évaluation et aux petits outils, pas à un lancement.
- Gemini 3.8 Flash Cyber. La version optimisée pour la sécurité est réservée au programme Fairwind pour les gouvernements, les opérateurs d'infrastructures et les mainteneurs de logiciels. Pas d'API publique, pas de prix, pas d'auto-hébergement. Personne en dehors de ce programme ne l'a, gratuitement ou payant.
- API en direct, génération d'images ou génération audio. 3.8 Flash ne supporte pas ces fonctionnalités, quel que soit le niveau. Les entrées peuvent être du texte, des images, des vidéos, de l'audio et des PDF ; la sortie est du texte.
- Un niveau « illimité ». Les sites promettant un accès illimité à Gemini utilisent la clé de quelqu'un d'autre ou servent un modèle différent. Le guide d'accès gratuit et illimité à l'API Gemini explique comment le savoir, et la même stratégie pour le niveau gratuit qui a fonctionné pour Gemini 3.6 Flash s'applique toujours ici.
Faites durer votre quota gratuit plus longtemps avec Apidog
Un niveau gratuit récompense la discipline. Chaque requête que vous retappez à la main, chaque 429 que vous déclenchez par accident, et chaque appel à réflexion intense dont vous n'aviez pas besoin est un quota que vous ne récupérerez pas. Apidog rend cette discipline abordable.
Stockez GEMINI_API_KEY comme variable d'environnement dans un environnement Apidog, afin que la clé n'apparaisse jamais dans un corps de requête ou une collection partagée. Enregistrez l'appel Interactions et l'appel hérité generateContent comme des requêtes nommées avec le prompt, le modèle et le thinking_level remplis, et changez de niveaux avec une variable au lieu d'éditer le JSON. Ajoutez une assertion sur le code de statut afin qu'un 429 apparaisse comme un test échoué au lieu d'une réponse vide et confuse, et une sur usageMetadata.thoughtsTokenCount sur le point de terminaison hérité afin que vous puissiez voir combien de votre quota a été consacré à la réflexion.
Ensuite, planifiez un petit test de fumée : une requête faible par jour. Cela vous indique quand le comportement du modèle ou les limites gratuites changent avant que vos utilisateurs ne le découvrent. Téléchargez Apidog pour le configurer, et voyez comment planifier des tests API dans Apidog pour les options de temporisation.
FAQ
Gemini 3.8 Flash est-il gratuit ? Oui, via Google AI Studio et le niveau gratuit de l'API Gemini, avec des limites de débit et l'utilisation de vos données pour améliorer les produits de Google. Le modèle est le même gemini-3.8-flash que celui utilisé par les niveaux payants.
Puis-je utiliser Gemini 3.8 Flash gratuitement dans l'application Gemini ? Non. L'application propose 3.8 Flash aux abonnés Google AI Pro et Ultra. Le mode IA dans Google Search et Gemini dans Sheets sont les interfaces grand public où vous pouvez l'utiliser sans abonnement.
Quelles sont les limites de débit du niveau gratuit pour Gemini 3.8 Flash ? Google les affiche par modèle sur la page des limites de débit d'AI Studio plutôt que dans le texte de la documentation, et elles peuvent changer. Vérifiez cette page pour votre projet. Lorsque vous avez besoin de plus, la liaison d'un compte de facturation vous fait passer au Niveau 1 sans aucune dépense requise.
Le niveau gratuit inclut-il la réflexion ? Oui. Les trois niveaux (faible, moyen, élevé) fonctionnent sur le niveau gratuit, et moyen est la valeur par défaut. minimal renvoie une erreur sur 3.8 Flash. Étant donné que les jetons de réflexion comptent pour vos limites de jetons, faible étend le quota gratuit le plus loin ; consultez la comparaison des niveaux de réflexion pour le coût mesuré par niveau.
Gemini 3.8 Flash Cyber est-il gratuit ? Il n'est pas du tout disponible en dehors du programme Fairwind. Les développeurs réguliers obtiennent 3.8 Flash et peuvent exécuter leurs propres tests de sécurité API contre lui.
Commencez gratuitement, puis décidez
Le niveau gratuit est un véritable environnement d'évaluation pour Gemini 3.8 Flash, et non un simple aperçu. Créez une clé, maintenez la réflexion à faible, gardez les données sensibles à l'écart, et lisez la page des limites de débit au lieu de deviner. Quand un 429 commence à vous faire perdre du temps, liez la facturation pour le Niveau 1 et utilisez le traitement par lots pour toute tâche asynchrone ; à 0,375 $ par million de jetons d'entrée jusqu'en décembre, le premier mois payant coûtera probablement moins cher que le café que vous avez bu en attendant que le niveau gratuit se réinitialise.
