Google a lancé Gemini 3.7 Flash le 13 août 2026, trois semaines après 3.6 Flash et alors que Gemini 3.5 Pro reste retardé. La société l'appelle "notre modèle polyvalent le plus intelligent", et l'annonce officielle étaye cette affirmation avec des bonds de 10 à 16 points dans les benchmarks sur les tâches de codage et d'agent. Si vous développez avec l'API Gemini, c'est le modèle que vous utiliserez pendant les prochains mois.
Cette page est la fiche de référence. Chaque spécification, prix, delta de benchmark et canal d'accès est réuni en un seul endroit, dans des tableaux que vous pouvez parcourir en moins d'une minute. Lorsque vous êtes prêt à écrire du code, le guide de démarrage rapide de l'API Gemini 3.7 Flash vous guide pas à pas à travers cURL, Python et Node, et Apidog vous offre un espace de travail pour envoyer des requêtes de test au point de terminaison avant même que ce code n'existe.
Mettez celle-ci en favori. Les chiffres ci-dessous changeront le 1er janvier 2027, lorsque la période de tarification d'introduction prendra fin, et nous maintiendrons les tableaux à jour.
En bref
- L'ID du modèle est
gemini-3.7-flash, disponible dans l'API Gemini depuis le 13 août 2026, dans plus de 160 pays. - Spécifications : Contexte d'entrée de 1M de tokens, limite de sortie de 64k tokens, entrée multimodale (texte, image, vidéo, audio, PDF), sortie texte.
- Outils : L'appel de fonction, la recherche en tant qu'outil et l'utilisation de l'ordinateur sont tous pris en charge.
- Prix de lancement : 0,75 $ par million de tokens en entrée et 3,75 $ par million de tokens en sortie jusqu'au 31 décembre 2026. Les tarifs standard doublent pour atteindre 1,50 $ et 7,50 $ le 1er janvier 2027.
- Benchmarks par rapport à 3.6 Flash : DeepSWE v1.1 49,0 % à 65,3 %, AutomationBench 17,0 % à 30,4 %, WebDev Arena Elo 1538 à 1588.
- Accédez-y via l'API Gemini, Google AI Studio, l'application Gemini, Gemini Spark, Google Antigravity, Android Studio et Gemini Enterprise.
Fiche technique de Gemini 3.7 Flash
Les chiffres clés, directement de la page du modèle Gemini Flash de Google et des documents de lancement.
| Spécification | Valeur |
|---|---|
| ID du modèle | gemini-3.7-flash |
| Date de publication | 13 août 2026 |
| Fenêtre de contexte d'entrée | 1 000 000 de tokens |
| Limite de tokens en sortie | 64 000 tokens |
| Modalités d'entrée | Texte, image, vidéo, audio, PDF |
| Modalité de sortie | Texte |
| Appel de fonction | Oui |
| Recherche en tant qu'outil | Oui |
| Utilisation de l'ordinateur | Oui |
| Récupération de contexte long (aiguille de 128k) | 97,0 % |
| Sécurité | Garanties CBRN et cybersécurité mises à jour |
| Disponibilité | Plus de 160 pays |
| Point de terminaison API | generativelanguage.googleapis.com (clé AI Studio) ou aiplatform.googleapis.com (Vertex, OAuth) |
Deux lignes méritent un examen approfondi. La limite de sortie de 64k est généreuse pour un modèle de classe Flash ; cela signifie que des réécritures de fichiers complètes et de longues sorties structurées peuvent tenir en une seule réponse. De plus, le support de l'utilisation de l'ordinateur place 3.7 Flash dans un petit groupe de modèles capables de piloter directement un navigateur, bien que pour la plupart des automatisations de production, un appel API structuré reste préférable. Les compromis sont abordés dans utilisation de l'ordinateur vs APIs structurées.
Tarification en un coup d'œil
Google a lancé 3.7 Flash à la moitié du prix de lancement de 3.6 Flash, mais la réduction a une date d'expiration.
| Niveau | Entrée (par million de tokens) | Sortie (par million de tokens) | Valide |
|---|---|---|---|
| Introductif | 0,75 $ | 3,75 $ | Jusqu'au 31 décembre 2026 |
| Standard | 1,50 $ | 7,50 $ | À partir du 1er janvier 2027 |
C'est un doublement net de chaque côté le jour de l'An. Si votre charge de travail est gourmande en tokens, la période d'introduction est le moment idéal pour effectuer des benchmarks, affiner les prompts et bloquer les stratégies de mise en cache, car les erreurs coûtent deux fois moins cher. Pour des exemples de coûts détaillés, le calcul des tokens sur des charges de travail réelles et des stratégies pour réduire les dépenses avant que les tarifs standard ne s'appliquent, consultez Explication des tarifs de Gemini 3.7 Flash. La source de vérité en direct est la page de tarification de l'API Gemini.
Benchmarks : 3.6 Flash vs 3.7 Flash
Google a publié des deltas par rapport à 3.6 Flash concernant le codage, le développement web, la compréhension de documents et l'automatisation par agents. Les écarts sont importants pour une version ponctuelle lancée trois semaines après son prédécesseur, un point que la couverture de lancement de 9to5Google a également souligné.
| Benchmark | Gemini 3.6 Flash | Gemini 3.7 Flash | Delta |
|---|---|---|---|
| DeepSWE v1.1 (codage par agent) | 49,0 % | 65,3 % | +16,3 |
| FrontierCode 1.1 Principal | 34,4 % | 43,6 % | +9,2 |
| WebDev Arena (Elo) | 1538 | 1588 | +50 |
| GDP.pdf (compréhension de document) | 22,0 % | 34,0 % | +12,0 |
| AutomationBench (automatisation par agent) | 17,0 % | 30,4 % | +13,4 |
| Harvey LAB-AA (juridique) | n/d | 90,7 % | n/d |
| Récupération d'aiguille 128k | n/d | 97,0 % | n/d |
Le motif à travers le tableau : les charges de travail d'agent ont le plus progressé. Les améliorations déclarées par Google correspondent : meilleur débogage, code de première tentative plus facilement déployable, réflexion plus diligente sur la planification multi-étapes et les appels d'outils, et un suivi des instructions plus strict. La comparaison de ces chiffres avec les modèles d'Anthropic et d'OpenAI est une question distincte, abordée dans Gemini 3.7 Flash vs Claude vs GPT.
Où vous pouvez utiliser Gemini 3.7 Flash
Sept canaux d'accès au lancement. Choisissez par rôle.
| Canal | À quoi ça sert | À qui il s'adresse |
|---|---|---|
| API Gemini | Accès programmatique avec une clé AI Studio | Développeurs d'applications |
| Google AI Studio | Environnement de test dans le navigateur, itération de prompts, gestion des clés | Développeurs en phase de prototypage |
| Application Gemini | Chat pour consommateurs sur web et mobile | Utilisateurs finaux |
| Gemini Spark | Environnement de codage par agent | Abonnés AI Pro et Ultra |
| Google Antigravity | Plateforme de développement axée sur les agents | Équipes construisant des agents autonomes |
| Android Studio | Intégration IDE pour le travail Android | Développeurs mobiles |
| Gemini Enterprise | Déploiement géré avec contrôles administratifs | Informatique d'entreprise |
Pour le travail avec l'API, le chemin via la clé AI Studio vous permet d'obtenir une requête fonctionnelle en quelques minutes. Vertex AI utilise le même modèle derrière OAuth avec IAM, les journaux d'audit et les points de terminaison régionaux lorsque vous avez besoin de contrôles de production.
Une requête fonctionnelle minimale
Obtenez une clé depuis AI Studio, exportez-la et envoyez une requête.
export GEMINI_API_KEY="AIza..."
curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.7-flash:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"contents": [{
"parts": [{ "text": "List the HTTP status codes an idempotent retry layer should handle." }]
}],
"generationConfig": {
"temperature": 0.4,
"maxOutputTokens": 1024
}
}'
Le streaming échange la méthode contre :streamGenerateContent?alt=sse sur le même chemin. La réponse renvoie un tableau candidates avec les parties de texte et un bloc usageMetadata avec le nombre de tokens qui vous seront facturés.
Si vous préférez ne pas éditer manuellement du JSON dans un terminal, Apidog importe la spécification de l'API Generative Language, lie GEMINI_API_KEY comme variable d'environnement sur l'en-tête x-goog-api-key et affiche les flux SSE en direct. Enregistrez une bonne réponse comme exemple une fois et réexécutez les tests par rapport à la fixture au lieu du point de terminaison payant.
Limites de débit et niveaux
Google fixe des limites de débit par modèle et par niveau (gratuit, paiement à l'utilisation et niveaux provisionnés), et les chiffres changent si souvent que tout tableau imprimé ici serait obsolète. Consultez la documentation officielle de l'API Gemini pour connaître les plafonds actuels de requêtes par minute et de tokens par minute pour gemini-3.7-flash.
Deux règles empiriques stables. Le quota du niveau gratuit via AI Studio est suffisant pour prototyper mais pas pour déployer. Et un 429 avec le statut RESOURCE_EXHAUSTED signifie que vous avez atteint une limite par minute ou par jour ; reculez avec un jitter, groupez là où vous le pouvez, ou déplacez le projet vers un niveau facturé.
Liens rapides
- Annonce officielle : article de lancement avec les affirmations de Google et les tableaux de benchmarks
- Documentation de l'API Gemini : référence des points de terminaison, guides SDK, limites de débit
- Page de tarification : tarifs par token en direct
- Page du modèle : spécifications et détails de modalité
- Obtenir une clé API : clé AI Studio en deux clics
FAQ
Quelles sont les spécifications de Gemini 3.7 Flash en une phrase ?
Une fenêtre de contexte d'entrée de 1M de tokens, une limite de sortie de 64k tokens, une entrée multimodale (texte, image, vidéo, audio et PDF), une sortie texte, et la prise en charge de l'appel de fonction, de la recherche en tant qu'outil et de l'utilisation de l'ordinateur, adressable sous le nom gemini-3.7-flash via l'API Gemini.
Combien coûte Gemini 3.7 Flash ?
0,75 $ par million de tokens en entrée et 3,75 $ par million de tokens en sortie jusqu'au 31 décembre 2026. À partir du 1er janvier 2027, les tarifs standard s'appliqueront : 1,50 $ en entrée et 7,50 $ en sortie. Le tarif de lancement est la moitié de celui de 3.6 Flash.
Dois-je modifier mon code pour passer de 3.6 Flash ?
L'échange lui-même tient en une ligne : changer l'ID du modèle pour gemini-3.7-flash. Les changements de comportement sont le vrai travail, car 3.7 réfléchit plus longtemps aux appels d'outils multi-étapes et suit les instructions plus strictement. Le guide de migration de 3.6 vers 3.7 Flash couvre ce qu'il faut tester en régression avant de basculer le trafic.
Pourquoi Google a-t-il lancé 3.7 Flash avant Gemini 3.5 Pro ?
Gemini 3.5 Pro est toujours retardé, et Axios a rapporté que Google lance des mises à jour Flash avant son prochain modèle phare plutôt que de retenir les améliorations. L'écart de trois semaines entre 3.6 et 3.7 Flash correspond à ce rythme.
Existe-t-il un moyen gratuit de l'essayer ?
Oui. Le niveau gratuit d'AI Studio inclut un quota quotidien pour gemini-3.7-flash, suffisant pour les tests de prompts et les petits prototypes, et aucun compte de facturation n'est requis tant que vous n'avez pas besoin de limites de débit plus élevées. Le guide d'accès gratuit à l'API Gemini explique jusqu'où s'étend le niveau gratuit et quoi faire lorsque vous atteignez ses plafonds.
Où 3.7 Flash s'intègre dans votre stack
Considérez 3.7 Flash comme le modèle Gemini par défaut pour les boucles d'agents, les assistants de codage, les pipelines de documents, et tout ce qui effectue de nombreux appels d'outils par session. Les gains de benchmark se situent précisément là où résident ces charges de travail, et la tarification d'introduction fait des quatre mois et demi à venir la période la moins chère pour construire. Réservez votre jugement sur le raisonnement de classe phare jusqu'à la sortie de Gemini 3.5 Pro ; pour tout le reste, c'est le modèle polyvalent que Google prétend qu'il est.
Avant que l'ID du modèle n'approche du code de production, testez le point de terminaison. Téléchargez Apidog pour conserver vos requêtes Gemini, environnements, vérifications de streaming et fixtures de réponse enregistrées dans un seul espace de travail, aux côtés des collections pour chaque autre fournisseur que vous évaluez.
