
Le 13 août 2026, Google a lancé Gemini 3.7 Flash, son nouveau modèle d'IA pensé pour le code et les agents, avec un prix d'entrée divisé par deux par rapport à la version précédente. Trois semaines seulement séparent ce lancement de celui de Gemini 3.6 Flash, fin juillet. Pour un dirigeant de PME qui suit ses factures d'API IA ou fait tourner des automatisations, ce rythme et cette baisse de prix méritent d'être compris précisément, avant de décider s'il faut ajuster son budget ou ses outils.
En bref
- Google a lancé Gemini 3.7 Flash le 13 août 2026, présenté comme son « modèle de travail le plus intelligent » pour le code et les agents (source : Google DeepMind).
- Le prix d'entrée est divisé par deux : 0,75 $ par million de tokens en entrée et 3,75 $ en sortie, contre un tarif standard qui double au 1er janvier 2027 (1,50 $ et 7,50 $).
- Sur le test de développement logiciel DeepSWE, le score passe de 49,0 % à 65,3 % ; sur FrontierCode, de 34,4 % à 43,6 % (source : Google DeepMind).
- Sur AutomationBench, qui mesure la capacité à exécuter des tâches de bureau type (facturation, tri de mails, reporting), le score passe de 17,0 % à 30,4 %.
- Le modèle est disponible immédiatement dans Google AI Studio, Gemini Enterprise et l'application Gemini Spark, dans plus de 160 pays.
- Pour une PME, l'enseignement n'est pas de courir après chaque nouveau modèle, mais de profiter d'une fenêtre de prix limitée avant la hausse programmée de janvier 2027.
Ce que Google a annoncé le 13 août 2026
Gemini 3.7 Flash est la troisième version de la gamme « Flash » en un peu plus d'un mois, après Gemini 3.5 Flash-Lite et Gemini 3.6 Flash lancé le 21 juillet 2026. Ce n'est pas le modèle le plus puissant du catalogue Google (Gemini Pro reste au-dessus), mais celui conçu pour tourner en volume : des agents qui enchaînent des dizaines d'appels par tâche, du code généré en continu, des workflows automatisés.
Selon Google DeepMind, l'éditeur du modèle, les progrès viennent à la fois des retours de développeurs et de changements algorithmiques ciblés sur trois usages : l'ingénierie logicielle, le développement web, et le travail de connaissance (finance, droit, sciences du vivant). Le modèle est déjà déployé pour les développeurs (Google AI Studio, Android Studio, Google Antigravity), pour les entreprises (Gemini Enterprise Agent Platform) et pour les particuliers abonnés à Gemini Spark.
Les gains mesurés sur le code et les agents
Les scores publiés par Google DeepMind montrent une progression nette sur les tâches les plus utiles à une entreprise : écrire et corriger du code, naviguer un site pour accomplir une tâche, ou automatiser un flux de travail bureautique.
| Indicateur | Gemini 3.6 Flash | Gemini 3.7 Flash |
|---|---|---|
| DeepSWE v1.1 | 49,0 % | 65,3 % |
| FrontierCode 1.1 Main | 34,4 % | 43,6 % |
| AutomationBench | 17,0 % | 30,4 % |
| WebDev Arena (Elo) | 1 538 | 1 588 |
| Prix (par M de tokens, entrée / sortie) | Non communiqué / 7,50 $ | 0,75 $ / 3,75 $ (lancement, jusqu'au 31/12/2026) |
Sources : Google DeepMind (billet officiel, 13 août 2026), MarkTechPost, VentureBeat.
Ces chiffres restent des scores de laboratoire, pas une garantie de résultat pour un usage précis. Mais la progression sur AutomationBench, qui simule des tâches administratives concrètes, est le signal le plus parlant pour une PME : c'est justement le type de tâche qu'une automatisation interne (tri de factures, réponses types, extraction de données) est censée accomplir.
Une baisse de prix, mais jusqu'à quand ?
Le tarif de 0,75 $ / 3,75 $ par million de tokens n'est pas définitif. C'est un prix de lancement, valable jusqu'au 31 décembre 2026. À partir du 1er janvier 2027, il double : 1,50 $ en entrée et 7,50 $ en sortie, soit le même niveau que Gemini 3.6 Flash en sortie.
À retenir
Une automatisation lancée aujourd'hui avec Gemini 3.7 Flash coûtera deux fois plus cher par appel à partir de janvier 2027, sauf nouvelle baisse annoncée par Google d'ici là. Avant de bâtir un processus critique sur ce tarif, il vaut mieux vérifier que le calcul reste rentable au prix standard, pas seulement au prix promotionnel.
Ce mécanisme n'est pas nouveau chez les grands fournisseurs d'IA : des tarifs d'introduction attractifs, resserrés une fois l'adoption installée. Pour une PME, la bonne pratique reste la même que celle déjà recommandée pour les précédents lancements Gemini : profiter du prix bas pour tester et calibrer un usage, sans y indexer un budget figé sur plusieurs années.
Un rythme de sortie inhabituel
Mi-2026
Gemini 3.5 Flash-Lite
21 juillet 2026
Gemini 3.6 Flash
13 août 2026
Gemini 3.7 Flash
Trois versions du modèle « Flash » en un peu plus d'un mois : Google concentre visiblement ses efforts sur la gamme la moins chère et la plus utilisée pour les agents, pendant que le rythme de sortie de son modèle haut de gamme Gemini Pro ralentit, selon plusieurs médias spécialisés (InfoWorld). Autrement dit, la course actuelle se joue moins sur le modèle « le plus intelligent dans l'absolu » que sur le modèle le plus rentable à faire tourner en continu, un critère qui parle directement à une PME.
Ce que cela change concrètement pour une PME
Recalculer le coût d'une automatisation existante
Tester avant de généraliser
Anticiper la fin du tarif promotionnel
Concrètement, une PME qui automatise le tri de mails, la génération de brouillons de devis ou la relecture de code n'a pas besoin de changer d'outil du jour au lendemain. Mais vérifier que son fournisseur cloud ou son prestataire IA propose déjà Gemini 3.7 Flash en option, et comparer le coût réel sur un mois de test, est un réflexe simple à adopter dès cette rentrée.
FAQ
Qu'est-ce que Gemini 3.7 Flash change concrètement pour ma facture IA ?
Si vos automatisations utilisent déjà un modèle Gemini Flash, le passage à la version 3.7 peut réduire le coût par tâche jusqu'au 31 décembre 2026, grâce au tarif de lancement à 0,75 $ / 3,75 $ par million de tokens. Le gain dépend du volume de tokens consommés par vos flux actuels.
Le prix de Gemini 3.7 Flash restera-t-il aussi bas ?
Non, sauf nouvelle annonce de Google. Le tarif actuel est un prix de lancement valable jusqu'au 31 décembre 2026. Il double ensuite (1,50 $ en entrée, 7,50 $ en sortie), au niveau de Gemini 3.6 Flash en sortie.
Gemini 3.7 Flash remplace-t-il Gemini 3.6 Flash ?
Oui, Gemini 3.7 Flash est présenté par Google comme la version la plus récente de sa gamme « workhorse », destinée au code et aux agents. Gemini 3.6 Flash reste disponible, mais les nouveaux déploiements sont encouragés à utiliser la version 3.7.
Faut-il changer de fournisseur IA pour profiter de ce prix ?
Pas nécessairement. Si votre pile technique utilise déjà l'écosystème Google (Google AI Studio, Vertex AI, Gemini Enterprise), la bascule vers Gemini 3.7 Flash se fait généralement par un simple changement de paramètre, sans migration d'outil complète.
En conclusion
La baisse de prix de Gemini 3.7 Flash confirme une tendance de fond observée depuis plusieurs mois : le coût de l'IA agentique continue de reculer, rendant rentables des automatisations qui ne l'étaient pas il y a un an. Mais un prix de lancement n'est pas un prix garanti, et une PME a intérêt à tester avant de généraliser, puis à provisionner la hausse annoncée pour 2027. Pour suivre les précédentes baisses de prix chez Google, consultez notre article sur Gemini 3.6 Flash et le coût de l'IA, ou explorez nos ressources Le Mag pour rester à jour sur l'actualité utile aux dirigeants de PME.


