Un rythme de sortie qui interroge les équipes techniques
Gemini 3.7 Flash a été annoncé le 13 août 2026 par Google, exactement trois semaines après Gemini 3.6 Flash. L'entreprise présente ce modèle comme son « workhorse » le plus performant à ce jour pour le codage et les agents d'intelligence artificielle, issu selon elle des retours des développeurs et d'innovations algorithmiques sur le socle de raisonnement. Le modèle repose techniquement sur Gemini 3.6 Flash, dont il hérite l'architecture et les données d'entraînement, avec une fenêtre de contexte allant jusqu'à 1 million de jetons en entrée et une sortie limitée à 64 000 jetons. Sa date de coupure de connaissances est fixée à mars 2026, avec une précision de Google selon laquelle certains domaines resteront limités à une connaissance de janvier 2025.
Ars Technica relève que ce cycle accéléré intervient alors que Gemini 3.5 Pro, promis pour juin 2026 lors de la conférence I/O, n'a toujours pas été lancé. Le média américain avance l'hypothèse que Google préfère multiplier les versions Flash plutôt que d'exposer directement son modèle phare à la comparaison avec les dernières sorties d'OpenAI et d'Anthropic. Cette lecture reste une interprétation d'un seul média et doit être traitée comme telle.
Des gains mesurés sur le code, le web et les documents complexes
Google avance plusieurs séries de benchmarks pour justifier la mise à jour. Sur FrontierCode 1.1 Main, qui évalue la qualité du code produit, Gemini 3.7 Flash atteint 43,6 %, contre 34,4 % pour 3.6 Flash. Sur DeepSWE v1.1, qui mesure l'ingénierie logicielle sur des tâches longues, le blog officiel de Google indique une progression de 49,0 % à 65,3 %, tandis que la fiche modèle publiée par DeepMind cite un chiffre légèrement différent pour la version précédente (48,6 %) sur le même test : les deux documents émanent de Google mais ne convergent pas totalement sur cette ligne.
En développement web, le score Elo sur WebDev Arena passe de 1 538 à 1 588. Google affirme que le modèle génère des mises en page plus fonctionnelles et des applications plus complètes à partir d'un nombre réduit de consignes, avec une meilleure fidélité aux maquettes fournies sous forme de captures d'écran ou de systèmes de conception. Pour les secteurs à forte densité de connaissances, comme la finance, le droit ou les sciences de la vie, le score sur GDP.pdf, qui teste la compréhension de documents complexes, grimpe de 22 % à 34 %. Sur AutomationBench, qui simule des flux de travail professionnels réels, Gemini 3.7 Flash atteint 30,4 % contre 17 % pour son prédécesseur.
| Benchmark | Ce qu'il mesure | Gemini 3.6 Flash | Gemini 3.7 Flash |
|---|---|---|---|
| FrontierCode 1.1 Main | Qualité du code produit | 34,4 % | 43,6 % |
| DeepSWE v1.1 | Ingénierie logicielle longue durée | 49,0 % (blog Google) | 65,3 % |
| WebDev Arena | Développement web (score Elo) | 1 538 | 1 588 |
| GDP.pdf | Compréhension de documents complexes | 22,0 % | 34,0 % |
| AutomationBench | Automatisation de flux de travail professionnels | 17,0 % | 30,4 % |
La baisse de prix, argument central pour les budgets d'agents
Le changement le plus concret concerne la tarification de l'API. Gemini 3.7 Flash est proposé jusqu'à fin 2026 à un tarif d'introduction de 0,75 dollar par million de jetons d'entrée et 3,75 dollars par million de jetons de sortie, soit la moitié du prix de lancement de Gemini 3.6 Flash. À partir du 1er janvier 2027, ce tarif doublera pour atteindre 1,50 dollar en entrée et 7,50 dollars en sortie. Ces montants sont exprimés en dollars américains, base variable selon l'usage réel, et ne sont pas directement comparables à un abonnement forfaitaire facturé en euros TTC.
La documentation technique de DeepMind situe ce tarif face à des modèles concurrents, toujours en dollars par million de jetons : Claude Sonnet 5 à 2,00 dollars en entrée et 10,00 dollars en sortie, GPT-5.6 à 2,00 dollars en entrée et 12,00 dollars en sortie, ou encore Terra Muse Spark 1.2 à 1,25 dollar en entrée et 4,25 dollars en sortie. Ars Technica rapporte par ailleurs qu'OpenAI aurait abaissé le prix d'une version « Luna » de GPT-5.6 à 0,20 dollar en entrée et 1,20 dollar en sortie par million de jetons, un chiffre qui n'émane que de ce média et qui doit être lu comme tel.
| Modèle | Prix entrée ($/1M jetons) | Prix sortie ($/1M jetons) |
|---|---|---|
| Gemini 3.7 Flash (jusqu'au 31/12/2026) | 0,75 | 3,75 |
| Gemini 3.7 Flash (à partir du 01/01/2027) | 1,50 | 7,50 |
| Gemini 3.6 Flash | 0,75 | 3,75 |
| Claude Sonnet 5 | 2,00 | 10,00 |
| GPT-5.6 | 2,00 | 12,00 |
| Terra Muse Spark 1.2 | 1,25 | 4,25 |
Optimiser ses flux multi-modèles depuis la France
Pour une équipe technique française qui construit des agents IA, ce type de mise à jour tarifaire crée un arbitrage récurrent. Une facturation à l'usage en dollars par million de jetons impose de suivre le taux de change, de modéliser la volumétrie réelle des agents en production, et d'anticiper le doublement du tarif prévu dès janvier 2027. Ce mode de facturation convient bien à des charges de travail ponctuelles ou expérimentales, mais rend la prévision budgétaire plus délicate pour une direction financière qui doit sanctuariser un poste de dépense stable.
C'est sur ce point qu'un abonnement forfaitaire par poste apporte une lisibilité différente. Moon AI, la plateforme éditée par Stellarr Studio SAS, propose plus de 70 modèles, dont GPT, Claude, Gemini, Mistral, DeepSeek, Llama, Grok, Qwen et le modèle maison Moon 6, dans un abonnement unique facturé en euros TTC par siège et par mois, avec des paliers allant de 9,90 euros à 249,90 euros et une offre gratuite sans carte bancaire. Ce type de structure ne remplace pas l'API directe pour un besoin de très gros volume, mais elle permet à une équipe de comparer Gemini 3.7 Flash à d'autres modèles sur un même flux de travail sans recalculer un budget par million de jetons à chaque changement de tarif.
La question de la donnée mérite une attention particulière pour les secteurs cités par Google lui-même, la finance, le droit et les sciences de la vie. Les requêtes envoyées à l'API Gemini partent chez Google, comme celles adressées à tout modèle tiers partent chez son fournisseur. Sur Moon AI, l'application et le stockage sont hébergés chez OVHcloud, à Strasbourg et à Roubaix, mais les requêtes adressées aux modèles tiers quittent bien la France après un traitement par Moon Blur, qui remplace les données personnelles par des jetons avant l'envoi et les rétablit au retour. Ce procédé étant réversible, il s'agit d'une pseudonymisation au sens de l'article 4-5 du RGPD, et non d'une anonymisation.
Ce que les sources ne disent pas encore
La fiche modèle publiée par DeepMind reconnaît que Gemini 3.7 Flash peut présenter les limites générales des modèles de fondation, y compris des hallucinations, et que des lenteurs ou des délais d'attente restent possibles. Google indique aussi avoir renforcé les protections contre les usages détournés dans les domaines chimique, biologique, radiologique et nucléaire ainsi que contre l'offensive informatique, sans que le rapport détaillé de sécurité, annoncé comme devant paraître prochainement, ne soit encore disponible. Aucune des sources ne précise de date de disponibilité pour la France en dehors des canaux mentionnés, ni de conditions tarifaires spécifiques pour un marché européen : les prix communiqués restent exprimés uniquement en dollars, sur une base de facturation par jeton.
Le déploiement dans Gemini Spark, l'agent personnel accessible aux abonnés Google AI Pro et Ultra dans plus de 160 pays, reste réservé à ces formules payantes : Ars Technica souligne que l'interface de chat classique de Gemini continue de fonctionner sous 3.6 Flash pour le moment. Pour les développeurs, le modèle est accessible via Google Antigravity, l'API Gemini, Google AI Studio, Android Studio, la plateforme Gemini Enterprise Agent et l'application Gemini Enterprise.
Questions fréquentes
Le tarif de 0,75 dollar par million de jetons est-il garanti sur la durée ?
Non. Google précise que ce tarif d'introduction s'applique jusqu'au 31 décembre 2026. À partir du 1er janvier 2027, le prix double pour atteindre 1,50 dollar par million de jetons d'entrée et 7,50 dollars par million de jetons de sortie.
Gemini 3.7 Flash est-il accessible sans abonnement payant ?
Pour les développeurs, oui, via l'API Gemini et Google AI Studio. Pour les particuliers, l'accès passe par Gemini Spark dans l'application Gemini, réservé aux abonnés Google AI Pro ou Ultra dans les pays pris en charge.
Peut-on comparer directement le prix de Gemini 3.7 Flash à un abonnement en euros ?
Pas sans précaution. Le tarif de Google est exprimé en dollars par million de jetons consommés, une base variable selon l'usage réel. Un abonnement forfaitaire en euros TTC par siège, comme celui de Moon AI, répond à une logique différente : un coût fixe mensuel indépendant du volume de jetons traités.
Les données envoyées à l'API Gemini restent-elles en France ?
Les sources ne l'indiquent pas. Les requêtes adressées à un modèle tiers, quel qu'il soit, sont traitées chez ce fournisseur. Sur une plateforme comme Moon AI, l'hébergement de l'application se fait chez OVHcloud à Strasbourg et Roubaix, mais les échanges avec les modèles tiers, dont Gemini, partent bien chez leurs éditeurs après une pseudonymisation des données personnelles.