NewsIA
En direct
Modèles de langage

Gemini 3.7 Flash : Google casse les prix du code

Google sort Gemini 3.7 Flash, 24 jours après la 3.6 : prix divisé par deux et meilleur que Sonnet 5 sur le code. Mais Gemini 3.5 Pro reste absent.


PartagerXLinkedInEmail
Gemini 3.7 Flash : Google casse les prix du code
L'essentiel en 30 secondes
  • Google a lancé Gemini 3.7 Flash le 13 août 2026, seulement 24 jours après la 3.6.
  • Prix d'intro divisé par deux : 0,75 / 3,75 $ par million de tokens jusqu'au 31 décembre.
  • Il bat Claude Sonnet 5 et GPT-5.6 sur le code de production, mais reste derrière sur les tâches longues.
  • Ombre au tableau : Gemini 3.5 Pro, le vrai flagship, est toujours absent.

Google accélère à un rythme inédit. Vingt-quatre jours seulement après Gemini 3.6 Flash, la firme sort la 3.7 Flash le 13 août, moitié moins chère et taillée pour le code et les agents. Un signal de vitalité, mais qui masque mal l'absence persistante du modèle phare, Gemini 3.5 Pro.

01 · Le lancement

Un « workhorse » à prix cassé

Google présente Gemini 3.7 Flash comme son « modèle de travail le plus intelligent pour le code et les agents ». Le vrai argument, c'est le tarif : 0,75 dollar en entrée et 3,75 en sortie par million de tokens, soit moitié moins que la 3.6 sortie trois semaines plus tôt. Cette promo court jusqu'au 31 décembre 2026 ; ensuite le prix remonte à 1,50 / 7,50 dollars. Côté vitesse, le modèle affiche 340 tokens par seconde, en tête d'un classement de 186 modèles.

-50 %de prix vs Gemini 3.6
24 jentre la 3.6 et la 3.7
340tokens/s, 1er sur 186 modèles
43,6 %sur FrontierCode 1.1 (code)
02 · Les benchmarks

Meilleur sur le code, mais pas partout

Google revendique un modèle qui bat ses rivaux sur le code, et c'est vrai... en partie. Sur FrontierCode 1.1 (code de production), la 3.7 Flash devance de peu Claude Sonnet 5 et GPT-5.6. Mais sur les tâches d'ingénierie longues (DeepSWE) et l'usage ordinateur (OSWorld), c'est GPT-5.6 qui domine. Autrement dit, un excellent rapport qualité-prix sur le code courant, pas un roi absolu.

BenchmarkUn test standardisé qui mesure la performance des modèles sur une tâche (ex : SWE-bench pour le code, MMLU pour les savoirs généraux). Gemini 3.7 Flash Claude Sonnet 5 GPT-5.6
FrontierCode 1.1 (code) 43,6 % 42,7 % 41,3 %
DeepSWE (tâches longues) 65,3 % 53,8 % 69,6 %
OSWorld 2.0 (ordinateur) 38,1 % , 50,2 %
Prix in/out ($/M) 0,75 / 3,75 2 / 10 2 / 12
03 · L'ombre au tableau

Gemini 3.5 Pro, l'arlésienne

Les retards de Gemini 3.5 Pro ont conduit les investisseurs à questionner la feuille de route de Google, notamment sur le code.D'après TradingKey / Seeking Alpha

Derrière la cadence effrénée sur les modèles Flash se cache un trou béant : le flagship Gemini 3.5 Pro, attendu depuis mai, n'est toujours pas là. Reporté au moins trois fois, il souffrirait de faiblesses en code, au point que Google aurait relancé un entraînement complet. Multiplier les petits modèles rapides, c'est aussi une façon d'occuper le terrain en attendant. Dans ce contexteLa fenêtre de contexte : le nombre maximum de tokens qu'un modèle peut traiter en une seule requête (ex : 200k, 1M). tendu, Google a nommé Koray Kavukcuoglu à la tête de son IA, avec pour mission de recoller à OpenAI et Anthropic.

04 · La course

Le même jour, OpenAI dégaine l'ultra-rapide

La course ne laisse aucun répit. Le 13 août également, OpenAI a prévisualisé GPT-5.6 Sol Ultrafast, une version jusqu'à 14 fois plus rapide propulsée par les puces Cerebras, pour l'instant sur invitation. Deux annonces le même jour, toutes deux sur la vitesse : le nerf de la guerre 2026, c'est autant la latenceLe temps écoulé entre l'envoi d'une requête et la réception de la réponse complète d'un modèle. et le prix que la puissance brute. À relativiser tout de même : la part de marché de Gemini reste débattue. Le détecteur Pangram parle d'un effondrement de 12 % à 1,9 %, mais cette mesure ne couvre que la génération de texte ; sur les applications grand public, Gemini progresse à environ 25 %, derrière ChatGPT (45 %).

05 · L'enjeu français

Ce que ça change pour les devs et PME français

Pour un développeur ou une PME en France, l'arithmétique est imparable : à 0,75 dollar le million de tokens en entrée, Gemini 3.7 Flash coûte près de 70 % de moins que GPT-5.6 pour un agent ou un chatbot. De quoi alléger fortement une facture d'APIApplication Programming Interface, le canal d'accès programmatique à un service ou à un modèle., au moins jusqu'à fin décembre. Revers de la médaille : côté souveraineté, il n'existe pas d'équivalent français aussi agressif sur le prix, Mistral restant plus cher sur ce créneau. Pour arbitrer, utilisez notre comparateur de modèles et notre calculateur de coût LLM. Voir aussi notre décryptage de la guerre des prix Opus 5 vs Gemini 3.6 et la fiche Gemini.

Sources

  • Google, « Introducing Gemini 3.7 Flash » (blog.google, 13 août 2026)
  • VentureBeat, « Gemini 3.7 Flash targets coding and agents with a 50% price cut »
  • The Decoder, « Gemini 3.7 Flash lands with coding gains »
  • 9to5Google, « Gemini 3.7 Flash launches three weeks after last model »
  • OpenAI, « Previewing Ultrafast » (GPT-5.6 Sol, Cerebras)

Questions fréquentes

Quand Gemini 3.7 Flash est-il sorti ?
Google a lancé Gemini 3.7 Flash le 13 août 2026, seulement 24 jours après Gemini 3.6 Flash. C'est une cadence inédite, que Google attribue au retour des développeurs et à des gains algorithmiques rapides sur ses modèles de travail dédiés au code et aux agents.
Combien coûte Gemini 3.7 Flash ?
Le prix d'introduction est de 0,75 dollar en entrée et 3,75 dollars en sortie par million de tokens, soit moitié moins que Gemini 3.6, jusqu'au 31 décembre 2026. Ensuite, le tarif remonte à 1,50 / 7,50 dollars par million de tokens.
Gemini 3.7 Flash est-il meilleur que Claude et GPT-5.6 ?
Sur le code de production (FrontierCode 1.1), il devance légèrement Claude Sonnet 5 et GPT-5.6. Mais sur les tâches d'ingénierie longues (DeepSWE) et l'usage ordinateur (OSWorld), c'est GPT-5.6 qui domine. C'est donc un excellent rapport qualité-prix, pas un leader absolu.
Où en est Gemini 3.5 Pro ?
Le flagship Gemini 3.5 Pro, attendu depuis mai 2026, est toujours absent. Reporté au moins trois fois, il souffrirait de faiblesses en code, au point que Google aurait relancé un entraînement complet. Aucune date de sortie officielle n'a été communiquée.
Gemini perd-il des parts de marché ?
Cela dépend de la mesure. Le détecteur Pangram évoque une chute de 12 % à 1,9 %, mais uniquement sur la génération de texte. Sur les applications grand public, Gemini progresse plutôt vers 25 %, derrière ChatGPT (environ 45 %) mais devant Claude.
Gemini 3.7 Flash est-il intéressant pour une PME française ?
Oui, surtout sur le coût : à 0,75 dollar le million de tokens en entrée, il revient environ 70 % moins cher que GPT-5.6 pour un agent ou un chatbot, au moins jusqu'à fin décembre 2026. Il n'existe pas d'équivalent français aussi agressif sur le prix à ce jour.

Source : blog.google

À lire aussi