Google a mis en disponibilité générale Gemini 3.7 Flash le 13 août, trois semaines seulement après la version précédente. Le modèle passe de 49,0 % à 65,3 % sur DeepSWE v1.1 et arrive à un tarif d’appel de 0,75 $ par million de tokens en entrée, valable jusqu’au 31 décembre.
Pour résumer
- Gemini 3.7 Flash est en disponibilité générale depuis le 13 août, trois semaines après le 3.6 Flash
- Tarif d’appel à 0,75 $ / 3,75 $ par million de tokens jusqu’au 31 décembre 2026, puis doublement au 1er janvier
- Les gains les plus nets portent sur le code et l’automatisation, avec AutomationBench qui passe de 17,0 % à 30,4 %
Faire résumer cet article par une IA
ChatGPTTrois semaines d’écart entre deux modèles Flash
Google n’a pas laissé son modèle de travail vieillir. Gemini 3.7 Flash arrive en disponibilité générale trois semaines après le 3.6, avec un positionnement inchangé sur le papier et des scores qui bougent partout ailleurs.
Les chiffres publiés dans la fiche de lancement officielle du modèle donnent le détail. FrontierCode 1.1 Main monte de 34,4 % à 43,6 %. DeepSWE v1.1 passe de 49,0 % à 65,3 %. Le Elo WebDev Arena gagne cinquante points, de 1538 à 1588.
Deux autres résultats méritent d’être regardés de près parce qu’ils ne concernent pas le code. Sur GDP.pdf, un test de compréhension documentaire dense, le modèle passe de 22,0 % à 34,0 %. Sur AutomationBench, il monte de 17,0 % à 30,4 %.
Le reste de la fiche technique ne bouge pas. Fenêtre de contexte d’un million de tokens, 64 000 tokens en sortie maximum, niveaux de réflexion réglables en bas, moyen et haut, entrées texte, image, audio et vidéo. La même boîte à outils intégrée que le 3.6 Flash, sans ajout.
Le contraste avec la ligne Pro reste frappant. Pendant que la gamme Flash sort deux versions en trois semaines, le Gemini 3.5 Pro a été repoussé pendant que Google le reconstruisait. Le modèle de travail avance, le modèle haut de gamme attend, et l’écart de rythme entre les deux lignes devient une caractéristique durable de la maison.
Ce que le tarif d’appel change pour une équipe produit
Le prix est le vrai sujet de cette sortie. Gemini 3.7 Flash est facturé 0,75 $ par million de tokens en entrée et 3,75 $ en sortie, mais ce tarif expire le 31 décembre 2026. Au 1er janvier 2027, il passe à 1,50 $ et 7,50 $.
Autrement dit, une équipe qui bascule aujourd’hui construit son modèle de coût sur un prix qui va doubler dans quatre mois et demi. La question n’est pas de savoir si la migration vaut le coup maintenant, elle est de savoir si elle tient encore au tarif de janvier.
Le calcul dépend du profil de charge. Sur des tâches de code réussies du premier coup plus souvent, le gain de qualité absorbe le doublement, parce que le nombre de tentatives baisse. Sur du traitement documentaire en volume, la hausse se voit directement sur la facture.
Cette mécanique de prix d’appel n’est pas nouvelle chez Google. Le tarif d’entrée de gamme grand public avait déjà servi d’arme, quand Google AI Plus est tombé à 4,99 $ pour ouvrir une guerre des prix. La logique est la même côté API, avec une date de fin écrite noir sur blanc.
Côté distribution, le modèle est disponible dans Google AI Studio, Android Studio et Google Antigravity pour les développeurs, sur la Gemini Enterprise Agent Platform pour les entreprises, et dans Gemini Spark pour les abonnés Google AI Pro et Ultra de plus de cent soixante pays, sur un service qui a frôlé le milliard d’utilisateurs mensuels. Les garde-fous CBRN et cyberoffensifs ont été mis à jour au passage.
D’autres articles sur Horizon
- Kimi K3 domine le code d’interface, notre test
- Twitch entraîne l’IA d’Amazon avec vos streams
- Grok 4.6 égale les meilleurs modèles à moitié prix
Le calendrier de janvier met les concurrents sous contrainte
Une sortie tous les vingt et un jours sur le segment le plus utilisé du marché, c’est une cadence que peu de labos peuvent tenir. Le message envoyé aux concurrents porte moins sur les scores que sur la fréquence.
Google avance sur plusieurs fronts en parallèle. La recherche maison pousse aussi des architectures alternatives, comme lorsque DiffusionGemma a généré du texte quatre fois plus vite. Le catalogue s’élargit pendant que la ligne principale accélère.
Le vrai levier reste la distribution. Un modèle poussé dès le premier jour vers la plus large base d’abonnés payants s’impose par défaut sans gagner le moindre benchmark.
Pour les concurrents, la fenêtre à surveiller est celle de janvier. Si Google double ses tarifs comme annoncé, l’écart de prix avec les modèles ouverts chinois et avec les gammes intermédiaires américaines se referme mécaniquement. C’est à ce moment que se jouera la fidélité des équipes qui migrent aujourd’hui.
Reste la question que la fiche technique ne tranche pas. Une cadence aussi rapide oblige les équipes à réévaluer leur modèle toutes les trois semaines, avec le travail de validation que cela implique. À un moment, la vitesse de sortie devient un coût pour celui qui la subit autant qu’un avantage pour celui qui l’impose.
Affaire à suivre sur Horizon.


