Seulement trois semaines après Gemini 3.6 Flash, Google lance déjà Gemini 3.7 Flash, un nouveau modèle conçu en priorité pour le développement logiciel, les agents IA et les workflows complexes. L’entreprise annonce d’importants gains de performance tout en divisant par deux son tarif de lancement. Une stratégie qui intervient alors que son prochain modèle Pro se fait toujours attendre.
Gemini 3.7 Flash : des progrès en code et développement web
Présenté le 13 août comme son « modèle de travail le plus intelligent » pour le code et les agents IA, Gemini 3.7 Flash serait directement issu des retours des développeurs et d’innovations algorithmiques. Google revendique notamment une progression importante en programmation dans plusieurs benchmarks : le modèle atteint 43,6 % sur FrontierCode 1.1 Main, contre 34,4 % pour Gemini 3.6 Flash, et 65,3 % sur DeepSWE v1.1, contre 49 % auparavant.
Le développement web fait également partie des points forts mis en avant par Google. Gemini 3.7 Flash obtient un score Elo de 1 588 sur WebDev Arena, contre 1 538 pour son prédécesseur. Il serait capable de produire des interfaces plus conformes à une capture d’écran, une image ou un « design system », c’est-à-dire un guide définissant une identité visuelle, ainsi que des applications plus complètes avec moins de prompts.
Le modèle progresserait aussi dans le traitement de documents complexes, notamment en finance, en droit et dans les sciences. Sur GDP.pdf, il atteint 34 % contre 22 % pour Gemini 3.6 Flash, tandis que son score sur AutomationBench passe de 17 % à 30,4 %. Ces résultats doivent toutefois être distingués des classements globaux : sur WebDev Arena, Gemini 3.7 Flash est indiqué à la huitième place, notamment derrière Claude Opus 5, le modèle chinois Kimi K3 et Grok 4.6, sorti lui aussi il y a quelques jours.

Un modèle conçu pour les agents IA, à commencer par Gemini Spark
Au-delà des performances brutes, Google insiste sur la manière dont Gemini 3.7 Flash exécute les tâches. Le modèle s’adapte davantage aux blocages, peut demander des précisions lorsque l’intention n’est pas suffisamment claire et suit plus fidèlement les instructions. Il consacrerait également davantage d’efforts à la planification en plusieurs étapes et à l’utilisation d’outils, avec pour objectif de limiter les interventions humaines et les tentatives infructueuses.
Cette orientation se retrouve dans Gemini Spark, l’agent personnel de Google capable d’agir en continu depuis le cloud. Depuis le 13 août, Spark utilise Gemini 3.7 Flash pour les abonnés Google AI Pro et Ultra dans plus de 160 pays. Le modèle doit notamment améliorer les interactions avec Google Workspace pour des tâches comme la gestion de fichiers, la rédaction d’e-mails ou la mise à jour de documents de suivi.
Gemini 3.7 Flash est également accessible via Google Antigravity, l’API Gemini dans Google AI Studio, qui sert à créer des programmes et applications par le vibe coding, Android Studio, Gemini Enterprise Agent Platform et l’application Gemini Enterprise. Il peut ainsi être utilisé aussi bien pour des applis et agents que pour des usages professionnels.
Tarifs de Gemini 3.7 Flash et développement de Gemini 3.5 Pro
Jusqu’au 31 décembre 2026, Google facture Gemini 3.7 Flash 0,75 $ par million de tokens en entrée et 3,75 $ en sortie. Ces tarifs sont deux fois inférieurs à ceux du lancement de Gemini 3.6 Flash. À partir du 1er janvier 2027, ils doivent doubler pour atteindre respectivement 1,50 et 7,50 $.
Google semble ainsi privilégier le rapport entre performances, vitesse et coût plutôt que la recherche du meilleur modèle. Une stratégie particulièrement importante pour les agents, dont l’utilisation à grande échelle peut rapidement faire grimper les dépenses. Elle place néanmoins l’entreprise face à une concurrence chinoise agressive sur les prix : DeepSeek, une des meilleures alternatives à ChatGPT à petit prix, proposerait ainsi certains modèles rapides à environ 0,14 $ par million de tokens en entrée. Les IA Qwen, Kimi, GLM et MiniMax participent également à cette pression sur les tarifs.
Cette offensive intervient enfin dans un contexte délicat pour les modèles haut de gamme de Google. Gemini 3.5 Pro, qui avait été annoncé pour juin, n’est toujours pas disponible en août. Des informations rapportées par plusieurs médias évoquent des difficultés internes concernant notamment le code et la fiabilité du modèle. De plus, selon des rumeurs, Google aurait choisi de concentrer ses efforts sur Gemini 4, la génération suivante. Aucun calendrier officiel n’a cependant été communiqué pour ce prochain modèle.
A ces problèmes techniques s’ajoute le départ de 4 chercheurs en IA de Google, dont Jeff Dean, l’un des responsables techniques de Gemini, parti le 5 août pour cofonder Discovery Loop. Par ailleurs, Demis Hassabis a cédé la direction opérationnelle de Google DeepMind pour devenir président du laboratoire et Chief Scientist d’Alphabet.
Avec Gemini 3.7 Flash, Google choisit donc de renforcer une gamme rapide, abordable et adaptée aux agents plutôt que de dévoiler immédiatement un nouveau modèle Pro. Reste à voir si cette stratégie suffira à reprendre l’avantage sur un marché où les performances, mais aussi le coût d’exploitation, sont devenus décisifs.
Certains liens de cet article peuvent être affiliés.
