Google joue gros pour gagner le cœur et le portefeuille des développeurs.
Trois semaines seulement après avoir présenté Gemini 3.6 Flash, Google a annoncé jeudi Gemini 3.7 Flash, que l’entreprise qualifie de « modèle polyvalent le plus intelligent à ce jour pour le codage et les agents ».
Google affirme que les retours des développeurs et les améliorations algorithmiques ont contribué à cette sortie accélérée, qui intensifie sa concurrence avec OpenAI et Anthropic sur le marché du codage par IA et des workflows agentiques.
Si de nombreux modèles d’IA excellent pour répondre aux questions, Gemini 3.7 Flash est conçu pour passer à l’action. Selon Google, le modèle affiche des progrès substantiels en ingénierie logicielle, dans les métiers de la connaissance et dans les workflows de développement web. L’entreprise affirme que le modèle s’adapte mieux aux obstacles, clarifie l’intention lorsque c’est nécessaire et suit les instructions avec davantage de fidélité. Google indique que le modèle consacre plus d’efforts à la planification en plusieurs étapes et aux appels d’outils, ce qui pourrait réduire le besoin de supervision manuelle.
Les résultats de benchmarks publiés par Google montrent des progrès substantiels par rapport à Gemini 3.6 Flash, même si ces chiffres n’ont pas été vérifiés indépendamment. Au benchmark FrontierCode 1.1 Main, qui évalue les capacités de codage, Gemini 3.7 Flash a obtenu 43,6 %, contre 34,4 % pour son prédécesseur. Il a également enregistré une nette amélioration sur DeepSWE v1.1, une évaluation d’ingénierie logicielle, passant à 65,3 %, contre 48,6 %, selon un article de blog de Google.
Au-delà du simple codage, le modèle est conçu pour prendre en charge des tâches de développement web plus fonctionnelles, avec un score de 1 588 au classement Elo WebDev Arena d’Arena.ai, contre 1 538 pour Gemini 3.6 Flash. Dans des domaines riches en connaissances comme la finance, le droit et les biosciences, il a obtenu 34,0 % au benchmark GDP.pdf, contre 22,0 % auparavant, et atteint 30,4 % sur AutomationBench pour des workflows métier du monde réel, contre seulement 17,0 % précédemment. Les progrès enregistrés dans les benchmarks ne se traduisent pas nécessairement par une meilleure fiabilité, une latence réduite ou un coût inférieur en production.
Google réduit de moitié le prix de lancement de son API
L’un des aspects les plus frappants de ce lancement est peut-être son prix. Google propose Gemini 3.7 Flash à un tarif de lancement de 0,75 dollar par million de tokens d’entrée et de 3,75 dollars par million de tokens de sortie jusqu’à la fin de 2026, soit exactement la moitié du coût initial de Gemini 3.6 Flash.
Google parie sur le fait que les gains de performances annoncés et la tarification de lancement agressive inciteront les développeurs et les entreprises qui créent des agents IA à les adopter. Pour les entreprises qui exécutent à grande échelle des agents IA très consommateurs de tokens, la remise pourrait réduire les coûts d’exploitation à court terme.
Gemini Spark adopte le nouveau modèle
Gemini 3.7 Flash est également intégré immédiatement à Gemini Spark, l’agent IA personnel de Google proposé aux abonnés Google AI Pro et Ultra dans plus de 160 pays. L’entreprise affirme que cette mise à jour améliore l’efficacité de Spark pour les métiers de la connaissance grâce à une meilleure utilisation des outils des applications Google Workspace, offrant une précision et une qualité des résultats accrues pour les workflows complexes mobilisant plusieurs compétences.
Google affirme que le modèle intègre des mesures de protection mises à jour contre les abus liés aux menaces chimiques, biologiques, radiologiques et nucléaires, ainsi qu’aux activités offensives de cybersécurité.
Disponibilité et réserves
Le passage rapide de Gemini 3.6 Flash à Gemini 3.7 Flash montre à quel point Google met à jour rapidement ses modèles plus compacts face à la concurrence d’OpenAI et d’Anthropic. Toutefois, l’éléphant dans la pièce reste Gemini 3.5 Pro, le modèle phare de Google. En juillet, Google avait déclaré que le modèle Pro était testé avec des partenaires et qu’il arriverait « bientôt », mais l’entreprise n’a fourni aucune nouvelle information sur le calendrier lors de l’annonce d’hier.
Même si le prix de lancement réduit est attractif, il faut noter que ces tarifs ne sont garantis que jusqu’à la fin de l’année. À partir du 1er janvier 2027, les prix doivent passer à 1,50 dollar par million de tokens d’entrée et à 7,50 dollars par million de tokens de sortie, une hausse importante que les entreprises devront intégrer à leur planification à long terme.
Les développeurs peuvent accéder dès aujourd’hui à Gemini 3.7 Flash via l’API Gemini de Google, AI Studio, Android Studio et Google Antigravity, tandis que les entreprises peuvent l’utiliser par l’intermédiaire des plateformes Enterprise AI de Google.
À lire aussi : pour mieux comprendre l’évolution de la gamme d’IA légère de Google, découvrez cinq enseignements clés du lancement de Gemini 3.5 Flash.

