Google lance Gemini 3.7 Flash pour le code et les agents, avec 50% de reduction au lancement
Google déploie Gemini 3.7 Flash, une nouvelle version de son modèle d'intelligence artificielle généraliste centrée sur le code, les workflows agentiques et les tâches de connaissance, accompagnée d'une baisse tarifaire temporaire de 50 % sur l'API. Le lancement intervient seulement trois semaines après celui de Gemini 3.6 Flash, un délai que Google justifie par les retours des développeurs et des avancées algorithmiques. Jusqu'à fin 2026, le modèle coûte 0,75 dollar par million de tokens en entrée et 3,75 dollars par million en sortie ; à partir du 1er janvier 2027, ces tarifs doubleront pour atteindre 1,50 et 7,50 dollars. Côté performances, sur le benchmark FrontierCode 1.1 Main, qui évalue la qualité du code en production, Gemini 3.7 Flash obtient 43,6 %, contre 34,4 % pour son prédécesseur, devançant de justesse Claude Sonnet 5 (42,7 %) et GPT-5.6 Terra (41,3 %). Sur DeepSWE v1.1, il atteint 65,3 % contre 49,0 % auparavant, mais reste derrière GPT-5.6 Terra (69,6 %). Sur Code Arena, son score Elo grimpe à 1588, contre 1538 pour Gemini 3.6 Flash, 1541 pour Claude Sonnet 5 et 1523 pour GPT-5.6 Terra. Google n'a en revanche annoncé aucune date de sortie pour son modèle phare Gemini 3.5 Pro, pourtant décrit comme en phase de test chez des partenaires, selon Reuters et Axios.
Résumé et traduction réalisés par Le Fil IA à partir de VentureBeat AI. Lire l'article original →
Également couvert par DeepMind Blog.
Pour les équipes techniques qui déploient des agents de codage à grande échelle, la combinaison de gains de qualité et de coûts d'inférence réduits change concrètement l'équation économique. Google affirme que 3.7 Flash s'adapte mieux aux blocages, clarifie davantage les intentions ambiguës et suit les instructions avec plus de rigueur, ce qui réduit en théorie le nombre d'interventions humaines nécessaires pour mener une tâche à terme. Le même principe s'applique aux agents métiers qui manipulent documents et applications, où un appel d'outil mal interprété peut faire dérailler un workflow entier. Le remise tarifaire, valable jusqu'à fin 2026, offre aux entreprises une fenêtre de plusieurs mois pour vérifier si ces gains d'intelligence se traduisent réellement par une baisse du coût total d'exploitation avant la hausse des prix programmée.
Ce lancement illustre aussi une inflexion stratégique chez Google, qui délaisse temporairement l'optimisation de la vitesse pure au profit de la qualité d'exécution. Alors que Gemini 3.6 Flash cherchait à réduire le nombre d'étapes de raisonnement et d'appels d'outils pour limiter les boucles d'exécution incontrôlées, Gemini 3.7 Flash privilégie désormais un effort de planification plus soutenu, jugé plus utile qu'une simple minimisation du nombre d'étapes. Google DeepMind revendique des progrès en débogage, en résolution de problèmes et en génération d'applications web fonctionnelles en moins de requêtes. Cette accélération sur la gamme Flash intervient toutefois alors que le modèle phare Gemini 3.5 Pro se fait toujours attendre, laissant planer une incertitude sur le calendrier complet de la famille Gemini face à une concurrence, Anthropic et OpenAI en tête, qui multiplie elle aussi les mises à jour rapides.
Pas d'impact direct sur la France/UE