Aller au contenu principal
LLMs · Opinion ·

Google lance Gemini 3.7 Flash pour le code et les agents, avec 50% de reduction au lancement

Google déploie Gemini 3.7 Flash, une nouvelle version de son modèle d'intelligence artificielle généraliste centrée sur le code, les workflows agentiques et les tâches de connaissance, accompagnée d'une baisse tarifaire temporaire de 50 % sur l'API. Le lancement intervient seulement trois semaines après celui de Gemini 3.6 Flash, un délai que Google justifie par les retours des développeurs et des avancées algorithmiques. Jusqu'à fin 2026, le modèle coûte 0,75 dollar par million de tokens en entrée et 3,75 dollars par million en sortie ; à partir du 1er janvier 2027, ces tarifs doubleront pour atteindre 1,50 et 7,50 dollars. Côté performances, sur le benchmark FrontierCode 1.1 Main, qui évalue la qualité du code en production, Gemini 3.7 Flash obtient 43,6 %, contre 34,4 % pour son prédécesseur, devançant de justesse Claude Sonnet 5 (42,7 %) et GPT-5.6 Terra (41,3 %). Sur DeepSWE v1.1, il atteint 65,3 % contre 49,0 % auparavant, mais reste derrière GPT-5.6 Terra (69,6 %). Sur Code Arena, son score Elo grimpe à 1588, contre 1538 pour Gemini 3.6 Flash, 1541 pour Claude Sonnet 5 et 1523 pour GPT-5.6 Terra. Google n'a en revanche annoncé aucune date de sortie pour son modèle phare Gemini 3.5 Pro, pourtant décrit comme en phase de test chez des partenaires, selon Reuters et Axios.

2 min de lecturePertinence 67
Source

Résumé et traduction réalisés par Le Fil IA à partir de VentureBeat AI. Lire l'article original →

Également couvert par DeepMind Blog.

Pour les équipes techniques qui déploient des agents de codage à grande échelle, la combinaison de gains de qualité et de coûts d'inférence réduits change concrètement l'équation économique. Google affirme que 3.7 Flash s'adapte mieux aux blocages, clarifie davantage les intentions ambiguës et suit les instructions avec plus de rigueur, ce qui réduit en théorie le nombre d'interventions humaines nécessaires pour mener une tâche à terme. Le même principe s'applique aux agents métiers qui manipulent documents et applications, où un appel d'outil mal interprété peut faire dérailler un workflow entier. Le remise tarifaire, valable jusqu'à fin 2026, offre aux entreprises une fenêtre de plusieurs mois pour vérifier si ces gains d'intelligence se traduisent réellement par une baisse du coût total d'exploitation avant la hausse des prix programmée.

Ce lancement illustre aussi une inflexion stratégique chez Google, qui délaisse temporairement l'optimisation de la vitesse pure au profit de la qualité d'exécution. Alors que Gemini 3.6 Flash cherchait à réduire le nombre d'étapes de raisonnement et d'appels d'outils pour limiter les boucles d'exécution incontrôlées, Gemini 3.7 Flash privilégie désormais un effort de planification plus soutenu, jugé plus utile qu'une simple minimisation du nombre d'étapes. Google DeepMind revendique des progrès en débogage, en résolution de problèmes et en génération d'applications web fonctionnelles en moins de requêtes. Cette accélération sur la gamme Flash intervient toutefois alors que le modèle phare Gemini 3.5 Pro se fait toujours attendre, laissant planer une incertitude sur le calendrier complet de la famille Gemini face à une concurrence, Anthropic et OpenAI en tête, qui multiplie elle aussi les mises à jour rapides.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

À lire ensuite

01Gemini 3.6 Flash de Google vise a reduire les couts de tokens pour les agents en entreprise50AI NewsLLMs 02Google présente Gemini 3.5 Flash à I/O 2026 : un modèle plus rapide et moins cher pour les agents IA et le code53MarkTechPostLLMs 03Google temporise avec Gemini 3.5 Pro : le lancement aurait été repoussé42Le Big DataLLMs 
Dossier · GeminiSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.