Google lance Gemini 3.8 Flash, son troisième modèle Flash en six semaines
Google a annoncé aujourd'hui la sortie de Gemini 3.8 Flash, son troisième modèle de la gamme Flash en seulement six semaines, alors qu'aucun modèle Gemini Pro de niveau frontière n'a été publié depuis début 2026. Le nouveau modèle se décline en deux versions : Gemini 3.8 Flash standard, présenté comme un modèle polyvalent adapté aux tâches agentiques comme au développement logiciel, et Gemini 3.8 Flash Cyber, une variante basée sur les mêmes fondations mais spécialisée dans la détection et la correction de vulnérabilités. Google affirme qu'il s'agit de son meilleur modèle à ce jour en matière de raisonnement et de programmation. Comme lors du lancement de la version 3.7 Flash quelques semaines plus tôt, l'entreprise propose un tarif d'introduction pour l'accès API jusqu'à la fin de l'année : 0,75 dollar par million de tokens en entrée et 3,75 dollars par million en sortie, contre un tarif standard de 1,50 et 7,50 dollars par million de tokens.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de Ars Technica AI. Lire l'article original →
Également couvert par Frandroid, MarkTechPost, The Decoder.
Cette accélération du rythme de sortie sur la gamme Flash, au détriment du très attendu Gemini 3.5 Pro, illustre un changement de stratégie chez Google, qui semble désormais privilégier des modèles plus légers et moins coûteux plutôt que des mises à jour majeures de ses modèles les plus puissants. Pour les développeurs et les entreprises, cela se traduit par un accès à des capacités de raisonnement et de codage améliorées à moindre coût, avec une version spécialisée en cybersécurité qui répond à une demande croissante d'outils d'IA capables d'identifier automatiquement des failles logicielles. La politique tarifaire agressive vise surtout à retenir des clients de plus en plus attentifs aux coûts d'utilisation de l'IA générative.
Cette stratégie de baisse des prix n'est pas isolée : plusieurs laboratoires d'IA concurrents ont récemment réduit le coût de leurs tokens pour maintenir l'intérêt d'entreprises échaudées par la facture cumulée de l'IA générative. En multipliant les versions Flash à un rythme soutenu, environ une toutes les deux semaines, Google semble parier sur l'itération rapide et l'optimisation des coûts plutôt que sur l'attente d'un modèle Pro plus ambitieux mais plus long à développer. Reste à savoir si cette cadence effrénée finira par produire la mise à jour Pro promise, ou si les modèles Flash continueront d'occuper le terrain laissé vacant.
Pas d'impact direct sur la France/UE