Aller au contenu principal
LLMs · Actu ·

Google affirme que son nouveau modèle Gemini 3.8 Flash "travaille plus" mais pourrait coûter plus cher

Google a lancé Gemini 3.8 Flash quelques semaines seulement après Gemini 3.7 Flash, poursuivant le rythme soutenu de mises à jour de sa gamme de modèles légers. L'entreprise affirme que ce nouveau modèle "travaille plus dur" que son prédécesseur en exécutant davantage d'étapes de raisonnement sur les tâches complexes et en appelant les outils de manière itérative. La tarification d'introduction reste identique à celle de la version 3.7 : 0,75 dollar par million de tokens en entrée et 3,75 dollars par million de tokens en sortie. Google prévient toutefois que le modèle pourrait consommer davantage de tokens pour maximiser ses performances, en particulier aux niveaux d'effort les plus élevés, ce qui pourrait alourdir la facture finale malgré des prix unitaires inchangés. Les développeurs qui souhaitent limiter leur consommation de tokens peuvent continuer à utiliser Gemini 3.7 Flash.

1 min de lecturePertinence 54

Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie

Source

Résumé et traduction réalisés par Le Fil IA à partir de The Verge AI. Lire l'article original →

Cette annonce illustre un enjeu concret pour les entreprises qui construisent des produits sur l'API Gemini : un prix par token stable ne garantit pas un coût total stable, puisque la profondeur de raisonnement du modèle peut faire varier fortement le volume de tokens consommés par requête. Pour les équipes techniques, cela complique la prévision budgétaire et impose de choisir entre puissance de raisonnement accrue et maîtrise des dépenses selon les cas d'usage.

Ce lancement s'inscrit dans une compétition intense entre grands laboratoires d'IA, où Google, OpenAI et Anthropic multiplient les itérations rapides de leurs modèles rapides et économiques, en misant de plus en plus sur des mécanismes de "niveaux d'effort" ajustables plutôt que sur de simples gains bruts de performance. Les premières réactions à la sortie de Gemini 3.8 Flash ont d'ailleurs déjà commencé à circuler, signe que les utilisateurs testent activement ce compromis entre coût et capacité de raisonnement.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE, si ce n'est pour les entreprises européennes qui intègrent l'API Gemini dans leurs produits et doivent revoir leurs prévisions de couts.

À lire ensuite

01Google lance Gemini 3.8 Flash, son troisième modèle Flash en six semaines63Ars Technica AILLMs 02Google lance trois nouveaux modèles Gemini… mais le plus attendu manque à l’appel44Le Big DataLLMs 03Google lance trois nouveaux modèles Gemini Flash, mais son modèle phare 3.5 Pro reste toujours en entraînement48The DecoderLLMs 
Dossier · GeminiSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.