Google affirme que son nouveau modèle Gemini 3.8 Flash "travaille plus" mais pourrait coûter plus cher
Google a lancé Gemini 3.8 Flash quelques semaines seulement après Gemini 3.7 Flash, poursuivant le rythme soutenu de mises à jour de sa gamme de modèles légers. L'entreprise affirme que ce nouveau modèle "travaille plus dur" que son prédécesseur en exécutant davantage d'étapes de raisonnement sur les tâches complexes et en appelant les outils de manière itérative. La tarification d'introduction reste identique à celle de la version 3.7 : 0,75 dollar par million de tokens en entrée et 3,75 dollars par million de tokens en sortie. Google prévient toutefois que le modèle pourrait consommer davantage de tokens pour maximiser ses performances, en particulier aux niveaux d'effort les plus élevés, ce qui pourrait alourdir la facture finale malgré des prix unitaires inchangés. Les développeurs qui souhaitent limiter leur consommation de tokens peuvent continuer à utiliser Gemini 3.7 Flash.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de The Verge AI. Lire l'article original →
Cette annonce illustre un enjeu concret pour les entreprises qui construisent des produits sur l'API Gemini : un prix par token stable ne garantit pas un coût total stable, puisque la profondeur de raisonnement du modèle peut faire varier fortement le volume de tokens consommés par requête. Pour les équipes techniques, cela complique la prévision budgétaire et impose de choisir entre puissance de raisonnement accrue et maîtrise des dépenses selon les cas d'usage.
Ce lancement s'inscrit dans une compétition intense entre grands laboratoires d'IA, où Google, OpenAI et Anthropic multiplient les itérations rapides de leurs modèles rapides et économiques, en misant de plus en plus sur des mécanismes de "niveaux d'effort" ajustables plutôt que sur de simples gains bruts de performance. Les premières réactions à la sortie de Gemini 3.8 Flash ont d'ailleurs déjà commencé à circuler, signe que les utilisateurs testent activement ce compromis entre coût et capacité de raisonnement.
Pas d'impact direct sur la France/UE, si ce n'est pour les entreprises européennes qui intègrent l'API Gemini dans leurs produits et doivent revoir leurs prévisions de couts.