Le vrai prix de Gemini 3.1 à 3.8 : coût, tokens et performances face à nos prompts
Next.ink a publié une analyse du coût réel de l'IA Gemini de Google, menée sur les modèles Gemini 3.1 à 3.8 Flash, la dernière version en date. Le média a interrogé l'API pour compter les tokens en entrée et en sortie, y compris ceux du raisonnement. Il a repris les trois prompts déjà utilisés pour Claude et ChatGPT. Le premier est une devinette de parenté. Le deuxième demande un carnet de voyage de Bayonne à Montpellier en voiture électrique, avec une charge limitée à 30 kW. Le troisième réclame une extension Chrome et Firefox qui inverse titres et sous-titres sur Next.ink. Le résultat principal est que Gemini consomme nettement moins de tokens que ses concurrents et coûte moins cher. Une requête sur les derniers modèles revient en moyenne à environ 1,2 centime. En revanche, aucun des modèles ne réussit correctement le prompt Extension. Le protocole comporte une nouveauté : les extensions sont maintenant vérifiées automatiquement avec Playwright et Chromium. Elles sont chargées sur une fausse page HTML qui reprend la structure du site, puis testées en direct sur Next.ink.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de Next INpact. Lire l'article original →
Ces résultats comptent d'abord pour les développeurs et les entreprises qui intègrent Gemini par API. Ils y trouvent un modèle sobre, dont la facture par requête reste très basse. Google dispose d'un atout particulier. Son IA est intégrée à de nombreux produits, à commencer par Android, donc la question du coût pèse moins que chez Anthropic ou OpenAI. L'échec sur la génération d'extension rappelle toutefois qu'un modèle économe n'est pas forcément fiable sur les tâches de programmation concrètes. L'ajout d'une vérification automatisée répond à une demande récurrente des lecteurs. Elle permet de distinguer une réponse qui paraît plausible d'un code qui fonctionne. Les deux autres prompts sont encore en cours de validation et feront l'objet d'un prochain article.
La grille tarifaire donne une idée des choix de Google. Les Gemini 3.6 à 3.8 sont facturés 0,75 dollar par million de tokens en entrée et 3,75 dollars en sortie, mais seulement jusqu'au 31 décembre 2026. Ces prix doubleront le 1er janvier 2027, pour atteindre 1,5 et 7,5 dollars. La 3.5 Flash coûte 1,5 et 9 dollars, la 3.1 Flash Lite 0,25 et 1,5 dollar, et la 3.1 Pro 2 et 12 dollars. Google propose aussi plusieurs niveaux de réflexion : minimal, low, medium et high pour les versions 3.1 à 3.6, et seulement les trois derniers pour la 3.1 Pro, la 3.7 et la 3.8. Cette analyse suit celles consacrées à Claude, qui portait sur 11 modèles, et à ChatGPT, de GPT-3.5 à GPT-6. Ces tarifs promotionnels devraient inciter à intégrer les modèles récents avant la hausse. Le vrai coût de Gemini se jugera donc à partir de 2027.
Next.ink, média français, publie ce comparatif chiffré des coûts de l'API Gemini, utile aux développeurs et entreprises françaises qui doivent anticiper la hausse tarifaire du 1er janvier 2027.