Aller au contenu principal
Google déploie enfin des outils pour contrôler les coûts de l’API Gemini
OutilsBlog du Modérateur · 1 min de lecture

Google déploie enfin des outils pour contrôler les coûts de l’API Gemini

Source originale ↗·

Google répond enfin à une demande récurrente des développeurs : l'API Gemini s'équipe de mécanismes concrets pour maîtriser les dépenses. Au programme, des contrôles budgétaires par projet, un nouveau système de paliers tarifaires et des tableaux de bord dédiés au suivi des coûts et de l'usage.

Cette mise à jour est significative pour les équipes qui intègrent Gemini dans leurs applications. Sans garde-fous budgétaires natifs, les développeurs s'exposaient à des factures imprévisibles en cas de pic de trafic ou d'usage non anticipé, un frein réel à l'adoption en production. L'arrivée de ces outils rapproche l'API Gemini des standards proposés par ses concurrents directs comme OpenAI ou Anthropic, qui disposent depuis plus longtemps de mécanismes de plafonnement et de monitoring granulaire.

Les nouvelles fonctionnalités s'articulent autour de trois axes : des limites budgétaires configurables au niveau du projet, un système de paliers permettant de segmenter l'accès selon les besoins, et des tableaux de bord offrant une visibilité en temps réel sur la consommation et les coûts. Cette architecture par projet est particulièrement adaptée aux organisations qui gèrent plusieurs applications ou équipes consommant l'API simultanément.

Ces ajouts positionnent Google dans une logique de maturité opérationnelle pour son offre Gemini, une étape nécessaire pour convaincre les entreprises de passer de l'expérimentation à un déploiement à grande échelle.

Impact France/UE

Les développeurs européens utilisant l'API Gemini peuvent désormais configurer des plafonds de dépenses et suivre leur consommation en temps réel.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Google déploie son IA Gemini personnalisée pour tous les Américains
1The Verge AI 

Google déploie son IA Gemini personnalisée pour tous les Américains

Google franchit un cap important dans la démocratisation de son intelligence artificielle en ouvrant Personal Intelligence à l'ensemble des utilisateurs américains disposant d'un compte gratuit. Cette fonctionnalité, jusqu'ici réservée aux abonnés Google AI Pro et AI Ultra, permet à Gemini d'exploiter les données personnelles de l'utilisateur pour enrichir ses réponses et suggestions. L'enjeu est considérable : en connectant les applications du quotidien à son IA, Google crée une couche de personnalisation qui différencie fondamentalement Gemini des assistants IA génériques. L'accès aux données personnelles permet de contextualiser les interactions de manière inédite, renforçant l'utilité de l'assistant dans les usages réels, et consolidant l'écosystème Google comme porte d'entrée privilégiée vers l'IA. Concrètement, Personal Intelligence se connecte à des services comme YouTube, Google Photos et Gmail pour alimenter Gemini en contexte. La fonctionnalité est désormais accessible via trois points d'entrée : le mode AI Mode dans la recherche, Gemini dans Chrome, et l'application Gemini elle-même. La restriction reste notable : seuls les comptes personnels sont éligibles, les comptes professionnels, entreprises et établissements scolaires en sont exclus pour l'instant. Cette ouverture aux comptes gratuits marque une stratégie d'acquisition massive : en supprimant la barrière payante, Google expose des millions d'utilisateurs à une IA intimement liée à leurs données, ce qui devrait accélérer l'adoption tout en renforçant l'ancrage dans l'écosystème propriétaire face à la concurrence d'OpenAI et Anthropic.

OutilsOutil
1 source
Google lance une API d'agents gérés : déploiement simplifié, mais moins de contrôle sur l'exécution
2VentureBeat AI 

Google lance une API d'agents gérés : déploiement simplifié, mais moins de contrôle sur l'exécution

Lors de Google I/O, Google a annoncé les Managed Agents dans son API Gemini, un service conçu pour réduire à un simple appel API ce qui nécessitait auparavant plusieurs semaines de travail d'infrastructure. Disponible en préversion via de nouveaux modèles personnalisés dans Google AI Studio, ce service s'accompagne du lancement du CLI Antigravity. Concrètement, avant même d'écrire le moindre agent, les équipes passaient des jours à configurer des environnements d'exécution, gérer des sandboxes et câbler l'infrastructure d'appels d'outils. Google promet désormais d'absorber toute cette complexité dans sa plateforme, en optimisant conjointement le modèle, le harnais d'exécution et le sandbox dans des environnements sécurisés entièrement gérés par Google. L'impact pour les équipes de développement est direct : en déléguant la couche d'exécution à Google, les développeurs peuvent se concentrer sur le comportement métier spécifique de leurs agents et itérer à un rythme radicalement différent. René Sultan, responsable chez Ramp, cité dans l'annonce de Google, résume ce basculement : le runtime d'agent passe désormais dans la plateforme, libérant les développeurs de la gestion du sandbox, de l'infrastructure et de la boucle d'exécution. Pour les entreprises qui démarrent avec les agents, cette proposition est séduisante. Elle supprime la plupart des obstacles au déploiement tout en conservant un contrôle sur le comportement applicatif. La concurrence s'intensifie sur ce segment précis du marché, ce qui accélère la maturité des outils disponibles pour tous. Ce mouvement s'inscrit dans une transformation plus large de l'architecture des systèmes multi-agents. Jusqu'à récemment, l'orchestration reposait sur des frameworks indépendants qui se plaçaient au-dessus du modèle, laissant aux équipes le contrôle du routage et de l'exécution. Cette couche est désormais absorbée par les plateformes elles-mêmes. Anthropic a adopté une approche différente avec ses Claude Managed Agents, en plaçant l'orchestration au niveau du modèle plutôt que sur une plateforme d'exécution séparée. AWS, via Bedrock AgentCore, propose pour sa part des harnais managés pour simplifier le déploiement initial. Google pousse vers une intégration verticale plus poussée, contrôlant l'ensemble de la pile. Ce choix n'est pas sans risques : Arie Trouw, fondateur et PDG de XYO, avertit que remplacer des services déterministes par des services probabilistes peut introduire des comportements imprévisibles pour les utilisateurs, voire de la corruption de données. Un rappel que l'enthousiasme autour des agents ne doit pas occulter les arbitrages fondamentaux entre contrôle, fiabilité et vitesse de développement.

UELes équipes de développement françaises peuvent tester cette API en préversion via Google AI Studio, réduisant significativement la complexité de déploiement d'agents IA.

💬 L'infra agent, c'était le vrai mur avant de démarrer. Des semaines à configurer des sandboxes, à câbler les appels d'outils, avant même d'avoir une ligne de logique métier qui tourne, et Google absorbe tout ça dans un appel API. Reste que troquer du déterministe contre du probabiliste pour gagner en vitesse de déploiement, ça va faire des dégâts chez quelques équipes qui n'auront pas lu les petites lignes.

OutilsOutil
1 source
Workday et Google Cloud déploient des agents IA pour les RH et la finance
3Le Big Data 

Workday et Google Cloud déploient des agents IA pour les RH et la finance

Workday et Google Cloud ont annoncé le 29 mai 2026 une extension significative de leur partenariat, visant à intégrer les agents IA de Workday directement dans Gemini Enterprise, la suite collaborative de Google. Concrètement, l'agent Sana Self-Service de Workday s'imbrique désormais dans l'environnement Google que les collaborateurs utilisent au quotidien. Un salarié peut ainsi consulter son solde de congés, récupérer un bulletin de paie ou soumettre une demande d'absence sans jamais ouvrir l'interface Workday. Les managers gagnent eux aussi en autonomie : approbation de feuilles de temps, lancement d'évaluations de performance, accès aux objectifs d'équipe, tout cela depuis une interface conversationnelle unique. Côté finance, les utilisateurs peuvent interroger les politiques de dépenses et initier des démarches administratives sans changer d'outil. L'annonce confirme par ailleurs que Gemini devient le modèle d'IA par défaut de Sana dans Workday, remplaçant les solutions précédemment utilisées. L'enjeu est considérable pour les grandes organisations, qui souffrent depuis des années d'une fragmentation logicielle coûteuse : les équipes jonglent quotidiennement entre suites RH, ERP financiers, outils collaboratifs et plateformes analytiques pour accomplir des tâches souvent élémentaires. En ancrant les agents directement dans les outils de travail existants, Workday et Google Cloud cherchent à éliminer ces frictions et à accélérer l'exécution des processus métiers. Pour les directions RH et financières, qui manipulent des données sensibles soumises à des réglementations strictes, l'intégration apporte aussi les capacités de raisonnement avancé, le support multimodal et le traitement multilingue de Gemini, tout en maintenant les garde-fous métier, les règles d'approbation et les contrôles de conformité propres à Workday. Ce rapprochement s'inscrit dans une tendance de fond qui voit les grands éditeurs de logiciels d'entreprise transformer leurs plateformes en orchestrateurs d'agents IA. Workday, qui gère les ressources humaines et les finances de milliers de grandes entreprises mondiales, dispose d'un levier stratégique majeur : ses données métier structurées, longtemps cloisonnées dans ses interfaces propriétaires. En ouvrant ces données aux agents via Gemini, l'éditeur américain positionne sa plateforme comme un nœud central des architectures multi-agents qui émergent dans les grands groupes. Pour Google Cloud, faire de Gemini le moteur par défaut de Sana représente une victoire commerciale et un signal fort envoyé à l'ensemble de l'écosystème enterprise, dans un marché où Microsoft, avec Copilot intégré à Office 365 et Dynamics, exerce une pression concurrentielle intense. Les prochaines étapes du partenariat devraient porter sur l'orchestration de workflows plus complexes, impliquant plusieurs agents agissant en coordination sur des processus bout-en-bout.

UELes grandes entreprises françaises et européennes utilisant Workday et Google Workspace pourraient réduire la fragmentation logicielle de leurs équipes RH et finance grâce à cette intégration.

OutilsOutil
1 source
Google adopte l'Interactions API comme interface par défaut pour ses modèles et agents Gemini
4The Decoder 

Google adopte l'Interactions API comme interface par défaut pour ses modèles et agents Gemini

Google DeepMind a officialisé l'Interactions API comme nouvelle interface par défaut pour ses modèles et agents Gemini. Ce changement architectural remplace l'ancienne API generateContent, jusqu'ici l'interface standard pour interroger les modèles Gemini via le Google AI Studio et les SDK associés. La nouvelle interface repose sur un schéma simplifié structuré autour d'étapes typées, abandonnant l'organisation précédente basée sur des rôles. Désormais, toutes les nouvelles fonctionnalités destinées aux agents seront exclusivement disponibles via cette API. Ce basculement a des conséquences directes pour les développeurs qui ont construit des applications ou des pipelines sur l'API generateContent : ils devront migrer vers le nouveau schéma pour accéder aux futures capacités. L'approche par étapes typées vise à rendre l'intégration plus claire et moins ambiguë, notamment pour les scénarios agentiques complexes où plusieurs actions s'enchaînent. En gelant les nouvelles fonctionnalités sur l'ancienne API, Google crée une pression de migration qui devrait accélérer l'adoption du nouveau standard. Ce choix s'inscrit dans une tendance de fond chez les grands fournisseurs de modèles : aligner l'interface de programmation sur les besoins des systèmes agentiques, qui nécessitent une gestion fine des états, des outils et des flux d'exécution. Google, qui fait face à une concurrence intense d'OpenAI et Anthropic sur le segment des agents IA, cherche à offrir une base technique plus cohérente pour les développeurs. L'Interactions API représente ainsi moins un simple changement d'interface qu'une réorientation stratégique de la plateforme Gemini vers les usages agentiques de nouvelle génération.

UELes développeurs européens ayant intégré l'API generateContent de Gemini dans leurs applications devront planifier une migration vers l'Interactions API pour continuer à accéder aux nouvelles fonctionnalités agentiques de Google.

OutilsOutil
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic