Aller au contenu principal
Google lance une compétence d'agent dans l'API Gemini pour combler les lacunes des modèles IA sur leurs propres SDK
OutilsThe Decoder · 1 min de lecture

Google lance une compétence d'agent dans l'API Gemini pour combler les lacunes des modèles IA sur leurs propres SDK

Source originale ↗·

Google a introduit une nouvelle fonctionnalité baptisée « Agent Skill » dans son API Gemini, conçue pour combler une lacune structurelle des modèles d'IA : leur ignorance des mises à jour de leurs propres SDK survenues après leur date d'entraînement. Ce mécanisme permet au modèle d'accéder dynamiquement à une documentation à jour sur ses propres outils, améliorant significativement la qualité du code généré pour les applications qui utilisent l'API Gemini.

L'impact est concret pour les développeurs : un modèle qui ne connaît pas les dernières versions d'un SDK produit du code obsolète, bogué ou incompatible. En injectant automatiquement les bonnes références au moment de la génération, Google réduit les erreurs d'intégration et accélère le développement d'agents IA, un enjeu critique alors que l'écosystème évolue plusieurs fois par mois.

Ce problème de « knowledge cutoff » est universel à tous les grands modèles de langage : ChatGPT, Claude et Gemini souffrent tous d'un décalage entre leur entraînement et l'état réel du monde. La réponse de Google illustre une tendance plus large, plutôt que d'attendre le prochain cycle d'entraînement, les éditeurs construisent des couches de récupération dynamique pour maintenir les modèles à jour en temps réel sur des domaines critiques comme leurs propres API.

Impact France/UE

Les développeurs et entreprises françaises intégrant des agents IA dans leurs produits bénéficient directement d'une réduction des erreurs d'intégration liées au knowledge cutoff des SDK.

💬 L'analyse de Mathieu

C'est un problème que je rencontre toutes les semaines en intégrant des SDK qui bougent vite. Google répond d'une façon élégante : plutôt que d'attendre le prochain cycle d'entraînement, ils injectent la doc à jour directement au moment de la génération, ce qui évite les erreurs bêtes sur des méthodes dépréciées depuis trois mois. Reste à voir si ça scale quand tous les éditeurs adoptent cette logique, mais c'est clairement la bonne direction.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Google adopte l'Interactions API comme interface par défaut pour ses modèles et agents Gemini
1The Decoder 

Google adopte l'Interactions API comme interface par défaut pour ses modèles et agents Gemini

Google DeepMind a officialisé l'Interactions API comme nouvelle interface par défaut pour ses modèles et agents Gemini. Ce changement architectural remplace l'ancienne API generateContent, jusqu'ici l'interface standard pour interroger les modèles Gemini via le Google AI Studio et les SDK associés. La nouvelle interface repose sur un schéma simplifié structuré autour d'étapes typées, abandonnant l'organisation précédente basée sur des rôles. Désormais, toutes les nouvelles fonctionnalités destinées aux agents seront exclusivement disponibles via cette API. Ce basculement a des conséquences directes pour les développeurs qui ont construit des applications ou des pipelines sur l'API generateContent : ils devront migrer vers le nouveau schéma pour accéder aux futures capacités. L'approche par étapes typées vise à rendre l'intégration plus claire et moins ambiguë, notamment pour les scénarios agentiques complexes où plusieurs actions s'enchaînent. En gelant les nouvelles fonctionnalités sur l'ancienne API, Google crée une pression de migration qui devrait accélérer l'adoption du nouveau standard. Ce choix s'inscrit dans une tendance de fond chez les grands fournisseurs de modèles : aligner l'interface de programmation sur les besoins des systèmes agentiques, qui nécessitent une gestion fine des états, des outils et des flux d'exécution. Google, qui fait face à une concurrence intense d'OpenAI et Anthropic sur le segment des agents IA, cherche à offrir une base technique plus cohérente pour les développeurs. L'Interactions API représente ainsi moins un simple changement d'interface qu'une réorientation stratégique de la plateforme Gemini vers les usages agentiques de nouvelle génération.

UELes développeurs européens ayant intégré l'API generateContent de Gemini dans leurs applications devront planifier une migration vers l'Interactions API pour continuer à accéder aux nouvelles fonctionnalités agentiques de Google.

OutilsOutil
1 source
Google Bedrock lance des compétences d'agent pour les politiques de raisonnement automatisé
2AWS ML Blog 

Google Bedrock lance des compétences d'agent pour les politiques de raisonnement automatisé

Amazon Web Services a publié une suite de six Agent Skills pour automatiser le cycle de vie complet des politiques Automated Reasoning d'Amazon Bedrock, une fonctionnalité qui valide les réponses des IA générative par la logique formelle plutôt que par échantillonnage statistique. Les Agent Skills sont un format ouvert conçu par Anthropic qui permet d'enrichir un agent de codage avec des connaissances spécialisées sur un service ou domaine précis. Grâce à ce format ouvert, la suite s'installe dans n'importe quel agent compatible, notamment Kiro, Claude Code, Cursor et Codex, et s'active automatiquement dès que l'utilisateur aborde une tâche liée aux politiques de raisonnement automatisé. Chaque politique repose sur des règles écrites dans un sous-ensemble de SMT-LIB, un format standard utilisé par les démonstrateurs de théorèmes automatiques, et nécessite un réglage fin des descriptions de variables pour que le service traduise correctement le langage des utilisateurs. Les six compétences couvrent chacune une étape du cycle de vie : la première crée une politique à partir d'un document source, puis d'autres prennent le relais pour tester, diagnostiquer les échecs et déployer une version validée derrière un garde-fou. Chaque compétence tient dans un fichier d'instructions court, appuyé par de petits scripts exécutables qui appellent directement les API Automated Reasoning de Bedrock, et toutes partagent un même document de référence décrivant la surface de l'API, les types de résultats et la syntaxe des règles. Cette automatisation répond à un problème concret : construire une bonne politique de raisonnement automatisé demande un apprentissage exigeant, et le cycle de vie du service impose des contraintes techniques faciles à mal négocier lorsqu'on travaille manuellement dans la console. Un contrôle Automated Reasoning fonctionne en deux temps : des modèles de fondation traduisent d'abord la question et la réponse en logique formelle en associant le langage naturel aux variables de la politique, puis un solveur SMT vérifie cette logique par rapport aux règles définies et rend un verdict. Si la traduction est fidèle, ce verdict est mathématiquement garanti et surtout explicable, puisque chaque résultat s'accompagne des règles précises qui l'appuient ou le contredisent. Pour les équipes qui déploient des applications d'IA générative dans des secteurs réglementés ou sensibles, cette certitude formelle constitue un avantage décisif face aux garde-fous purement statistiques, qui ne peuvent qu'estimer une probabilité de conformité. En confiant à un agent de codage le travail répétitif d'extraction des règles, de rédaction de tests reflétant les questions réelles des utilisateurs et de diagnostic des échecs, les équipes gagnent en reproductibilité et en traçabilité tout en gardant un processus révisable par des experts métier. Ce lancement prolonge un article précédent d'AWS qui présentait comment construire des systèmes d'IA fiables avec Automated Reasoning directement depuis la console Bedrock, décrite comme le bon point de départ pour collaborer avec des experts du domaine. La nouvelle suite d'Agent Skills déplace ce travail vers le code, là où les équipes techniques peuvent versionner, réviser et automatiser chaque étape. Les auteurs indiquent aussi avoir tiré des enseignements sur le comportement réel du service en testant la suite à grande échelle contre Bedrock. Ce mouvement s'inscrit dans une tendance plus large chez les fournisseurs de cloud et d'IA, qui équipent désormais leurs agents de codage de compétences spécialisées plutôt que de s'appuyer sur des connaissances générales souvent incomplètes ou obsolètes face à des API en évolution rapide. Le format ouvert des Agent Skills, porté par Anthropic mais adopté ici par AWS pour son propre service, illustre une interopérabilité croissante entre les grands acteurs de l'écosystème des agents IA, où un même ensemble de compétences peut circuler d'un environnement de développement à l'autre.

💬 Ce qui compte ici, c'est pas les six compétences, c'est le principe derrière. Un garde-fou statistique estime une probabilité de conformité, un contrôle par logique formelle la garantit, et ça change la donne pour une boîte qui déploie de l'IA générative dans la santé ou la finance : un verdict prouvé mathématiquement se défend devant un régulateur, une estimation non. Et voir AWS empaqueter tout ça dans le format Agent Skills d'Anthropic plutôt que de recréer son propre truc fermé, ça confirme qu'on va vers un vrai standard commun pour outiller les agents de code.

OutilsOutil
1 source
Gemini Enterprise : Google lance sa plateforme unifiée pour orchestrer des agents IA
3Le Big Data 

Gemini Enterprise : Google lance sa plateforme unifiée pour orchestrer des agents IA

Google a présenté le 22 avril 2026, lors de Google Cloud Next 2026, Gemini Enterprise : une plateforme unifiée conçue pour orchestrer des flottes d'agents IA à l'échelle de l'entreprise. La nouveauté fusionne l'application Gemini Enterprise pour les utilisateurs finaux et la nouvelle Gemini Enterprise Agent Platform pour les développeurs, absorbant au passage Vertex AI qui disparaît en tant que plateforme indépendante. Plus de 200 modèles sont accessibles via Model Garden, dont les dernières générations Gemini mais aussi des modèles tiers d'Anthropic et autres. La marketplace intégrée permet de connecter des agents issus de partenaires comme Oracle, ServiceNow, Adobe, Salesforce ou Workday. Du côté technique, la plateforme introduit Agent Studio pour le développement low-code, un SDK basé sur des graphes pour les systèmes multi-agents, et Agent Runtime pour des agents capables de fonctionner en continu pendant des heures, voire des jours. Des outils d'optimisation complètent l'ensemble : Agent Simulation, Evaluation et Observability. Pour les directions informatiques, la gouvernance est au coeur du dispositif. Chaque agent se voit attribuer une identité cryptographique via Agent Identity, tandis qu'un registre central valide les outils et agents autorisés, et qu'Agent Gateway applique les politiques de sécurité à l'échelle de l'organisation. La couche de protection intègre Model Armor pour contrer les injections malveillantes et les fuites de données, appuyée par Security Command Center pour la détection des vulnérabilités. Du côté des équipes métier, Agent Designer permet de créer et déployer des agents sans écrire de code, depuis une interface unique avec boîte de réception centralisée, espaces projets à mémoire partagée et outil collaboratif Canvas pour produire des documents exportables vers Microsoft Office. Un agent Data Insights natif analyse données structurées et non structurées pour générer visualisations et rapports, tandis que Deep Research synthétise sources web et données internes. Ce lancement s'inscrit dans une course intense entre les grands acteurs du cloud pour capter les budgets IA des entreprises. Microsoft, avec Copilot Studio et Azure AI Foundry, Amazon avec Bedrock Agents, et Salesforce avec Agentforce occupent le même terrain. Google répond en cassant la fragmentation de son offre précédente : Vertex AI, Duet AI, Gemini for Workspace coexistaient sans cohérence claire pour les acheteurs. En absorbant tout dans une plateforme unique, Google vise à simplifier les cycles de vente et à verrouiller les grandes entreprises dans son écosystème. La compatibilité revendiquée avec Microsoft 365 et Google Workspace trahit la volonté de ne pas imposer une migration brutale, mais de s'intégrer aux environnements existants. L'enjeu des prochains mois sera la disponibilité réelle de ces fonctionnalités et leur tenue à l'échelle, deux points sur lesquels les annonces de Cloud Next ont historically précédé des déploiements progressifs.

UELes entreprises européennes utilisant Google Cloud devront évaluer la migration vers cette plateforme unifiée, dont les mécanismes de gouvernance (identité cryptographique des agents, registre central, audit de sécurité) pourraient faciliter la mise en conformité avec l'AI Act.

OutilsOutil
1 source
Google teste l'agent IA Remy pour Gemini, avec un accent mis sur le contrôle utilisateur
4AI News 

Google teste l'agent IA Remy pour Gemini, avec un accent mis sur le contrôle utilisateur

Google teste en interne un nouvel agent IA baptisé Remy, conçu pour s'intégrer à l'application Gemini et agir de manière autonome au nom des utilisateurs dans leurs tâches professionnelles et quotidiennes. L'information provient de Business Insider, qui affirme avoir consulté un document interne et échangé avec deux personnes au fait du projet. Selon ce document, Remy se présente comme un "agent personnel disponible 24h/24", capable de gérer des tâches complexes, d'apprendre les préférences de l'utilisateur et de se connecter aux services Google comme Gmail, Calendar, Docs, Drive, ainsi qu'à des plateformes tierces telles que GitHub, Spotify ou WhatsApp. Pour l'heure, le projet est en phase de "dog-fooding", c'est-à-dire testé exclusivement par des employés de Google. Aucune date de lancement public n'a été communiquée, et Google a refusé de commenter. Remy représente une évolution significative dans la stratégie de Google autour de Gemini, qui cherche à dépasser le simple chatbot pour devenir un assistant capable d'agir, et non plus seulement de répondre. Si Google propose déjà un "Agent Mode" dans Gemini, Remy serait selon les sources une version nettement plus avancée, intégrant un apprentissage des préférences utilisateur et une gestion de tâches multi-étapes. Cette orientation vers les agents autonomes soulève toutefois des questions de contrôle et de vie privée que Google semble anticiper : le Privacy Hub de Gemini permet déjà aux utilisateurs de consulter et supprimer l'historique d'activité, de gérer les données de personnalisation et de révoquer l'accès aux applications connectées. Les chercheurs de Google Research ont par ailleurs formalisé des principes pour les agents IA, insistant sur des pouvoirs strictement limités, des actions observables et l'application du principe de moindre privilège. La course aux agents autonomes s'est accélérée ces derniers mois dans l'ensemble du secteur. OpenAI a attiré l'attention début 2025 avec OpenClaw, un agent capable de répondre à des messages et de mener des recherches de façon autonome, dont le créateur a été recruté par Sam Altman en février. Le PDG de Google DeepMind, Demis Hassabis, a lui-même évoqué l'ambition de construire un "assistant numérique" de référence, sans préciser le calendrier. Remy s'inscrit dans cette dynamique où les grandes plateformes IA cherchent à passer du stade de l'assistant conversationnel à celui d'un véritable mandataire numérique. Les détails techniques restent flous: l'architecture de Remy, le modèle sous-jacent et le degré d'autonomie réel, notamment la question de savoir s'il peut agir sans confirmation explicite de l'utilisateur, n'ont pas été divulgués.

UELe déploiement futur de Remy serait soumis à l'AI Act européen, notamment aux exigences de transparence et de contrôle utilisateur imposées aux agents autonomes, que Google semble anticiper via son Privacy Hub.

OutilsOutil
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic