Aller au contenu principal
Gemini peut désormais contrôler votre téléphone : les nouvelles fonctionnalités clés
OutilsThe Verge AI · 1 min de lecture

Gemini peut désormais contrôler votre téléphone : les nouvelles fonctionnalités clés

Source originale ↗·

Google a dévoilé une série de nouvelles fonctionnalités pour son assistant Gemini lors d'un événement Android organisé en amont de sa conférence annuelle Google I/O. Présentées par Ben Greenwood, directeur des expériences Android chez Google, ces nouveautés visent à intégrer Gemini plus profondément dans l'usage quotidien du smartphone : l'assistant s'invite désormais dans Chrome sur Android, dans les suggestions de remplissage automatique, et peut interagir directement au sein des applications tierces. Google en profite pour lancer une nouvelle marque, Gemini Intelligence, destinée à regrouper les fonctionnalités les plus avancées de l'assistant sur les appareils Android haut de gamme.

L'enjeu principal de cette mise à jour est de transformer Gemini en un véritable agent capable d'agir à la place de l'utilisateur sur son téléphone, pas seulement de répondre à des questions. En s'intégrant aux applications et au remplissage automatique, Gemini peut potentiellement exécuter des tâches complexes sans que l'utilisateur ait besoin de naviguer manuellement entre les écrans. Cela représente un saut qualitatif dans l'assistance mobile, particulièrement pour les utilisateurs qui délèguent de plus en plus leurs tâches numériques à l'IA.

Cette annonce s'inscrit dans une compétition acharnée entre Google et Apple, qui prépare sa propre refonte d'Apple Intelligence pour iOS 19. En réservant Gemini Intelligence aux appareils Android les plus récents, Google adopte une stratégie similaire à celle d'Apple, utilisant l'IA comme argument de vente pour pousser les utilisateurs vers le renouvellement de leurs appareils. Les détails complets seront probablement précisés lors de Google I/O dans les prochains jours.

Impact France/UE

Les utilisateurs européens d'Android pourront bénéficier de ces nouvelles capacités agentiques de Gemini, sous réserve de conformité avec le RGPD et le Digital Markets Act qui encadrent l'intégration d'assistants IA dans les systèmes d'exploitation.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

1Ars Technica AI 

Codex s'enrichit de nouvelles fonctionnalités, dont l'utilisation de votre ordinateur en arrière-plan

OpenAI a déployé aujourd'hui une nouvelle version de son application desktop Codex, apportant un ensemble de fonctionnalités inédites qui étendent son champ d'action bien au-delà du code. Parmi les ajouts les plus notables figure la capacité d'effectuer des tâches sur l'ordinateur de l'utilisateur en arrière-plan, sans interrompre le travail en cours sur le bureau. L'entreprise a détaillé cette mise à jour dans un billet de blog officiel, présentant également des améliorations pour les développeurs et une ouverture vers des usages non techniques. Cette fonctionnalité d'exécution en arrière-plan représente un changement de paradigme significatif : l'agent ne se contente plus de répondre à des requêtes ponctuelles, il agit de manière autonome sur la machine pendant que l'utilisateur continue son activité normale. Pour les développeurs comme pour les professionnels du secteur, cela ouvre la voie à une automatisation plus profonde des tâches répétitives, qu'il s'agisse de refactorisation de code, de recherche ou de traitement de fichiers, sans mobiliser l'attention de l'utilisateur. Cette mise à jour s'inscrit dans la stratégie plus large d'OpenAI de transformer Codex en une "super app" polyvalente, capable de couvrir à la fois les besoins techniques et les tâches de travail du savoir en général. La compétition dans ce segment s'intensifie, avec des concurrents comme Anthropic (Claude) et Google (Gemini) qui proposent également des agents de bureau. OpenAI mise sur l'intégration native et la discrétion d'exécution pour se différencier dans une course qui redéfinit la relation entre l'humain et l'ordinateur.

OutilsOutil
1 source
Claude d'Anthropic peut désormais prendre le contrôle de votre ordinateur
2AI Business 

Claude d'Anthropic peut désormais prendre le contrôle de votre ordinateur

Anthropic franchit une nouvelle étape dans la course aux agents IA en dotant son modèle Claude d'une capacité inédite : prendre le contrôle d'un ordinateur et interagir directement avec son interface graphique. Cette fonctionnalité place Claude parmi les rares modèles capables d'exécuter des tâches de façon autonome sur un PC, sans intervention humaine à chaque étape. Cette évolution s'inscrit dans une tendance de fond qui redéfinit le rôle des assistants IA, non plus de simples outils de génération de texte, mais de véritables agents personnels capables d'agir dans l'environnement numérique de l'utilisateur. Pour les entreprises comme pour les particuliers, l'enjeu est considérable : déléguer à une IA des workflows complexes, de la navigation web à la gestion de fichiers, en passant par l'interaction avec des logiciels tiers. Anthropic rejoint ainsi OpenAI et d'autres acteurs qui développent des capacités similaires de contrôle d'interface graphique (GUI control). La fonctionnalité repose sur la capacité du modèle à analyser visuellement l'écran, interpréter les éléments affichés et simuler des actions, clics, saisie clavier, défilement, comme le ferait un opérateur humain. Cette course aux agents autonomes soulève néanmoins des questions importantes en matière de sécurité et de contrôle des accès : confier à un modèle de langage le pilotage d'un système entier implique une surface d'attaque potentiellement élargie, un défi que les équipes d'Anthropic devront adresser au fil du déploiement.

UELes développeurs et entreprises européens peuvent désormais intégrer des capacités d'automatisation desktop via l'API Claude d'Anthropic.

OutilsActu
1 source
Créez votre premier agent en quelques minutes : nouvelles fonctionnalités d'Amazon Bedrock AgentCore
3AWS ML Blog 

Créez votre premier agent en quelques minutes : nouvelles fonctionnalités d'Amazon Bedrock AgentCore

Amazon a annoncé de nouvelles fonctionnalités pour Bedrock AgentCore, sa plateforme de développement d'agents IA, qui promettent de réduire drastiquement le temps nécessaire pour passer d'une idée à un agent fonctionnel. La pièce maîtresse de cette mise à jour est le "managed agent harness", une couche d'infrastructure gérée qui permet de déclarer et lancer un agent en trois appels d'API seulement, sans écrire de code d'orchestration. Le développeur n'a qu'à définir quel modèle utiliser, quels outils appeler et quelles instructions suivre : AgentCore assemble automatiquement le calcul, la mémoire, les identités et la sécurité. La plateforme est compatible avec les frameworks déjà en usage dans l'industrie : LangGraph, LlamaIndex, CrewAI et Strands Agents, le framework open source d'AWS qui propulse le harness. AgentCore gère également la persistance de l'état de session sur un système de fichiers durable, ce qui permet à un agent de suspendre une tâche en cours et de la reprendre exactement là où il s'était arrêté. Jusqu'ici, construire l'infrastructure sous-jacente d'un agent, compute, sandbox d'exécution de code, connexions sécurisées aux outils, stockage persistant, gestion des erreurs, représentait plusieurs jours de travail avant de pouvoir tester la moindre logique métier. Avec AgentCore, tester une variante d'agent, changer de modèle ou ajouter un outil devient une modification de configuration et non une réécriture de code. Rodrigo Moreira, VP Engineering chez VTEX, l'un des premiers utilisateurs, confirme que ce qui prenait auparavant des jours de mise en place peut désormais être validé en quelques minutes. Cette accélération du cycle de prototypage est particulièrement significative pour les équipes produit qui veulent itérer rapidement sur la logique agent sans s'embourber dans la plomberie backend. Les patterns "human-in-the-loop", souvent coûteux à implémenter, deviennent pratiques grâce à la persistance native de session, sans nécessiter de refonte architecturale ultérieure. La sortie de ces fonctionnalités s'inscrit dans une concurrence féroce entre les grands fournisseurs cloud pour capter les équipes qui industrialisent l'IA agentique. AWS fait le pari que les développeurs adoptent plus facilement un service géré s'il supprime la friction initiale tout en restant extensible : lorsque les besoins d'orchestration personnalisée ou de coordination multi-agents se précisent, il suffit de basculer d'une configuration déclarative vers du code, sur la même plateforme, avec la même pipeline de déploiement et le même isolement microVM. La prochaine étape annoncée, déployer et opérer les agents depuis le même terminal, vise à unifier le cycle complet de développement, de la première idée jusqu'à la production, dans un seul environnement sans rupture d'outil.

UELes équipes de développement françaises et européennes peuvent réduire leur temps de prototypage d'agents IA, accélérant l'industrialisation de l'IA agentique pour les entreprises du continent.

OutilsOutil
1 source
Claude Code peut désormais prendre le contrôle de votre ordinateur pour effectuer des tâches
4Ars Technica AI 

Claude Code peut désormais prendre le contrôle de votre ordinateur pour effectuer des tâches

Anthropic franchit une nouvelle étape dans la course aux agents IA autonomes : Claude Code et son pendant grand public Claude Cowork peuvent désormais prendre le contrôle direct du bureau d'un ordinateur pour accomplir des tâches, cliquer, faire défiler, ouvrir des fichiers et naviguer sur le web de manière autonome. Cette capacité, désignée sous le terme "computer use", positionne Anthropic face à des concurrents déjà bien installés sur ce créneau, comme OpenAI avec son agent Operator ou Google avec Project Mariner. L'enjeu est majeur : offrir des agents capables d'agir sur n'importe quelle application, même sans API dédiée, ouvrant la voie à une automatisation bien plus large des tâches numériques du quotidien. Concrètement, Claude Code privilégie toujours les Connectors, des intégrations directes avec des applications et sources de données externes, lorsque ceux-ci sont disponibles. Ce n'est qu'en leur absence que l'agent demande la permission d'interagir physiquement avec l'écran. Le contrôle peut également être déclenché et piloté à distance via l'outil Dispatch, tant que la machine cible reste allumée. La fonctionnalité est disponible dès maintenant pour les abonnés Claude Pro et Max sous MacOS, dans le cadre d'une "research preview". Anthropic tempère toutefois les attentes : le système "ne fonctionnera pas toujours parfaitement" et nécessitera parfois une seconde tentative sur des tâches complexes. La voie du computer use reste aussi "bien plus lente et sujette aux erreurs" que le passage par les Connectors, reconnaît la société. Un avertissement qui souligne que cette technologie, prometteuse, est encore loin d'une maturité opérationnelle complète.

UELes abonnés européens à Claude Pro et Max peuvent accéder à cette fonctionnalité de contrôle du bureau en avant-première sur MacOS.

OutilsOutil
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic