Aller au contenu principal
OutilsLe Big Data · 2 min de lecture

Claude Voice passe enfin de la conversation aux vraies actions

Source originale ↗·

Claude Voice, l'assistant vocal d'Anthropic, s'étend désormais aux modèles Opus et Sonnet, alors qu'il ne reposait jusqu'ici que sur Haiku, la version la plus légère du catalogue. L'annonce a été faite le 23 juillet 2026 via le compte Twitter officiel de Claude, et la bêta est disponible sur toutes les plateformes, sans être réservée aux abonnés payants. Surtout, Claude Voice sort enfin du simple échange oral pour agir concrètement dans des applications tierces : Gmail, Google Calendar, Slack, Canva et Notion figurent parmi les outils déjà connectés. Une commande vocale permet ainsi de déplacer un rendez-vous, rédiger un courriel ou créer un document Notion directement pendant la conversation. Le service reconnaît plusieurs langues, mais l'utilisateur doit la préciser manuellement à chaque échange : anglais, français, allemand, hindi, indonésien, italien, japonais, coréen, portugais du Brésil, ainsi que deux variantes d'espagnol pour l'Amérique latine et l'Espagne. Les comptes gratuits restent toutefois cantonnés à Haiku et limités à une seule application externe connectée à la fois.

Cette évolution change concrètement l'usage de l'assistant vocal, qui devient capable de gérer de vraies tâches plutôt que de simplement reformuler une demande. Avec Opus et Sonnet, Anthropic promet des conversations plus longues sur des sujets exigeants, ainsi que des retours sur le style de communication, utiles par exemple pour préparer une présentation ou répéter un argumentaire commercial avant un rendez-vous. Les utilisateurs peuvent aussi réfléchir à voix haute pour construire une étude de marché complète. Cette capacité à déclencher des actions dans des outils du quotidien marque une différence nette avec le mode vocal d'OpenAI, qui reste cantonné à la conversation sans pouvoir agir dans des applications connectées.

Lancé l'année dernière avec le seul modèle Haiku, Claude Voice séduisait par sa rapidité mais montrait vite ses limites sur les tâches complexes, selon TechCrunch. Anthropic a donc choisi de faire reprendre automatiquement à l'assistant vocal le dernier modèle utilisé par l'utilisateur dans ses échanges écrits, tout en privilégiant la variante la plus rapide de ce modèle pour éviter des temps de réponse trop longs. L'entreprise précise n'avoir apporté aucun changement au modèle vocal lui-même : l'amélioration porte uniquement sur le raisonnement mobilisé et les actions désormais accessibles. L'architecture technique du système vocal reste pour sa part non divulguée.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

AWS et Workato veulent faire passer les agents IA de la conversation à l’action
1Le Big Data 

AWS et Workato veulent faire passer les agents IA de la conversation à l’action

AWS et Workato viennent de renforcer leur partenariat autour d'Enterprise MCP, une offre conçue pour permettre aux agents IA d'exécuter de véritables actions en entreprise plutôt que de se limiter à générer du texte. Concrètement, les deux sociétés combinent la plateforme d'intégration WorkatoONE, qui centralise plus de 14 000 systèmes d'entreprise, avec les services d'IA d'AWS, notamment Amazon Bedrock, Amazon SageMaker et AWS Lambda. Cette architecture s'appuie sur le Model Context Protocol (MCP), un standard qui simplifie la connexion entre les modèles d'IA et les outils métiers, en évitant les développements sur mesure jusqu'ici nécessaires pour relier un agent à plusieurs applications. Workato a par ailleurs obtenu la spécialisation AWS AI Competency dans la catégorie des outils d'IA agentique, une reconnaissance qui vise les systèmes capables de planifier, raisonner et exécuter de manière autonome des tâches complexes en plusieurs étapes. Les deux partenaires citent déjà des cas d'usage dans la finance, l'informatique, les ventes, les ressources humaines et l'expérience client. L'enjeu dépasse la simple prouesse technique. Jusqu'à présent, les agents conversationnels savaient répondre à des questions ou rédiger du contenu, mais restaient impuissants dès qu'il fallait interagir avec des systèmes fragmentés, bases de données, logiciels métiers, processus internes, sans créer de failles de sécurité ni perdre le contrôle sur ce que l'agent est autorisé à faire. Enterprise MCP cherche justement à donner davantage d'autonomie aux agents tout en maintenant des garde-fous stricts sur les données consultables et les actions déclenchables. Pour les entreprises, cela signifie la possibilité de déléguer des tâches réelles, par exemple à une équipe financière qui a besoin qu'un agent consulte plusieurs systèmes, analyse un contexte métier puis déclenche une opération, sans multiplier les développements d'intégration coûteux et risqués en matière de gouvernance. Cette initiative s'inscrit dans un mouvement plus large où les pilotes d'IA générative, après avoir démontré la capacité des modèles à produire du contenu, peinent encore à prouver un retour sur investissement tangible faute de passage à l'action concrète. En misant sur l'orchestration de Workato et l'infrastructure d'AWS, les deux groupes espèrent transformer les agents IA en véritables exécutants capables d'intervenir dans les opérations quotidiennes des organisations. Reste à voir si cette approche convaincra les entreprises encore prudentes face aux risques opérationnels et de sécurité que soulève l'autonomisation croissante de ces systèmes.

💬 MCP standardisé sur 14 000 connecteurs, ça change la donne : le vrai coût des agents IA en entreprise, ça n'a jamais été le modèle, c'est l'intégration. AWS et Workato attaquent enfin ce chantier-là plutôt que de sortir un énième LLM plus malin. Reste que donner à un agent le droit de déclencher des actions dans des systèmes critiques, c'est un pari sur la gouvernance autant que sur la technique, et ça, MCP ne le résout pas tout seul.

OutilsOutil
1 source
AWS entre dans la course aux super-agents et lance sa propre version de Claude Cowork
2The Information AI 

AWS entre dans la course aux super-agents et lance sa propre version de Claude Cowork

Amazon Web Services a annoncé mardi le lancement d'Amazon Quick, une nouvelle application de bureau dédiée à ses agents IA. L'application tourne en arrière-plan sur l'ordinateur de l'utilisateur, lui permettant de continuer à travailler pendant que les agents automatisent des tâches comme la création de présentations, de documents ou d'images. Amazon Quick est proposée à partir de 20 dollars par mois et, fait notable, elle ne nécessite pas de compte AWS pour fonctionner. Les agents sont conçus pour interagir avec les fichiers locaux de l'utilisateur ainsi qu'avec des outils professionnels populaires : Google Workspace, Microsoft 365, Zoom et Salesforce. Ce lancement marque une nouvelle étape dans la course aux agents IA enterprise, un marché que tous les grands acteurs du cloud cherchent à conquérir. En rendant Amazon Quick accessible sans compte AWS, Amazon abaisse significativement la barrière à l'entrée pour les professionnels et les petites structures qui n'ont pas d'infrastructure cloud déjà en place. La capacité de déléguer des tâches bureautiques à des agents fonctionnant en parallèle représente un changement concret dans la productivité quotidienne, en particulier pour les équipes qui jonglent entre plusieurs plateformes collaboratives. AWS se retrouve cette semaine sous les feux des projecteurs pour une deuxième raison : le géant du cloud peut désormais proposer les modèles d'OpenAI à ses clients, après un changement dans le partenariat exclusif de longue date entre OpenAI et Microsoft. Pour AWS, la création d'une application enterprise à succès reste un objectif stratégique majeur, un défi que le groupe de Jeff Bezos cherche à relever depuis plusieurs années face à des concurrents comme Microsoft Copilot ou Google Workspace AI. Amazon Quick s'inscrit dans cette ambition, en ciblant directement l'utilisateur final plutôt que les équipes IT, avec une approche tarifaire simple et une intégration large des outils déjà en place dans les entreprises.

UELes professionnels et PME français peuvent désormais accéder à des agents IA bureautiques sans compte cloud préalable à 20 $/mois, abaissant la barrière d'entrée pour l'automatisation des tâches bureautiques dans les petites structures.

OutilsOutil
1 source
Android XR : traduction en temps réel, résumés de conversations… voici les lunettes IA audio
3Le Big Data 

Android XR : traduction en temps réel, résumés de conversations… voici les lunettes IA audio

Google a présenté lors de la Google I/O 2026 une nouvelle génération de lunettes connectées fonctionnant sous Android XR, son système d'exploitation dédié à la réalité étendue. Alimentées par Gemini, son modèle d'IA maison, ces lunettes audio misent sur une interaction entièrement vocale : elles traduisent des conversations en temps réel, lisent et résument les notifications reçues, répondent à des questions sur l'environnement immédiat de l'utilisateur, et permettent d'envoyer des SMS, passer des appels ou appeler un Uber sans jamais sortir le smartphone de sa poche. Lors des démonstrations, Google a montré les lunettes capables de traduire un menu rédigé en langue étrangère simplement en le regardant, ou de retranscrire un échange oral en adaptant le ton à celui de l'interlocuteur. La navigation vocale figure également parmi les fonctions phares : les lunettes détectent la direction du regard et guident l'utilisateur de manière plus naturelle qu'un GPS classique. Des photos et vidéos peuvent aussi être prises sur commande vocale, avec retouches automatiques générées par l'IA. L'enjeu de ces lunettes dépasse largement le gadget : elles représentent une tentative sérieuse de rendre l'IA ambiante et permanente, intégrée dans le quotidien sans friction d'écran. Pour les utilisateurs, cela signifie accéder à l'information et piloter son environnement numérique les mains libres, en toutes circonstances. Pour l'industrie, c'est un signal fort que la prochaine bataille de l'IA se joue sur le corps, pas sur le bureau. Google se positionne directement face à Meta, dont les Ray-Ban connectées ont démontré qu'un facteur de forme discret peut effectivement séduire le grand public, là où les interfaces tête-haute et les écrans superposés peinent encore à convaincre. Treize ans après le fiasco des Google Glass, rejetées pour leur design ostensiblement technologique et leurs questions éthiques sur la vie privée, Google a visiblement tiré les leçons. Les nouvelles montures Android XR ont été co-développées avec Gentle Monster et Warby Parker, deux acteurs reconnus dans la lunetterie et la mode, pour que le produit ressemble avant tout à une paire de lunettes ordinaires. Les haut-parleurs et microphones sont dissimulés dans les branches sans altérer l'aspect visuel. Cette stratégie de normalisation du design est désormais le prérequis non négociable du marché des wearables : Meta l'a compris avec Ray-Ban, Google y revient avec Android XR. La prochaine étape sera de convaincre sur l'usage réel au quotidien, loin des démonstrations scénarisées, et de répondre aux inévitables questions sur la collecte de données dans des espaces publics.

UELa commercialisation en Europe de lunettes capables d'enregistrer l'environnement en continu soulèvera des questions directes pour la CNIL et le RGPD sur la collecte de données biométriques et environnementales dans les espaces publics.

OutilsOutil
1 source
Gemini veut récupérer vos conversations issues de ChatGPT et Claude
4Blog du Modérateur 

Gemini veut récupérer vos conversations issues de ChatGPT et Claude

Google a lancé deux nouvelles fonctionnalités pour Gemini conçues explicitement pour attirer les utilisateurs de ChatGPT et Claude : un importateur de conversations et un outil de comparaison côte à côte. L'importateur permet de transférer l'historique de ses échanges depuis les assistants concurrents directement dans Gemini, tandis que le comparateur affiche en parallèle les réponses de Gemini et d'un autre modèle sur la même requête. Ces outils sont actuellement déployés aux États-Unis, mais restent indisponibles en France et dans l'Union européenne. Pour Google, l'enjeu est de réduire le coût du changement qui freine les utilisateurs à quitter un assistant IA pour un autre. L'historique de conversations représente une forme de fidélisation puissante, perdre ses échanges passés, ses contextes de travail, ses habitudes de prompt, c'est recommencer à zéro. En supprimant cette friction, Google espère convertir une partie des 400 millions d'utilisateurs hebdomadaires déclarés par OpenAI pour ChatGPT. Cette offensive intervient dans un contexte de guerre d'attrition entre les grands acteurs de l'IA grand public. OpenAI domine toujours le marché avec ChatGPT, Anthropic consolide Claude comme alternative premium, et Google cherche à capitaliser sur son intégration native dans Android, Search et Workspace pour imposer Gemini. L'absence de déploiement européen reflète probablement des contraintes liées au RGPD, notamment sur le transfert et le traitement des données personnelles issues de services tiers, un obstacle réglementaire qui pourrait retarder l'arrivée de ces fonctionnalités en France.

UELes fonctionnalités d'importation de conversations et de comparaison ne sont pas disponibles en France ni dans l'UE, probablement bloquées par le RGPD sur le transfert de données personnelles issues de services tiers concurrents.

OutilsOutil
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic