Aller au contenu principal
Le mode Auto d'Anthropic supprime la supervision manuelle de Claude
LLMsAI Business · 1 min de lecture

Le mode Auto d'Anthropic supprime la supervision manuelle de Claude

Source originale ↗·

Anthropic franchit un nouveau cap dans l'autonomie de son assistant Claude en lançant un mode baptisé Auto, qui permet à l'IA de prendre des décisions et d'effectuer des actions sans attendre la validation manuelle de l'utilisateur à chaque étape. Ce changement représente une évolution significative dans la façon dont les développeurs et les professionnels interagissent avec les outils d'IA générative au quotidien.

L'enjeu est considérable pour le secteur : la supervision humaine était jusqu'ici présentée comme un garde-fou essentiel pour garantir la fiabilité des sorties produites par les grands modèles de langage. En supprimant ce point de contrôle intermédiaire, Anthropic parie sur la maturité de Claude pour gérer des tâches complexes en autonomie, à l'image de ce que proposent déjà certains agents IA concurrents dans des environnements de développement logiciel.

Le revers de la médaille est reconnu par l'entreprise elle-même : le mode Auto peut entraîner davantage d'hallucinations et produire du code de moindre qualité. Sans boucle de rétroaction humaine en temps réel, le modèle peut accumuler des erreurs sur plusieurs étapes sans correction immédiate. Le gain de productivité est réel, mais il s'accompagne d'un transfert de responsabilité vers l'utilisateur final, qui devra redoubler de vigilance lors de la relecture des résultats.

Cette décision s'inscrit dans une course à l'autonomie que se livrent les grands acteurs de l'IA, OpenAI, Google DeepMind et Anthropic en tête, pour proposer des agents capables de travailler en arrière-plan sur des workflows entiers. Le curseur entre efficacité et fiabilité reste un défi ouvert, et le lancement de ce mode sera probablement suivi de près par les équipes d'ingénierie qui en feront l'usage en production.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Claude Sonnet 5 arrive sur AWS : le modèle Sonnet le plus performant d'Anthropic
1AWS ML Blog 

Claude Sonnet 5 arrive sur AWS : le modèle Sonnet le plus performant d'Anthropic

Anthropic a annoncé le déploiement de Claude Sonnet 5 sur Amazon Bedrock et sur la Claude Platform disponible via AWS. Il s'agit du premier modèle Sonnet de la dernière génération d'Anthropic, conçu pour offrir une intelligence de premier plan au tarif Sonnet, destiné au code, aux agents autonomes et aux tâches professionnelles courantes à grande échelle. Sur Amazon Bedrock, les entreprises peuvent l'intégrer directement dans leur environnement AWS existant, en conservant la sécurité de niveau entreprise et la résidence régionale des données. Le modèle est également accessible via la Claude Platform sur AWS, ce qui permet d'utiliser les mêmes API et fonctionnalités que la plateforme native d'Anthropic, mais avec une facturation et une authentification unifiées sous AWS. Pour démarrer, les développeurs peuvent passer par la console Amazon Bedrock, sélectionner Claude Sonnet 5 dans l'espace de test Playground, ou y accéder par programmation via l'API Messages d'Anthropic, les points d'accès bedrock-runtime ou bedrock-mantle, ou encore les API Invoke et Converse via la ligne de commande AWS ou le SDK AWS. Cette annonce marque un changement concret pour les équipes techniques qui développent des produits d'intelligence artificielle à grande échelle. Claude Sonnet 5 vise à offrir une intelligence proche de celle d'Opus tout en conservant l'équilibre coût-performance propre à la gamme Sonnet, ce qui en fait une option par défaut pour les usages quotidiens, là où Opus reste réservé aux tâches qui justifient un coût plus élevé. Le modèle est présenté comme capable de suivre un plan sur plusieurs étapes, de garder la trace de ce qui a déjà été fait et de corriger ses erreurs avec moins d'allers-retours, ce qui se traduit par un comportement plus prévisible en production. Pour le code, Anthropic met en avant sa capacité à naviguer dans des bases de code réelles, à appliquer des modifications sur plusieurs fichiers et à mener à bien des tâches longues de débogage ou de refactorisation. Pour les agents autonomes, il sert de socle plus fiable pour gérer des chaînes de dépendances complexes et des usages d'outils en plusieurs étapes, aussi bien pour des agents internes que pour des agents en contact avec les clients. Anthropic cite plusieurs secteurs où ce nouveau modèle devrait avoir un impact direct. Dans la finance, Sonnet 5 est positionné pour la modélisation de tableurs, l'analyse financière et des agents de reporting capables de vérifier eux-mêmes leurs calculs tout au long du flux de travail, de l'ingestion des données jusqu'à la validation des résultats. Pour la productivité de bureau, il est annoncé pour la rédaction de rapports, leur audit, la rédaction de documents et l'analyse structurée, avec en complément des capacités d'utilisation d'ordinateur permettant d'automatiser des tâches de navigateur ou de bureau auparavant réalisées manuellement. Le modèle est présenté comme une mise à niveau directe par rapport à Sonnet 4.6, dans un contexte où la concurrence entre fournisseurs de cloud pour héberger les meilleurs modèles de langage s'intensifie, chaque acteur cherchant à attirer les entreprises qui veulent déployer de l'intelligence artificielle générative sans quitter leur infrastructure cloud existante.

UELes entreprises européennes utilisant Amazon Bedrock pourront déployer Claude Sonnet 5 en conservant la résidence des données dans l'UE, sans impact réglementaire direct mentionne.

LLMsActu
1 source
Anthropic transforme Claude en assistant autonome capable d’agir sur votre ordinateur
2Siècle Digital 

Anthropic transforme Claude en assistant autonome capable d’agir sur votre ordinateur

Anthropic franchit une nouvelle étape dans l'évolution des assistants IA avec le lancement du « computer use » pour Claude. Cette fonctionnalité inédite permet à l'assistant d'interagir directement avec un ordinateur, déplacer le curseur, cliquer, saisir du texte, naviguer dans des applications, sans qu'aucune ligne de code ne soit nécessaire de la part de l'utilisateur. Claude devient ainsi un agent capable d'exécuter des tâches complexes de façon autonome sur un poste de travail réel. L'enjeu dépasse la simple démonstration technique. Déléguer des workflows entiers à une IA, remplir des formulaires, effectuer des recherches multi-onglets, automatiser des processus répétitifs, représente un changement structurel dans la façon dont les entreprises et les particuliers envisagent leur productivité. Pour le secteur, c'est la concrétisation d'une promesse longtemps restée théorique : l'IA non plus comme outil de génération de texte, mais comme collaborateur actif sur l'environnement numérique. Anthropic a introduit cette capacité via l'API Claude dans une version bêta destinée aux développeurs, leur permettant d'intégrer le « computer use » dans leurs propres applications. Claude peut interpréter des captures d'écran pour comprendre l'état de l'interface, puis enchaîner des actions en conséquence, une approche dite vision-action qui se distingue des automatisations scriptées traditionnelles. La société reconnaît que la fonctionnalité est encore expérimentale et sujette à des erreurs, notamment sur des interfaces complexes ou dynamiques. Les perspectives ouvertes par cette annonce alimentent déjà les débats sur l'avenir du travail numérique. Si Google et Microsoft explorent des territoires similaires avec leurs propres agents, Anthropic positionne Claude comme un acteur sérieux dans la course aux agents autonomes, un marché que les analystes considèrent comme l'un des plus transformateurs de la prochaine décennie en matière d'IA appliquée.

UELes professionnels et entreprises européens peuvent désormais déléguer des tâches informatiques complexes à Claude, avec des implications potentielles pour la réglementation sur les agents IA autonomes dans le cadre de l'AI Act.

LLMsActu
1 source
3Latent Space 

Anthropic Claude Opus 4.7 : une longueur d'avance sur 4.6 dans chaque dimension

Anthropic a lancé Claude Opus 4.7 le jeudi 14 avril 2026, positionnant ce nouveau modèle comme une amélioration nette et systématique par rapport à son prédécesseur Opus 4.6 sur l'ensemble des dimensions mesurées. Le tarif reste inchangé à 5 dollars par million de tokens en entrée et 25 dollars par million en sortie. La progression est quantifiable : le niveau d'effort 4.7-low surpasse le 4.6-medium, le 4.7-medium dépasse le 4.6-high, et le 4.7-high efface le 4.6-max. Anthropic introduit par ailleurs un nouveau palier d'effort baptisé "xhigh", immédiatement adopté comme niveau par défaut dans Claude Code. Sur SWE-Bench Pro, le benchmark de référence pour l'évaluation des agents de développement, Claude Code gagne 11 points. La vision est également revue en profondeur : Opus 4.7 accepte désormais des images jusqu'à 2 576 pixels sur le grand côté, soit environ 3,75 mégapixels, plus de trois fois la résolution supportée par les versions précédentes. Ces améliorations ont des répercussions concrètes pour plusieurs catégories d'utilisateurs professionnels. Les développeurs utilisant Claude Code bénéficient immédiatement du gain de performance en programmation, avec une meilleure gestion des tâches longues, un suivi plus précis des instructions et une auto-vérification renforcée avant de répondre. La résolution d'image étendue ouvre des cas d'usage auparavant impossibles : agents d'utilisation de l'ordinateur lisant des captures d'écran denses, extraction de données depuis des schémas complexes, travail nécessitant des références pixel par pixel. Autre point notable sur l'économie des tokens : malgré un nouveau tokenizer qui peut générer jusqu'à 35 % de tokens supplémentaires sur un même texte, les gains d'efficacité de raisonnement sont suffisants pour réduire la consommation totale de tokens de jusqu'à 50 % par rapport aux niveaux équivalents de la génération précédente. Anthropic lance également en bêta publique un système de "task budgets", un outil /ultrareview dans Claude Code, et un accès élargi au mode Auto pour les abonnés Claude Code Max. Ce lancement s'inscrit dans une séquence de publications majeures qui rythment le marché de l'IA depuis début 2026. OpenAI avait publié le même jour GPT-Rosalind et une nouvelle version de Codex, mais la trajectoire d'Anthropic a capté l'essentiel de l'attention technique. La communauté débat encore du statut exact d'Opus 4.7 : successeur direct d'Opus 4.6, modèle sur nouvelle base d'entraînement, ou système partiellement distillé depuis une architecture interne de plus grande taille ? Le nouveau tokenizer découvert par plusieurs chercheurs alimente cette interrogation sur la nature des changements en préentraînement. Les semaines à venir permettront de mesurer si les gains de benchmark se traduisent en gains réels dans les usages quotidiens des développeurs et des entreprises qui intègrent Claude dans leurs produits.

UELes développeurs et entreprises européennes intégrant Claude via l'API bénéficient immédiatement des gains de performance et de la réduction de consommation de tokens, sans surcoût tarifaire.

💬 Le même prix, et chaque palier 4.7-low dépasse le 4.6-medium, le 4.7-medium écrase le 4.6-high. C'est le genre de saut qu'on attendait. Sur le tokenizer qui génère 35% de tokens supplémentaires, Anthropic annonce -50% de consommation globale en raisonnement, mais bon, faut voir ce que ça donne sur de vrais contextes longs avant de se réjouir.

LLMsActu
1 source
Anthropic lance Claude Fable 5 et Mythos 5, avec des progrès majeurs en programmation et en science
4The Decoder 

Anthropic lance Claude Fable 5 et Mythos 5, avec des progrès majeurs en programmation et en science

Anthropic a dévoilé deux nouveaux modèles d'intelligence artificielle, Claude Fable 5 et Mythos 5, qui surpassent significativement la génération Opus actuelle, notamment en programmation et en recherche scientifique. Fable 5 s'est illustré de manière spectaculaire en réalisant en une seule journée une migration de code pour l'entreprise de paiements Stripe, une tâche qui aurait nécessité deux mois de travail à une équipe entière de développeurs. Mythos 5, de son côté, a démontré une capacité autonome à concevoir des candidats médicamenteux, mais reste pour l'instant inaccessible au public en raison de ses aptitudes jugées dangereuses en cybersécurité offensive. Ces deux modèles redéfinissent ce que l'on entend par agent autonome dans le secteur technologique. La performance de Fable 5 sur la migration Stripe représente un changement de paradigme pour les équipes d'ingénierie : des tâches autrefois réservées à des équipes entières pendant des semaines peuvent désormais être déléguées à un système IA en quelques heures, avec des implications directes sur les coûts et l'organisation du travail. Pour l'industrie pharmaceutique, les capacités de Mythos 5 ouvrent des perspectives considérables dans la découverte de médicaments, en accélérant des processus de recherche qui prennent habituellement des années. Ces annonces s'inscrivent dans une course intense entre les grands laboratoires d'IA, où Anthropic cherche à rivaliser avec OpenAI et Google DeepMind sur le terrain des modèles dits frontier. La décision de restreindre l'accès à Mythos 5 illustre une tension croissante entre la puissance des nouveaux modèles et les risques qu'ils engendrent : même leurs créateurs hésitent désormais à les rendre publics. Cette prudence d'Anthropic, laboratoire historiquement centré sur la sécurité, signale que les capacités des modèles les plus avancés franchissent des seuils préoccupants, et que la question de leur déploiement responsable va s'imposer comme enjeu central de l'industrie dans les mois à venir.

UELes équipes tech européennes peuvent dès maintenant tester Fable 5 pour automatiser des tâches d'ingénierie complexes, tandis que la restriction de Mythos 5 pour risques cybersécurité offensifs va alimenter les débats européens sur l'AI Act et l'encadrement des modèles frontier.

💬 La migration Stripe en une journée, bon, faut voir ce que donne le code en prod. Mais Mythos 5 bloqué par Anthropic eux-mêmes pour risques cyber offensifs, c'est le vrai signal : on a franchi un seuil que même ses créateurs ne savent plus comment tenir. Reste à voir combien de temps cette prudence va durer.

LLMsOpinion
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic