Aller au contenu principal
[AINews] Bulletin Claude Cowork : la réponse d'Anthropic à OpenClaw
LLMsLatent Space · 2 min de lecture

[AINews] Bulletin Claude Cowork : la réponse d'Anthropic à OpenClaw

Source originale ↗·

Anthropic vient de lancer Claude Cowork, sa réponse directe à OpenClaw, l'outil collaboratif qui a dominé les conversations dans l'écosystème IA ces derniers mois. La sortie, portée notamment par swyx (Latent Space), est saluée par des figures comme Simon Willison et Ethan Mollick, qui la comparent favorablement à l'offre concurrente. Anthropic, qui avait été critiquée pour avoir « raté » le virage Clawdbot, reprend pied sur le segment du coworking assisté par IA.

L'enjeu est stratégique : comme l'a rappelé Jensen Huang cette semaine, toute entreprise technologique doit désormais avoir une stratégie OpenClaw. Ce segment, qui consiste à faire collaborer plusieurs agents ou utilisateurs humains avec un LLM dans un espace de travail partagé, est en train de devenir un point de bascule pour la productivité des développeurs et des équipes tech. L'architecture technique de Claude Cowork, notamment ses choix de sandboxing et d'Electron, fait l'objet d'une discussion approfondie dans le podcast associé à l'annonce.

En parallèle, OpenAI a lancé GPT-5.4 mini et GPT-5.4 nano, présentés comme ses modèles légers les plus performants à ce jour. GPT-5.4 mini affiche une vitesse plus de 2× supérieure à GPT-5 mini, une fenêtre de contexte de 400 000 tokens via l'API, et ne consomme que 30 % du quota Codex de GPT-5.4, en faisant le choix par défaut pour les workflows de coding en arrière-plan et les sous-agents. Côté tarification : 0,75 $/M tokens en entrée et 4,5 $/M tokens en sortie pour mini. Sur le benchmark APEX-Agents de Mercor, mini atteint 24,5 % Pass@1 avec raisonnement étendu, mais performe moins bien sur BullshitBench, un test de résistance aux prémisses fausses.

L'infrastructure agent s'impose comme le vrai terrain de compétition de 2026 : LangChain a ouvert LangSmith Sandboxes pour l'exécution de code éphémère sécurisée, et open-sourcé Open SWE, un agent de coding background inspiré des systèmes internes de Stripe, Ramp et Coinbase, intégrant Slack, Linear et GitHub. De son côté, Hermes Agent v0.3.0 a consolidé 248 pull requests en 5 jours, ajoutant contrôle Chrome en direct, mode voix local via Whisper, et redaction de données personnelles. Le message est clair : la guerre des modèles laisse place à la guerre des harnais d'agents.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Claude Sonnet 5 d'Anthropic réduit l'écart avec la gamme Opus, plus chère
1The Decoder 

Claude Sonnet 5 d'Anthropic réduit l'écart avec la gamme Opus, plus chère

Anthropic a dévoilé Claude Sonnet 5, la dernière évolution de sa gamme de modèles de langage. Selon l'entreprise, ce nouveau modèle surpasse son prédécesseur, Sonnet 4.6, sur l'ensemble des benchmarks utilisés pour l'évaluer. Fait notable, Sonnet 5 devance même Opus 4.8, le modèle haut de gamme et plus coûteux de la même famille, sur le test GDPval-AA v2, qui évalue les compétences en travail de connaissance : il y obtient un score de 1 618 points. Anthropic précise également que Sonnet 5 affiche des résultats nettement inférieurs, sur les tâches liées à la cybersécurité, à ceux des modèles que le gouvernement américain a actuellement interdits pour ce type d'usage. Cette annonce a une portée qui dépasse la simple mise à jour technique. En rattrapant, voire en dépassant sur certains critères, un modèle plus onéreux, Sonnet 5 permet aux entreprises et développeurs d'obtenir des performances de premier plan à moindre coût, ce qui pourrait redistribuer les usages entre les différentes gammes de modèles d'Anthropic. La mention explicite des scores en cybersécurité n'est pas anodine : elle intervient alors que les autorités américaines examinent de près les capacités offensives de l'intelligence artificielle et envisagent de restreindre l'accès à certains modèles jugés trop performants dans ce domaine. Ce positionnement s'inscrit dans un contexte plus large de compétition entre laboratoires d'IA, où chaque nouvelle génération de modèle cherche à combiner puissance et maîtrise des risques. En insistant sur le fait que Sonnet 5 reste loin des seuils jugés problématiques par Washington, Anthropic cherche à démontrer sa capacité à proposer des modèles à la fois performants et conformes aux exigences réglementaires émergentes, dans un débat toujours en cours sur l'encadrement des IA les plus avancées.

LLMsActu
1 source
Claude Opus 4.7 : Le nouveau monstre d’Anthropic arrive (peut-être) cette semaine !
2Le Big Data 

Claude Opus 4.7 : Le nouveau monstre d’Anthropic arrive (peut-être) cette semaine !

Anthropic s'apprêterait à lancer Claude Opus 4.7, la prochaine itération de son modèle phare, potentiellement dès cette semaine. L'information provient de The Information, qui rapporte que l'identifiant "Claude Opus 4.7" a déjà été repéré dans les références internes de l'API d'Anthropic, un signal qui précède généralement de peu une annonce officielle. Un utilisateur du réseau X, sous le pseudonyme BridgeMind, a également alimenté les spéculations en relevant que Claude Opus 4.5 avait été publié 73 jours avant Opus 4.6, sorti le 5 février 2026. Au 14 avril, 68 jours s'étaient déjà écoulés depuis cette dernière version, plaçant la prochaine sortie dans la fenêtre habituelle de déploiement. Le code source de Claude Code ayant par ailleurs déjà mentionné Opus 4.7, les indices convergent, sans qu'Anthropic ait pour autant confirmé quoi que ce soit officiellement. Si les rumeurs s'avèrent fondées, Claude Opus 4.7 apporterait des améliorations substantielles sur plusieurs fronts critiques : le raisonnement en plusieurs étapes, la gestion de tâches longues et complexes, et surtout la coordination entre agents d'IA. Anthropic travaillerait sur un concept d'"équipe d'agents", où plusieurs modèles collaborent sur un même problème comme le ferait un groupe de travail humain. Cette architecture permettrait à des systèmes autonomes de fonctionner pendant de longues périodes avec une intervention humaine minimale, une capacité très attendue par les entreprises qui intègrent l'IA dans leurs workflows. En parallèle, The Information évoque également un assistant tout-en-un capable de gérer des tâches complètes comme la création de sites web ou de présentations, en intégrant rédaction, design et mise en place technique dans un processus unifié. Ce lancement s'inscrit dans une course effrénée entre les grands laboratoires d'IA. OpenAI, Google et Anthropic accélèrent tous leurs cycles de publication, les intervalles entre versions majeures se réduisant à quelques semaines. Anthropic, fondée en 2021 par d'anciens cadres d'OpenAI dont Dario et Daniela Amodei, positionne Claude comme une alternative axée sur la sécurité et la fiabilité. Avec Opus 4.7, la société chercherait à consolider son avance sur le segment des agents autonomes et des tâches longue durée, un marché entreprise à fort potentiel. Les suites dépendront de la réaction des concurrents : OpenAI prépare ses propres modèles o3 et GPT-5, tandis que Google continue de faire évoluer Gemini Ultra. La semaine à venir pourrait donc marquer une nouvelle étape dans la compétition mondiale pour les modèles de langage de pointe.

LLMsOpinion
1 source
Le mode Auto d'Anthropic supprime la supervision manuelle de Claude
3AI Business 

Le mode Auto d'Anthropic supprime la supervision manuelle de Claude

Anthropic franchit un nouveau cap dans l'autonomie de son assistant Claude en lançant un mode baptisé Auto, qui permet à l'IA de prendre des décisions et d'effectuer des actions sans attendre la validation manuelle de l'utilisateur à chaque étape. Ce changement représente une évolution significative dans la façon dont les développeurs et les professionnels interagissent avec les outils d'IA générative au quotidien. L'enjeu est considérable pour le secteur : la supervision humaine était jusqu'ici présentée comme un garde-fou essentiel pour garantir la fiabilité des sorties produites par les grands modèles de langage. En supprimant ce point de contrôle intermédiaire, Anthropic parie sur la maturité de Claude pour gérer des tâches complexes en autonomie, à l'image de ce que proposent déjà certains agents IA concurrents dans des environnements de développement logiciel. Le revers de la médaille est reconnu par l'entreprise elle-même : le mode Auto peut entraîner davantage d'hallucinations et produire du code de moindre qualité. Sans boucle de rétroaction humaine en temps réel, le modèle peut accumuler des erreurs sur plusieurs étapes sans correction immédiate. Le gain de productivité est réel, mais il s'accompagne d'un transfert de responsabilité vers l'utilisateur final, qui devra redoubler de vigilance lors de la relecture des résultats. Cette décision s'inscrit dans une course à l'autonomie que se livrent les grands acteurs de l'IA, OpenAI, Google DeepMind et Anthropic en tête, pour proposer des agents capables de travailler en arrière-plan sur des workflows entiers. Le curseur entre efficacité et fiabilité reste un défi ouvert, et le lancement de ce mode sera probablement suivi de près par les équipes d'ingénierie qui en feront l'usage en production.

LLMsOutil
1 source
Anthropic force son IA Claude à… « rêver », (et c’est pour votre bien)
4Le Big Data 

Anthropic force son IA Claude à… « rêver », (et c’est pour votre bien)

Anthropic a présenté le 6 mai 2026, lors de sa conférence développeurs Code with Claude à San Francisco, une nouvelle fonctionnalité baptisée « Dreaming » pour sa plateforme Claude Managed Agents. Disponible en avant-première de recherche, ce système place les agents IA dans un état d'analyse récurrente des sessions passées et des données mémorisées par plusieurs agents simultanément. Contrairement à la compaction classique, qui résume les conversations longues pour alléger la mémoire d'un seul agent, Dreaming opère de manière transversale : il inspecte les historiques de multiples agents, détecte des schémas récurrents, des erreurs fréquentes, des méthodes de travail adoptées spontanément, ou encore des préférences communes au sein d'une équipe. Les utilisateurs pourront choisir entre un mode automatique, où les ajustements s'appliquent sans intervention, et un mode manuel permettant de valider chaque modification avant son intégration. Lors de la même conférence, Anthropic a annoncé en version bêta publique trois autres fonctionnalités : « Results » (un évaluateur indépendant qui vérifie si une tâche a réellement atteint son objectif, et relance l'agent si ce n'est pas le cas), l'orchestration multi-agents (jusqu'à 20 agents spécialisés collaborant en parallèle sous la direction d'un agent principal), et les notifications webhook pour des alertes en temps réel vers des systèmes externes. L'enjeu central que Dreaming cherche à résoudre est structurel : les modèles de langage disposent d'une fenêtre de contexte limitée, et sur des projets longs, des informations critiques finissent inévitablement par disparaître. Pour les entreprises qui déploient des agents IA sur des semaines ou des mois, cette perte de continuité représente un frein opérationnel concret. En permettant à la mémoire de se restructurer automatiquement à partir de données croisées entre agents, Anthropic entend rendre les systèmes multi-agents plus cohérents, moins redondants dans leurs erreurs, et capables d'apprendre des comportements collectifs plutôt que de repartir de zéro à chaque session. La fonctionnalité Results, de son côté, répond à un problème tout aussi pragmatique : garantir que l'agent a bien produit ce qui était demandé, et non une approximation acceptable. Ces annonces s'inscrivent dans une course que se livrent OpenAI, Google DeepMind et Anthropic autour des agents autonomes capables de gérer des tâches complexes sur la durée. Claude Managed Agents est la réponse d'Anthropic aux frameworks agentiques concurrents, avec une philosophie axée sur la sécurité et la contrôlabilité, ce qui explique l'option de validation manuelle dans Dreaming plutôt qu'une automatisation totale. En restant en avant-première de recherche pour la fonctionnalité phare et en bêta publique pour les autres, Anthropic adopte une posture prudente avant un déploiement général, probablement dans les mois à venir, à mesure que les retours des développeurs consolideront le système.

UELes entreprises européennes déployant des agents Claude sur des projets longs bénéficieront d'une meilleure continuité mémorielle, mais la fonctionnalité reste en avant-première de recherche sans calendrier de déploiement général annoncé.

LLMsOpinion
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic