Aller au contenu principal
xAI lance Grok Build : L’agent de codage qui veut détrôner Claude Code
OutilsLe Big Data3h

xAI lance Grok Build : L’agent de codage qui veut détrôner Claude Code

Résumé IASource uniqueImpact UE
Source originale ↗·

xAI, la société d'intelligence artificielle fondée par Elon Musk, a lancé le 14 mai 2026 Grok Build, un agent de codage en version bêta. Accessible uniquement aux abonnés SuperGrok Heavy à 300 dollars par mois, l'outil se présente comme un agent de programmation avancé doublé d'une interface en ligne de commande. Cette phase initiale est revendiquée par xAI comme un laboratoire grandeur nature : les retours des premiers utilisateurs serviront à corriger les bugs, affiner les performances et enrichir les fonctionnalités au fil du temps. L'installation s'effectue directement depuis le site officiel de xAI, via connexion au compte utilisateur.

Grok Build cible explicitement les développeurs professionnels confrontés à des tâches complexes. Son mode sans interface graphique permet de l'intégrer dans des scripts et des automatisations existantes, et son interface en ligne de commande prend en charge le protocole ACP pour faciliter la création de bots personnalisés et d'applications orchestrant plusieurs agents. Pour les projets ambitieux, un mode planification permet à l'agent de préparer une stratégie détaillée que le développeur peut approuver, modifier ou réécrire avant toute exécution. Chaque modification s'affiche ensuite sous forme de diff structuré. L'outil reconnaît automatiquement les conventions d'un dépôt existant, prend en charge les fichiers AGENTS.md, plugins, hooks, skills et serveurs MCP, et peut déléguer certaines tâches à des sous-agents spécialisés exécutés en parallèle pour accélérer le développement.

Le lancement de Grok Build s'inscrit dans une course effrénée aux agents de codage autonomes, marché où Anthropic s'est imposé avec Claude Code et où GitHub Copilot, Cursor ou Devin occupent déjà des positions établies. xAI, qui a considérablement accéléré le développement de sa famille de modèles Grok depuis le rachat de Twitter, cherche à transformer son avantage en données et en visibilité publique en une présence concrète dans les outils du quotidien des développeurs. La barrière d'entrée actuelle, 300 dollars mensuels pour un accès bêta, limite volontairement la base d'utilisateurs initiale afin de contrôler la charge et la qualité des retours. Si xAI parvient à démontrer des performances compétitives sur des benchmarks de codage réels, une ouverture plus large à des tarifs inférieurs semble probable. L'enjeu dépasse le simple outil : c'est la capacité de la plateforme Grok à s'imposer comme infrastructure de développement logiciel qui est en jeu.

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Coder sans développeur ? Mistral lance des agents IA qui font tout dans le cloud
1Le Big Data 

Coder sans développeur ? Mistral lance des agents IA qui font tout dans le cloud

Mistral AI a franchi une étape décisive le 29 avril 2026 avec le lancement des agents distants dans sa plateforme Vibe. Jusqu'à présent cantonnés à la machine locale de l'utilisateur, ces agents peuvent désormais s'exécuter entièrement dans le cloud, lancés depuis la ligne de commande ou depuis Le Chat, l'interface conversationnelle de Mistral. Le moteur de cette évolution est Mistral Medium 3.5, un nouveau modèle conçu spécifiquement pour gérer le raisonnement, le suivi d'instructions complexes et la génération de code. Une fois une tâche lancée, l'agent travaille en arrière-plan, peut poser des questions si nécessaire, suit les modifications de fichiers en temps réel et, en fin de session, crée automatiquement une pull request sur GitHub pour validation. Plusieurs agents peuvent fonctionner en parallèle, et une session locale peut être basculée dans le cloud sans interruption. Ce changement modifie profondément la position du développeur dans le cycle de production. L'utilisateur n'est plus un point de blocage : il confie une tâche, reprend ses activités, et n'intervient qu'au moment de la validation finale. Chaque session s'exécute dans un environnement isolé où l'agent peut installer des dépendances, tester des correctifs et modifier du code de façon autonome. La portée dépasse le seul développement logiciel : le mode Travail intégré à Le Chat étend la même logique à la recherche, à l'analyse et à la rédaction, permettant de préparer automatiquement une réunion, de gérer des tickets ou de traiter des e-mails. Vibe s'intègre directement dans les écosystèmes existants, GitHub, Jira, Linear, Slack, Teams, sans remplacer ces outils mais en les activant via l'IA. Cette annonce s'inscrit dans une compétition acharnée autour du "vibe coding" et des agents d'ingénierie autonomes, un segment où Cursor, GitHub Copilot Workspace et Devin se disputent déjà le marché. Mistral, qui a levé 1,1 milliard de dollars fin 2024 et revendique une position d'alternative européenne aux géants américains, accélère sa montée en gamme vers des cas d'usage professionnels à forte valeur ajoutée. La sortie simultanée de Mistral Medium 3.5 comme socle technique des agents Vibe signale une stratégie de verticalisation : contrôler à la fois le modèle et la couche applicative. Les prochaines étapes probables concerneront l'élargissement des intégrations d'outils, la gestion de projets multi-dépôts et une tarification adaptée aux équipes d'ingénierie qui délèguent des workflows entiers à ces agents.

UEMistral, entreprise française, consolide sa position dans la course aux agents de codage autonomes et offre aux équipes européennes une alternative souveraine aux outils américains comme Cursor ou GitHub Copilot Workspace.

💬 Mistral fait enfin le truc qu'on attendait : contrôler à la fois le modèle et la couche applicative, pas juste vendre une API. La PR automatique en fin de session, c'est le petit détail qui change tout dans le quotidien d'une équipe, parce que c'est là que la supervision humaine a encore du sens. Reste à voir si Medium 3.5 tient la comparaison avec ce que Cursor fait tourner depuis des mois.

OutilsOutil
1 source
Claude Code : '/goals' sépare l'agent qui travaille de celui qui décide que c'est fini
2VentureBeat AI 

Claude Code : '/goals' sépare l'agent qui travaille de celui qui décide que c'est fini

Anthropic a introduit une nouvelle fonctionnalité dans Claude Code appelée /goals, qui sépare formellement l'exécution d'une tâche de son évaluation. Concrètement, lorsqu'un développeur définit un objectif via cette commande, par exemple /goal all tests in test/auth pass, and the lint step is clean, un second modèle, Claude Haiku par défaut, intervient après chaque étape pour vérifier si la condition est réellement remplie. Si ce n'est pas le cas, l'agent continue à travailler. Ce n'est qu'une fois la condition satisfaite que le système enregistre l'objectif atteint dans la transcription de la conversation et efface l'instruction. Haiku est retenu pour ce rôle d'évaluateur car sa décision est binaire : terminé ou pas terminé. Le problème que /goals cherche à résoudre est concret et coûteux : un agent de migration de code peut terminer son exécution, afficher un pipeline vert, mais avoir laissé plusieurs composants non compilés, une erreur qui peut prendre plusieurs jours à détecter. Ce n'est pas une défaillance du modèle en tant que tel, c'est l'agent qui décide qu'il a fini avant que ce soit réellement le cas. Pour les entreprises qui déploient des pipelines IA en production, cette confusion entre ce qui a été accompli et ce qui reste à faire représente un risque opérationnel sérieux. Avec ce mécanisme natif, Anthropic affirme qu'il n'est plus nécessaire de s'appuyer sur une plateforme d'observabilité tierce ni sur des journaux personnalisés pour reconstruire après coup ce qui s'est passé. D'autres acteurs du secteur ont identifié le même obstacle. OpenAI permet aux utilisateurs d'ajouter leurs propres évaluateurs mais laisse au modèle la responsabilité de décider quand s'arrêter. LangGraph et le Google Agent Development Kit (ADK) rendent possible une évaluation indépendante, mais exigent que les développeurs définissent eux-mêmes le nœud critique, la logique de terminaison et la configuration de l'observabilité. Google ADK propose un LoopAgent aux capacités comparables, mais l'architecture reste entièrement à la charge du développeur. Anthropic, en intégrant l'évaluateur directement dans Claude Code avec des paramètres par défaut, mise sur la simplicité de déploiement comme avantage différenciant. Sean Brownell, directeur solutions chez Sprinklr, tempère toutefois l'enthousiasme : la boucle tâche/juge fonctionne, mais l'approche d'Anthropic n'est pas fondamentalement unique. Cette évolution s'inscrit dans une tendance plus large où les systèmes de vérification indépendants deviennent un composant standard des agents à longue durée d'exécution, aux côtés d'outils comme Devin ou SWE-agent.

OutilsOutil
1 source
AWS entre dans la course aux super-agents et lance sa propre version de Claude Cowork
3The Information AI 

AWS entre dans la course aux super-agents et lance sa propre version de Claude Cowork

Amazon Web Services a annoncé mardi le lancement d'Amazon Quick, une nouvelle application de bureau dédiée à ses agents IA. L'application tourne en arrière-plan sur l'ordinateur de l'utilisateur, lui permettant de continuer à travailler pendant que les agents automatisent des tâches comme la création de présentations, de documents ou d'images. Amazon Quick est proposée à partir de 20 dollars par mois et, fait notable, elle ne nécessite pas de compte AWS pour fonctionner. Les agents sont conçus pour interagir avec les fichiers locaux de l'utilisateur ainsi qu'avec des outils professionnels populaires : Google Workspace, Microsoft 365, Zoom et Salesforce. Ce lancement marque une nouvelle étape dans la course aux agents IA enterprise, un marché que tous les grands acteurs du cloud cherchent à conquérir. En rendant Amazon Quick accessible sans compte AWS, Amazon abaisse significativement la barrière à l'entrée pour les professionnels et les petites structures qui n'ont pas d'infrastructure cloud déjà en place. La capacité de déléguer des tâches bureautiques à des agents fonctionnant en parallèle représente un changement concret dans la productivité quotidienne, en particulier pour les équipes qui jonglent entre plusieurs plateformes collaboratives. AWS se retrouve cette semaine sous les feux des projecteurs pour une deuxième raison : le géant du cloud peut désormais proposer les modèles d'OpenAI à ses clients, après un changement dans le partenariat exclusif de longue date entre OpenAI et Microsoft. Pour AWS, la création d'une application enterprise à succès reste un objectif stratégique majeur, un défi que le groupe de Jeff Bezos cherche à relever depuis plusieurs années face à des concurrents comme Microsoft Copilot ou Google Workspace AI. Amazon Quick s'inscrit dans cette ambition, en ciblant directement l'utilisateur final plutôt que les équipes IT, avec une approche tarifaire simple et une intégration large des outils déjà en place dans les entreprises.

UELes professionnels et PME français peuvent désormais accéder à des agents IA bureautiques sans compte cloud préalable à 20 $/mois, abaissant la barrière d'entrée pour l'automatisation des tâches bureautiques dans les petites structures.

OutilsOutil
1 source
Agent View débarque sur Claude Code : votre armée d’agents IA en une vue
4Le Big Data 

Agent View débarque sur Claude Code : votre armée d’agents IA en une vue

Anthropic a lancé une nouvelle fonctionnalité appelée Agent View pour son outil Claude Code, disponible dès la version 2.1.139 de l'application. Accessible via la commande claude agents dans le terminal, cette interface regroupe l'ensemble des sessions d'agents actives dans un tableau de bord unique intégré directement à l'environnement de développement. Elle est disponible pour tous les abonnements Pro, Max, Team et Enterprise, ainsi que via l'API Claude, dans le respect des limites de débit habituelles. Les administrateurs d'organisation disposent par ailleurs de la possibilité de désactiver la fonctionnalité depuis les paramètres centraux. Chaque ligne du tableau de bord représente une session Claude Code avec son état en temps réel : en cours, en attente de réponse humaine, terminée, inactive, arrêtée ou en échec. Pour les équipes de développeurs qui orchestrent plusieurs tâches simultanées, Agent View change concrètement la façon de travailler. Jusqu'ici, gérer plusieurs agents en parallèle signifiait jongler entre de multiples fenêtres de terminal, sans vue d'ensemble claire sur l'état de chaque processus. Désormais, un développeur peut lancer en parallèle des agents chargés de correctifs, de tests, de revues de code ou de mises à jour, passer de l'un à l'autre sans friction, reprendre une session suspendue à tout moment, et surtout identifier immédiatement les agents qui nécessitent une intervention humaine. Ce gain de visibilité est particulièrement précieux dans les environnements d'intégration continue où le temps perdu à chercher quelle tâche est bloquée peut coûter cher. Cette mise à jour s'inscrit dans une stratégie plus large qu'Anthropic mène depuis plusieurs mois pour transformer Claude Code en véritable plateforme de gestion d'agents IA pour les équipes techniques. L'entreprise avait déjà introduit successivement les sous-agents, les équipes d'agents, les compétences personnalisées, les hooks, les commandes à distance, les tâches programmées et une version web de Claude Code. Agent View est en quelque sorte la pièce qui manquait : elle consolide tous ces blocs épars en une interface cohérente. Anthropic cherche clairement à sortir Claude Code du statut d'assistant à l'écriture de code pour en faire un outil d'orchestration de workflows autonomes, en concurrence directe avec des environnements comme GitHub Copilot Workspace ou les solutions agentiques de Google DeepMind. La question qui reste ouverte est celle de la fiabilité à grande échelle : plus les agents sont nombreux et autonomes, plus la capacité à détecter rapidement les échecs devient critique, et c'est précisément ce que vise Agent View.

OutilsOutil
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour