Aller au contenu principal
Langages dynamiques : plus rapides et moins coûteux dans le benchmark Claude Code à 13 langages
OutilsInfoQ AI · 1 min de lecture

Langages dynamiques : plus rapides et moins coûteux dans le benchmark Claude Code à 13 langages

Source originale ↗·

Un benchmark de 600 exécutions mené par Yusuke Endoh, contributeur au langage Ruby, a comparé les performances de Claude Code sur 13 langages de programmation différents, en lui faisant implémenter une version simplifiée de Git. Les résultats montrent que Ruby, Python et JavaScript sont les langages les plus rapides et les moins coûteux, avec un tarif compris entre 0,36 et 0,39 dollar par exécution. Les langages à typage statique, comme Java, Go ou Rust, se révèlent 1,4 à 2,6 fois plus chers. L'ajout de vérificateurs de types aux langages dynamiques entraîne quant à lui des ralentissements de 1,6 à 3,2 fois. Le jeu de données complet est disponible sur GitHub.

Ces chiffres ont des implications directes pour les équipes qui utilisent des agents de codage alimentés par des LLM dans leurs workflows de développement. Le choix du langage influence non seulement la vitesse d'exécution des agents, mais aussi le coût opérationnel à grande échelle. Pour les entreprises qui déploient Claude Code massivement, la différence entre un langage dynamique et un langage statiquement typé peut représenter une multiplication substantielle des dépenses en tokens.

Cette étude s'inscrit dans un contexte où l'utilisation des agents de codage autonomes se généralise rapidement dans l'industrie. Anthropic, l'entreprise derrière Claude, pousse activement Claude Code comme outil de développement agentic. La question de l'efficacité par langage devient stratégique alors que les équipes cherchent à optimiser leurs pipelines d'automatisation du code, et ce type de benchmark indépendant fournit des données concrètes pour guider ces choix techniques.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Zhipu AI lance ZCode pour concurrencer Claude Code et OpenAI Codex à moindre coût
1The Decoder 

Zhipu AI lance ZCode pour concurrencer Claude Code et OpenAI Codex à moindre coût

Zhipu AI a lancé ZCode, un environnement de développement intégrant son modèle GLM-5.2, avec pour ambition de concurrencer Claude Code d'Anthropic et Codex d'OpenAI sur le terrain de l'assistance au code par intelligence artificielle. L'entreprise chinoise met en avant la capacité de GLM-5.2 à traiter de très longs contextes, un atout revendiqué pour gérer des tâches de programmation complexes sur des bases de code volumineuses. Pour attirer les nouveaux utilisateurs, Zhipu AI propose un essai gratuit de cinq jours donnant accès à un quota pouvant atteindre 5 millions de tokens par jour. Les abonnés existants bénéficient quant à eux d'environ 1,5 fois plus de quota de tokens, une offre valable jusqu'en juillet 2026. Cette stratégie tarifaire agressive vise directement les développeurs et les entreprises qui utilisent quotidiennement des assistants de code, un segment où les coûts liés à la consommation de tokens peuvent rapidement devenir importants. En proposant des volumes généreux à moindre coût, Zhipu AI cherche à convaincre les équipes techniques de basculer vers son offre plutôt que de payer les tarifs pratiqués par les acteurs américains dominants du secteur. Ce lancement s'inscrit dans une tendance plus large de montée en puissance des laboratoires d'intelligence artificielle chinois, qui misent sur des prix cassés et des capacités techniques compétitives pour gagner des parts de marché face à Anthropic et OpenAI. Les outils d'aide à la programmation sont devenus un champ de bataille stratégique majeur, où la course aux contextes toujours plus longs et aux tarifs toujours plus bas devrait continuer de s'intensifier dans les mois à venir.

OutilsOutil
1 source
Codex a dépassé les 7 millions d'utilisateurs, en hausse de plus de 10 fois en 6 mois : dépasse-t-il Claude Code ?
2Latent Space 

Codex a dépassé les 7 millions d'utilisateurs, en hausse de plus de 10 fois en 6 mois : dépasse-t-il Claude Code ?

OpenAI a franchi une nouvelle étape dans l'adoption de son outil de programmation assistée Codex. Selon des données relayées sur les réseaux sociaux, le nombre d'utilisateurs de Codex a dépassé les 7 millions cette semaine, avec un gain d'environ un million d'utilisateurs en seulement 24 heures, entre le 12 et le 13 juillet 2026. Ce bond fait suite au lancement de GPT 5.6 le 9 juillet, et à une annonce du 12 juillet indiquant que 6 millions d'utilisateurs avaient été atteints en 48 heures. En remontant aux données communiquées par Fidji Simo en mars, qui évoquait 2 millions d'utilisateurs, puis à une estimation de 550 000 à 700 000 utilisateurs au 1er janvier, la progression de Codex représente une multiplication par dix de sa base d'utilisateurs en seulement six mois. À titre de comparaison, Anthropic avait communiqué en février des chiffres autour de 2 millions d'utilisateurs actifs hebdomadaires pour Claude Code, avec un chiffre d'affaires annualisé de 2,5 milliards de dollars, en précisant que cette base avait doublé en six semaines depuis le 1er janvier. Cette divergence de communication entre les deux entreprises interroge. L'hypothèse la plus favorable à Anthropic est que l'essentiel des usages de programmation se serait déplacé vers Claude en tant qu'agent intégré à Slack plutôt que vers l'outil en ligne de commande Claude Code, rendant toute comparaison directe des statistiques d'usage difficile puisque les deux produits n'ont pas la même accessibilité. Il n'empêche que la croissance de Codex, multipliée par dix en six mois, reste un signal fort pour l'industrie des agents de codage, où la course aux utilisateurs et à la rétention devient un enjeu concurrentiel central entre OpenAI et Anthropic, avec des implications directes sur les revenus, l'adoption en entreprise et l'attractivité des différents écosystèmes de développement assisté par IA. Ce mouvement s'inscrit dans un contexte plus large où la qualité du modèle sous-jacent ne suffit plus à faire la différence: le harnais, c'est-à-dire l'environnement d'exécution et d'orchestration entourant l'agent, devient lui-même un facteur décisif de performance. C'est dans cette logique que Prime Intellect a dévoilé cette semaine la version 1 de ses environnements verifiers, une refonte de sa pile logicielle pour l'apprentissage par renforcement agentique, désormais valorisée à un milliard de dollars pour 100 millions de dollars de revenus annualisés. La nouvelle architecture sépare les tâches, le harnais et le moteur d'exécution, et stocke les traces de rollout sous forme de graphes de messages plutôt que de copies répétées, ce qui réduit la croissance des données de complexité quadratique à linéaire et facilite l'entraînement sur des tâches longues, comme un modèle de 100 milliards de paramètres entraîné sur des tâches d'ingénierie logicielle de 40 tours en moins de deux jours sur six nœuds H200.

💬 Dix fois plus d'utilisateurs en six mois, ça change la nature du problème : la bataille des agents de codage ne se joue plus sur le modèle, elle se joue sur la distribution. Anthropic peut toujours dire que Claude Code n'est qu'une partie de l'histoire à cause de Slack, ça n'efface pas l'écart brut avec ses 2 millions d'utilisateurs hebdo. Et le vrai signal de la semaine est peut-être ailleurs, dans les verifiers de Prime Intellect : le harnais qui entraîne ces agents commence à valoir aussi cher que le modèle qui tourne dedans.

OutilsOutil
1 source
Microsoft AI lance MAI-Transcribe-1.5 : 2,4 % de taux d'erreur et transcriptions longues jusqu'à 5x plus rapides
3MarkTechPost 

Microsoft AI lance MAI-Transcribe-1.5 : 2,4 % de taux d'erreur et transcriptions longues jusqu'à 5x plus rapides

Microsoft a dévoilé la semaine dernière MAI-Transcribe-1.5, la deuxième génération de son modèle de reconnaissance vocale développé en interne. Ce système de transcription automatique prend en charge 43 langues, contre 25 pour la version précédente, avec dix-huit nouvelles langues ajoutées sans dégradation des performances, dont le bengali, le tamoul, le télougou côté Asie du Sud, et l'ukrainien, le grec ou le catalan côté Europe. Sur le benchmark multilingue FLEURS, Microsoft revendique la première place parmi les modèles du marché. Sur le classement Artificial Analysis, le modèle affiche un taux d'erreur par mot (WER) de 2,4 %, ce qui le place troisième dans un champ concurrentiel. En vitesse, il est capable de transcrire une heure d'audio en moins de 15 secondes et se révèle jusqu'à 5 fois plus rapide que des modèles comparables comme Gemini 3.1, Scribe v2 ou GPT-4o-Transcribe sur des fichiers longs. MAI-Transcribe-1.5 est intégré à Copilot, Teams, GitHub et Dynamics 365 Contact Centre, et disponible via Foundry, la plateforme de modèles de Microsoft. La fonctionnalité qui mérite le plus d'attention est le « keyword biasing », ou biais par entités nommées. Les transcripteurs génériques trébuchent régulièrement sur les vocabulaires métiers, noms propres, termes médicaux, acronymes internes, précisément là où les erreurs coûtent le plus cher. MAI-Transcribe-1.5 permet de fournir jusqu'à 200 mots-clés personnalisés que le modèle prend en compte lors de la transcription, sans forcer mécaniquement les correspondances mais en s'appuyant sur le contexte. Résultat : une réduction de 30 % du WER sur FLEURS lorsque ce mécanisme est activé. Sur les réunions d'entreprise, dans les centres d'appels ou les environnements de santé, cette capacité change concrètement la qualité des transcriptions produites. La détection automatique de la langue parlée, sans paramétrage manuel, complète l'ensemble pour des flux d'entrée non structurés. La course aux modèles de transcription s'est considérablement intensifiée depuis que OpenAI a popularisé Whisper et que des acteurs comme AssemblyAI ou ElevenLabs ont investi le segment entreprise. Microsoft, fort de son infrastructure Azure et de son intégration profonde dans les outils de productivité, cherche à imposer une solution maison plutôt que de dépendre de fournisseurs tiers. Le passage de 25 à 43 langues, avec une couverture renforcée des langues d'Asie du Sud, reflète aussi une ambition de croissance sur des marchés où l'anglais n'est pas dominant. Pour les équipes qui traitent des archives audio volumineuses en batch, médias, justice, santé, support client, un facteur de vitesse de 5x sur les fichiers longs n'est pas anecdotique : il réduit directement les coûts d'infrastructure et les délais de traitement à grande échelle.

UELes entreprises européennes intégrées à l'écosystème Microsoft (Teams, Dynamics 365) bénéficieront directement de ces gains de précision et de vitesse, avec un support renforcé des langues européennes comme le grec, le catalan et l'ukrainien.

OutilsOpinion
1 source
Le nouveau mode automatique de Claude Code cherche à équilibrer sécurité et rapidité
4The Decoder 

Le nouveau mode automatique de Claude Code cherche à équilibrer sécurité et rapidité

Anthropic a lancé un nouveau mode "Auto Mode" pour Claude Code, son outil de développement assisté par IA. Jusqu'ici, les développeurs devaient choisir entre approuver manuellement chaque action exécutée par l'outil ou désactiver complètement les vérifications de sécurité — deux extrêmes peu satisfaisants. Ce nouveau mode intermédiaire cherche à trouver le bon équilibre entre sécurité et fluidité d'utilisation. Il permettrait à Claude Code d'agir de façon autonome pour les opérations courantes, tout en sollicitant une confirmation humaine pour les actions potentiellement risquées. Claude Code s'inscrit dans la vague des agents de développement IA capables d'écrire, modifier et exécuter du code de façon semi-autonome. La question du contrôle humain est centrale dans ce secteur, où trop de friction freine l'adoption et trop d'autonomie pose des risques réels.

OutilsOutil
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic