Aller au contenu principal
Nous avons fait venir Claude pour créer des noyaux CUDA et enseigner les modèles ouverts !
LLMsHuggingFace Blog · 1 min de lecture

Nous avons fait venir Claude pour créer des noyaux CUDA et enseigner les modèles ouverts !

Source originale ↗·

Claude a été recruté pour développer des noyaux CUDA et enseigner les modèles ouverts. Son expertise contribuera à la création et à la diffusion de connaissances sur l'utilisation de ces modèles avancés.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Moonshot AI publie les poids ouverts et l'infrastructure de Kimi K3 après avoir bousculé la course aux modèles de pointe
1The Decoder 

Moonshot AI publie les poids ouverts et l'infrastructure de Kimi K3 après avoir bousculé la course aux modèles de pointe

Moonshot AI, la start-up chinoise à l'origine de la série Kimi, a publié les poids du modèle Kimi K3 en open source et rendu accessible une partie de son infrastructure technique. Sur les benchmarks les plus suivis du secteur, Kimi K3 talonne les modèles frontières occidentaux les plus performants, dont Claude et GPT-5.6 Sol d'OpenAI, un résultat remarqué pour un modèle développé en Chine dans un contexte de restrictions sur l'accès aux puces avancées. Des tests indépendants menés après la sortie ont toutefois révélé des écarts significatifs de performance sur les tâches de cybersécurité et de mathématiques, des domaines où Kimi K3 reste nettement en retrait par rapport à ses concurrents malgré ses bons scores globaux. Cet écart entre les benchmarks généralistes et les résultats sur des tâches spécialisées relance un débat déjà ancien dans l'industrie de l'IA : celui de la distillation, une technique consistant à entraîner un modèle en s'appuyant sur les sorties d'un modèle plus puissant déjà existant plutôt que sur des données brutes originales. Si cette hypothèse se confirme, elle interrogerait la nature réelle des progrès affichés par les laboratoires chinois sur les classements publics, souvent utilisés comme argument commercial et géopolitique pour démontrer une parité avec les acteurs américains. Pour les développeurs et entreprises qui envisagent d'adopter Kimi K3, ces failles ciblées changent concrètement le calcul de risque selon les cas d'usage prévus. La publication s'inscrit dans une compétition mondiale de plus en plus tendue entre laboratoires chinois et occidentaux, où l'ouverture des poids de modèle est devenue un outil stratégique autant que technique, permettant d'attirer développeurs et entreprises vers son écosystème plutôt que celui d'un concurrent propriétaire. Moonshot AI rejoint ainsi DeepSeek et d'autres acteurs chinois dans une stratégie d'open source agressive, à contre-courant de la fermeture croissante des modèles occidentaux les plus avancés. Reste à savoir si d'autres évaluations indépendantes confirmeront les limites observées en cybersécurité et en mathématiques, et si Moonshot AI ajustera sa méthode d'entraînement pour les prochaines itérations de Kimi.

💬 Ce qui m'intéresse ici, c'est pas le classement, c'est l'écart. Kimi K3 talonne Claude et GPT-5.6 sur les benchmarks généralistes mais s'écroule en cybersécurité et en maths, et ça sent la distillation, un modèle qui a appris à imiter les réponses des autres plutôt qu'à raisonner par lui-même. Bon, sur le papier la parité technique avec les US est là, mais dans les faits elle se limite aux domaines qu'on mesure le plus. Retiens ça : les classements publics deviennent un argument géopolitique avant d'être une preuve technique, et Moonshot le démontre malgré lui.

LLMsActu
1 source
Anthropic lance Claude Opus 5, un modèle IA moins cher pour le code, les agents et les entreprises
2VentureBeat AI 

Anthropic lance Claude Opus 5, un modèle IA moins cher pour le code, les agents et les entreprises

Anthropic a lancé Claude Opus 5 vendredi, un modèle que l'entreprise présente comme délivrant presque toute l'intelligence de son modèle phare Claude Fable 5, mais à moitié prix. Disponible immédiatement sur toutes les plateformes d'Anthropic, Opus 5 est facturé 5 dollars par million de tokens en entrée et 25 dollars par million en sortie, un tarif inchangé par rapport à son prédécesseur Opus 4.8. Il devient le modèle par défaut sur Claude Max, l'offre premium grand public, et le modèle le plus puissant accessible sur Claude Pro. Sur le plan des performances, Anthropic annonce de nouveaux records sur plusieurs évaluations de codage et de travail de connaissance, dont Frontier-Bench et GDPval-AA. Sur Frontier-Bench v0.1, un benchmark de codage agentique en ligne de commande, Opus 5 obtient un score de 43,3%, plus du double des 18,7% d'Opus 4.8 et nettement devant les 33,7% de Fable 5, tout en coûtant moins cher par tâche. Sur ARC-AGI 3, qui évalue la résolution de problèmes inédits, le score serait trois fois supérieur à celui du meilleur modèle concurrent. Sur OSWorld 2.0, un test d'usage informatique autonome, Opus 5 dépasserait le meilleur résultat de Fable 5 pour un peu plus d'un tiers du coût. Anthropic reconnaît toutefois qu'Opus 5 reste derrière Mythos 5, un modèle concurrent, sur les tâches de cybersécurité et de recherche en biologie, et qu'un modèle de la famille OpenAI garde l'avantage sur un benchmark de codage agentique. Ce lancement traduit un changement de stratégie dans la course à l'IA, qui glisse de la pure performance vers l'économie de l'usage quotidien. Pour Anthropic, l'essentiel du travail professionnel se situe dans une zone intermédiaire de difficulté, où une intelligence proche de la pointe mais délivrée à moindre coût l'emporte sur une intelligence maximale mais coûteuse. L'entreprise positionne désormais sa gamme par usage: Fable 5 pour les projets autonomes de plusieurs jours, Opus 5 comme modèle de référence pour le travail complexe quotidien, Sonnet 5 pour les usages à grande échelle où le coût par appel prime, et Haiku 4.5 pour les sous-agents et réponses instantanées. Un réglage d'effort ajustable permet aussi aux entreprises d'arbitrer entre intelligence, vitesse et consommation de tokens. Cette annonce s'inscrit dans un contexte où les benchmarks classiques atteignent leurs limites, poussant les laboratoires à distinguer les tâches bornées, avec un résultat précis et mesurable, des missions longues et autonomes s'étalant sur plusieurs jours. Anthropic lui-même admet que ses évaluations ne mesurent pas la durée ni la capacité à rester cohérent sur des étapes multiples, un terrain où Fable 5 garde l'avantage. Cette frontière entre tâches ponctuelles et travail agentique prolongé pourrait devenir, en 2026, le principal axe de différenciation entre Anthropic, OpenAI et les autres acteurs du secteur.

💬 Opus 5 au même prix que son prédécesseur mais avec un score qui double sur Frontier-Bench, c'est le vrai signal : la course à l'IA ne se joue plus sur qui a le modèle le plus intelligent, mais sur qui livre le plus d'intelligence par dollar dépensé. Anthropic vient d'admettre à voix haute ce que tout le monde pressentait, l'essentiel du taf pro ne demande pas une IA au sommet absolu, juste une IA solide et pas ruineuse à faire tourner en boucle toute la journée. Reste que sur les tâches longues et autonomes, celles qui s'étalent sur plusieurs jours, Fable 5 garde la main, et c'est là que la vraie bataille de 2026 va se jouer.

LLMsActu
1 source
Google lance la famille de modèles ouverts Gemma 4
3AI Business 

Google lance la famille de modèles ouverts Gemma 4

Google a lancé Gemma 4, une nouvelle famille de modèles d'IA open source conçue pour le raisonnement avancé et les capacités multimodales. Héritière de la série Gemma, cette offre s'inscrit dans la stratégie de Google DeepMind de proposer des modèles accessibles aux développeurs et chercheurs, utilisables localement ou dans le cloud. La famille comprend plusieurs variantes de tailles différentes, adaptées à des usages allant des appareils mobiles aux serveurs de production. L'arrivée de Gemma 4 renforce l'arsenal open source disponible pour les équipes techniques qui ne veulent pas dépendre exclusivement de modèles propriétaires via API. Les capacités multimodales, traitement combiné de texte et d'images, ouvrent la voie à des applications concrètes dans l'analyse documentaire, la vision par ordinateur et les assistants enrichis. Pour les entreprises soucieuses de confidentialité ou de coûts d'inférence, un modèle performant déployable en local représente un avantage opérationnel direct. Google s'inscrit ainsi dans une compétition ouverte avec Meta (LLaMA), Mistral et d'autres acteurs qui misent sur l'open source pour gagner l'adhésion des développeurs. La série Gemma, lancée début 2024, avait déjà rencontré un accueil favorable grâce à ses performances compétitives à taille réduite. Avec Gemma 4, Google cherche à consolider sa position dans cet écosystème, alors que le débat entre modèles ouverts et fermés reste central dans l'industrie de l'IA.

UELes équipes techniques et entreprises européennes disposent d'une nouvelle famille open source déployable en local, réduisant la dépendance aux APIs propriétaires et facilitant la conformité RGPD.

LLMsOpinion
1 source
Bonne nouvelle pour votre productivité : Claude Fable 5 pourrait revenir dès cette semaine
4Presse-citron 

Bonne nouvelle pour votre productivité : Claude Fable 5 pourrait revenir dès cette semaine

Anthropic s'apprête à redéployer Claude Fable 5 pour le grand public, possiblement dès cette semaine, selon des informations en circulation dans le secteur. Le modèle Claude Mythos 5, suspendu depuis le 12 juin, a quant à lui déjà été remis en ligne, mais uniquement auprès d'un nombre restreint d'organisations, toutes américaines. Cette réactivation partielle marque une première étape dans le retour progressif de ces modèles après plusieurs semaines d'interruption. L'enjeu est significatif pour les entreprises et développeurs qui dépendent de ces modèles dans leurs workflows quotidiens. La suspension de Mythos 5 et l'absence de Fable 5 ont contraint de nombreuses équipes à se rabattre sur des alternatives moins performantes, avec un impact direct sur la productivité. Le retour de Fable 5 en accès général représenterait un déblocage important pour les utilisateurs individuels et les petites structures qui n'ont pas accès aux programmes d'accès anticipé réservés aux grandes organisations. Ce redéploiement s'inscrit dans un contexte de négociations actives entre Anthropic et le gouvernement américain. Le laboratoire d'IA discuterait de l'élargissement de l'accès à Claude Mythos 5 à davantage d'organisations, au-delà du cercle initial. Ces échanges illustrent la position particulière d'Anthropic, dont certains modèles semblent désormais soumis à un cadre de validation gouvernementale avant diffusion, une dynamique qui pourrait redéfinir la façon dont les modèles frontier sont distribués aux États-Unis et, par extension, à l'international.

UELe retour de Claude Fable 5 en accès général bénéficierait aux développeurs et entreprises européens contraints depuis plusieurs semaines d'utiliser des modèles alternatifs moins performants, bien que Claude Mythos 5 demeure pour l'instant réservé aux seules organisations américaines.

LLMsActu
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic