Aller au contenu principal
LLMsLe Big Data · 2 min de lecture

Qwen 3.8-Max : Alibaba clash la Silicon Valley avec une IA puissante et… open weight

Source originale ↗·

Alibaba a dévoilé le 3 août 2026 Qwen 3.8-Max, le modèle le plus puissant de toute la famille Qwen à ce jour. Contrairement aux modèles fermés d'OpenAI ou d'Anthropic, celui-ci sera open-weight : ses poids seront publiés la semaine prochaine, et Qwen3.8-27B suivra le même chemin. Le modèle est déjà accessible sur la plateforme officielle Qwen et le sera bientôt sur Model Studio, la plateforme cloud d'Alibaba. Techniquement, il s'agit d'un modèle multimodal capable de traiter texte, images et vidéo dans une même conversation, avec une fenêtre de contexte d'un million de tokens. Alibaba affirme qu'il peut analyser des rapports financiers de plusieurs centaines de pages en comprenant simultanément texte, graphiques et tableaux, ou encore parcourir plus de 100 heures de vidéo pour identifier personnages, événements et changements de scène. Le modèle repose sur une architecture Mixture of Experts avec 2 400 milliards de paramètres au total, dont seulement 95 milliards activés à chaque requête.

Cette approche change la donne pour l'accès à l'IA de pointe. En rendant public un modèle qui rivalise avec les meilleures offres américaines, Alibaba permet à des chercheurs et développeurs du monde entier de télécharger, étudier et adapter le modèle sur leurs propres infrastructures, sans dépendre d'une API propriétaire. Les résultats publiés sont significatifs : sur PaperBench, qui évalue la capacité à reproduire un article scientifique en code, Qwen 3.8-Max obtient 93 sur 100, devançant Fable 5 (88,8) et Claude Opus 4.8 (80,3). Sur OSWorld, qui mesure l'usage d'un ordinateur comme le ferait un humain, il prend la première place mondiale avec 86,1. Pour les entreprises et développeurs, cela signifie un accès à des capacités de pointe en codage autonome et en automatisation, à moindre coût grâce à l'architecture MoE qui limite les ressources mobilisées par requête.

Ce lancement s'inscrit dans une compétition de plus en plus vive entre laboratoires chinois et américains. Sur Arena.AI, Qwen 3.8-Max s'est immédiatement classé premier modèle chinois pour les tâches textuelles, même s'il reste derrière Claude Fable 5 au niveau mondial. En vision par ordinateur, il se classe deuxième, juste derrière une variante de Claude Fable 5. Alibaba le compare directement à Kimi K3, le modèle de Moonshot AI doté de 2 800 milliards de paramètres, signe que plusieurs acteurs chinois jouent désormais dans la même catégorie que les géants américains. Reste que les benchmarks ne disent pas tout : l'usage en conditions réelles déterminera si cette avance open source chinoise se confirme face à des modèles fermés qui gardent, pour l'instant, une légère longueur d'avance sur certains terrains.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

MiniMax lance M3 : le modèle Open Weight le plus puissant jamais créé ?
1Le Big Data 

MiniMax lance M3 : le modèle Open Weight le plus puissant jamais créé ?

Le 1er juin 2026, la société chinoise MiniMax a lancé M3, son nouveau modèle d'intelligence artificielle à poids ouverts. Il s'agit du premier modèle open weight à combiner trois capacités jusqu'ici réservées aux systèmes propriétaires : une fenêtre contextuelle d'un million de jetons, des performances de pointe en programmation et en agents autonomes, ainsi qu'une prise en charge native du texte et des images. Sur SWE-Bench Pro, le benchmark de référence pour la résolution de problèmes logiciels réels, M3 obtient 59 %, dépassant GPT-5.5 et Gemini 3.1 Pro selon MiniMax. Il atteint également 66 % sur Terminal-Bench 2.1, 74,2 % sur Atlas MCP et 83,5 sur BrowseComp, score qui surpasserait Claude Opus 4.7. Le modèle est déjà accessible via l'API officielle de MiniMax et son agent de développement MiniMax Code, tandis que les poids ouverts seront publiés sur Hugging Face et GitHub dans une dizaine de jours. Ce lancement est significatif parce qu'il réduit concrètement la barrière entre modèles open source et systèmes propriétaires de premier rang. L'architecture repose sur une technologie maison appelée MiniMax Sparse Attention (MSA), qui identifie les informations pertinentes avant de concentrer les calculs sur elles : résultat, le coût de calcul par jeton est divisé par vingt sur un contexte d'un million de jetons, le traitement des entrées est neuf fois plus rapide que sur la génération précédente, et la génération de réponses gagne un facteur supérieur à quinze. La vitesse de production avoisine 100 jetons par seconde, environ trois fois celle de Claude Opus. Pour les développeurs et les entreprises qui cherchent à déployer des agents autonomes sans dépendre d'APIs propriétaires à coût élevé, M3 représente une option crédible et, surtout, inspecTable. MiniMax est une startup fondée à Shanghai qui opère depuis plusieurs années dans l'ombre des géants américains et de ses concurrents chinois comme Baidu ou Zhipu AI. Avec M3, elle entre directement en compétition avec Anthropic, Google et OpenAI sur le segment haut de gamme, mais avec la carte distinctive de l'ouverture des poids. Le contexte réglementaire et géopolitique autour de l'IA chinoise reste tendu, ce qui rend d'autant plus remarquable qu'une entreprise de ce pays publie un modèle en open weight à ce niveau de performance. Des validations indépendantes seront nécessaires : une partie des benchmarks ont été conduits sur l'infrastructure de MiniMax elle-même. La publication imminente des poids permettra à la communauté de vérifier ces affirmations, et les semaines qui suivent diront si M3 tient ses promesses dans des conditions réelles d'utilisation.

UEL'arrivée d'un modèle open weight performant réduit la dépendance des entreprises et développeurs européens aux APIs propriétaires américaines à coût élevé.

💬 Un million de jetons, des scores d'agent au niveau des meilleurs modèles fermés, et les poids open source dans dix jours : si tout ça se confirme, c'est une vraie gifle pour les APIs propriétaires. Le calcul change pour ceux qui veulent déployer des agents sans facturer à chaque appel. Les benchmarks sont en partie auto-déclarés, donc on attend les poids sur HuggingFace, mais là MiniMax joue dans la cour des grands pour de bon.

LLMsOpinion
1 source
L'équipe Qwen d'Alibaba lance Qwen3.7-Plus avec vision, raisonnement avancé et agents autonomes sur Bailian
2MarkTechPost 

L'équipe Qwen d'Alibaba lance Qwen3.7-Plus avec vision, raisonnement avancé et agents autonomes sur Bailian

L'équipe Qwen d'Alibaba a lancé le 2 juin 2026 le modèle Qwen3.7-Plus, désormais disponible via API sur la plateforme Bailian d'Alibaba Cloud, accessible aux développeurs internationaux sous le nom Model Studio. Ce modèle multimodal comprend les images et les vidéos en plus du texte, ce qui le distingue de son frère jumeau Qwen3.7-Max, exclusivement textuel. Il s'agit d'une capacité de lecture visuelle, non de génération : Qwen3.7-Plus analyse des médias, il ne les crée pas. Au-delà de la vision, le modèle intègre cinq capacités agentiques : raisonnement approfondi, autoprogrammation (il écrit et révise son propre code), invocation d'outils externes et d'API, vérification et test des résultats, et itération autonome jusqu'à l'accomplissement complet d'une tâche. La préversion du modèle s'est classée 16e au classement Vision Arena de LM Arena, plaçant Alibaba au 5e rang mondial des laboratoires en compréhension visuelle. Le modèle texte Max, de son côté, avait obtenu 56,6 points sur l'Artificial Analysis Intelligence Index, meilleur score d'un modèle chinois à sa sortie. Cette sortie marque un tournant dans la stratégie d'Alibaba : le groupe ne cherche plus seulement à rivaliser sur les benchmarks de raisonnement, mais à proposer des modèles capables d'exécuter des tâches longues et complexes de façon autonome. Pour les développeurs et les entreprises, cela ouvre des cas d'usage concrets comme l'analyse OCR à grande échelle, la lecture automatique de graphiques, l'analyse de séquences vidéo, ou encore l'automatisation de workflows techniques complets. La plateforme Bailian embarque deux mécanismes complémentaires : un système d'apprentissage par renforcement agentique (Agentic RL) qui affine la précision du modèle grâce aux retours d'exécution réels, et des garde-fous de sécurité intégrés pour maintenir les outils autonomes dans des limites opérationnelles prédéfinies, un détail crucial lorsqu'un agent exécute des commandes ou modifie des fichiers en production. Ce lancement s'inscrit dans la vague de modèles agentiques qui déferle sur l'industrie depuis début 2026, face à des acteurs comme OpenAI, Google DeepMind et Anthropic. Alibaba avait déjà dévoilé la génération Qwen3.7 en mai 2026, et la sortie de la variante multimodale complète maintenant l'offre de la famille. Le positionnement au 5e rang mondial en vision, malgré un retard encore visible sur les premiers laboratoires américains, confirme que les équipes chinoises se rapprochent du front technologique à un rythme soutenu. L'enjeu pour Alibaba est de transformer Bailian en plateforme de référence pour les entreprises cherchant à déployer des agents IA capables d'agir dans des environnements réels, pas seulement de répondre à des questions, une bataille qui s'annonce centrale dans les prochains mois.

UELes développeurs et entreprises françaises peuvent accéder dès maintenant à Qwen3.7-Plus via l'API internationale Model Studio, offrant une alternative compétitive aux modèles américains pour des cas d'usage agentiques et d'analyse visuelle.

LLMsOpinion
1 source
Alibaba dévoile Qwen3.8-Max, un modèle MoE de 2,4 billions de paramètres, le plus performant de la famille Qwen à ce jour
3MarkTechPost 

Alibaba dévoile Qwen3.8-Max, un modèle MoE de 2,4 billions de paramètres, le plus performant de la famille Qwen à ce jour

Alibaba a annoncé la disponibilité générale de Qwen3.8-Max, un modèle de mélange d'experts (MoE) de 2,4 billions de paramètres, le plus puissant à ce jour dans la famille Qwen. L'entreprise a confirmé que les poids ouverts du modèle seront publiés la semaine prochaine, tout comme ceux d'un second modèle, Qwen3.8-27B, plus adapté à un déploiement sur des serveurs GPU classiques. Qwen3.8-Max accepte du texte, des images et de la vidéo en entrée et produit du texte en sortie. Son API hébergée, compatible avec les formats OpenAI et DashScope, est utilisable dès aujourd'hui par toute entreprise, l'intégration se limitant à un changement d'URL de base et d'identifiant de modèle. Le modèle propose une fenêtre de contexte d'un million de tokens, avec une entrée maximale de 991 000 tokens (983 000 en mode réflexion) et une sortie maximale de 131 000 tokens. Les limites de débit sont fixées à 2 millions de tokens par minute et 15 000 requêtes par minute. Côté tarifs, comptez 2 dollars par million de tokens en entrée, 6 dollars en sortie, et 0,25 dollar pour la lecture en cache implicite, un cache huit fois moins cher que les tokens frais. Le modèle intègre nativement cinq outils via l'API Responses, dont un interpréteur de code et la recherche web. Cette annonce est significative parce qu'elle cible directement des usages professionnels concrets: l'ingénierie logicielle à l'échelle d'un dépôt entier, la revue de documents juridiques et financiers, l'indexation de vidéos longues, l'extraction de données structurées et les assistants de recherche multi-étapes. Mais l'ampleur du modèle pose une vraie question de déploiement. Avec 2,4 billions de paramètres au total, Qwen3.8-Max reste un artefact réservé aux infrastructures de datacenter multi-nœuds, Alibaba n'ayant pas communiqué le nombre de paramètres réellement activés, ce qui empêche pour l'instant d'estimer son coût de service. C'est donc Qwen3.8-27B qui représente la voie réaliste pour un déploiement sur site chez la plupart des entreprises. Les gains de performance les plus nets se situent dans le multimodal et les tâches agentiques plutôt que dans le raisonnement pur: le modèle passe de 21,6 à 56,6 sur DeepSWE 1.1 et de 40,7 à 73,5 sur FrontierSWE par rapport à Qwen3.7-Max. Sur les benchmarks publiés par Alibaba, Qwen3.8-Max obtient 86,6 sur Terminal-Bench 2.1, devançant Claude Opus 4.8 et Claude Fable 5 (84,6) mais restant derrière GPT-5.6 Sol en mode maximal (88,8). Il domine en revanche sur PaperBench (93,0) et sur plusieurs tests de vision comme OSWorld-Verified (86,1) et OmniDocBench 1.5 (92,1). Deux réserves s'imposent toutefois: la comparaison multimodale se fait face à Qwen3.7-Plus et non Qwen3.7-Max, ce qui gonfle artificiellement les progrès affichés, et la courbe d'apprentissage par renforcement d'Alibaba plafonne à 0,725 avant de redescendre à 0,689, signe que la mise à l'échelle atteint ses limites. Aucune licence ni tableau de benchmark complet n'accompagne pour l'instant l'annonce des poids ouverts, prévus la semaine prochaine.

LLMsOpinion
1 source
Alibaba (Chine) tente une nouvelle offensive contre la suprématie américaine dans l'IA
4The Verge AI 

Alibaba (Chine) tente une nouvelle offensive contre la suprématie américaine dans l'IA

Alibaba a dévoilé lundi Qwen3.8-Max, présenté comme son modèle d'intelligence artificielle le plus vaste et le plus performant à ce jour. Le géant technologique chinois affirme que ce système rivalise avec les meilleures offres des laboratoires américains de pointe, Anthropic et OpenAI, ainsi qu'avec son concurrent domestique Moonshot AI et son modèle Kimi K3. L'annonce, publiée sur le blog officiel d'Alibaba, confirme un lancement déjà anticipé depuis le mois précédent, lorsque l'entreprise avait présenté une version préliminaire du modèle en le qualifiant de "juste derrière" le modèle phare d'Anthropic. Qwen3.8-Max est désormais mis à disposition à grande échelle des utilisateurs, marquant une nouvelle étape dans la stratégie d'Alibaba de rendre ses modèles accessibles largement plutôt que de les garder propriétaires. Cette sortie confirme que les entreprises chinoises continuent de réduire l'écart technologique avec les laboratoires américains, longtemps considérés comme largement en tête sur les modèles de fondation les plus avancés. Pour les développeurs et les entreprises du monde entier, la disponibilité d'un modèle open ou largement accessible aussi performant qu'un système propriétaire américain change la donne: elle offre une alternative moins coûteuse et potentiellement moins contrainte par les restrictions d'export américaines. Pour l'industrie de l'IA dans son ensemble, cela accentue la pression concurrentielle sur les laboratoires occidentaux, qui doivent désormais justifier leurs prix et leurs conditions d'accès face à des rivaux chinois de plus en plus crédibles. Cette annonce s'inscrit dans un contexte de tensions déjà vives entre les Etats-Unis et la Chine sur plusieurs fronts liés à l'intelligence artificielle, entre restrictions américaines sur l'exportation de puces avancées vers la Chine et volonté de Pékin d'atteindre l'autonomie technologique dans ce secteur jugé stratégique. Alibaba, comme d'autres géants chinois de la tech, investit massivement dans le développement de modèles capables de rivaliser avec les meilleurs systèmes occidentaux, une course qui s'accélère à mesure que Washington et Silicon Valley observent avec attention les progrès réalisés de l'autre côté du Pacifique. Les prochains mois devraient voir se multiplier les annonces similaires de la part des acteurs chinois et américains, chacun cherchant à démontrer sa suprématie technologique dans un secteur dont les enjeux dépassent largement la seule compétition commerciale.

UEOffre potentiellement aux developpeurs et entreprises europeens une alternative moins couteuse et moins soumise aux restrictions d'export americaines, sans impact direct sur une entreprise ou une loi francaise.

💬 Alibaba enfonce le clou et ça devient dur à ignorer. Qwen3.8-Max qui prétend rivaliser avec Anthropic et OpenAI en accès large, pas en démo, c'est un signal de plus que l'écart se referme vite. Selon Le Fil IA, la vraie bascule n'est pas technique mais économique: pour un développeur en France, un modèle chinois quasi aussi bon et moins cher devient un argument qu'aucun labo américain ne peut juste ignorer avec un "on est meilleurs".

LLMsActu
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic