Aller au contenu principal
Qwen 3.8-Max : Alibaba clash la Silicon Valley avec une IA puissante et… open weight
LLMsLe Big Data · 2 min de lecture

Qwen 3.8-Max : Alibaba clash la Silicon Valley avec une IA puissante et… open weight

Source originale ↗·

Alibaba a dévoilé le 3 août 2026 Qwen 3.8-Max, le modèle le plus puissant de toute la famille Qwen à ce jour. Contrairement aux modèles fermés d'OpenAI ou d'Anthropic, celui-ci sera open-weight : ses poids seront publiés la semaine prochaine, et Qwen3.8-27B suivra le même chemin. Le modèle est déjà accessible sur la plateforme officielle Qwen et le sera bientôt sur Model Studio, la plateforme cloud d'Alibaba. Techniquement, il s'agit d'un modèle multimodal capable de traiter texte, images et vidéo dans une même conversation, avec une fenêtre de contexte d'un million de tokens. Alibaba affirme qu'il peut analyser des rapports financiers de plusieurs centaines de pages en comprenant simultanément texte, graphiques et tableaux, ou encore parcourir plus de 100 heures de vidéo pour identifier personnages, événements et changements de scène. Le modèle repose sur une architecture Mixture of Experts avec 2 400 milliards de paramètres au total, dont seulement 95 milliards activés à chaque requête.

Cette approche change la donne pour l'accès à l'IA de pointe. En rendant public un modèle qui rivalise avec les meilleures offres américaines, Alibaba permet à des chercheurs et développeurs du monde entier de télécharger, étudier et adapter le modèle sur leurs propres infrastructures, sans dépendre d'une API propriétaire. Les résultats publiés sont significatifs : sur PaperBench, qui évalue la capacité à reproduire un article scientifique en code, Qwen 3.8-Max obtient 93 sur 100, devançant Fable 5 (88,8) et Claude Opus 4.8 (80,3). Sur OSWorld, qui mesure l'usage d'un ordinateur comme le ferait un humain, il prend la première place mondiale avec 86,1. Pour les entreprises et développeurs, cela signifie un accès à des capacités de pointe en codage autonome et en automatisation, à moindre coût grâce à l'architecture MoE qui limite les ressources mobilisées par requête.

Ce lancement s'inscrit dans une compétition de plus en plus vive entre laboratoires chinois et américains. Sur Arena.AI, Qwen 3.8-Max s'est immédiatement classé premier modèle chinois pour les tâches textuelles, même s'il reste derrière Claude Fable 5 au niveau mondial. En vision par ordinateur, il se classe deuxième, juste derrière une variante de Claude Fable 5. Alibaba le compare directement à Kimi K3, le modèle de Moonshot AI doté de 2 800 milliards de paramètres, signe que plusieurs acteurs chinois jouent désormais dans la même catégorie que les géants américains. Reste que les benchmarks ne disent pas tout : l'usage en conditions réelles déterminera si cette avance open source chinoise se confirme face à des modèles fermés qui gardent, pour l'instant, une légère longueur d'avance sur certains terrains.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Qwen3.8-Max : Alibaba revient dans la course pour rivaliser avec Fable 5 et Kimi K3
1Next INpact 

Qwen3.8-Max : Alibaba revient dans la course pour rivaliser avec Fable 5 et Kimi K3

Alibaba a dévoilé Qwen3.8-Max, un modèle de langage doté de 2 400 milliards de paramètres, quinze jours seulement après le lancement de Kimi K3 par Moonshot AI, un autre acteur chinois du secteur. Contrairement à Kimi K3 et ses 2 800 milliards de paramètres et 104,2 milliards de paramètres actifs par token, Qwen3.8-Max repose sur une architecture Mixture of Experts activant 95 milliards de paramètres par token, tout en nécessitant le chargement complet du modèle en mémoire. Alibaba revendique, benchmarks à l'appui, des performances comparables à Gemini 3.1-Pro, GPT-5.6 Sol et Fable 5 sur le raisonnement multimodal, l'analyse d'images en tant qu'« agent visuel », le code et l'analyse de documents. Comme Moonshot AI l'avait fait avec Kimi K3, Alibaba promet de rendre les poids du modèle disponibles en open source sur Hugging Face et ModelScope dans la semaine, après une exclusivité initiale sur sa propre plateforme QwenCloud. Côté tarifs, l'entreprise affiche 2 dollars par million de tokens en entrée et 6 dollars en sortie, des prix inférieurs à ceux de Kimi K3 (3 et 15 dollars), GPT-5.6 Sol (5 et 30 dollars), Opus 4.8 (5 et 25 dollars) et Fable 5 (10 et 50 dollars). Cette sortie confirme que les entreprises chinoises de l'IA générative continuent de talonner les leaders américains, un an après le « moment DeepSeek » qui avait déjà bousculé le secteur. En ciblant explicitement le code et l'automatisation des tâches de bureau, Alibaba se positionne frontalement contre Anthropic, un terrain jusque-là dominé par cette dernière. Pour appuyer sa démonstration, l'entreprise met en avant trois défis réalisés sans intervention humaine, écriture et exécution de code exclues : la génération du projet « oh-my-cli » en dix jours, la reproduction du code d'un article scientifique, et un concours de compréhension des besoins clients. Alibaba insiste sur le fait que son modèle ne se contente pas de suivre un plan prédéfini mais s'adapte grâce à des boucles de rétroaction, un argument destiné à convaincre les développeurs et les entreprises cherchant à automatiser des tâches complexes. Les prix cassés renforcent l'attractivité du modèle pour les usages à grande échelle. Reste que la comparaison des prix par million de tokens masque une réalité plus complexe, comme le montre l'exemple d'Opus 4.7 qui consommait ses tokens bien plus rapidement qu'Opus 4.6 sans que cela soit reflété dans le tarif affiché. Plusieurs utilisateurs de Qwen3.8-Max rapportent déjà avoir épuisé leur quota en quelques prompts seulement, ce qui interroge sur l'écart entre le prix nominal et le coût réel d'usage. Cette question de la consommation de tokens devient centrale dans un marché où les modèles surenchérissent sur les benchmarks et les tarifs, sans que les utilisateurs disposent toujours d'outils fiables pour comparer l'efficacité réelle de chaque système face à leurs besoins concrets.

💬 Le vrai combat n'est plus sur les benchmarks, il est sur le prix au token réel. Alibaba affiche 2 dollars l'entrée contre 10 pour Fable 5, sauf que plusieurs utilisateurs ont grillé leur quota en quelques prompts à peine, preuve que le tarif affiché ne dit presque rien de la facture finale. Kimi K3 puis Qwen3.8-Max en quinze jours, la Chine ne rattrape plus les leaders américains, elle les talonne à un rythme mensuel, mais sans mètre étalon pour la conso réelle, choisir son LLM reste un pari sur une étiquette.

LLMsActu
1 source
MiniMax lance M3 : le modèle Open Weight le plus puissant jamais créé ?
2Le Big Data 

MiniMax lance M3 : le modèle Open Weight le plus puissant jamais créé ?

Le 1er juin 2026, la société chinoise MiniMax a lancé M3, son nouveau modèle d'intelligence artificielle à poids ouverts. Il s'agit du premier modèle open weight à combiner trois capacités jusqu'ici réservées aux systèmes propriétaires : une fenêtre contextuelle d'un million de jetons, des performances de pointe en programmation et en agents autonomes, ainsi qu'une prise en charge native du texte et des images. Sur SWE-Bench Pro, le benchmark de référence pour la résolution de problèmes logiciels réels, M3 obtient 59 %, dépassant GPT-5.5 et Gemini 3.1 Pro selon MiniMax. Il atteint également 66 % sur Terminal-Bench 2.1, 74,2 % sur Atlas MCP et 83,5 sur BrowseComp, score qui surpasserait Claude Opus 4.7. Le modèle est déjà accessible via l'API officielle de MiniMax et son agent de développement MiniMax Code, tandis que les poids ouverts seront publiés sur Hugging Face et GitHub dans une dizaine de jours. Ce lancement est significatif parce qu'il réduit concrètement la barrière entre modèles open source et systèmes propriétaires de premier rang. L'architecture repose sur une technologie maison appelée MiniMax Sparse Attention (MSA), qui identifie les informations pertinentes avant de concentrer les calculs sur elles : résultat, le coût de calcul par jeton est divisé par vingt sur un contexte d'un million de jetons, le traitement des entrées est neuf fois plus rapide que sur la génération précédente, et la génération de réponses gagne un facteur supérieur à quinze. La vitesse de production avoisine 100 jetons par seconde, environ trois fois celle de Claude Opus. Pour les développeurs et les entreprises qui cherchent à déployer des agents autonomes sans dépendre d'APIs propriétaires à coût élevé, M3 représente une option crédible et, surtout, inspecTable. MiniMax est une startup fondée à Shanghai qui opère depuis plusieurs années dans l'ombre des géants américains et de ses concurrents chinois comme Baidu ou Zhipu AI. Avec M3, elle entre directement en compétition avec Anthropic, Google et OpenAI sur le segment haut de gamme, mais avec la carte distinctive de l'ouverture des poids. Le contexte réglementaire et géopolitique autour de l'IA chinoise reste tendu, ce qui rend d'autant plus remarquable qu'une entreprise de ce pays publie un modèle en open weight à ce niveau de performance. Des validations indépendantes seront nécessaires : une partie des benchmarks ont été conduits sur l'infrastructure de MiniMax elle-même. La publication imminente des poids permettra à la communauté de vérifier ces affirmations, et les semaines qui suivent diront si M3 tient ses promesses dans des conditions réelles d'utilisation.

UEL'arrivée d'un modèle open weight performant réduit la dépendance des entreprises et développeurs européens aux APIs propriétaires américaines à coût élevé.

💬 Un million de jetons, des scores d'agent au niveau des meilleurs modèles fermés, et les poids open source dans dix jours : si tout ça se confirme, c'est une vraie gifle pour les APIs propriétaires. Le calcul change pour ceux qui veulent déployer des agents sans facturer à chaque appel. Les benchmarks sont en partie auto-déclarés, donc on attend les poids sur HuggingFace, mais là MiniMax joue dans la cour des grands pour de bon.

LLMsOpinion
1 source
L'équipe Qwen d'Alibaba lance Qwen3.7-Plus avec vision, raisonnement avancé et agents autonomes sur Bailian
3MarkTechPost 

L'équipe Qwen d'Alibaba lance Qwen3.7-Plus avec vision, raisonnement avancé et agents autonomes sur Bailian

L'équipe Qwen d'Alibaba a lancé le 2 juin 2026 le modèle Qwen3.7-Plus, désormais disponible via API sur la plateforme Bailian d'Alibaba Cloud, accessible aux développeurs internationaux sous le nom Model Studio. Ce modèle multimodal comprend les images et les vidéos en plus du texte, ce qui le distingue de son frère jumeau Qwen3.7-Max, exclusivement textuel. Il s'agit d'une capacité de lecture visuelle, non de génération : Qwen3.7-Plus analyse des médias, il ne les crée pas. Au-delà de la vision, le modèle intègre cinq capacités agentiques : raisonnement approfondi, autoprogrammation (il écrit et révise son propre code), invocation d'outils externes et d'API, vérification et test des résultats, et itération autonome jusqu'à l'accomplissement complet d'une tâche. La préversion du modèle s'est classée 16e au classement Vision Arena de LM Arena, plaçant Alibaba au 5e rang mondial des laboratoires en compréhension visuelle. Le modèle texte Max, de son côté, avait obtenu 56,6 points sur l'Artificial Analysis Intelligence Index, meilleur score d'un modèle chinois à sa sortie. Cette sortie marque un tournant dans la stratégie d'Alibaba : le groupe ne cherche plus seulement à rivaliser sur les benchmarks de raisonnement, mais à proposer des modèles capables d'exécuter des tâches longues et complexes de façon autonome. Pour les développeurs et les entreprises, cela ouvre des cas d'usage concrets comme l'analyse OCR à grande échelle, la lecture automatique de graphiques, l'analyse de séquences vidéo, ou encore l'automatisation de workflows techniques complets. La plateforme Bailian embarque deux mécanismes complémentaires : un système d'apprentissage par renforcement agentique (Agentic RL) qui affine la précision du modèle grâce aux retours d'exécution réels, et des garde-fous de sécurité intégrés pour maintenir les outils autonomes dans des limites opérationnelles prédéfinies, un détail crucial lorsqu'un agent exécute des commandes ou modifie des fichiers en production. Ce lancement s'inscrit dans la vague de modèles agentiques qui déferle sur l'industrie depuis début 2026, face à des acteurs comme OpenAI, Google DeepMind et Anthropic. Alibaba avait déjà dévoilé la génération Qwen3.7 en mai 2026, et la sortie de la variante multimodale complète maintenant l'offre de la famille. Le positionnement au 5e rang mondial en vision, malgré un retard encore visible sur les premiers laboratoires américains, confirme que les équipes chinoises se rapprochent du front technologique à un rythme soutenu. L'enjeu pour Alibaba est de transformer Bailian en plateforme de référence pour les entreprises cherchant à déployer des agents IA capables d'agir dans des environnements réels, pas seulement de répondre à des questions, une bataille qui s'annonce centrale dans les prochains mois.

UELes développeurs et entreprises françaises peuvent accéder dès maintenant à Qwen3.7-Plus via l'API internationale Model Studio, offrant une alternative compétitive aux modèles américains pour des cas d'usage agentiques et d'analyse visuelle.

LLMsOpinion
1 source
Alibaba dévoile Qwen3.8-Max, un modèle MoE de 2,4 billions de paramètres, le plus performant de la famille Qwen à ce jour
4MarkTechPost 

Alibaba dévoile Qwen3.8-Max, un modèle MoE de 2,4 billions de paramètres, le plus performant de la famille Qwen à ce jour

Alibaba a annoncé la disponibilité générale de Qwen3.8-Max, un modèle de mélange d'experts (MoE) de 2,4 billions de paramètres, le plus puissant à ce jour dans la famille Qwen. L'entreprise a confirmé que les poids ouverts du modèle seront publiés la semaine prochaine, tout comme ceux d'un second modèle, Qwen3.8-27B, plus adapté à un déploiement sur des serveurs GPU classiques. Qwen3.8-Max accepte du texte, des images et de la vidéo en entrée et produit du texte en sortie. Son API hébergée, compatible avec les formats OpenAI et DashScope, est utilisable dès aujourd'hui par toute entreprise, l'intégration se limitant à un changement d'URL de base et d'identifiant de modèle. Le modèle propose une fenêtre de contexte d'un million de tokens, avec une entrée maximale de 991 000 tokens (983 000 en mode réflexion) et une sortie maximale de 131 000 tokens. Les limites de débit sont fixées à 2 millions de tokens par minute et 15 000 requêtes par minute. Côté tarifs, comptez 2 dollars par million de tokens en entrée, 6 dollars en sortie, et 0,25 dollar pour la lecture en cache implicite, un cache huit fois moins cher que les tokens frais. Le modèle intègre nativement cinq outils via l'API Responses, dont un interpréteur de code et la recherche web. Cette annonce est significative parce qu'elle cible directement des usages professionnels concrets: l'ingénierie logicielle à l'échelle d'un dépôt entier, la revue de documents juridiques et financiers, l'indexation de vidéos longues, l'extraction de données structurées et les assistants de recherche multi-étapes. Mais l'ampleur du modèle pose une vraie question de déploiement. Avec 2,4 billions de paramètres au total, Qwen3.8-Max reste un artefact réservé aux infrastructures de datacenter multi-nœuds, Alibaba n'ayant pas communiqué le nombre de paramètres réellement activés, ce qui empêche pour l'instant d'estimer son coût de service. C'est donc Qwen3.8-27B qui représente la voie réaliste pour un déploiement sur site chez la plupart des entreprises. Les gains de performance les plus nets se situent dans le multimodal et les tâches agentiques plutôt que dans le raisonnement pur: le modèle passe de 21,6 à 56,6 sur DeepSWE 1.1 et de 40,7 à 73,5 sur FrontierSWE par rapport à Qwen3.7-Max. Sur les benchmarks publiés par Alibaba, Qwen3.8-Max obtient 86,6 sur Terminal-Bench 2.1, devançant Claude Opus 4.8 et Claude Fable 5 (84,6) mais restant derrière GPT-5.6 Sol en mode maximal (88,8). Il domine en revanche sur PaperBench (93,0) et sur plusieurs tests de vision comme OSWorld-Verified (86,1) et OmniDocBench 1.5 (92,1). Deux réserves s'imposent toutefois: la comparaison multimodale se fait face à Qwen3.7-Plus et non Qwen3.7-Max, ce qui gonfle artificiellement les progrès affichés, et la courbe d'apprentissage par renforcement d'Alibaba plafonne à 0,725 avant de redescendre à 0,689, signe que la mise à l'échelle atteint ses limites. Aucune licence ni tableau de benchmark complet n'accompagne pour l'instant l'annonce des poids ouverts, prévus la semaine prochaine.

LLMsOpinion
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic