Cette IA chinoise a réinventé une méthode scientifique… et a fait mieux que les chercheurs
Le 3 août 2026, Alibaba a présenté Qwen3.8-Max, son modèle d'intelligence artificielle le plus avancé, un système multimodal et open weight doté de 2 400 milliards de paramètres. Au-delà de sa taille, l'entreprise met en avant sa capacité à travailler seul pendant plusieurs jours sur un même objectif, sans supervision humaine. Pour l'illustrer, Alibaba a publié trois démonstrations. Dans la première, le modèle a développé de bout en bout un projet logiciel baptisé oh-my-cli : pendant environ seize jours, il a écrit le code, lancé les tests, corrigé ses propres erreurs et intégré des retours d'utilisateurs, produisant au final 265 commits, 127 pull requests et 151 tickets traités. Dans la deuxième, on lui a fourni un seul article scientifique sur la sélection de données d'entraînement, sans code associé : en 125 heures, soit un peu plus de cinq jours, le modèle a reconstruit tout le pipeline expérimental, écrit 7 600 lignes de code, réalisé plus de 1 100 actions et 33 entraînements sur GPU, reproduit les résultats de l'étude, puis proposé et testé 18 idées d'amélioration, aboutissant selon Alibaba à une méthode dépassant l'original sur le benchmark AIME24. Enfin, inscrit à un concours réel sur la plateforme Tianchi avec les mêmes 24 heures que les participants humains, Qwen3.8-Max a conçu sa solution, entraîné plusieurs modèles et soumis 45 versions successives, terminant devant 458 équipes sur 526, soit 87 % des concurrents.
Ces résultats marquent une rupture avec le fonctionnement habituel des assistants IA, où chaque étape nécessite une validation humaine avant de passer à la suivante. Un modèle capable de tenir un objectif général sur plusieurs jours, de détecter ses erreurs et d'ajuster sa méthode change la nature du travail qu'on peut lui confier : développement logiciel complet, recherche scientifique exploratoire, participation à des compétitions techniques. Pour les développeurs et chercheurs, cela laisse entrevoir des gains de productivité considérables, mais aussi des questions sur le contrôle qualité et la fiabilité de productions non supervisées pendant de longues périodes.
Ce lancement s'inscrit dans une course mondiale à l'IA agentique, où les grands laboratoires cherchent à dépasser le simple chatbot pour créer des agents autonomes capables de planifier, exécuter et corriger leur propre travail. En choisissant l'open weight, Alibaba pousse aussi une stratégie de diffusion large face aux modèles fermés occidentaux. Les chiffres avancés restent toutefois auto-rapportés par Alibaba, sans vérification indépendante à ce stade, ce qui invite à la prudence avant de valider pleinement ces performances face aux futurs benchmarks et à la concurrence.
Dans nos dossiers
Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.




