Aller au contenu principal
LLMs · Opinion ·

L'histoire de Qwen : les modèles d'IA d'Alibaba, de 7B à 2,4 billions de paramètres

En avril 2023, Alibaba Cloud a commencé à distribuer des codes d'invitation à ses clients professionnels pour Tongyi Qianwen, un chatbot dont le nom évoque « la vérité née de mille questions » et emprunte en partie au philosophe Mencius. Présenté publiquement le 11 avril à Pékin par le PDG d'alors, Daniel Zhang, il devait être intégré à toutes les activités du groupe, à commencer par DingTalk et l'enceinte Tmall Genie. Le tournant a eu lieu le 3 août 2023, avec l'ouverture de Qwen-7B et Qwen-7B-Chat, réponse directe à Llama 2 de Meta : 2,2 trillions de tokens de pré-entraînement et licence gratuite en usage commercial sous 100 millions d'utilisateurs mensuels. Qwen-VL, première branche vision-langage, a suivi fin août, puis le service s'est ouvert au grand public le 13 septembre, signe d'une approbation réglementaire chinoise. Les modèles 72B et 1,8B sont sortis vers le 1er décembre. En 2024, trois générations se sont enchaînées en huit mois : Qwen1.5 en février (0,5B à 72B, plus un modèle de 110B), Qwen2 en juin (dont un premier MoE ouvert, 57B-A14B, 27 langues supplémentaires, licence Apache 2.0 pour tous les modèles sauf le 72B), puis Qwen2.5 le 19 septembre avec plus de 100 modèles ouverts, entraînés sur 18 trillions de tokens avec un contexte de 128K. Alibaba revendiquait alors plus de 40 millions de téléchargements et plus de 50 000 modèles dérivés sur Hugging Face.

2 min de lecturePertinence 51

Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie

Source

Résumé et traduction réalisés par Le Fil IA à partir de MarkTechPost. Lire l'article original →

Cette trajectoire a transformé Qwen en choix par défaut pour de nombreux développeurs, grâce à une gamme couvrant du modèle pour ordinateur portable aux poids ouverts de très grande taille, et à une licence de plus en plus permissive. Pour les entreprises et chercheurs, cela offre une alternative ouverte aux modèles américains, avec des déclinaisons spécialisées : Qwen2.5-Coder pour le code (novembre 2024), Qwen2-Math, Qwen2-Audio et Qwen2-VL, capable d'analyser des vidéos de plus de 20 minutes. L'arrivée du raisonnement ouvert, avec QwQ-32B-Preview sous Apache 2.0 fin novembre 2024 face à o1 d'OpenAI, puis de QVQ-72B-Preview le 24 décembre pour le raisonnement visuel, a montré que cette ouverture ne se limitait pas aux modèles de base. L'écart matériel est parlant : QwQ-32B, publié le 6 mars 2025, revendique des performances comparables à DeepSeek-R1 (671B) avec environ 24 Go de VRAM contre plus de 1 500 Go selon VentureBeat. L'action Alibaba cotée à Hong Kong a gagné plus de 7 % ce jour-là.

Ce parcours s'inscrit dans la course ouverte par ChatGPT, où Alibaba est entré avec quelques mois de retard, avant de se positionner face à Llama de Meta puis à DeepSeek. Début 2025, l'essor de DeepSeek-R1 a poussé l'équipe à réagir en quelques semaines : Qwen2.5-VL, capable de piloter ordinateurs et téléphones, est sorti le 26 janvier, suivi le 29 janvier de Qwen2.5-Max, un grand modèle MoE qui, selon Alibaba, dépasse DeepSeek-V3 (Reuters). Trois ans et demi après la démonstration d'avril 2023, la famille publie désormais des poids ouverts allant jusqu'à 2,4 trillions de paramètres, ce qui illustre le chemin parcouru depuis le modèle de 7 milliards. Reste à voir comment Alibaba conciliera cette stratégie d'ouverture avec ses ambitions commerciales dans le cloud, face à une concurrence chinoise et américaine toujours plus rapide.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

À lire ensuite

01Alibaba dévoile Qwen3.8-Max, un modèle MoE de 2,4 billions de paramètres, le plus performant de la famille Qwen à ce jour45MarkTechPostLLMs 02Alibaba dévoile Qwen3.8-Flash-Next, un modèle MoE multimodal de 125 milliards de paramètres qui préfigure Qwen444MarkTechPostLLMs 03IFM dévoile K2 Horizon : six modèles Apache 2.0, de 0,9 à 375 milliards de paramètres44MarkTechPostLLMs 
Dossier · Qwen3Suivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.