Aller au contenu principal
LLMs · Opinion ·

L'IA chinoise accélère la course aux modèles à bas coût, portée par Alibaba et DeepSeek

Alibaba a lancé Qwen3.8-Max, son plus grand modèle d'IA à ce jour, doté de 2,4 billions de paramètres et d'une architecture mixture-of-experts qui n'active qu'une partie du réseau par requête, soit environ 95 milliards de paramètres actifs. Le modèle traite texte, images et vidéo, gère jusqu'à un million de tokens de contexte, et a mené à bien un projet d'ingénierie logicielle sur 16 jours selon Alibaba. Il se positionne près de Kimi K3, lancé en juillet par Moonshot AI (2,8 billions de paramètres au total, environ 104 milliards actifs), mais coûte moins cher : 2 dollars par million de tokens en entrée et 6 dollars en sortie, contre 3 et 15 dollars pour Kimi K3. Dans le même temps, DeepSeek a dévoilé V4-Flash, un modèle plus modeste (284 milliards de paramètres au total, 13 milliards actifs selon Artificial Analysis) mais bien plus abordable, à 0,14 dollar par million de tokens en entrée et 0,28 dollar en sortie, avec un tarif de cache pouvant descendre à 0,003 dollar par million de tokens.

2 min de lecturePertinence 47

Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie

Source

Résumé et traduction réalisés par Le Fil IA à partir de AI News. Lire l'article original →

Cette bataille sur les prix illustre un basculement stratégique dans la course chinoise à l'IA, où la performance brute compte désormais moins que le coût réel d'exécution. Sur le benchmark d'Artificial Analysis, V4-Flash revient en moyenne à trois cents par test, contre 86 cents pour Kimi K3, 1,86 dollar pour GPT-5.6 Sol d'OpenAI et 3,15 dollars pour Claude Fable 5 d'Anthropic, un écart qui pourrait redéfinir les arbitrages des entreprises qui déploient ces modèles à grande échelle. Qwen3.8-Max s'est aussi hissé en tête des modèles textuels chinois sur la plateforme comparative Arena.AI, tout en restant derrière plusieurs modèles d'Anthropic au classement général, et se classe deuxième pour l'analyse d'images, derrière une variante de Claude Fable 5.

Ces annonces s'inscrivent dans une compétition plus large entre Alibaba, DeepSeek, Moonshot AI, OpenAI et Anthropic, où l'architecture sparse et le nombre de paramètres actifs deviennent des leviers de compétitivité aussi importants que la taille totale du modèle. Artificial Analysis souligne toutefois que le prix par token ne raconte qu'une partie de l'histoire : sur son benchmark AA-Briefcase pour les tâches agentiques, Kimi K3 revient en moyenne à 10,57 dollars par tâche, avec environ 120 000 tokens générés et 83 échanges en moyenne, preuve que le volume de sortie et le nombre d'appels au modèle peuvent faire grimper la facture bien au-delà du tarif affiché. La suite dépendra de la capacité de chaque acteur à optimiser simultanément coût, rapidité et efficacité réelle sur des tâches complexes.

Impact France / UEChamp produit par Le Fil IA

Les entreprises européennes utilisant ces modèles via API pourraient bénéficier de la baisse des couts d'exploitation, sans qu'aucune entité française ou européenne ne soit directement impliquée.

À lire ensuite

01DeepSeek : dernière avancée en IA et la course aux modèles du monde51MIT Technology ReviewLLMs 02L'IA à base d'agents pousse les prix à la hausse, Deepseek sort un modèle compétitif pour presque rien54The DecoderLLMs 03Le modèle ouvert K3 de Kimi se rapproche de GPT-5.6 Sol et Fable 5, marquant la fin de l'IA chinoise à bas coût46The DecoderLLMs 
Dossier · Moonshot AISuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.