Aller au contenu principal
LLMs · Paper ·

La domination de GPT-4 a duré un an, alors que les modèles les plus performants d'aujourd'hui tiennent à peine sept semaines au sommet

Pendant environ un an, GPT-4 d'OpenAI a occupé la première place de l'Epoch Capabilities Index, un classement qui mesure les capacités des modèles d'intelligence artificielle. Cette domination reste, à ce jour, la plus longue jamais enregistrée par un modèle sur ce classement. Depuis que Claude 3 Opus d'Anthropic a pris la tête en février 2024, la situation a radicalement changé : le leadership a changé de mains 17 fois en un peu plus de deux ans, avec une durée médiane de règne d'à peine sept semaines par modèle.

1 min de lecturePertinence 37
Source

Résumé et traduction réalisés par Le Fil IA à partir de The Decoder. Lire l'article original →

Ce basculement traduit une transformation profonde du secteur. La course entre OpenAI, Anthropic, Google, Meta et les acteurs chinois comme DeepSeek s'est intensifiée au point que plus aucun laboratoire ne parvient à conserver un avantage durable. Pour les entreprises et développeurs qui construisent des produits sur ces modèles, cela signifie une instabilité technologique constante : le meilleur outil aujourd'hui peut être dépassé dans quelques semaines, ce qui complique les choix d'investissement à long terme et encourage une architecture logicielle capable de changer de modèle facilement.

Paradoxalement, cette accélération apparente cache un ralentissement des progrès réels. Les écarts de performance entre les modèles qui se succèdent en tête du classement se réduisent d'une génération à l'autre, signe que les gains de capacités s'amenuisent à mesure que les modèles s'approchent de certaines limites techniques. Cette tendance interroge sur la suite de la course à l'IA générative : les laboratoires devront-ils changer d'approche, au-delà du simple agrandissement des modèles, pour continuer à progresser significativement ?

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

À lire ensuite

01Gemma 4 : les modèles open source les plus performants à taille égale47DeepMind BlogLLMs 02Alibaba dévoile Qwen3.8-Max, un modèle MoE de 2,4 billions de paramètres, le plus performant de la famille Qwen à ce jour45MarkTechPostLLMs 03Claude Sonnet 5 arrive sur AWS : le modèle Sonnet le plus performant d'Anthropic42AWS ML BlogLLMs 
Dossier · OpenAISuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.