Claude et ChatGPT semblent moins intelligents après chaque mise à jour ou lors de pics d’affluence : simple biais ou réalité ?
Depuis l'arrivée des grands modèles de langage grand public, un scénario se répète à chaque sortie de Claude ou de ChatGPT : un accueil enthousiaste suivi, quelques semaines plus tard, d'une vague de plaintes affirmant que le modèle « est devenu nul ». Anthropic a fini par se pencher sérieusement sur ces signalements et a reconnu que certains d'entre eux correspondaient bien à de véritables bugs techniques, documentés officiellement, plutôt qu'à de simples impressions d'utilisateurs. OpenAI a de son côté également admis quelques dysfonctionnements ponctuels ayant affecté la qualité des réponses de ChatGPT. Mais dans la majorité des cas recensés, aucune dégradation mesurable n'a pu être établie, ce qui suggère qu'une bonne partie du phénomène relève davantage de la perception que d'un problème réel.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de Frandroid. Lire l'article original →
Cette distinction compte pour les millions d'utilisateurs professionnels qui bâtissent des workflows entiers autour de ces outils : si la qualité fluctue réellement selon les périodes de forte affluence ou après une mise à jour silencieuse, cela remet en cause la fiabilité même de ces services comme infrastructures de travail. À l'inverse, si le biais cognitif domine, cela interroge la manière dont les entreprises communiquent sur leurs changements de modèles et gèrent la confiance de leur base d'utilisateurs, un capital fragile dans un marché où la concurrence entre Anthropic, OpenAI et d'autres acteurs reste très vive.
Le sujet s'inscrit dans un débat plus large sur la transparence des fournisseurs d'IA, qui modifient régulièrement l'infrastructure derrière leurs modèles (routage, optimisations, quantification) sans toujours en informer clairement leurs utilisateurs. Anthropic comme OpenAI sont désormais poussés à documenter plus systématiquement leurs incidents, une pratique appelée à se renforcer à mesure que ces outils deviennent critiques pour le monde professionnel.
Pas d'impact direct sur la France/UE