Aller au contenu principal
Recherche · Paper ·

« GPT-5.6 Sol Ultra d'OpenAI aurait résolu un problème mathématique vieux de 50 ans en moins d'une heure »

OpenAI affirme que son dernier modèle, GPT-5.6 Sol Ultra, a produit une démonstration de la conjecture de la double couverture par cycles (Cycle Double Cover Conjecture) en moins d'une heure, un problème de théorie des graphes resté sans solution depuis cinquante ans. Pour y parvenir, le système aurait mobilisé 64 sous-agents travaillant en parallèle, une architecture qui permet de répartir l'exploration des pistes de démonstration plutôt que de suivre un raisonnement linéaire unique. Le mathématicien Thomas Bloom a examiné la preuve et la juge étonnamment élémentaire dans sa construction, tout en pointant un défaut de taille : l'absence de citations vers les travaux antérieurs sur lesquels elle s'appuie manifestement.

1 min de lecturePertinence 42
Source

Résumé et traduction réalisés par Le Fil IA à partir de The Decoder. Lire l'article original →

Cette omission n'est pas un détail cosmétique. Dans un contexte où les entreprises d'IA mettent en avant chaque nouvelle percée pour justifier des valorisations et des investissements colossaux, la capacité réelle de ces modèles à produire des mathématiques originales, plutôt qu'à recombiner intelligemment des résultats déjà publiés, devient une question centrale pour la crédibilité du secteur. Pour la communauté mathématique, cela pose aussi un problème de méthode : une preuve non sourcée complique la vérification et l'attribution du mérite intellectuel.

L'épisode relance ainsi un débat de fond qui traverse la recherche en IA depuis plusieurs années : les grands modèles de langage se contentent-ils de réorganiser des connaissances existantes de façon habile, ou sont-ils capables d'une véritable créativité scientifique ? OpenAI, comme ses concurrents, a tout intérêt à mettre en avant des résultats spectaculaires, mais la vérification indépendante par des experts comme Bloom reste indispensable avant de trancher si ces systèmes ouvrent réellement de nouvelles voies mathématiques ou se limitent à accélérer un travail de synthèse déjà documenté ailleurs.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

Notre lecture

GPT-5.6 Sol Ultra qui "résout" un problème vieux de 50 ans, mais sans citer les travaux dont la preuve s'inspire manifestement, ça ne prouve rien du tout. Le vrai signal, c'est que 64 sous-agents en parallèle explorent des pistes plus vite qu'un chercheur seul, pas que le modèle invente des maths originales. Selon Le Fil IA, tant que les labos ne publient pas de preuves sourcées et vérifiables, on mesure la puissance de recherche des IA, pas leur créativité scientifique.

À lire ensuite

01Un modèle OpenAI résout un problème mathématique célèbre resté sans réponse pendant 80 ans48Ars Technica AIRecherche 02OpenAI promeut son prochain modèle Astra avec la résolution de 10 problèmes de maths46Next INpactRecherche 03Deux équipes résolvent le même problème de cryptographie quantique à trois heures d'intervalle avec GPT-5.642The DecoderRecherche 
Dossier · OpenAISuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.