L'IA peut moderniser les logiciels de recherche, mais pas juger si la science est correcte
OpenAI et plusieurs partenaires académiques ont publié un rapport de terrain montrant que les agents de codage IA peuvent moderniser des logiciels de recherche scientifique laissés à l'abandon, avec des gains de performance atteignant jusqu'à 60 fois la vitesse d'origine. Ces outils ont été testés sur du code utilisé par des chercheurs, souvent ancien, mal documenté ou jamais optimisé, faute de temps ou de compétences en ingénierie logicielle au sein des équipes scientifiques. Les résultats montrent que les agents parviennent à réécrire, paralléliser et accélérer ces programmes de manière significative, sans intervention humaine lourde sur le code lui-même.
Mais le rapport pointe une limite critique : ces systèmes se montrent, selon les mots des participants, "éloquents, convaincants, et confiants à tort d'une manière difficile à détecter". Autrement dit, un agent peut produire du code plus rapide et qui semble fonctionner, tout en introduisant des erreurs subtiles qui faussent les résultats scientifiques sans que cela saute aux yeux. Pour les chercheurs, l'enjeu n'est donc plus la vitesse d'exécution mais la fiabilité des conclusions tirées de ces calculs, un problème d'autant plus sensible que la science repose sur l'exactitude des données produites.
Conséquence directe observée sur le terrain : le travail des chercheurs et ingénieurs ne se déplace plus vers l'écriture de code, largement prise en charge par l'IA, mais vers la vérification minutieuse de la justesse scientifique des résultats produits. Ce constat s'inscrit dans un débat plus large sur l'usage des agents de codage en recherche, où la promesse de gains de productivité se heurte à la nécessité de garder un contrôle humain rigoureux sur la validité des sorties, faute de quoi l'automatisation pourrait accélérer la production d'erreurs autant que celle des résultats.
Dans nos dossiers
Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.




