De nouvelles stratégies de raisonnement se généralisent chez OpenAI et d'autres développeurs d'IA
OpenAI prépare un modèle encore non publié, baptisé Astra, dont la particularité repose sur une technique de recherche inédite permettant au système de "réfléchir" beaucoup plus longtemps et plus profondément sur des problèmes complexes. Cette avancée s'appuie sur des concepts déjà connus dans la recherche en intelligence artificielle, les "loop transformers" (transformeurs à boucle) et la "recurrent depth" (profondeur récurrente), qui permettent à un modèle de réitérer ses propres calculs internes plutôt que de produire une réponse en une seule passe. L'information a été rapportée par des journalistes spécialisés couvrant l'actualité d'OpenAI, sans que la date de sortie d'Astra soit précisée. En parallèle, une conférence dédiée à l'intelligence artificielle, AI Agenda Live, doit se tenir à San Francisco dans les prochaines semaines, réunissant notamment Koray Kavukcuoglu, vice-président senior et architecte en chef de l'IA chez Google DeepMind, et Thibault Sottiaux, responsable des produits principaux chez OpenAI.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de The Information AI. Lire l'article original →
Cette percée technique suscite à la fois un fort enthousiasme et une certaine inquiétude dans le secteur. Si elle se confirme, une capacité de raisonnement prolongée et plus profonde pourrait permettre aux modèles d'OpenAI de résoudre des problèmes bien plus complexes qu'aujourd'hui, renforçant l'avance de l'entreprise face à ses concurrents comme Google DeepMind. Mais cette même puissance accrue alimente des craintes sur la difficulté à contrôler ou prédire le comportement de systèmes capables de mener des chaînes de raisonnement plus longues et plus autonomes, un sujet sensible pour les régulateurs et les chercheurs en sécurité de l'IA.
Cette évolution s'inscrit dans une course plus large entre laboratoires d'IA pour améliorer les capacités de raisonnement des grands modèles de langage, après l'essor des modèles dits "de raisonnement" ces deux dernières années. La prochaine conférence AI Agenda Live, où interviendront des figures de Google DeepMind et d'OpenAI, doit permettre d'éclairer la manière dont ces entreprises envisagent la suite des recherches sur le raisonnement, ainsi que la façon dont les start-up d'IA comptent se positionner face aux grands fournisseurs de modèles comme OpenAI et Google.
Pas d'impact direct sur la France/UE