L'ontologie fait son grand retour : pourquoi les agents IA relancent le web sémantique

Lors de l'édition 2026 de l'AI Engineer World's Fair, l'une des présentations les plus suivies a été celle de Frank Coyle, professeur d'informatique qui enseigne l'IA générative et les LLMs à UC Berkeley. Dans une intervention de vingt minutes, Coyle a réintroduit auprès des ingénieurs IA d'aujourd'hui le concept d'ontologie, une notion qui, selon lui, remonte à Aristote et qui a traversé toute l'histoire de l'intelligence artificielle. Une ontologie, qu'il définit simplement comme des "données sous forme de graphes", décrit la structure des données d'un domaine de connaissance : ses classes, ses propriétés et ses relations. Coyle défend l'idée que si les LLMs excellent dans le raisonnement probabiliste, les systèmes agentiques ont besoin de "garde-fous logiques" pour être réellement fiables, et que ces garde-fous, ce sont précisément les ontologies. Lors d'un keynote au même événement, Emil Eifrem, PDG de Neo4j, société spécialisée dans les bases de données en graphe, a détaillé trois types d'ontologies permettant de créer un "substrat partagé plus intelligent" pour faire tourner des agents à grande échelle : une ontologie orientée métier décrivant les concepts clés d'une organisation, une ontologie technique regroupant les métadonnées de toutes les sources et actifs de données de l'entreprise, et enfin les traces d'exécution, c'est-à-dire les signaux produits en temps réel par les agents.
Cette remise au goût du jour a une portée concrète pour les développeurs qui construisent des agents IA. Coyle a cité des standards du web sémantique déjà bien connus, comme Schema.org, FOAF, Dublin Core, ainsi que des technologies complémentaires comme RDFS et OWL. Leur avantage est qu'elles figurent déjà dans les données d'entraînement des LLMs, ce qui permet aux développeurs de les invoquer directement par prompt plutôt que de réinventer des ontologies depuis zéro. Il a notamment montré un agent Claude utilisant une ontologie pour valider le raisonnement du modèle après l'exécution d'un outil, une approche qu'il qualifie d'"IA neurosymbolique", combinant réseaux de neurones et systèmes symboliques à base de règles et de graphes de connaissances.
Cette approche relance en réalité un vieux débat. Kingsley Idehen, dirigeant d'OpenLink Software, développe depuis des années une pile technique d'ingénierie d'agents fondée sur le web sémantique, incluant un agent doté d'une "mémoire RDF". Il résume l'intérêt de combiner les deux mondes : le langage donne sa puissance expressive, l'ontologie lui donne un contexte calculable. Reste un problème historique, celui de la maintenance des ontologies, qui explique en grande partie pourquoi la vision du "web sémantique" des années 1990 et 2000 n'a jamais vraiment décollé. Sur X, le développeur Prasenjit Sarkar a proposé une piste : confier à l'agent lui-même la tâche de maintenir son ontologie au fil de son fonctionnement.
Dans nos dossiers
Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.




