Reddit mise désormais l’IA pour débusquer le harcèlement et les règles implicites
Reddit vient d'ouvrir son nouvel outil de modération, le Rules Hub, à toutes les communautés nouvellement créées sur la plateforme. Ce système remplace progressivement l'Automoderator historique, qui reposait uniquement sur des listes de mots-clés et d'expressions figées, parfois définies des années plus tôt par des modérateurs devenus inactifs. Le directeur général de Reddit, Steve Huffman, a lui-même critiqué cet ancien outil, jugé selon ses propos relayés par IBTimes UK « difficile à apprendre et à maintenir » pour des équipes de modération majoritairement bénévoles. Avec Rules Hub, les modérateurs rédigent désormais leurs règles en langage naturel, par exemple pour viser le harcèlement déguisé en humour ou les remarques passives-agressives, et une IA analyse chaque publication pour en saisir le contexte plutôt que de chercher de simples correspondances textuelles. L'outil a été testé ces derniers mois auprès de plus de 700 communautés, avec la participation de membres du Mod Council Network, avant ce déploiement plus large annoncé aujourd'hui.
Cette évolution touche un écosystème considérable : Reddit revendique plus de 130 millions de visiteurs quotidiens et plus de 100 000 communautés actives, dont la modération repose en grande partie sur des bénévoles souvent démunis face à des règles complexes ou des contenus ambigus. En permettant à l'IA de comprendre l'intention derrière un message plutôt que de se limiter à des mots interdits, Reddit espère réduire la charge de travail des modérateurs et améliorer la détection de comportements toxiques qui échappaient jusqu'ici aux filtres automatiques. Le contrôle humain reste toutefois central : les équipes choisissent la réaction appropriée, qu'il s'agisse d'une mise en file d'attente pour vérification, d'un masquage automatique ou d'une suppression directe, et peuvent tester une règle sur d'anciennes publications avant de l'activer, tout en consultant un journal détaillé des décisions prises par l'IA.
Ce lancement s'inscrit dans une stratégie plus large de Reddit visant à automatiser la sécurité de la plateforme grâce à l'intelligence artificielle, aux côtés d'outils déjà déployés comme Post and Comment Guidance, qui rappelle les règles aux utilisateurs avant publication, et Safety Filters, dédié à la détection de contenus problématiques. Le déploiement du Rules Hub se fera de façon progressive : les communautés les plus importantes ou dotées de règles particulièrement complexes devront attendre avant d'y accéder pleinement. Cette prudence reflète les enjeux propres à une modération assistée par IA, où la fiabilité des décisions automatisées et la confiance des équipes bénévoles restent déterminantes. L'initiative s'inscrit également dans un mouvement plus général des grandes plateformes sociales, confrontées à une pression croissante pour lutter contre le harcèlement en ligne tout en allégeant la charge pesant sur des modérateurs non rémunérés.
Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.



