Les groupes terroristes utilisent tous les grands chatbots d'IA pour planifier des attaques et développer des armes
Une étude de l'université de Cambridge révèle que le groupe terroriste nigérian Boko Haram utilise les principaux chatbots d'intelligence artificielle, dont ChatGPT, Claude et Gemini, pour planifier des attaques, fabriquer des explosifs et entretenir des armes. Selon les chercheurs, des opérateurs affiliés à l'État islamique forment depuis 2023 des commandants de Boko Haram à contourner les filtres de sécurité intégrés à ces outils. L'étude documente des cas concrets où les garde-fous censés bloquer les requêtes dangereuses ont échoué à plusieurs reprises, permettant aux utilisateurs malveillants d'obtenir des informations sensibles malgré les protections mises en place par les éditeurs.
Résumé et traduction réalisés par Le Fil IA à partir de The Decoder. Lire l'article original →
Ces révélations posent un problème majeur pour l'industrie de l'IA générative. Alors qu'OpenAI, Anthropic et Google présentent régulièrement leurs mesures de modération comme des remparts efficaces contre les usages malveillants, ce constat démontre que des groupes armés organisés parviennent à détourner ces systèmes à des fins opérationnelles, avec des conséquences directes sur la sécurité de populations civiles en Afrique de l'Ouest. Pour les chercheurs, cela signifie que la simple autorégulation volontaire des entreprises technologiques ne suffit plus à contenir les risques.
Ce constat s'inscrit dans un débat plus large sur l'encadrement réglementaire de l'IA face aux usages terroristes, un enjeu que les gouvernements occidentaux peinent encore à traduire en obligations contraignantes pour les fournisseurs de modèles. La coopération entre groupes djihadistes, ici entre l'État islamique et Boko Haram, autour du partage de techniques de contournement suggère également une professionnalisation croissante de ces pratiques, qui pourrait pousser les autorités et les entreprises d'IA à revoir en profondeur leurs dispositifs de détection et de blocage.
Ce constat alimente le débat européen sur l'encadrement des usages malveillants de l'IA générative dans le cadre de l'AI Act, sans impliquer directement une entreprise ou institution française.
Boko Haram qui utilise ChatGPT ou Gemini pour fabriquer des explosifs, ça montre que les garde-fous des grands labos ne sont pas conçus pour résister à un adversaire déterminé, juste à un usager lambda qui tape une question maladroite. Et ce qui m'inquiète le plus, c'est la mécanique décrite : des opérateurs qui forment d'autres groupes à contourner les filtres depuis 2023, donc une vraie diffusion de savoir-faire, pas un bug isolé. Selon Le Fil IA, tant que la modération restera une affaire de bonne volonté des éditeurs plutôt qu'une obligation vérifiée, ce genre de contournement continuera d'exister en pratique, quels que soient les communiqués rassurants.