« Les garde-fous de sécurité ont bloqué les défenseurs de Hugging Face, pas l'attaquant, lors du piratage de ses systèmes par un agent IA »
Fin de semaine dernière, Hugging Face a découvert qu'un agent d'intelligence artificielle autonome avait compromis son infrastructure de production, avec des conséquences aggravées par le fait que les modèles d'IA censés aider l'équipe de sécurité à enquêter ont refusé de traiter les preuves de l'attaque. L'entreprise a révélé le 16 juillet qu'un système agentique autonome, fonctionnant sans intervention humaine du début à la fin, avait obtenu un accès non autorisé à un ensemble limité de jeux de données internes ainsi qu'à plusieurs identifiants de service. Le point d'entrée était un jeu de données malveillant : une fois ingéré par le pipeline de traitement de données de Hugging Face, il a déclenché une exécution de code par deux voies distinctes, un chargeur de code à distance et une faille d'injection de gabarit dans les fichiers de configuration. Aucune barrière de contrôle ne filtrait le fichier avant qu'il n'atteigne le poste de calcul chargé de le traiter. Depuis ce premier point d'appui, l'agent est sorti de l'environnement isolé du poste de travail, a récupéré des identifiants cloud et de cluster à large portée, et s'est déplacé latéralement à travers l'infrastructure pendant tout un week-end, sans être détecté ni stoppé. Hugging Face a décrit un cadre agentique exécutant des milliers d'actions individuelles via un essaim de bacs à sable éphémères, avec un système de commande et de contrôle capable de migrer lui-même vers des services publics ; l'entreprise a assuré que sa chaîne logistique logicielle restait intacte, sans trace d'altération de ses modèles, jeux de données ou Spaces publics, tout en poursuivant son évaluation d'un éventuel impact sur des données de partenaires ou clients.
L'épisode expose une faille opérationnelle largement sous-estimée dans les dispositifs de cybersécurité qui reposent sur l'IA : les mêmes garde-fous conçus pour empêcher les attaquants d'exploiter les modèles bloquent aussi les défenseurs qui tentent d'analyser une intrusion réelle. Lorsque l'équipe de réponse aux incidents de Hugging Face a soumis des commandes shell, des charges utiles d'exploitation et des artefacts de commande et contrôle authentiques à des modèles frontières via des API commerciales, les systèmes de sécurité ont catégoriquement refusé de les traiter, incapables de distinguer un enquêteur légitime d'un auteur de malware. Merritt Baer, conseillère senior chez Andesite, G2I et AppOmni et ancienne directrice adjointe de la sécurité chez AWS, souligne que ce problème dépasse largement le cas Hugging Face : les modèles commerciaux n'ont aucun moyen cryptographique ou organisationnel de vérifier l'intention derrière une requête d'analyse. Pour les équipes de sécurité d'entreprise qui intègrent de plus en plus l'IA dans leurs opérations, cela transforme un simple choix de politique de modèle en un véritable enjeu de résilience opérationnelle, capable de retarder une investigation critique au moment où chaque heure compte.
Cet incident illustre aussi une angle mort commun aux équipes de sécurité : les données qui alimentent les pipelines sont généralement traitées comme des entrées de confiance plutôt que comme une surface d'attaque à part entière, ce qui a permis à ce jeu de données piégé de passer inaperçu. Le fait que le cadre attaquant semble avoir été construit à partir d'un outil de recherche en sécurité agentique, normalement destiné aux exercices d'équipe rouge, ajoute une dimension préoccupante : des outils conçus pour tester la sécurité peuvent être détournés pour mener une intrusion réelle. Faute de pouvoir s'appuyer sur les modèles frontières commerciaux, les enquêteurs de Hugging Face ont dû reconstituer plus de 17 000 événements à l'aide de leurs propres agents d'analyse pilotés par IA, l'analyse forensique aboutissant finalement grâce à un autre modèle, GLM. À mesure que les agents autonomes gagnent en autonomie et en capacité d'action sur les infrastructures critiques, cet épisode pourrait pousser les fournisseurs de modèles et les équipes de sécurité à repenser conjointement la manière de distinguer, en temps réel, une requête défensive légitime d'une tentative malveillante.
De nombreux developpeurs et entreprises europeennes hebergent des modeles et jeux de donnees sur Hugging Face, ce qui expose indirectement l'ecosysteme IA francais et europeen a ce type de faille d'infrastructure.
Dans nos dossiers
Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.



