Aller au contenu principal
Régulation · Reglementation ·

Un dirigeant de Microsoft qualifie le pillage de données par l'IA de "plus grand vol de travail de l'histoire

Des documents internes de Microsoft, jusqu'ici gardés confidentiels, ont été rendus publics jeudi dans le cadre du procès pour violation de droits d'auteur intenté par un groupe de médias mené par The New York Times contre Microsoft et OpenAI. Ces pièces figurent dans une requête en jugement sommaire déposée par les organes de presse plaignants. Elles révèlent que Brent Hecht, directeur des sciences appliquées chez Microsoft, avait mis en garde à plusieurs reprises contre l'utilisation massive de contenus journalistiques pour entraîner les modèles d'intelligence artificielle. La pièce la plus citée est une présentation interne datée de janvier 2024, donc postérieure au lancement de ChatGPT et de Copilot comme au dépôt de la plainte du New York Times. Dans ces documents, Hecht qualifiait cette pratique de vol de travail d'une ampleur inédite, allant jusqu'à évoquer possiblement le plus grand vol de travail de l'histoire humaine. Il contestait aussi directement l'argument juridique central de la défense de Microsoft et OpenAI, selon lequel l'entraînement de l'IA sur des articles de presse relève du fair use, estimant que la pratique tournait cette notion en dérision.

2 min de lecturePertinence 54

Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie

Source

Résumé et traduction réalisés par Le Fil IA à partir de Ars Technica AI. Lire l'article original →

Également couvert par TechCrunch AI.

Ces révélations fragilisent considérablement la position de Microsoft et OpenAI dans un contentieux qui pourrait redéfinir les règles d'utilisation de contenus protégés pour l'entraînement des systèmes d'IA générative. Que des cadres aient eux-mêmes nommé et chiffré le risque alors que les produits étaient déjà déployés déplace le débat : il ne s'agit plus seulement d'interprétation juridique du fair use, mais de ce que les entreprises savaient et de ce qu'elles en ont fait. Ces phrases proviennent toutefois du mémoire des plaignants, les pièces elles-mêmes restant largement scellées ou caviardées. Pour l'industrie des médias, exsangue depuis des années face à la baisse des revenus publicitaires, ces preuves renforcent l'argument selon lequel les géants technologiques se sont enrichis en pillant leur travail sans compensation.

Le procès, engagé depuis plusieurs années par le New York Times et d'autres organes de presse, s'inscrit dans une vague plus large de litiges opposant éditeurs et créateurs de contenus aux entreprises d'IA générative, incluant des poursuites contre OpenAI, Microsoft, Meta et Google. La stratégie de défense reposait largement sur le fair use, une doctrine juridique américaine encore peu testée face à l'IA générative. La déclassification de ces documents pourrait peser lourd lors du jugement à venir et inciter d'autres plaignants à demander la publication de communications internes similaires.

Impact France / UEChamp produit par Le Fil IA

Ce procès américain pourrait influencer le débat européen sur le fair use et les droits d'auteur face à l'IA, mais n'a pas d'effet juridique direct en France ou dans l'UE.

Notre lecture

Ce qui change la donne, c'est pas le procès, c'est qui parle : un cadre Microsoft qui alertait en interne, avant même le lancement de Copilot, que c'était potentiellement le plus grand vol de travail de l'histoire. Ça, ça vaut plus que dix ans de plaidoiries sur le fair use. Le message aux éditeurs : arrêtez de négocier la compensation après coup, exigez la publication des mails internes, c'est là que se niche la vraie preuve.

À lire ensuite

01L'IA entraînée sur le "fair use" vacille quand ses propres employés parlent de "vol stupéfiant52The DecoderRégulation 02Sony et Warner poursuivent Anthropic pour "l'un des vols de propriété intellectuelle les plus massifs et flagrants de l'histoire45The DecoderRégulation 03OpenAI et Microsoft savaient qu'ils enclenchaient une "spirale de la mort" pour le web53The Verge AIRégulation 
Dossier · MicrosoftSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.