DERNIÈRES ACTUALITÉS
SÉLECTIONNÉ POUR VOUS

Le PDG de Meta, Mark Zuckerberg, a approuvé l'utilisation de livres piratés pour entraîner l'IA : dépôt de plainte

ParEnacy MapakameEnacy Mapakame 2 min de lecture
Le PDG de Meta, Mark Zuckerberg, a approuvé l'utilisation de livres piratés pour entraîner l'IA : dépôt de plainte
  • Les auteurs affirment que Meta savait qu'elle utilisait des œuvres piratées pour entraîner ses systèmes d'IA.
  • Des communications internes de l'entreprise étayent ces allégations.
  • Cela représente l'un des nombreux cas où des auteurs et des artistes ont accusé des entreprises technologiques d'utiliser leurs œuvres sans leur consentement pour entraîner l'IA.

Meta Platforms a entraîné ses modèles d'IA en utilisant des versions piratées de livres protégés par le droit d'auteur, avec l'approbation de son PDG, Mark Zuckerberg.

Selon des documents judiciaires nouvellement divulgués, un groupe d'auteurs allègue que le géant des réseaux sociaux savait qu'il utilisait des œuvres piratées pour entraîner ses systèmes d'IA.

Des documents internes de Meta « révèlent » les allégations

Dans leur dépôt de plainte, les auteurs ont déclaré que des documents internes produits par Meta lors de la phase de divulgation ont montré que la société de réseaux sociaux savait pour les livres piratés. Selon The Guardian, son PDG Zuckerberg a soutenu l'utilisation du jeu de données LibGen, un énorme archive en ligne de livres. Cela était malgré les avertissements au sein de l'équipe exécutive IA de l'entreprise selon lesquels il s'agit d'un jeu de données « que nous savons être piraté ».

L'auteur américain Ta-Nehisi Coates, la comédienne Sarah Silverman et d'autres écrivains qui poursuivent l'entreprise pour violation du droit d'auteur ont formulé ces accusations dans des dépôts rendus publics mercredi devant un tribunal fédéral en Californie.

Les auteurs ont poursuivi Meta en justice en 2023 pour alléguer que la société de réseaux sociaux utilisait abusivement leurs livres pour entraîner des modèles d'IA, en particulier Llama, son grand modèle de langage qui alimente ses chatbots.

Originaire de Russie, le jeu de données Library Genesis ou LibGen est une « bibliothèque fantôme » qui prétend contenir des millions de romans, de livres de notification ainsi que des articles de magazines scientifiques.

En 2024, un tribunal fédéral de New York a demandé aux opérateurs anonymes de LibGen de payer à un groupe d'éditeurs 30 millions de dollars en dommages et intérêts pour violation du droit d'auteur

C'est l'un des nombreux autres cas qui allèguent que des œuvres protégées par le droit d'auteur d'auteurs, d'artistes et d'autres ont été utilisées pour entraîner des outils d'IA génératifs comme le chatbot ChatGPT sans le consentement des propriétaires. Les professionnels de la création ont averti que l'utilisation de leurs travaux sans leur consentement met en danger leurs modèles économiques.

Selon Reuters, les défendeurs ont cependant fait valoir qu'ils avaient fait un usage loyal (fair use) du matériel protégé par le droit d'auteur.

Le juge a autorisé les auteurs à déposer une plainte modifiée

Dans l'affaire Meta, les auteurs auraient demandé au tribunal mercredi la permission de déposer une plainte mise à jour. Dans leurs arguments, ils ont indiqué que de nouvelles preuves montraient que les sociétés de réseaux sociaux utilisaient le jeu de données d'entraînement d'IA LibGen, qui comprend des millions d'œuvres piratées, et le distribuaient via des torrents pair-à-pair.

Selon eux, Zuckerberg « a approuvé l'utilisation par Meta du jeu de données LibGen, malgré les préoccupations au sein de l'équipe exécutive IA de Meta (et d'autres chez Meta) selon lesquelles LibGen est “un jeu de données que nous savons être piraté.””

Le dépôt cite également un mémo qui faisait référence aux initiales de Zuckerberg, notant qu'« après escalade vers MZ », l'équipe IA de Meta « a été approuvée pour utiliser LibGen ».

L'année dernière, un juge de district américain, Vince Chhabria, a rejeté les allégations selon lesquelles le texte généré par les modèles d'IA de Meta enfreignait les droits d'auteur des auteurs et que Meta avait illégalement retiré les informations de gestion du droit d'auteur des livres. Cela fait référence aux informations sur l'œuvre, y compris le titre, le nom de l'auteur et le propriétaire du droit d'auteur.

Les plaignants ont cependant été autorisés à modifier leurs allégations. Dans leurs arguments de cette semaine, les auteurs ont déclaré que les preuves renforçaient leurs allégations de violation et justifiaient la relance de leur affaire de gestion du droit d'auteur en ajoutant une nouvelle allégation de fraude informatique.

Lors d'une audience jeudi, le juge a déclaré qu'il permettrait aux auteurs de déposer une plainte modifiée, bien qu'il soit sceptique quant au bien-fondé des allégations de fraude.

Les esprits les plus brillants du secteur crypto lisent déjà notre newsletter. Vous aussi ? Rejoignez-les.

Partager cet article

Avertissement. Les informations fournies ne constituent pas des conseils en matière d'investissement. Cryptopolitan.com ne saurait être tenue responsable des investissements réalisés sur la base des informations fournies sur cette page. Nous recommandons vivement de mener vos propres recherches et/ou de consulter un professionnel qualifié avant de prendre toute décision d'investissement.

Enacy Mapakame

Enacy Mapakame

Enacy Mapakame est journaliste avec plus de 10 ans d'expérience dans les actualités économiques et financières. Elle couvre les marchés capitalistiques et les technologies émergentes – le métavers, l'IA et la cryptomonnaie. Enacy détient un diplôme de licence (BSc) en études médiatiques et sociales avec mention.

PLUS D'ACTUALITÉS…