DERNIÈRES ACTUALITÉS
SÉLECTIONNÉ POUR VOUS

PDG de Reddit : Microsoft et autres moteurs de recherche IA doivent payer pour utiliser « nos données »

ParJeffrey GogoJeffrey Gogo 2 min de lecture
Reddit
  • Reddit continuera à bloquer les entreprises d'IA qui tentent de scraper des données sur son site.
  • La plateforme souhaite être rémunérée pour le contenu qu'elle propose.
  • Des entreprises comme Microsoft affirment que le contenu de Reddit est du « logiciel gratuit » et refusent de payer.

Le PDG de Reddit, Steve Huffman, a insisté sur le fait que la plateforme de médias sociaux continuera de bloquer les entreprises d'IA, y compris Microsoft, de récupérer des données sur son site jusqu'à ce qu'elles soient payées et aient leur mot à dire sur la façon dont le contenu est utilisé. Il a déclaré que Reddit ne ferait aucun compromis sur l'utilisation non licenciée de ses données pour entraîner des modèles IA, selon The Verge.

Au cours des derniers mois, Reddit a apporté des changements à sa politique dans le but d'empêcher les développeurs d'IA de récupérer ses données utilisateurs, publications et communautés sans consentement ou paiement. L'entreprise a depuis conclu un accord d'une valeur de 60 millions de dollars avec Google, permettant au géant de la tech d'utiliser son contenu. Reddit a conclu un accord similaire avec OpenAI, le créateur de ChatGPT, en mai.

Microsoft tire profit du contenu gratuit de Reddit

Cependant, Microsoft a continué à utiliser le contenu de Reddit pour construire les fonctionnalités IA dans son moteur de recherche Bing sans permission, a allégué Huffman. Le PDG de Reddit a accusé Microsoft de tirer profit du contenu de son entreprise. Il a déclaré que Microsoft récupérait les données gratuitement mais les vendait aux entités IA via l'API Bing pour en tirer profit.

Finalement, Reddit a bloqué l'accès de Microsoft à ses données utilisateurs, ce qui signifiait que Bing ne pouvait plus afficher le contenu de Reddit dans ses résultats de recherche. Reddit utilise le Protocole d'exclusion des robots, ou robots.txt, un outil utilisé par les sites web pour identifier les robots d'exploration accédant au site et empêcher l'utilisation non autorisée de leurs données. Dans une récente interview avec The Verge, Huffman a déclaré :

« Nous avons eu Microsoft, Anthropic et Perplexity agissant comme si tout le contenu d'Internet était gratuit pour eux. C'est leur vraie position. »

Huffman a révélé que les trois entreprises – Microsoft, Anthropic et Perplexity – et d'autres petites entreprises d'IA ont refusé de négocier un paiement pour la récupération du contenu de Reddit. Les entités argumentent généralement que les données sont des informations publiquement disponibles et peuvent être utilisées dans le cadre du principe d'utilisation équitable. Salesforce a précédemment défendu son utilisation du contenu YouTube sur les mêmes bases. Apple a également déclaré qu'elle avait entraîné son IA sur des données publiquement disponibles.

« Sans ces accords, nous n'avons aucun mot à dire ni aucune connaissance de la façon dont nos données sont affichées et de ce à quoi elles sont utilisées », a déclaré Huffman. « [Cela] nous a placés dans une position maintenant de bloquer ceux qui n'ont pas été disposés à convenir de la façon dont nous aimerions que nos données soient utilisées ou non. »

Reddit

Le patron de Microsoft dit que le contenu web est un « logiciel gratuit »

Un porte-parole de Microsoft a déclaré que l'entreprise « respecte » le protocole robot.txt et a cessé d'explorer Reddit le 1er juillet. Pendant ce temps, Mustafa Suleyman, PDG de Microsoft AI, est récemment apparu dans la presse décrivant le contenu de Reddit comme un logiciel gratuit.

« … en ce qui concerne le contenu qui est déjà sur le web ouvert, le contrat social de ce contenu depuis les années 90 a été qu'il relève de l'utilisation équitable », a-t-il détaillé. « N'importe qui peut le copier, le recréer avec, le reproduire avec. C'était un logiciel gratuit, si vous voulez. C'était la compréhension. »

Les lois américaines sur le droit d'auteur permettent la réutilisation du contenu publié. Le site web du droit d'auteur du gouvernement des États-Unis indique qu'il est permis d'utiliser des portions limitées d'une œuvre, y compris des citations, à des fins telles que le commentaire, la critique, le reportage d'actualités et les rapports universitaires, car ceux-ci relèvent tous de la doctrine de l'utilisation équitable. Cependant, les moteurs de recherche ne sont pas tenus de compenser les éditeurs.

Si vous lisez ceci, vous êtes déjà en avance. Restez ainsi grâce à notre newsletter.

Partager cet article

Avertissement. Les informations fournies ne constituent pas des conseils en matière d'investissement. Cryptopolitan.com ne saurait être tenue responsable des investissements réalisés sur la base des informations fournies sur cette page. Nous recommandons vivement de mener vos propres recherches et/ou de consulter un professionnel qualifié avant de prendre toute décision d'investissement.

Jeffrey Gogo

Jeffrey Gogo

Jeffrey Gogo est journaliste avec 20 ans d'expérience dans les actualités et analyses liées aux affaires, à la finance et au changement climatique. Son travail a été publié par la Fondation Thomson Reuters, le Zimbabwe Herald et plusieurs publications en ligne. Il a également écrit abondamment sur l'IA et le métavers et a commencé à couvrir les marchés cryptographiques en 2017. Gogo a étudié le journalisme et la communication de masse à CCOSA à Harare.

PLUS D'ACTUALITÉS…