CEO da Reddit: Microsoft e outros mecanismos de busca de IA devem pagar para usar ‘nossos dados’

- O Reddit continuará a bloquear empresas de IA que raspam dados em seu site.
- A plataforma afirma que deseja ser remunerada por seu conteúdo.
- Empresas como a Microsoft afirmam que o conteúdo do Reddit é 'gratuito' e se recusam a pagar por ele.
O CEO da Reddit, Steve Huffman, insistiu que a plataforma de mídia social continuará a bloquear empresas de IA, incluindo a Microsoft, de raspagem de dados em seu site até que seja pago e tenha voz sobre como o conteúdo é usado. Ele disse que a Reddit não vai ceder no uso não licenciado de seus dados para treinar modelos de IA, de acordo com The Verge.
Nos últimos meses, a Reddit fez mudanças em sua política na tentativa de impedir que desenvolvedores de IA raspem seus dados de usuários, postagens e comunidades sem consentimento ou pagamento. A empresa concluiu um acordo no valor de $60 milhões com o Google, permitindo que o gigante da tecnologia use seu conteúdo. A Reddit fez um acordo semelhante com a OpenAI, criadora do ChatGPT, em maio.
Microsoft lucra com o conteúdo gratuito da Reddit
No entanto, a Microsoft continuou a usar o conteúdo da Reddit para construir os recursos de IA em seu mecanismo de busca Bing sem permissão, alegou Huffman. O CEO da Reddit acusou a Microsoft de lucrar com o conteúdo de sua empresa. Ele disse que a Microsoft raspou os dados gratuitamente, mas os vendeu para entidades de IA por meio da API do Bing para lucro.
Eventualmente, a Reddit bloqueou a Microsoft de acessar seus dados de usuários – o que significava que o Bing não poderia mais exibir conteúdo da Reddit em seus resultados de pesquisa. A Reddit utiliza o Protocolo de Exclusão de Robôs, ou robots.txt, uma ferramenta usada por sites para identificar rastreadores da web que acessam o site e impedir o uso não autorizado de seus dados. Em uma recente entrevista com The Verge, Huffman afirmou:
“Tivemos Microsoft, Anthropic e Perplexity agindo como se todo o conteúdo da internet fosse gratuito para eles usarem. Essa é a verdadeira posição deles.”
Huffman revelou que as três empresas – Microsoft, Anthropic e Perplexity – e outras pequenas empresas de IA se recusaram a negociar o pagamento pela raspagem do conteúdo da Reddit. As entidades geralmente argumentam que os dados são informações publicamente disponíveis e podem ser usados sob os princípios de uso justo. A Salesforce anteriormente defendeu o uso de conteúdo do YouTube nos mesmos termos. A Apple também disse que treinou sua IA em dados publicamente disponíveis.
“Sem esses acordos, não temos nenhuma voz ou conhecimento sobre como nossos dados são exibidos e para que são usados”, disse Huffman. “[Isso] nos colocou em uma posição agora de bloquear pessoas que não estiveram dispostas a chegar a um acordo sobre como gostaríamos que nossos dados fossem usados ou não usados.”

Chefe da Microsoft diz que conteúdo da web é ‘freeware’
Um porta-voz da Microsoft disse que a empresa “respeita” o protocolo robot.txt e parou de rastrear a Reddit em 1º de julho. Enquanto isso, Mustafa Suleyman, CEO da IA da Microsoft, apareceu recentemente na imprensa descrevendo o conteúdo da Reddit como freeware.
“…no que diz respeito ao conteúdo que já está na web aberta, o contrato social desse conteúdo desde os anos 90 tem sido que é de uso justo”, detalhou ele. “Qualquer um pode copiá-lo, recriá-lo com ele, reproduzi-lo com ele. Isso tem sido freeware, se preferir. Essa tem sido a compreensão.”
As leis de direitos autorais dos EUA permitem o reuso de conteúdo publicado. O site de direitos autorais do governo dos Estados Unidos diz que é permitido usar partes limitadas de uma obra, incluindo citações, para fins como comentários, críticas, reportagem de notícias e relatórios acadêmicos, pois todos eles se enquadram na doutrina de uso justo. No entanto, os mecanismos de busca não são obrigados a compensar os editores.
Se você está lendo isso, já está à frente. Mantenha-se assim com nosso boletim informativo.
Aviso Legal. As informações fornecidas não constituem aconselhamento de investimento. Cryptopolitan.com não assume responsabilidade por quaisquer investimentos realizados com base nas informações fornecidas nesta página. Recomendamos fortemente a realização de pesquisa independente e/ou consulta com um profissional qualificado antes de tomar quaisquer decisões de investimento.
Jeffrey Gogo
Jeffrey Gogo é um jornalista com 20 anos de experiência em notícias e análises sobre negócios, finanças e mudanças climáticas. Seu trabalho foi destacado pela Thomson Reuters Foundation, The Zimbabwe Herald e várias publicações online. Ele também escreveu amplamente sobre IA e o metaverso e começou a cobrir os mercados de criptomoedas em 2017. Gogo estudou jornalismo e comunicação social no CCOSA em Harare.















