CEO de Reddit: Microsoft y otros motores de búsqueda de IA deben pagar para usar «nuestros datos»

- Reddit seguirá bloqueando a las empresas de IA para que no extraigan datos de su sitio.
- La plataforma dice que busca compensación por su contenido.
- Empresas como Microsoft afirman que el contenido de Reddit es 'gratuito' y se niegan a pagar por él.
El CEO de Reddit, Steve Huffman, ha insistido en que la plataforma de redes sociales continuará bloqueando a las empresas de IA, incluida Microsoft, para extraer datos de su sitio hasta que se les pague y tengan voz en cómo se utiliza el contenido. Dijo que Reddit no cederá en el uso no licenciado de sus datos para entrenar modelos de IA, según The Verge.
Durante los últimos meses, Reddit ha realizado cambios en su política en un intento por evitar que los desarrolladores de IA extraigan sus datos de usuarios, publicaciones y comunidades sin consentimiento o pago. La compañía ha concluido un acuerdo valorado en $60 millones con Google, permitiendo que el gigante tecnológico utilice su contenido. Reddit firmó un acuerdo similar con OpenAI, creadora de ChatGPT, en mayo.
Microsoft se beneficia del contenido gratuito de Reddit
Sin embargo, Microsoft ha continuado utilizando el contenido de Reddit para construir las funciones de IA en su motor de búsqueda Bing sin permiso, alegó Huffman. El CEO de Reddit acusó a Microsoft de beneficiarse del contenido de su empresa. Dijo que Microsoft extrajo los datos de forma gratuita pero los vendió a entidades de IA a través de la API de Bing para obtener ganancias.
Finalmente, Reddit bloqueó a Microsoft el acceso a sus datos de usuarios, lo que significaba que Bing ya no podía mostrar contenido de Reddit en sus resultados de búsqueda. Reddit utiliza el Protocolo de Exclusión de Robots, o robots.txt, una herramienta utilizada por los sitios web para identificar a los rastreadores web que acceden al sitio y prevenir el uso no autorizado de sus datos. En una reciente entrevista con The Verge, Huffman declaró:
«Hemos tenido a Microsoft, Anthropic y Perplexity actuando como si todo el contenido de internet fuera gratuito para su uso. Esa es su verdadera posición.»
Huffman reveló que las tres compañías —Microsoft, Anthropic y Perplexity— y otras empresas de IA más pequeñas se han negado a negociar el pago por extraer el contenido de Reddit. Las entidades suelen argumentar que los datos son información de acceso público y pueden utilizarse bajo los principios de uso justo. Salesforce previamente defendió su uso del contenido de YouTube bajo los mismos argumentos. Apple también ha dicho que entrenó su IA con datos de acceso público.
«Sin estos acuerdos, no tenemos ninguna voz ni conocimiento sobre cómo se muestran nuestros datos y para qué se utilizan», dijo Huffman. «[Esto] nos ha puesto en una posición ahora de bloquear a aquellos que no han estado dispuestos a llegar a un acuerdo sobre cómo nos gustaría que se usara o no se usara nuestros datos.»

El jefe de Microsoft dice que el contenido web es «software gratuito»
Un portavoz de Microsoft dijo que la compañía «respeta» el protocolo robot.txt y dejó de rastrear Reddit el 1 de julio. Mientras tanto, Mustafa Suleyman, director ejecutivo de Microsoft AI, apareció recientemente en la prensa describiendo el contenido de Reddit como software gratuito.
«…con respecto al contenido que ya está en la web abierta, el contrato social de ese contenido desde los años 90 ha sido que es de uso justo», detalló. «Cualquiera puede copiarlo, recrearlo, reproducirlo. Eso ha sido software gratuito, si se quiere. Esa ha sido la comprensión.»
Las leyes de derechos de autor de EE. UU. permiten la reutilización del contenido publicado. El sitio web de derechos de autor del gobierno de Estados Unidos dice que se permite usar porciones limitadas de una obra, incluidas citas, con fines como comentarios, crítica, reportajes de noticias e informes académicos, ya que todo esto cae bajo la doctrina de uso justo. Sin embargo, los motores de búsqueda no están obligados a compensar a los editores.
Las mentes más inteligentes del mundo cripto ya leen nuestro boletín. ¿Quieres unirte? Únete a ellos.
Aviso de responsabilidad. La información proporcionada no es un consejo de trading. Cryptopolitan.com no asumimos responsabilidad alguna por las inversiones realizadas basándose en la información proporcionada en esta página. Recomendamos encarecidamente la investigación independiente y/o la consulta con un profesional calificado antes de tomar cualquier decisión de inversión.
Jeffrey Gogo
Jeffrey Gogo es un periodista con 20 años de experiencia en noticias y análisis de negocios, finanzas y cambio climático. Su trabajo ha sido destacado por la Fundación Thomson Reuters, The Zimbabwe Herald y varias publicaciones en línea. También ha escrito extensamente sobre IA y el metaverso, y comenzó a cubrir los mercados de criptomonedas en 2017. Gogo estudió periodismo y comunicación masiva en CCOSA en Harare.















