OpenAI no logra proteger los registros de ChatGPT en el juicio por derechos de autor

- OpenAI debe entregar 20 millones de registros de ChatGPT anonimizados para ayudar a determinar si copió contenido con derechos de autor de The New York Times y otros medios.
- La empresa debe eliminar toda la información personal antes de publicar los registros; sin embargo, OpenAI argumenta que esto podría comprometer la confianza del usuario.
- El caso plantea preguntas sobre el entrenamiento de la IA, las normas de derechos de autor y cómo deben ser remunerados los periodistas por su trabajo.
OpenAI debe entregar 20 millones de registros de conversaciones de ChatGPT anonimizados en una disputa por derechos de autor con The New York Times (NYT) y otros. Los registros de chat son una pieza crítica de evidencia en la investigación sobre si ChatGPT está reproduciendo contenido periodístico con derechos de autor sin autorización, según la Jueza de Magistratura de EE. UU. Ona Wang.
El pedido se basa en una solicitud de descubrimiento presentada en el juicio en el que el NYT y otras organizaciones de medios sostienen que ChatGPT, y por extensión los modelos de lenguaje subyacentes de OpenAI, utilizaron inapropiadamente su contenido con derechos de autor en el entrenamiento, produciendo salidas que replican o resumen reportajes con muro de pago. Los demandantes afirman que el acceso a los registros de chat de los usuarios revelará si y con qué frecuencia ChatGPT regenera pasajes completos o parciales de sus artículos con derechos de autor.
La Jueza Wang rechazó las objeciones de privacidad de OpenAI, señalando que la empresa está obligada a eliminar nombres, direcciones de correo electrónico, números de teléfono y cualquier otro detalle identificable antes de entregar los registros. Añadió que, además de esta desidentificación, el tribunal ya ha implementado “múltiples capas de protección” para salvaguardar la información de los usuarios.
A OpenAI se le ha ordenado publicar el contenido siete días después de que se complete la anonimización. La empresa había advertido anteriormente que cumplir podría establecer un precedente preocupante, señalando que la abrumadora mayoría de las conversaciones no tienen nada que ver con el juicio.
Los medios advierten que los registros revelarán el mal uso de la IA
The New York Times y los periódicos propiedad de MediaNews Group sostienen que los registros establecerán que OpenAI recolectó y utilizó su periodismo sin permiso.
Afirman que ChatGPT ha generado varios párrafos que se asemejan o reflejan sus narrativas casi literalmente. Frank Pine, editor ejecutivo de MediaNews Group, criticó a la empresa de IA. Dijo que OpenAI estaba alucinando cuando pensaba que podría salirse con la suya al retener evidencia sobre cómo su modelo de negocio se basa en robar a periodistas trabajadores. Las publicaciones también negaron la afirmación de OpenAI de que había manipulado la IA para infringir el contenido.
Los registros, también dicen, servirán como evidencia de que el chatbot ya podía crear contenido con derechos de autor antes y sin ninguna entrada del usuario. El caso no se trata de frenar la innovación de la IA, dijo The New York Times, sino de garantizar el pago y la equidad para el periodismo. OpenAI ha apelado la decisión de la Jueza Wang ante la Jueza del Distrito de EE. UU. Sidney Stein, quien supervisa el caso.
La empresa argumenta que la privacidad de los usuarios no debe verse comprometida en la corte, y cualquier divulgación de estos registros, incluso datos anonimizados, podría erosionar la confianza en la empresa. Dane Stuckey, el oficial de seguridad de la información de la empresa, había declarado anteriormente que tales demandas de múltiples organizaciones de medios contradicen las prácticas de seguridad de sentido común y ignoran las protecciones de privacidad de larga data.
Los críticos ven la resistencia de OpenAI como un signo de culpa
Los críticos argumentan que la resistencia de OpenAI sugiere que tiene algo que ocultar. Cuando los sistemas de IA dependen de contenido públicamente disponible, como el periodismo, para aprender y mejorar su contenido, la transparencia es necesaria, dicen.
La demanda por derechos de autor es una entre varias que se presentan contra gigantes tecnológicos como Microsoft y Meta. En conjunto, los casos plantean preguntas significativas sobre cómo las organizaciones que utilizan IA recopilan, comparten y monetizan la información, así como a quién, en qué medida y cuándo pedir compensación.
Esto coloca a OpenAI en una cuerda floja, equilibrando la privacidad de los usuarios con acusaciones de robo masivo de derechos de autor. También plantea preguntas más amplias sobre cómo estas interfaces de usuario de IA se alinean con las leyes existentes, las protecciones de propiedad intelectual y la confianza social.
Si los registros indican que ChatGPT estaba copiando contenido periodístico con derechos de autor sin permiso, eso tendría enormes implicaciones. No solo para OpenAI, sino para el futuro del entrenamiento de IA, la sostenibilidad de los medios y los derechos digitales.
Por ahora, la decisión señala que los tribunales están dispuestos a equilibrar la innovación de la IA contra las protecciones tradicionales de la propiedad intelectual — incluso si esto complica las nociones de privacidad en la era digital.
No te limites a leer noticias sobre criptomonedas. Entiéndelas. Suscríbete a nuestro boletín. Es gratis.

Nellius Irene
Nellius es graduada en Administración de Empresas y Tecnología de la Información con cinco años de experiencia en la industria de las criptomonedas. También es egresada de Bitcoin Dada. Nellius ha contribuido a publicaciones mediáticas líderes, incluyendo BanklessTimes, Cryptobasic y Riseup Media.
















