OpenAI falha em proteger registros do ChatGPT em processo por direitos autorais

- A OpenAI deve fornecer 20 milhões de registros do ChatGPT anonimizados para ajudar a determinar se copiou conteúdo protegido por direitos autorais do The New York Times e de outras mídias.
- A empresa deve remover todas as informações pessoais antes de liberar os registros; no entanto, a OpenAI argumenta que isso poderia comprometer a confiança dos usuários.
- O caso levanta questões sobre treinamento de IA, regras de direitos autorais e como os jornalistas devem ser remunerados por seu trabalho.
A OpenAI deve entregar 20 milhões de registros de conversas do ChatGPT anonimizados em uma disputa de direitos autorais com The New York Times (NYT) e outros. Os registros de chat são uma peça crítica de evidência na investigação sobre se o ChatGPT está reproduzindo conteúdo noticioso protegido por direitos autorais sem autorização, de acordo com a Juíza Federal Adjunta dos EUA, Ona Wang.
A ordem está enraizada em um pedido de descoberta apresentado no processo em que o NYT e outras organizações de mídia alegam que o ChatGPT – e, por extensão, os modelos de linguagem subjacentes da OpenAI – usaram indevidamente seu conteúdo protegido por direitos autorais no treinamento, produzindo saídas que replicam ou resumem relatórios pagos. Os autores da ação afirmam que o acesso aos registros de chat dos usuários revelará se e com que frequência o ChatGPT regenera passagens completas ou parciais de seus artigos protegidos por direitos autorais.
A Juíza Wang rejeitou as objeções de privacidade da OpenAI, observando que a empresa é obrigada a remover nomes, endereços de e-mail, números de telefone e quaisquer outros detalhes identificáveis antes de entregar os registros. Ela acrescentou que, além dessa desidentificação, o tribunal já implementou “múltiplas camadas de proteção” para salvaguardar as informações dos usuários.
A OpenAI foi ordenada a publicar o conteúdo sete dias após a conclusão da anonimização. A empresa havia alertado anteriormente que cumprir isso poderia estabelecer um precedente preocupante, observando que a esmagadora maioria das conversas não tem nada a ver com o processo.
Casas de mídia alertam que os registros revelarão o uso indevido de IA
O The New York Times e jornais de propriedade do MediaNews Group alegam que os registros estabelecerão que a OpenAI colheu e usou seu jornalismo sem permissão.
Eles afirmam que o ChatGPT gerou vários parágrafos que se assemelham ou ecoam suas narrativas quase literalmente. Frank Pine, editor executivo do MediaNews Group, criticou a empresa de IA. Ele disse que a OpenAI estava alucinando quando pensou que poderia se safar de reter evidências sobre como seu modelo de negócios depende de roubar de jornalistas dedicados. Os veículos também negaram a afirmação da OpenAI de que manipulou a IA para infringir conteúdo.
Os registros, eles também dizem, servirão como evidência de que o chatbot já poderia criar conteúdo protegido por direitos autorais antes e sem qualquer entrada do usuário. O caso não é sobre frear a inovação em IA, disse o The New York Times, mas sim sobre garantir pagamento e justiça ao jornalismo. A OpenAI recorreu da decisão da Juíza Wang para o Juiz do Distrito dos EUA, Sidney Stein, que está supervisionando o caso.
A empresa argumenta que a privacidade do usuário não deve ser comprometida no tribunal, e qualquer divulgação desses registros, mesmo dados anonimizados, pode corroer a confiança na empresa. Dane Stuckey, oficial de segurança da informação da empresa, havia afirmado anteriormente que tais demandas de várias organizações de mídia contradizem práticas de segurança de senso comum e ignoram proteções de privacidade de longa data.
Críticos veem a resistência da OpenAI como sinal de culpa
Críticos argumentam que a resistência da OpenAI sugere que ela tem algo a esconder. Quando os sistemas de IA dependem de conteúdo publicamente disponível, como jornalismo, para aprender e melhorar seu conteúdo, a transparência é necessária, dizem eles.
O processo por direitos autorais é um entre vários sendo movidos contra gigantes da tecnologia como Microsoft e Meta. Juntos, os casos levantam questões significativas sobre como as organizações que usam IA coletam, compartilham e monetizam informações, bem como a quem, em que medida e quando pedir compensação.
Isso coloca a OpenAI em uma corda bamba, equilibrando a privacidade do usuário com acusações de enorme roubo de direitos autorais. Também levanta questões maiores sobre como essas interfaces de usuário de IA se alinham com leis existentes, proteções de propriedade intelectual e confiança social.
Se os registros indicarem que o ChatGPT estava copiando conteúdo noticioso protegido por direitos autorais sem permissão, isso teria implicações enormes. Não apenas para a OpenAI — mas para o futuro do treinamento de IA, sustentabilidade da mídia e direitos digitais.
Por enquanto, a decisão sinaliza que os tribunais estão dispostos a equilibrar a inovação em IA contra proteções legítimas de propriedade intelectual — mesmo que isso complique noções de privacidade na era digital.
Se você está lendo isso, já está à frente. Mantenha-se assim com nosso boletim informativo.

Nellius Irene
Nellius é graduada em Gestão de Negócios e TI, com cinco anos de experiência no setor de criptomoedas. Também é formada pela Bitcoin Dada. Nellius contribuiu para publicações de mídia de destaque, incluindo BanklessTimes, Cryptobasic e Riseup Media.
















