Pesquisadores Franceses e Startup dos EUA Desafiam Afirmação de Direitos Autorais da OpenAI

- Pesquisadores franceses e uma startup dos EUA contestaram a necessidade da OpenAI de usar dados protegidos por direitos autorais no treinamento de IA.
- Eles apresentaram alternativas, como grandes conjuntos de dados de domínio público e um modelo de IA certificado.
- Isso abala as normas do setor e se alinha às regulamentações globais, incentivando uma repensar sobre o uso de dados na IA.
Em um giro surpreendente dos eventos, um consórcio de pesquisadores franceses apoiado pelo governo e uma startup dos EUA contestou a afirmação de OpenAI de que treinar modelos de IA de ponta sem recorrer a materiais protegidos por direitos autorais é “impossível”. Esse desafio à norma da indústria enviou ondas pela comunidade de IA, provocando debates e discussões sobre o futuro do treinamento de modelos de IA e regulamentações de uso de dados.
Novas evidências emergem
Anúncios recentes trouxeram à tona evidências convincentes contrárias à alegação da OpenAI. O grupo de pesquisa francês revelou o que se acredita ser o maior conjunto de dados de treinamento de IA composto inteiramente por texto de domínio público. Esse desenvolvimento indica uma mudança significativa na abordagem de obtenção de dados para o treinamento de modelos de IA, potencialmente reduzindo a dependência de materiais protegidos por direitos autorais.
Além disso, uma startup dos EUA, a 273 Ventures, recebeu certificação da organização sem fins lucrativos Fairly Trained por desenvolver um modelo de linguagem grande (LLM) sem infringir direitos autorais. O modelo, chamado KL3M, foi treinado usando um conjunto de dados meticulosamente curado de documentos legais, financeiros e regulatórios, demonstrando a viabilidade de treinar modelos de IA em conformidade com as regulamentações de direitos autorais.
Desafiando as normas da indústria
O surgimento dessas iniciativas desafia a norma predominante da indústria de utilizar materiais protegidos por direitos autorais para o treinamento de modelos de IA. Com a Fairly Trained oferecendo certificação a empresas que demonstram práticas éticas de uso de dados, há um impulso crescente para que as empresas explorem abordagens alternativas para a obtenção de dados.
Esse desenvolvimento também está alinhado com os esforços globais para regular o uso de dados de IA. Países como a China propuseram listas negras de fontes consideradas inadequadas para treinar modelos de IA generativa, enquanto a Índia implementou medidas para restringir o acesso a seus conjuntos de dados a modelos de IA confiáveis. Essas iniciativas reguladoras sublinham a importância das práticas éticas de dados no desenvolvimento e implantação de tecnologias de IA.
Implicações para a OpenAI
A OpenAI, uma protagonista proeminente na indústria de IA, encontra-se no centro deste discurso. A afirmação da empresa de que serviços como ChatGPT seriam “impossíveis” sem a utilização de obras protegidas por direitos autorais foi colocada em questão por esses desenvolvimentos recentes. Elon Musk, um crítico vocal das estratégias de obtenção de dados da OpenAI, expressou preocupações sobre a abordagem da empresa após revelações de sua CTO, Mira Murati.
À medida que o cenário de IA continua a evoluir, é evidente que as práticas éticas de dados e a conformidade com as regulamentações de direitos autorais desempenharão um papel fundamental na moldagem do futuro do desenvolvimento de IA. O surgimento de iniciativas como o conjunto de dados de treinamento de IA do grupo de pesquisa francês e o modelo certificado pela Fairly Trained da 273 Ventures signifique uma mudança de paradigma na indústria, incentivando as partes interessadas a reavaliar suas abordagens de obtenção de dados e treinamento de modelos.
O desafio lançado por pesquisadores franceses e uma startup dos EUA à afirmação da OpenAI sobre a necessidade de materiais protegidos por direitos autorais no treinamento de modelos de IA marca um marco significativo na busca por práticas de desenvolvimento de IA éticas e transparentes. Com os esforços regulatórios globais ganhando impulso e as normas da indústria sendo questionadas, a comunidade de IA enfrenta um ponto crítico onde a inovação deve ser equilibrada com considerações éticas e conformidade com as regulamentações de direitos autorais.
As mentes mais inteligentes do setor de criptomoedas já leem nosso boletim informativo. Quer entrar? Junte-se a eles.
Aviso Legal. As informações fornecidas não constituem aconselhamento de investimento. Cryptopolitan.com não assume responsabilidade por quaisquer investimentos realizados com base nas informações fornecidas nesta página. Recomendamos fortemente a realização de pesquisa independente e/ou consulta com um profissional qualificado antes de tomar quaisquer decisões de investimento.

James Kinoti
Entusiasta de criptomoedas, James encontra prazer em compartilhar conhecimento sobre fintech, criptomoedas, blockchain e tecnologias de fronteira. As últimas inovações no setor de cripto, jogos cripto, IA, tecnologia blockchain e outras tecnologias são sua principal preocupação. Sua missão: manter-se atualizado com aplicações transformadoras em diversos setores.















