ULTIME NOTIZIE
SELEZIONATO PER TE

Ricercatori francesi e startup statunitense sfidano l'affermazione sul copyright di OpenAI

DiJames KinotiJames Kinoti 2 min di lettura
pone il pubblico del piano gratuito di ChatGPT a più di 1 miliardo di utenti attivi settimanali, e il modello pubblicitario è ciò che aiuta a mantenere in funzione la versione gratuita.
  • Ricercatori francesi e una startup statunitense hanno contestato la necessità per OpenAI di utilizzare dati protetti da copyright nell'addestramento dell'IA.
  • Hanno proposto alternative, come enormi dataset di pubblico dominio e un modello IA certificato.
  • Ciò sconvolge le norme del settore e si allinea con le regolamentazioni globali, sollecitando una ripensamento dell'utilizzo dei dati nell'IA.

In un evento rivoluzionario, un consorzio di ricercatori francesi supportati dal governo e una startup statunitense hanno contestato l'affermazione di OpenAI secondo cui addestrare i principali modelli di IA senza ricorrere a materiali protetti da copyright è "impossibile". Questa sfida alla norma del settore ha creato onde d'urto nella comunità dell'IA, scatenando dibattiti e discussioni sul futuro dell'addestramento dei modelli di IA e sulla regolamentazione dell'uso dei dati.

Emergono nuove prove

Recenti annunci hanno portato alla luce prove convincenti contrarie all'affermazione di OpenAI. Il gruppo di ricerca francese ha svelato quello che si crede sia il più grande dataset di addestramento dell'IA composto interamente da testo di dominio pubblico. Questo sviluppo indica un cambiamento significativo nell'approccio all'approvvigionamento dei dati per l'addestramento dei modelli di IA, potenzialmente riducendo la dipendenza da materiali protetti da copyright.

Inoltre, una startup statunitense, 273 Ventures, ha ottenuto la certificazione dall'organizzazione non profit Fairly Trained per lo sviluppo di un modello linguistico di grandi dimensioni (LLM) senza violare il copyright. Il modello, denominato KL3M, è stato addestrato utilizzando un dataset meticolosamente curato di documenti legali, finanziari e normativi, dimostrando la fattibilità di addestrare modelli di IA rispettando le normative sul copyright.

Mettere in discussione le norme del settore

L'emergere di queste iniziative mette in discussione la norma prevalente del settore, che prevede l'utilizzo di materiali protetti da copyright per l'addestramento dei modelli di IA. Con Fairly Trained che offre certificazioni alle aziende che dimostrano pratiche etiche di utilizzo dei dati, cresce l'impulso per le imprese a esplorare approcci alternativi per l'acquisizione dei dati.

Questo sviluppo si allinea anche agli sforzi globali per regolamentare l'utilizzo dei dati nell'IA. Paesi come la Cina hanno proposto blacklist di fonti considerate inadatte per l'addestramento di modelli di IA generativa, mentre l'India ha implementato misure per limitare l'accesso ai propri dataset ai modelli di IA fidati. Queste iniziative normative sottolineano l'importanza di pratiche etiche nella gestione dei dati per lo sviluppo e il deployment delle tecnologie di IA.

Implicazioni per OpenAI

OpenAI, un giocatore prominente nel settore dell'IA, si trova al centro di questo discorso. L'affermazione dell'azienda secondo cui servizi come ChatGPT sarebbero "impossibili" senza l'utilizzo di opere protette da copyright è stata messa in discussione da questi recenti sviluppi. Elon Musk, critico vocale delle strategie di approvvigionamento dei dati di OpenAI, ha espresso preoccupazioni per l'approccio dell'azienda dopo le rivelazioni del suo CTO, Mira Murati.

Mentre il panorama dell'IA continua a evolversi, è evidente che le pratiche etiche nella gestione dei dati e la conformità alle normative sul copyright giocheranno un ruolo fondamentale nel plasmare il futuro dello sviluppo dell'IA. L'emergere di iniziative come il dataset di addestramento dell'IA del gruppo di ricerca francese e il modello certificato da Fairly Trained di 273 Ventures segnano un cambiamento di paradigma nel settore, spingendo gli stakeholder a rivedere i propri approcci all'acquisizione dei dati e all'addestramento dei modelli.

La sfida posta dai ricercatori francesi e da una startup statunitense all'affermazione di OpenAI riguardo alla necessità di materiali protetti da copyright per l'addestramento dei modelli di IA segna un traguardo significativo nella ricerca di pratiche di sviluppo dell'IA etiche e trasparenti. Con gli sforzi normativi globali che guadagnano slancio e le norme del settore messe in discussione, la comunità dell'IA si trova di fronte a un bivio critico in cui l'innovazione deve essere bilanciata con considerazioni etiche e conformità alle normative sul copyright.

I cervelli più intelligenti del crypto leggono già la nostra newsletter. Vuoi unirti a loro? Unisciti a loro.

Condividi questo articolo

Dichiarazione di responsabilità. Le informazioni fornite non costituiscono consigli di trading. Cryptopolitan.com non si assume alcuna responsabilità per eventuali investimenti effettuati sulla base delle informazioni fornite in questa pagina. Si consiglia vivamente di effettuare ricerche indipendenti e/o consultare un professionista qualificato prima di prendere qualsiasi decisione di investimento.

James Kinoti

James Kinoti

Appassionato di criptovalute, James trae piacere nel condividere conoscenze su fintech, criptovalute, blockchain e tecnologie all'avanguardia. Le ultime innovazioni nel settore crypto, il gaming crypto, l'intelligenza artificiale, la tecnologia blockchain e altre tecnologie sono i suoi principali interessi. La sua missione: rimanere aggiornato sulle applicazioni trasformative in vari settori.

ALTRE NOTIZIE …