ULTIME NOTIZIE
SELEZIONATO PER TE

L'IA non può prosperare senza la conoscenza umana: il compenso per i creatori originali è un imperativo

DiAamir SheikhAamir Sheikh 3 min di lettura
Conoscenza umana
  • L'addestramento dei modelli di IA richiede grandi set di dati, ed è preferibile che si basino sulla conoscenza umana.
  • Giornali e organizzazioni di ricerca, insieme ai portali web, impiegano le proprie risorse per raccogliere e pubblicare informazioni.
  • Il compenso per i creatori originali dei contenuti è indispensabile, poiché ora le aziende di IA acquistano in licenza i contenuti da altre società.

L'addestramento dei modelli di intelligenza artificiale richiede enormi quantità di set di dati, e la loro capacità di produrre buoni risultati dipende direttamente dai dati forniti al sistema. Le informazioni non sono gratuite e qui stiamo parlando di molti diritti di proprietà intellettuale. 

Ma le aziende di intelligenza artificiale non pensano in questi termini; danno per scontato tutto il prodotto dalle generazioni di scrittori; il loro concetto di "fair use" (uso lecito) è anche diverso da come era percepito in origine; e non piace pagare ai creatori di contenuti che hanno reso possibile ciò che i loro modelli sono oggi in grado di fare.

Furto di conoscenza umana

C'è molto lavoro duro e sudore coinvolto nella produzione dei contenuti che vediamo nei giornali, riviste, libri, archivi online e articoli di ricerca, ma questo non è possibile senza scrittori, editori, ricercatori e editori che hanno portato tutto questo al pubblico in diverse forme.

Tale riconoscimento e conoscenza, faticosamente conquistati, non dovrebbero essere gratuiti per essere sfruttati da un'azienda, come è accaduto.

"Informazioni pubblicamente disponibili su Internet."

Fonte: pone il pubblico del piano gratuito di ChatGPT a più di 1 miliardo di utenti attivi settimanali, e il modello pubblicitario è ciò che aiuta a mantenere in funzione la versione gratuita..

Sì, è quello che dice OpenAI se interrogato sui contenuti utilizzati per addestrare i suoi sistemi di intelligenza artificiale, insieme alle informazioni che ha licenziato da terze parti e alle informazioni fornite dai loro utenti e addestratori umani. 

Parlando dei contenuti in licenza, le aziende li stanno cercando ora, ma non abbiamo informazioni su se OpenAI abbia licenziato alcuna informazione da un fornitore prima del lancio del suo modello GPT iniziale. Il modello deve essere stato addestrato su materiali protetti da copyright che non erano gratuiti per l'uso commerciale.

Fonte: Statista.

Compenso per i creatori originali

Fino a un anno fa, la maggior parte del testo scritto online o offline era frutto dello sforzo umano. Nonostante i titoli sensazionalistici, anche i contenuti di bassa qualità erano mescolati, ma erano almeno creati da esseri umani che comprendevano la psiche e il processo di pensiero umano, e le applicazioni di intelligenza artificiale generativa sono state costruite sulla base di tali informazioni. 

Ma oggi, le aziende stanno affrontando un nuovo problema per l'addestramento dei loro modelli di intelligenza artificiale, ed è il contenuto generato dalle macchine che prevale su tutto Internet, che non è considerato di qualità in alcun modo. Tale contenuto sta infestando le risorse disponibili per l'addestramento dei modelli di intelligenza artificiale poiché non possono produrre output di qualità quando addestrati su verbosità inutile, che è come questi modelli solitamente generano contenuti. L'IA che elabora l'IA è un processo spesso chiamato cannibalismo o clonazione dell'IA.

Per prevenire ciò, le aziende di intelligenza artificiale devono limitare il loro materiale sorgente a fonti credibili, che non sono altri che giornali, riviste e forum pubblici che ospitano una ricchezza di conoscenza prodotta dagli esseri umani. Alcuni altri possono anche essere contati, come menzionato sopra, ma questa necessità e le cause legali intentate dai giornali le hanno costrette a licenziare i contenuti e pagare per lo sfruttamento che stavano commettendo.

Aziende come Reddit, che è un grande forum pubblico ospitato sul web, stanno anche prendendo in considerazione la licenza dei propri contenuti alle aziende di intelligenza artificiale. In una dichiarazione, ha affermato di preferire gli accordi commerciali alle cause legali, ma non ha escluso le azioni legali se i negoziati falliscono. Se non ti è permesso inserire una colonna sonora protetta da copyright nel tuo video su YouTube, perché un'azienda di intelligenza artificiale dovrebbe essere autorizzata a utilizzarla per addestrare i propri modelli destinati all'uso commerciale?

La proprietà del copyright è un problema qui, poiché le aziende di intelligenza artificiale continuano a violarla. D'altra parte, l'IA non è in grado di raccogliere nuove notizie da sola; richiede uno sforzo umano per raccogliere notizie e confermarle da diverse fonti prima della pubblicazione; solo allora un modello di intelligenza artificiale può utilizzare quelle informazioni, e non compensare la risorsa umana in questo caso è uno sfruttamento. 

I cervelli più intelligenti del crypto leggono già la nostra newsletter. Vuoi unirti a loro? Unisciti a loro.

Condividi questo articolo

Dichiarazione di responsabilità: Le informazioni fornite non costituiscono consulenza finanziaria. Cryptopolitan.com non si assume alcuna responsabilità per gli investimenti effettuati sulla base delle informazioni presenti in questa pagina. Si raccomanda vivamente di effettuare ricerche indipendenti e/o consultare un professionista qualificato prima di prendere qualsiasi decisione di investimento.

Aamir Sheikh

Aamir Sheikh

Aamir è un giornalista tecnologico con quasi sei anni di esperienza nei settori delle criptovalute e della tecnologia. Si è laureato presso l'Università MAJ con un MBA in Finanza e Marketing. Attualmente lavora per Cryptopolitan, dove si occupa delle ultime novità sui mercati delle criptovalute e delle previsioni sui prezzi.

ALTRE NOTIZIE …