ULTIME NOTIZIE
SELEZIONATO PER TE

Le startup AI usano le foto dei bambini brasiliani per addestrare i modelli senza consenso

DiEnacy MapakameEnacy Mapakame 3 min di lettura
Brasiliano
  • Le immagini coprono l'intera infanzia, rendendo i loro identità facilmente rintracciabili.
  • Le immagini sono state estratte da miliardi di foto di famiglia caricate su blog personali.
  • LAION ha sostenuto che genitori e tutori dovrebbero essere responsabili della rimozione delle immagini dei minori da internet.

Un gruppo di advocacy ha rivelato che i generatori di immagini hanno utilizzato miliardi di immagini di bambini brasiliani per addestrare i loro modelli AI senza il loro consenso. Human Rights Watch (HRW) ha condotto una ricerca che mostra che generatori di immagini popolari come Stable Diffusion hanno usato immagini di bambini "che coprono tutta la loro infanzia" per addestrare i loro modelli.

Leggi anche: Le aziende tech sono esortate a combattere l'aumento del materiale di abuso sessuale minorile generato dall'IA

Lo studio HRW rivela che queste immagini sono state prese da circa 10 stati brasiliani. Ha riportato che queste foto pongono un enorme "rischio per la privacy dei bambini" perché l'atto aumenta anche la produzione di immagini non consensuali che ne ritraggono l'aspetto.

Bilioni di immagini di bambini brasiliani usate per addestrare i modelli AI

La ricercatrice HRW Hye Jung Han ha esposto il problema dopo aver analizzato una frazione (meno dello 0,0001%) di LAION-5B, un dataset costruito da snapshot di Common Crawl del web pubblico. Lei ha rivelato che il dataset non conteneva le foto effettive, ma includeva "coppie testo-immagine" prese da quasi 6 miliardi di immagini e didascalie pubblicate dal 2008.

Sono state trovate foto di bambini provenienti da 10 stati brasiliani, per lo più composte da foto di famiglia caricate su blog di genitorialità e personali. Secondo il rapporto, queste sono foto che gli utenti di internet non incontrano facilmente.

Leggi anche: Il Regno Unito dichiarerà la creazione di deepfake sessualmente espliciti un atto criminale

HRW ha rimosso i link alle immagini in collaborazione con LAION, l'organizzazione no-profit tedesca che ha creato il dataset. Restano preoccupazioni che il dataset possa ancora fare riferimento a immagini di bambini di tutto il mondo poiché la rimozione dei link da sola non risolve completamente il problema.

"Questo è un problema più ampio e molto preoccupante e, come organizzazione di volontariato, faremo la nostra parte per aiutare", ha dichiarato il portavoce di LAION Nate Tyler ad Ars.

Le identità dei bambini sono facilmente rintracciabili

Il rapporto HRW ha ulteriormente rivelato che le identità di molti bambini brasiliani potevano essere rintracciate poiché i loro nomi e le loro località erano usati nelle didascalie che hanno costruito il dataset. Ha anche sollevato preoccupazioni sul fatto che i bambini potrebbero essere a rischio di essere presi di mira dai bulli mentre le loro immagini potrebbero essere usate per contenuti espliciti.

"Le foto esaminate coprono l'intera infanzia", recita una parte del rapporto.

"Catturano momenti intimi di neonati che nascono nelle mani guantate dei medici, bambini piccoli che soffiano le candeline sulla torta di compleanno o ballano in mutande a casa…"

HRW.

Han ha tuttavia rivelato che "tutte le versioni pubblicamente disponibili di LAION-5B sono state rimosse", e quindi meno rischio che le foto dei bambini brasiliani vengano usate ora.

Secondo HRW, il dataset non sarà più disponibile finché LAION non sarà certa che tutto il contenuto segnalato sia stato rimosso. La decisione è stata presa dopo che un rapporto dell'Università di Stanford ha anche "trovato link nel dataset che puntano a contenuti illegali sul web pubblico", tra cui oltre 3.000 casi sospetti di contenuti di abuso sessuale minorile.

Almeno 85 ragazze in Brasile hanno segnalato che i loro compagni di classe le molestano utilizzando l'IA per generare contenuti deepfake sessualmente espliciti "basati su foto tratte dai loro contenuti sui social media".

Protezione della privacy dei minori

Secondo Ars, LAION-5B è stato introdotto nel 2022, riportatamente per replicare il dataset di OpenAI, ed è stato definito il più grande "dataset di immagini-testo liberamente disponibile".

Quando HRW ha contattato LAION riguardo alle immagini, l'organizzazione ha risposto affermando che i modelli di IA addestrati su LAION-5B "non potevano produrre i dati dei minori verbatim", sebbene abbiano riconosciuto i rischi per la privacy e la sicurezza.

L'organizzazione ha quindi iniziato a rimuovere alcune immagini, ma ha anche sostenuto che i genitori e i tutori sono responsabili della rimozione delle foto personali dei minori da Internet. Han ha disapprovato questa argomentazione, affermando:

"I bambini e i loro genitori non dovrebbero essere chiamati a farsi carico della responsabilità di proteggere i minori da una tecnologia contro cui è fondamentalmente impossibile proteggersi. Non è colpa loro."

Han.

HRW ha chiesto un intervento urgente dei legislatori brasiliani per proteggere i diritti dei minori dalle tecnologie emergenti. Devono essere introdotte nuove leggi per vietare l'inserimento dei dati dei minori nei modelli di IA, secondo le raccomandazioni di HRW.


Reportage di Cryptopolitan a cura di Enacy Mapakame 

I cervelli più intelligenti del crypto leggono già la nostra newsletter. Vuoi unirti a loro? Unisciti a loro.

Condividi questo articolo

Dichiarazione di responsabilità. Le informazioni fornite non costituiscono consigli di trading. Cryptopolitan.com non si assume alcuna responsabilità per eventuali investimenti effettuati sulla base delle informazioni fornite in questa pagina. Si consiglia vivamente di effettuare ricerche indipendenti e/o consultare un professionista qualificato prima di prendere qualsiasi decisione di investimento.

Enacy Mapakame

Enacy Mapakame

Enacy Mapakame è una giornalista con oltre 10 anni di esperienza nel settore delle notizie finanziarie e aziendali. Si occupa di mercati dei capitali e tecnologie emergenti: metaverso, intelligenza artificiale e criptovalute. Enacy è laureata con onori in Media and Society Studies.

ALTRE NOTIZIE …