Google rende open source lo strumento di watermarking per consentire agli utenti di identificare il testo generato dall'IA

- “Il rilevatore di testo generato dall'IA di Google, SynthID, non comprometterà la qualità e l'accuratezza dei testi.”
- Questo è considerato il passo giusto per affrontare i deepfake.
- Altre aziende tecnologiche come OpenAI hanno lavorato a uno strumento di watermarking per il testo ma ne hanno ritardato il rilascio.
Google ha reso open source lo strumento di watermarking del testo SynthID, una tecnologia che consente agli utenti di rilevare facilmente se un testo è originale o generato dall'IA.
Secondo Google, il rilevatore di testo generato dall'IA può essere scaricato dalla piattaforma AI Hugging Face e dal toolkit Responsible GenAI Toolkit aggiornato di Google. I watermark sono diventati significativi con il boom dell'IA generativa negli ultimi due anni, poiché i LLM vengono manipolati per diffondere disinformazione e misinformation, nonché contenuti sessuali non consensuali e per scopi malevoli.
Lo sviluppo arriva mentre c'è urgenza di sviluppare tali strumenti, poiché l'Agenzia europea di polizia è preoccupata che il 90% dei testi online potrebbe essere sintetico entro il 2026, rendendo propaganda, frodi e inganni dilaganti.
I ricercatori di Google spiegano il loro strumento di watermarking
In un post sulla piattaforma X, il gigante della ricerca ha rivelato di aver reso open source il suo strumento di watermarking SynthID Text, dicendo che sarà "disponibile gratuitamente per aziende e sviluppatori, poiché li aiuterà a identificare i loro contenuti generati dall'IA."
Pushmeet Kohli, vicepresidente della ricerca presso Google DeepMind e coautore di un articolo di ricerca di Google DeepMind, ha dichiarato: "Il sistema non compromette le funzioni dei modelli di IA, ma li rende semplicemente migliori."
Le immagini e i video sono stati centrali nelle discussioni sulle credenziali di contenuto e i watermark sono stati indicati come la soluzione necessaria per combattere i deepfake.
La Coalition for Content Provenance and Authenticity (C2PA), una collaborazione tra aziende tecnologiche e principali testate giornalistiche per elaborare un sistema di allegazione di metadati crittografati per indicare file di immagini e video generati dall'IA, è stata anche centrale in queste discussioni.
Secondo l'articolo di ricerca di Google DeepMind, SynthID Text interferisce durante la generazione alterando alcune parole prodotte da un chatbot per renderle chiare a un rilevatore SynthID, ma quasi invisibili agli esseri umani.
"Modifiche come queste introducono una firma statistica nel testo generato dall'IA e durante la fase di rilevamento del watermark, la firma può essere misurata per vedere se il testo proviene da un modello IA del LLM con watermark", hanno scritto i ricercatori nell'articolo.
Generando frasi parola per parola, è così che funzionano i LLM che alimentano i chatbot, poiché scelgono la parola successiva probabile in base al contesto di ciò che è venuto prima. Assegnando casualmente punteggi numerici alle parole candidate, il LLM produce parole con un punteggio più alto. I watermark verranno applicati a un pezzo di testo che sarebbe stato analizzato dal rilevatore, e dopo essere stato trovato ad avere un punteggio più alto.
Oggi stiamo rendendo open source il nostro strumento di watermarking del testo SynthID attraverso un toolkit Responsible Generative AI aggiornato.
Disponibile gratuitamente per sviluppatori e aziende, aiuterà a identificare i loro contenuti generati dall'IA. 🔍
Scopri di più → https://t.co/n2aYoeJXqn pic.twitter.com/4uRKYaz57Y
— Google DeepMind (@GoogleDeepMind) Ottobre 23, 2024
Gli esperti del settore lodano Google per il passo nella direzione giusta
Nonostante il sistema di DeepMind abbia funzionato meglio di altri strumenti nel watermarking del testo, i ricercatori hanno riconosciuto nel loro articolo che lo strumento ha ancora difetti. Ad esempio, se si altera un testo generato da Gemini, il rilevatore verrà ingannato.
"Mentre SynthID non è una soluzione magica per identificare i contenuti generati dall'IA, è un importante mattone per sviluppare strumenti di identificazione dell'IA più affidabili."
– Kohli.
Se gli utenti alterano significativamente i testi o utilizzano un altro chatbot per riassumere il testo, il rilevatore verrà sviato nel watermarking del testo generato dall'IA.
Google afferma che SynthID Text non compromette la qualità, l'accuratezza o la velocità della generazione di testo, come testato dal sistema integrato nei suoi modelli Gemini. L'azienda ha inoltre aggiunto che funziona anche sui testi che sono stati ritagliati, modificati o parafrasati.
"Il rilevamento è un problema particolare quando si inizia a considerare l'implementazione in situazioni reali, poiché ci sono problemi con la revisione del testo nel mondo reale, dove si dovrà sapere quale modello di watermarking è stato applicato per conoscere e dove localizzare il segnale", ha spiegato Bruce MacCormack, membro del comitato direttivo C2PA.
Oltre a Google, anche OpenAI sta lavorando da anni sulla tecnologia di watermarking del testo IA, ma ha posticipato il loro rilascio per motivi tecnici e di sostenibilità commerciale.
Ma gli esperti del settore hanno generalmente lodato l'iniziativa di Google come un passo nella direzione giusta.
"Ha la promessa di migliorare l'uso di credenziali di contenuto durevoli da C2PA per documenti e testo grezzo", ha detto Andrew Jenks, direttore della provenienza dei media di Microsoft e presidente esecutivo di C2PA.
MacCormack ha anche aggiunto che, sebbene i ricercatori di Google abbiano ancora molto da fare per rendere questo un caso pratico, rimane un'ottima iniziativa e "il primo passo nella maratona che ci aspetta."
I cervelli più intelligenti del crypto leggono già la nostra newsletter. Vuoi unirti a loro? Unisciti a loro.
Dichiarazione di responsabilità. Le informazioni fornite non costituiscono consigli di trading. Cryptopolitan.com non si assume alcuna responsabilità per eventuali investimenti effettuati sulla base delle informazioni fornite in questa pagina. Si consiglia vivamente di effettuare ricerche indipendenti e/o consultare un professionista qualificato prima di prendere qualsiasi decisione di investimento.
Enacy Mapakame
Enacy Mapakame è una giornalista con oltre 10 anni di esperienza nel settore delle notizie finanziarie e aziendali. Si occupa di mercati dei capitali e tecnologie emergenti: metaverso, intelligenza artificiale e criptovalute. Enacy è laureata con onori in Media and Society Studies.















