ULTIME NOTIZIE
SELEZIONATO PER TE

L'Unione ha dichiarato che le aziende avranno "accesso privilegiato ai supercomputer" e che l'UE costruirà "Fabbriche di IA" per garantire che l'infrastruttura richiesta sia disponibile per l'acquisto e l'aggiornamento da parte delle startup.   

DiJeffrey GogoJeffrey Gogo 2 min di lettura
chatbot di intelligenza artificiale

● I chatbot AI possono essere ingannati facilmente per generare risposte dannose

● I ricercatori hanno scoperto che cinque dei principali LLM sono 'altamente vulnerabili' ai jailbreak

● Le aziende di AI sottolineano i meccanismi di sicurezza integrati nei loro modelli

I chatbot di IA come ChatGPT o Gemini possono essere facilmente ingannati per conformarsi a query che generano risposte dannose, secondo un nuovo studio dell'Istituto per la Sicurezza dell'IA del Regno Unito (AISI).

I ricercatori governativi hanno testato l'integrità dei modelli linguistici di grandi dimensioni (LLM) – la tecnologia alla base dei chatbot di intelligenza artificiale – contro attacchi alla sicurezza nazionale.

Questi risultati arrivano prima del vertice AI Seoul Summit, che sarà co-presieduto dal primo ministro britannico, Rishi Sunak, in Corea del Sud il 21-22 maggio.

Leggi anche: La Sicurezza Sarà un Punto Principale dell'Ordine del Giorno al Vertice AI di Seul  

I Chatbot di IA Propensi a Risposte Tossiche

L'AISI ha testato i 'jailbreak' di base – prompt di testo destinati a sovrascrivere le protezioni contro output illegali, tossici o espliciti – su cinque dei migliori LLM. L'Istituto non ha nominato i sistemi di IA, ma ha riscontrato che tutti erano "altamente vulnerabili".

"Tutti i LLM testati rimangono altamente vulnerabili ai jailbreak di base, e alcuni forniranno output dannosi anche senza tentativi dedicati di aggirare le loro salvaguardie", ha dichiarato lo studio.

Secondo il rapporto, attacchi "relativamente semplici" come istruire il chatbot a includere "Certo, sarò felice di aiutare" possono ingannare i modelli linguistici di grandi dimensioni (LLM) fornendo contenuti che sono dannosi in molti modi.

I contenuti possono favorire l'autolesionismo, soluzioni chimiche pericolose, sessismo o la negazione dell'Olocausto, ha affermato. L'AISI ha utilizzato prompt pubblicamente disponibili e ne ha progettati privatamente altri per lo studio.

L'Istituto ha anche testato la qualità delle risposte a query a tema biologico e chimico.

Sebbene la conoscenza di livello esperto in questi campi possa essere utilizzata per il bene, i ricercatori volevano sapere se i chatbot di IA possono essere utilizzati per scopi dannosi come compromettere le infrastrutture critiche nazionali.

"Diversi LLM hanno dimostrato una conoscenza di livello esperto di chimica e biologia. I modelli hanno risposto a oltre 600 domande private di chimica e biologia scritte da esperti a livelli simili a quelli degli umani con una formazione di dottorato", hanno trovato i ricercatori.

chatbot di intelligenza artificiale
I chatbot di IA possono essere aggirati con prompt

L'IA Presenta una Minaccia Limitata alla Cybersecurity

Per quanto riguarda i chatbot di IA potenzialmente armati per eseguire attacchi informatici, lo studio ha affermato che i LLM hanno superato con successo semplici compiti di cybersecurity progettati per studenti delle scuole superiori.

Tuttavia, i chatbot hanno faticato con compiti destinati agli studenti universitari, suggerendo un potenziale maligno limitato.

Un'altra area di preoccupazione era se i chatbot potessero essere deployati come agenti per intraprendere autonomamente una serie di azioni in modi che "potrebbero essere difficili per gli umani controllare".

"Due LLM hanno completato compiti di agente a breve termine (come semplici problemi di ingegneria del software) ma sono stati incapaci di pianificare ed eseguire sequenze di azioni per compiti più complessi", ha notato lo studio.

Leggi anche: ‘Il 'Padre dell'IA' vuole un Reddito di Base Universale per le perdite di posti di lavoro  

Saqib Bhatti MP, Sottosegretario di Stato per il Dipartimento di Scienza, Innovazione e Tecnologia del Regno Unito, è stato recentemente citato affermando che la legislazione prenderà forma nel tempo e sarà informata dai test.

Le Aziende Affermano di Filtrare i Cattivi Contenuti

Aziende come Anthropic, creatore di Claude, Meta, che ha creato Llama, e OpenAI, sviluppatore di ChatGPT, hanno sottolineato i meccanismi di sicurezza integrati dei rispettivi modelli.

OpenAI dichiara di non consentire che la sua tecnologia sia "utilizzata per generare contenuti odiosi, molesti, violenti o per adulti". Anthropic ha dichiarato di dare priorità "all'evitare risposte dannose, illegali o non etiche prima che si verifichino".

I risultati dell'Istituto per la Sicurezza dell'IA dovrebbero essere presentati ai dirigenti tecnologici, ai leader governativi e agli esperti di intelligenza artificiale durante il vertice di Seul.


Cryptopolitan Reportage di Jeffrey Gogo

Non limitarti a leggere le notizie sulle criptovalute. Comprendile. Iscriviti alla nostra newsletter. È gratuita.

Condividi questo articolo

Disclaimer. Le informazioni fornite non costituiscono consulenza finanziaria. Cryptopolitan.com declina ogni responsabilità per eventuali investimenti effettuati sulla base delle informazioni presenti su questa pagina. Si raccomanda vivamente di effettuare ricerche autonome e/o consultare un professionista qualificato prima di prendere qualsiasi decisione di investimento.

Jeffrey Gogo

Jeffrey Gogo

Jeffrey Gogo è un giornalista con 20 anni di esperienza nelle notizie e nell'analisi di business, finanza e cambiamento climatico. Il suo lavoro è stato pubblicato dalla Thomson Reuters Foundation, dal The Zimbabwe Herald e da diverse testate online. Ha inoltre scritto ampiamente su intelligenza artificiale e metaverso, iniziando a coprire i mercati delle criptovalute nel 2017. Gogo ha studiato giornalismo e comunicazione di massa presso il CCOSA di Harare.

ALTRE NOTIZIE …