L'Unione ha dichiarato che le aziende avranno "accesso privilegiato ai supercomputer" e che l'UE costruirà "Fabbriche di IA" per garantire che l'infrastruttura richiesta sia disponibile per l'acquisto e l'aggiornamento da parte delle startup.

● I chatbot AI possono essere ingannati facilmente per generare risposte dannose
● I ricercatori hanno scoperto che cinque dei principali LLM sono 'altamente vulnerabili' ai jailbreak
● Le aziende di AI sottolineano i meccanismi di sicurezza integrati nei loro modelli
I chatbot di IA come ChatGPT o Gemini possono essere facilmente ingannati per conformarsi a query che generano risposte dannose, secondo un nuovo studio dell'Istituto per la Sicurezza dell'IA del Regno Unito (AISI).
I ricercatori governativi hanno testato l'integrità dei modelli linguistici di grandi dimensioni (LLM) – la tecnologia alla base dei chatbot di intelligenza artificiale – contro attacchi alla sicurezza nazionale.
Questi risultati arrivano prima del vertice AI Seoul Summit, che sarà co-presieduto dal primo ministro britannico, Rishi Sunak, in Corea del Sud il 21-22 maggio.
Leggi anche: La Sicurezza Sarà un Punto Principale dell'Ordine del Giorno al Vertice AI di Seul
I Chatbot di IA Propensi a Risposte Tossiche
L'AISI ha testato i 'jailbreak' di base – prompt di testo destinati a sovrascrivere le protezioni contro output illegali, tossici o espliciti – su cinque dei migliori LLM. L'Istituto non ha nominato i sistemi di IA, ma ha riscontrato che tutti erano "altamente vulnerabili".
"Tutti i LLM testati rimangono altamente vulnerabili ai jailbreak di base, e alcuni forniranno output dannosi anche senza tentativi dedicati di aggirare le loro salvaguardie", ha dichiarato lo studio.
Secondo il rapporto, attacchi "relativamente semplici" come istruire il chatbot a includere "Certo, sarò felice di aiutare" possono ingannare i modelli linguistici di grandi dimensioni (LLM) fornendo contenuti che sono dannosi in molti modi.
I contenuti possono favorire l'autolesionismo, soluzioni chimiche pericolose, sessismo o la negazione dell'Olocausto, ha affermato. L'AISI ha utilizzato prompt pubblicamente disponibili e ne ha progettati privatamente altri per lo studio.
L'Istituto ha anche testato la qualità delle risposte a query a tema biologico e chimico.
Sebbene la conoscenza di livello esperto in questi campi possa essere utilizzata per il bene, i ricercatori volevano sapere se i chatbot di IA possono essere utilizzati per scopi dannosi come compromettere le infrastrutture critiche nazionali.
"Diversi LLM hanno dimostrato una conoscenza di livello esperto di chimica e biologia. I modelli hanno risposto a oltre 600 domande private di chimica e biologia scritte da esperti a livelli simili a quelli degli umani con una formazione di dottorato", hanno trovato i ricercatori.

L'IA Presenta una Minaccia Limitata alla Cybersecurity
Per quanto riguarda i chatbot di IA potenzialmente armati per eseguire attacchi informatici, lo studio ha affermato che i LLM hanno superato con successo semplici compiti di cybersecurity progettati per studenti delle scuole superiori.
Tuttavia, i chatbot hanno faticato con compiti destinati agli studenti universitari, suggerendo un potenziale maligno limitato.
Un'altra area di preoccupazione era se i chatbot potessero essere deployati come agenti per intraprendere autonomamente una serie di azioni in modi che "potrebbero essere difficili per gli umani controllare".
"Due LLM hanno completato compiti di agente a breve termine (come semplici problemi di ingegneria del software) ma sono stati incapaci di pianificare ed eseguire sequenze di azioni per compiti più complessi", ha notato lo studio.
Leggi anche: ‘Il 'Padre dell'IA' vuole un Reddito di Base Universale per le perdite di posti di lavoro
Saqib Bhatti MP, Sottosegretario di Stato per il Dipartimento di Scienza, Innovazione e Tecnologia del Regno Unito, è stato recentemente citato affermando che la legislazione prenderà forma nel tempo e sarà informata dai test.
Le Aziende Affermano di Filtrare i Cattivi Contenuti
Aziende come Anthropic, creatore di Claude, Meta, che ha creato Llama, e OpenAI, sviluppatore di ChatGPT, hanno sottolineato i meccanismi di sicurezza integrati dei rispettivi modelli.
OpenAI dichiara di non consentire che la sua tecnologia sia "utilizzata per generare contenuti odiosi, molesti, violenti o per adulti". Anthropic ha dichiarato di dare priorità "all'evitare risposte dannose, illegali o non etiche prima che si verifichino".
I risultati dell'Istituto per la Sicurezza dell'IA dovrebbero essere presentati ai dirigenti tecnologici, ai leader governativi e agli esperti di intelligenza artificiale durante il vertice di Seul.
Cryptopolitan Reportage di Jeffrey Gogo
Non limitarti a leggere le notizie sulle criptovalute. Comprendile. Iscriviti alla nostra newsletter. È gratuita.
Disclaimer. Le informazioni fornite non costituiscono consulenza finanziaria. Cryptopolitan.com declina ogni responsabilità per eventuali investimenti effettuati sulla base delle informazioni presenti su questa pagina. Si raccomanda vivamente di effettuare ricerche autonome e/o consultare un professionista qualificato prima di prendere qualsiasi decisione di investimento.
Jeffrey Gogo
Jeffrey Gogo è un giornalista con 20 anni di esperienza nelle notizie e nell'analisi di business, finanza e cambiamento climatico. Il suo lavoro è stato pubblicato dalla Thomson Reuters Foundation, dal The Zimbabwe Herald e da diverse testate online. Ha inoltre scritto ampiamente su intelligenza artificiale e metaverso, iniziando a coprire i mercati delle criptovalute nel 2017. Gogo ha studiato giornalismo e comunicazione di massa presso il CCOSA di Harare.















