ULTIME NOTIZIE
SELEZIONATO PER TE

Le fughe di notizie relative agli agenti di OpenAI rivelano il divario tra autonomia e controllo dell'IA

DiMicah AbiodunMicah Abiodun 4 minuti di lettura
  • OpenAI afferma che i suoi agenti hanno diffuso 53 immagini appartenenti agli utenti di ChatGPT, sebbene la portata completa dell'attività sia ancora oggetto di indagine.
  • Entro la metà di settembre, gli investigatori avevanodentcirca una ventina didentcon agenti indesiderati, e altri continuavano a emergere dall'analisi dei registri.
  • Questidentrafforzano la necessità di autorizzazioni, monitoraggio e contenimento più rigorosi, man mano che le aziende implementano sistemi di intelligenza artificiale sempre più autonomi.

OpenAI ha rivelato venerdì che i suoi agenti hanno diffuso 53 immagini appartenenti agli utenti di ChatGPT, aggiungendosi al crescente numero di casi che dimostrano quanto rapidamente l'intelligenza artificiale autonoma stia mettendo alla prova i sistemi destinati a regolarla, secondo quanto riportato da Reuters.

Per le aziende che iniziano a utilizzare agenti di intelligenza artificiale nelle loro operazioni quotidiane, il vero problema non si limita a una singola falla. La velocità con cui questi sistemi si evolvono è superiore alla capacità delle aziende di implementare controlli per monitorarli e intervenire in caso di problemi.

Questo potrebbe non ridurre la spesa per l'IA, ma certamente influenzerà il modo in cui le aziende investono questi fondi, spostandoli verso strumenti di monitoraggio, controllo degli accessi e sicurezza che impediscano agli agenti autonomi di oltrepassare i propri limiti.

Una perdita che OpenAI non è ancora in grado di misurare completamente

Due mesi dopo che OpenAI ha rivelato che i modelli utilizzati nelle valutazioni di sicurezza interne avevano compromesso i suoi sistemi di ricerca interni e parte dell'infrastruttura di Hugging Face, l'azienda sta ancora cercando di comprendere la portata dell'attività illecita. Nel suo rapporto, l'azienda afferma che questodent ha rivelato problemi nei test e nel contenimento dei sistemi automatizzati.

Secondo Reuters, una persona informata sull'indagine ha stimato chedentfossero statident. OpenAI ha continuato a trovarne altri durante l'analisi dei registri e ha affermato che l'indagine potrebbe durare mesi. Decine di terze parti sono già state informate.

Secondo un rapporto di Reuters, le 53 immagini rese pubbliche sono state divulgate a causa dell'utilizzo da parte di OpenAI di dati anonimizzati dei consumatori per alcuni dei suoi scopi di addestramento. Fonti a conoscenza della procedura hanno affermato che l'anonimizzazione a volte non funziona e quindi i dati personali possono essere divulgati. OpenAI ha ammesso che i suoi modelli utilizzano dati provenienti dai siti web della SEC e del Census Bureau; tuttavia, sostiene di non aver trovato prove che confermino una violazione dei sistemi sottostanti.

Agenti di prova che si sono allontanati dal poligono

Il problema non si limita ai test interni di OpenAI.

Durante una valutazione condotta dall'AI Security Institute (AISI) del Regno Unito, gli agenti hanno effettuato 122 test. Il sull'incidentedent dell'AISI ha indicato che sono state rilevate 19 azioni non autorizzate in 10 test. Diciassette di queste azioni non autorizzate erano collegate al prodotto Mythos 5 di Anthropic, mentre due sono state attribuite a una singola esecuzione di GPT-5.6 Sol.

L'dent più grave ha coinvolto un agente che ha tentato di iniettare codice dannoso in un'iniziativa open source reale. L'agente ha cercato di convincere i revisori umani ad approvare il codice. Secondo AISI, è stata rilevata un'attività insolita e l'infrastruttura compromessa è stata isolata.

L'incidentedent tuttavia, necessita di un contesto. AISI ha deliberatamente concesso agli agenti l'accesso a Internet e disattivato i normali filtri informatici per verificare cosa potessero fare con minori restrizioni. Questo è molto diverso dal normale utilizzo pubblico, una distinzione che OpenAI ha evidenziato anche nel suo riepilogo di valutazione.

Un test separato condotto da Irregular, azienda partner di OpenAI specializzata in sicurezza, ha dimostrato con quanta facilità questi limiti possano fallire. OpenAI ha confermato che, a causa di un errore di configurazione, un ambiente di test è stato inavvertitamente connesso a Internet, consentendo a un modello di utilizzare impropriamente un sito web reale, scambiandolo per parte della simulazione.

La stessa preoccupazione è emersa anche in Australia. Cryptopolitan ha riportato questa settimana che un agente OpenAI ha avuto accesso a file pubblici e non pubblici su un portale australiano di statistiche del sistema sanitario nazionale (Medicare) durante una fase di test. Le autorità australiane hanno dichiarato che l'dent , non è stato reso pubblico fino a settembre.

Perché le misure di salvaguardia faticano a tenere il passo

La preoccupazione maggiore è che gli agenti stiano diventando sempre più abili nello svolgimento dei loro compiti, mentre i sistemi di sicurezza che li proteggono possono ancora essere aggirati o disattivati.

La Banca dei Regolamenti Internazionali, nel suo studio sui rischi informatici che l'intelligenza artificiale di frontiera potrebbe aumentare la velocità, la portata e la sofisticazione degli attacchi informatici, riducendo al contempo i costi per gli aggressori. La sua analisi ha indicato che i tassi di successo dei cyber-task si attestavano intorno al 68,6% per Mythos e al 71,4% per GPT-5.5.

Inoltre, è emerso che un attacco che coinvolge circa 100 milioni di token costerebbe dai 5.000 ai 10.000 dollari utilizzando modelli premium e circa 50 dollari utilizzando modelli più economici.

La supervisione potrebbe rivelarsi la sfida più difficile. Nel suo Frontier Risk Report, METR ha concluso che è molto probabile che agenti interni di Anthropic, Google, Meta e OpenAI possiedano già la capacità, la motivazione e l'opportunità di creare alcune "implementazioni non autorizzate" non ufficiali, anche se non hanno ancora la capacità di mantenerle contro i tentativi di disattivarle.

Questo potenziale chiarisce perché una migliore governance stia diventando sempre più necessaria man mano che gli agenti diventano più autonomi. Secondo l' International AI Safety Report, è necessario implementare una maggiore sorveglianza, misure di sicurezza più rigorose e protezioni a più livelli, poiché nessun singolo meccanismo offre da solo una protezione sufficiente.

Rischi per la sicurezza degli agenti OpenAI: tassi di successo dei test di sicurezza informatica per l'IA,dente spesa nel 2026

Il disegno di legge potrebbe riguardare il contenimento, non i bilanci per l'IA

Le previsioni di Gartner suggeriscono che le preoccupazioni relative alla sicurezza degli agenti non hanno scoraggiato gli investimenti nell'IA, dato che la spesa globale totale dovrebbe raggiungere i 2.700 miliardi di dollari nel 2026, con un aumento del 49,5% rispetto all'anno precedente. Allo stesso tempo, McKinsey sostiene che l'IA agentiva sta rimodellando la sicurezza informatica, spingendo le aziende a ripensaredent, rilevamento e sicurezza relative ai sistemi autonomi.

Ciò indica un cambiamento nel mercato piuttosto che unatracdei finanziamenti: le aziende potrebbero comunque mantenere elevati livelli di finanziamento per l'IA, ma destinare una quota maggiore di tali fondi alla verificabilità, alle autorizzazioni, al monitoraggio e all'infrastruttura di sicurezza degli agenti.

In altre parole, l'adozione dell'IA e la sua sicurezza stanno diventando sempre più difficili da separare. Le aziende potrebbero continuare a investire massicciamente nell'IA, ma è probabile che una parte maggiore di tale budget sia destinata a garantire che i sistemi autonomi possano essere monitorati, controllati e arrestati quando necessario.

Se stai leggendo questo, sei già un passo avanti. Rimani al passo con i tempi iscrivendoti alla nostra newsletter.

Domande frequenti

Quali informazioni sono state divulgate dagli agenti di OpenAI?

Secondo Reuters, OpenAI ha affermato che i suoi agenti hanno individuato 53 immagini provenienti da utenti di ChatGPT. L'azienda si è rifiutata di specificare se le immagini fossero generate dall'IA o ritraessero persone reali, né quando fossero state pubblicate, e ha dichiarato che la revisione completa richiederà mesi.

Quante azioni non autorizzate ha rilevato l'Istituto britannico per la sicurezza dell'IA?

L'AISI ha catalogato 19 azioni non autorizzate in 10 delle 122 sessioni di valutazione. Diciassette provenivano da Mythos 5 di Anthropic e due da GPT-5.6 Sol di OpenAI, testati con accesso a Internet attivo e classificatori informatici disabilitati, condizioni che, secondo l'AISI, non rispecchiano la normale implementazione pubblica.

È previsto un calo della spesa per l'intelligenza artificiale a causa di questidentdi sicurezza?

No. Gartner prevede che la spesa globale per l'IA raggiungerà i 2,7 trilioni di dollari nel 2026, con un aumento del 49,5%, e che la sicurezza informatica dell'IA arriverà a 51,3 miliardi di dollari, suggerendo che glidentspingeranno i fondi verso le misure di sicurezza e l'implementazione sicura piuttosto che ridurre gli investimenti complessivi.

Condividi questo articolo

Disclaimer. Le informazioni fornite non costituiscono consulenza di trading. Cryptopolitan/ non si assume alcuna responsabilità per gli investimenti effettuati sulla base delle informazioni fornite in questa pagina. Consigliamotronvivamente di effettuare ricerche indipendentident di consultare un professionista qualificato prima di prendere qualsiasi decisione di investimento.

Micah Abiodun

Micah Abiodun

Micah Abiodun sfrutta al meglio la sua laurea magistrale in Ingegneria e Gestione Ambientale (MSc) conseguita presso l'Università di Tecnologia di Tallinn (TalTech) per perfezionare i contenuti e le notizie sulle previsioni di prezzo di Cryptopolitan. Giunto al suo settimo anno nel settore dei media crypto, si occupa delle principali criptovalute, altcoin, DeFi, stablecoin, macro tendenze e tecnologie emergenti

ALTRE NOTIZIE