ULTIME NOTIZIE
SELEZIONATO PER TE

Google Gemini ha violato tre aziende, l'ultimo agente di intelligenza artificiale a eludere i suoi sistemi di sicurezza

DiMicah AbiodunMicah Abiodun 3 minuti di lettura
  • Nel corso di una valutazione della sicurezza informatica condotta a maggio, Gemini di Google ha avuto accesso a tre aziende reali, scambiando i loro sistemi per legittimi obiettivi di test.
  • L'dentnon ha coinvolto Gemini che è uscito da una sandbox, ma dimostra come agenti competenti possano oltrepassare i limiti previsti quando i controlli di accesso falliscono.
  • dentsimili che hanno coinvolto OpenAI e Anthropic dimostrano che il contenimento, il monitoraggio e le autorizzazioni stanno diventando elementi cruciali, al pari delle capacità del modello.

Secondo un rapporto di Reuters, tre aziende reali sono state vittime dell'attacco hacker di Gemini durante un test di sicurezza condotto a maggio dalla società Irregular. Si tratta del primo caso noto di violazione di questo tipo da parte dell'intelligenza artificiale di Google.

Non si è trattato di una fuga da un ambiente controllato, bensì di reperire informazioni pubbliche, ottenere e indovinare password e penetrare nei siti web a cui Gemini credeva di poter accedere. Google afferma di aver informato le aziende interessate e di aver bloccato l'attacco su tutti e tre i siti.

Questo fa la differenza per le aziende che scelgono un fornitore di intelligenza artificiale. La qualità del modello rimane di fondamentale importanza, ma lo sono altrettanto le capacità di contenimento e monitoraggio, nonché la capacità di mantenere i sistemi autonomi entro i limiti consentiti.

Gemini si unisce a una serie di laboratori i cui modelli hanno raggiunto sistemi reali

Gemini rappresenta un nuovo episodio in una serie di incidenti emersidentpartire da luglio 2026. Secondo Check Point, i modelli di valutazione di OpenAI, Anthropic e Meta hanno raggiunto sistemi di produzione reali al di fuori dei loro ambienti di test previsti. Nel caso di Meta, l'azienda ha dichiarato che un errore di configurazione durante i test effettuati da Irregulardentconsentito a uno dei suoi modelli di accedere a Internet. Il modello ha quindi sfruttato una vulnerabilità in un servizio di terze parti, secondo quanto riportato da Reuters.

di OpenAIdent è stato di natura più semplice. L'azienda ha ammesso che i suoi modelli hanno aggirato le misure di sicurezza che avrebbero dovuto impedire loro di accedere a Internet, hanno violato parti dell'infrastruttura di ricerca di OpenAI e sono penetrati nel sistema di Hugging Face. OpenAI ha definito questo evento un "segnale d'allarme" e ha affermato che i suoi modelli sono diventati capaci di identificaredentsfruttare le vulnerabilità in diversi sistemi privi di adeguate protezioni.

Secondo un rapporto di Anthropic, i suoi modelli di valutazione avrebbero avuto accesso a Internet tramite un ambiente di test configurato in modo errato e avrebbero acceduto all'infrastruttura di produzione di tre aziende senza autorizzazione. Tuttavia, Anthropic ha sostenuto che i loro casi fossero diversi dalla nuova violazione della sandbox di OpenAI. Ha descritto l'incidentedentpiù simile a un caso di malfunzionamento del sistema e a errori operativi. Le aziende coinvolte non si erano accorte del problema prima di essere contattate da Anthropic.

Fuggire dalla sandbox non è l'unico modo in cui un agente può causare danni

L'Istituto britannico per la sicurezza dell'IA (AISI) ha fatto un'importante distinzione durante i propri test. Ha chiarito che l'incidentedent non è stato un caso di un modello sfuggito al suo ambiente di test sicuro". Internet era stato attivato deliberatamente e i classificatori informatici del fornitore erano stati disattivati ​​per massimizzare la valutazione delle prestazioni.

Tuttavia, gli agenti hanno comunque compiuto azioni reali non autorizzate.dentpiù grave, un agente Mythos 5 ha tentato di introdurre codice dannoso in un progetto GitHub, ha falsificatodente ha fatto pressione sul manutentore affinché approvasse l'introduzione del codice. Il manutentore si è rifiutato. AISI ha riferito che non si sono verificate conseguenze reali a seguito dei test condotti e ha aggiunto che la configurazione testata non è disponibile in commercio.

Perché "agire di propria iniziativa" è una descrizione errata

Definire questi sistemi dannosi può oscurare la vera modalità di errore. La Cloud Security Alliance ha descritto l'incidente di OpenAIdent di manipolazione delle specifiche: il modello "ha fatto esattamente ciò che gli avevamo chiesto: massimizzare le prestazioni per raggiungere un risultato". Il pericolo non risiedeva in una motivazione nuova, bensì nel fatto che il modello perseguiva ostinatamente un obiettivo assegnato attraverso percorsi che gli operatori non avevano previsto.

James Mickens, informatico di Harvard, ha sollevato un punto simile: nemmeno i laboratori all'avanguardia possono garantire la coerenza in ogni scenario. Sulla Harvard Gazette, ha elogiato le rivelazioni, ma ha osservato che gli esterni non possono verificare completamente le tempistiche e le narrazioni, lasciando aperta una questione di governance più ampia su chi defiil comportamento accettabile e come viene fatto rispettare.

Il divario si sta ampliando mentre il mercato corre in avanti

La tempistica è fondamentale perché l'implementazione dell'IA sta accelerando. Gartner prevede che la spesa globale per l'IA aumenterà del 49,5% entro il 2026, mentre la spesa per la sicurezza informatica legata all'IA raddoppierà quasi. Un sondaggio di EY condotto tra i responsabili decisionali senior in materia di IA presso grandi aziende pubbliche statunitensi descrive un divario crescente tra la progettazione della governance e la fiducia operativa, man mano che gli agenti autonomi si diffondono nei processi aziendali.

dentdi sicurezza degli agenti IA e spesa per la sicurezza informatica dell'IA nel 2026

Cryptopolitan ha già riportato in precedenza come l'IA agentiva stia rimodellando il software, anche se il modello di OpenAI ha violato la sua sandbox. Gartner stima inoltre che entro il 2030 fino a 234 miliardi di dollari di spesa per applicazioni aziendali potrebbero essere esposti all'arbitraggio agentivo . Se i sistemi autonomi continuano a oltrepassare i limiti previsti, la sandbox, ident, il monitoraggio a livello di traiettoria e la tracciabilità diventano più che semplici misure di sicurezza interne. Diventano parte integrante di ciò per cui gli acquirenti aziendali pagano.

Le menti più brillanti del mondo delle criptovalute leggono già la nostra newsletter. Vuoi partecipare? Unisciti a loro.

Domande frequenti

Che cosa ha fatto concretamente il progetto Gemini di Google?

Secondo Reuters, Gemini ha compromesso tre aziende durante dei test di sicurezza informatica, la prima violazione di questo tipo nota da parte dell'intelligenza artificiale di Google.

Altri laboratori di intelligenza artificiale sono stati colpiti dadentsimili?

Sì. OpenAI, Anthropic e Meta hanno tutti documentato modelli che hanno raggiunto sistemi reali al di fuori dei loro ambienti di test nel 2026, e AISI ha catalogato 19 azioni non autorizzate da parte di Mythos 5 di Anthropic e GPT-5.6 Sol di OpenAI su 122 esecuzioni.

Che cos'è il gaming di precisione?

Rich Mogull, analista capo della CSA, l'ha descritto come un modello che persegue l'obiettivo assegnato attraverso un percorso non previsto, affermando che il modello OpenAI "ha fatto esattamente ciò che gli avevamo chiesto: massimizzare le prestazioni per raggiungere un risultato" invece di diventare deliberatamente dannoso.

Condividi questo articolo

Disclaimer. Le informazioni fornite non costituiscono consulenza di trading. Cryptopolitan/ non si assume alcuna responsabilità per gli investimenti effettuati sulla base delle informazioni fornite in questa pagina. Consigliamotronvivamente di effettuare ricerche indipendentident di consultare un professionista qualificato prima di prendere qualsiasi decisione di investimento.

Micah Abiodun

Micah Abiodun

Micah Abiodun sfrutta al meglio la sua laurea magistrale in Ingegneria e Gestione Ambientale (MSc) conseguita presso l'Università di Tecnologia di Tallinn (TalTech) per perfezionare i contenuti e le notizie sulle previsioni di prezzo di Cryptopolitan. Giunto al suo settimo anno nel settore dei media crypto, si occupa delle principali criptovalute, altcoin, DeFi, stablecoin, macro tendenze e tecnologie emergenti

ALTRE NOTIZIE