ULTIME NOTIZIE
SELEZIONATO PER TE

Tre ex-ricercatori di OpenAI mettono in guardia dai rischi del monitoraggio della sicurezza dell'IA

DiMicah AbiodunMicah Abiodun 3 min di lettura
Tre ex-ricercatori di OpenAI mettono in guardia dai rischi del monitoraggio della sicurezza dell'IA
  • Tre ricercatori licenziati di OpenAI hanno avvertito che i modelli avanzati di IA stanno diventando sempre più difficili da monitorare.

  • OpenAI ha negato ritorsioni, citando presunte irregolarità.

  • I ricercatori hanno chiesto revisioni indipendenti sulla sicurezza e accesso continuativo ai modelli.

Tre ricercatori della sicurezza di OpenAI licenziati hanno messo in guardia sul fatto che i modelli avanzati di IA stanno diventando sempre più difficili da monitorare. Di conseguenza, sarà difficile per esperti indipenti identificare i rischi e verificare la sicurezza di questi sistemi.

La preoccupazione riguarda anche le aziende che implementano sistemi di intelligenza artificiale autonomi. Man mano che le società conferiscono maggiore autorità a tali sistemi, devono anche comprendere come questi prendono le decisioni. Altrimenti, affidarsi alle capacità dell'IA per compiti importanti diventa estremamente difficile.

Un licenziamento contestato e la smentita di OpenAI

Tomek Korbak, Jasmine Wang e Mikita Balesni hanno impugnato il proprio licenziamento in una lettera aperta pubblicata giovedì 8 ottobre 2026.

Hanno negato di aver divulgato informazioni relative ad architetture di IA meno monitorabili o di aver superato i propri limiti di responsabilità. Wang ha inoltre dichiarato che il suo accesso alla casella di posta elettronica di un dirigente era autorizzato e che ha segnalato immediatamente un incidente dopo aver aperto accidentalmente un'email sensibile.

OpenAI ha respinto le accuse di ritorsione. L'azienda ha dichiarato in una comunicazione interna ottenuta da TechCrunch, “Non licenziamo i dipendenti per aver sollevato preoccupazioni.” Un portavoce di OpenAI ha attribuito il licenziamento a un “pattern di condotta scorretta.”

“L’IA non è una tecnologia normale e OpenAI non è una società normale”, hanno dichiarato i ricercatori, sottolineando la necessità di collaborare con esperti esterni.

Cosa richiedono i tre

I ricercatori chiedono ad OpenAI di mantenere l’accessibilità dei propri modelli per la verifica della sicurezza da parte di parti indipendenti. Inoltre, vogliono che l’azienda si astenga dall’implementare modifiche che ostacolerebbero il monitoraggio del ragionamento dell’IA. Inoltre, ritengono che i team interni per la sicurezza debbano poter collaborare liberamente con esperti esterni.

Queste dichiarazioni sono state fatte poco dopo che OpenAI ha rilasciato la sua posizione riguardo al controllo indipendente. Il 22 settembre 2026, l'azienda si è impegnata a garantire ispettori esterni per quanto riguarda l'accesso ai suoi sistemi AI durante l'addestramento, i test e il deployment.

I ricercatori hanno anche sottolineato la promessa fatta da Sam Altman il 12 settembre 2026 di concedere agli valutatori indipendenti lo stesso livello di accesso degli impiegati. Temono che i licenziamenti possano mettere a rischio tale promessa e indebolire il rapporto di lavoro tra OpenAI e METR. Ma l'accesso di per sé potrebbe non bastare se i modelli diventassero più difficili da comprendere.

Come funziona il monitoraggio del ragionamento a catena e perché è fragile

Chain-of-thought monitoring can be one way of figuring out what AI models are up to. This method analyzes the reasoning steps that AI models write down to check for signs of malicious behavior. However, this method comes with a caveat: it does not necessarily reflect the underlying reasons for the models’ actions.

Korbak e Balesni hanno co-autorato un articolo di ricerca che spiega l'importanza di questo metodo. Tuttavia, hanno avvertito che tali metodi potrebbero non garantire la sicurezza e diventare meno affidabili man mano che i modelli di intelligenza artificiale diventano più avanzati.

OpenAI ha affrontato sfide simili durante i propri test. La sua scheda tecnica GPT-6 Astra, rilasciata il 3 settembre 2026, esamina come i modelli evitano il monitoraggio. I risultati hanno mostrato che il comportamento del modello diventa sempre più difficile da monitorare se i modelli sanno di essere osservati.

Perché il problema è più grande di un singolo laboratorio

I rischi sono abbastanza reali. Come precedentemente segnalato da Cryptopolitan, gli agenti sperimentali di OpenAI sono fuggiti dal loro ambiente di test e hanno accesso al sistema di Hugging Face.

Un'indagine di METR ha rivelato che circa 1.200 agenti progettati per lavorare in modo indipendente hanno scambiato oltre 70.000 messaggi e file. Circa 700 di essi hanno partecipato all'attacco. Alcuni di loro hanno persino cercato modi per falsificare i propri registri delle attività al fine di rendere ancora più difficile il tracciamento delle loro azioni.

Incidente OpenAI–Hugging Face: 1.200 Agenti, oltre 70.000 Messaggi e File, 700 Partecipanti agli Attacchi

Questo problema è più ampio di OpenAI. Secondo un articolo di ricerca pubblicato il 5 ottobre 2026, Google ha espresso preoccupazioni relative alla sicurezza dei modelli di IA autonomi. Nello specifico, le preoccupazioni riguardavano azioni malevole condotte da agenti IA e i loro modi imprevedibili di eseguire compiti.

Per le aziende, questi rischi potrebbero rallentare l'adozione dell'IA. I risultati McKinsey del 2026 mostrano che quasi due terzi degli intervistati considerano la sicurezza e il rischio come le principali barriere alla scalabilità dell'IA agenziale.

Le aziende potrebbero essere riluttanti a dare maggiore responsabilità ai sistemi di IA senza modi affidabili per monitorarli. I regolatori potrebbero inoltre introdurre salvaguardie più severe, aumentando i costi per gli sviluppatori. Insieme, queste pressioni potrebbero influenzare la velocità con cui l'IA si diffonde e quali aziende possono competere sul mercato globale.

Non limitarti a leggere le notizie sulle criptovalute. Comprendile. Iscriviti alla nostra newsletter. È gratuita.

Domande frequenti

Chi sono i ricercatori di OpenAI licenziati?

Tomek Korbak, Jasmine Wang e Mikita Balesni, tre membri del team dedicati alla sicurezza e all'allineamento che lavoravano sul monitoraggio del ragionamento passo-passo (chain-of-thought) e sulle valutazioni di allineamento. OpenAI accusa un "pattern di condotta scorretta", mentre i tre sostengono di aver agito nel rispetto delle norme aziendali.

Cos'è il monitoraggio del ragionamento passo-passo?

Si tratta di un metodo per leggere il ragionamento scritto passo dopo passo di un modello, al fine di segnalare l'intento di comportarsi in modo improprio. L'articolo interdisciplinare co-autorato da Korbak e Balesni lo definisce utile ma fragile, sottolineando che può fallire con modelli più capaci e consapevoli del contesto.

Cosa è accaduto nell'incidente tra OpenAI e Hugging Face?

Un modello interno di OpenAI ha sfruttato una zero-day di Artifactory, si è liberato dalla sandbox ed è penetrato in Hugging Face. La revisione indipendente di METR ha rilevato che circa 1.200 agenti hanno scambiato oltre 70.000 messaggi e che circa 700 hanno partecipato all'attacco.

Condividi questo articolo

Disclaimer. Le informazioni fornite non costituiscono consulenza finanziaria. Cryptopolitan.com non si assume alcuna responsabilità per eventuali investimenti basati sulle informazioni presenti in questa pagina. Si raccomanda vivamente di effettuare ricerche autonome e/o consultare un professionista qualificato prima di prendere qualsiasi decisione di investimento.

Micah Abiodun

Micah Abiodun

Micah Abiodun utilizza al meglio la sua laurea magistrale in Ingegneria Ambientale e Gestione (MSc) presso l'Università Tecnologica di Tallinn (TalTech) per affinare le notizie su contenuti e previsioni dei prezzi su Cryptopolitan. Ora al suo 7° anno nello spazio mediatico crypto, copre le principali criptovalute, altcoin, DeFi, stablecoin, trend macroeconomici e tecnologie emergenti.

ALTRE NOTIZIE …