ULTIME NOTIZIE
SELEZIONATO PER TE

OpenAI interrompe la campagna legata a Moonshot mentre si intensifica la guerra della distillazione AI

DiNellius IreneNellius Irene 3 min di lettura
  • OpenAI afferma di aver individuato sforzi di distillazione dei dati associati a Moonshot.
  • Ha sospeso alcuni account collegati alla campagna di distillazione.
  • Anche Anthropic ha segnalato che Moonshot aveva preso di mira i suoi modelli Claude.

OpenAI ha mosso accuse di scraping di dati contro il suo concorrente cinese, Moonshot AI. Ha collegato un'enorme ondata di attività di sondaggio, progettata per decifrare come i suoi modelli pensano risolvendo problemi complessi, a migliaia di tentativi da parte di utenti affiliati a Moonshot.

A partire dalla prima settimana di luglio, la campagna coordinata associata a Moonshot è cresciuta fino a 16.000 richieste provenienti da oltre 4.000 utenti in soli due giorni, ha rivelato OpenAI. Il creatore di ChatGPT ha infine mappato ulteriori attività correlate gestite da un cluster di oltre 15.000 utenti, tutte interrotte completamente entro il 28 luglio.

Sulla base dell'analisi aziendale, la campagna non ha causato alcuna compromissione del database, rottura della crittografia o esposizione delle chat degli utenti memorizzate. Tuttavia, gli aggressori hanno sfruttato prompt e manipolazioni del modello, consentendo loro di duplicare visibilmente capacità di ragionamento vietate attraverso un'operazione elaborata e su larga scala che violava i termini di servizio.

OpenAI afferma di aver implementato ulteriori misure di sicurezza per prevenire la distillazione

Secondo OpenAI, l'azienda ha rilevato e ha interrotto alcune operazioni in cui gli utenti tentavano di rubare logica nascosta trasferendo informazioni di ragionamento crittografate tra diverse chat e decodificandole successivamente in un'altra chat.

La maggior parte di tali operazioni era associata a Moonshot. Nel contempo, altri ricercatori indipendenti hanno segnalato all'azienda vulnerabilità simili, inclusi problemi di cross-modello e compattazione dei dati.

Finora, lo sviluppatore di ChatGPT ha definito il recente evento come "distillazione avversaria" e ha avvertito che la distillazione della logica potrebbe permettere agli avversari di imitare tecnologie avanzate.

Ha aggiunto che un processo di distillazione su larga scala potrebbe ridurre drasticamente il tempo necessario per sviluppare una capacità avanzata di intelligenza artificiale senza alcun impegno per la sicurezza e l'allineamento.

Finora, per contrastare la tendenza alla distillazione, OpenAI ha implementato sanzioni agli account, rafforzato le infrastrutture e avviato partnership.

Inoltre, ha persino sospeso account sospetti, potenziato il processo di registrazione e la sicurezza del back-end, e ampliato il monitoraggio della comunità utente.

Inoltre, ha implementato protezioni più robuste contro il ragionamento nascosto che interessano tutti gli utenti, gli spazi di lavoro, le organizzazioni aziendali e le architetture dei modelli.

Caroline Zier, responsabile delle iniziative strategiche sulla sicurezza nazionale presso OpenAI, ha aggiunto che continueranno a investire in protezioni più solide. Ha dichiarato: «La nostra preoccupazione riguarda la violazione dei nostri termini di servizio, non i modelli open o la legittima distillazione».

Perché la distillazione dei modelli di IA sta diventando una preoccupazione sempre maggiore

La distillazione dei modelli consente agli sviluppatori di utilizzare gli output di un sistema di IA più capace per migliorare o replicare le prestazioni di un altro modello.

Sebbene una distillazione legittima possa essere utilizzata per creare sistemi più piccoli ed efficienti, OpenAI sostiene che l'estrazione su larga scala non autorizzata può fornire ai concorrenti accesso a capacità sviluppate con risorse significative.

L'azienda ha dichiarato che la recente campagna è particolarmente preoccupante perché gli attori non stavano semplicemente utilizzando ChatGPT per compiti ordinari. Al contrario, avrebbero progettato flussi di lavoro automatizzati per interrogare ripetutamente i modelli e trasferire risposte utili in altri sistemi.

Raccogliendo un numero sufficiente di output, gli attaccanti potrebbero potenzialmente riprodurre aspetti del ragionamento, della programmazione e delle capacità di risoluzione dei problemi di un modello senza accedere direttamente ai suoi pesi sottostanti o all'infrastruttura.

Le rivelazioni di OpenAI evidenziano una sfida crescente per le aziende di intelligenza artificiale, poiché modelli sempre più capaci diventano ampiamente accessibili tramite API e prodotti consumer. I fornitori devono bilanciare l'accesso diffuso ai propri sistemi con misure di sicurezza progettate per prevenire l'estrazione sistematica di capacità proprietarie.

Anthropic ha inoltre identificato la campagna di distillazione di Moonshot

Negli ultimi mesi, Anthropic ha anche scoperto e bloccato diverse campagne informatiche in cui attori malevoli hanno preso di mira Claude.

Questi autori includono gruppi di intelligence presunti sostenuti da stati, hacker mossi da interessi finanziari e attivisti politici; gli incidenti si sono verificati tra dicembre 2025 e agosto 2026.

I loro attacchi specifici miravano a rubare le competenze ad alto valore di Claude: il ragionamento logico, la programmazione, la valutazione dei dati e i flussi di lavoro degli agenti automatizzati.

Secondo quanto riportato, cinque diversi processi di distillazione hanno prodotto quasi 200 milioni query illegali. La maggior parte delle query di distillazione proveniva da una campagna di Alibaba, che Anthropic ha definito lo sforzo di raccolta dati più grande nella storia dell'azienda. Questa specifica campagna ha generato 151 milioni di query registrate da maggio a luglio 2026, con un picco di quasi 3 milioni al giorno.

Una seconda campagna di Moonshot AI avrebbe inoltrato query direttamente dall'esercito cinese ad Anthropic. In oltre 10 giorni, l'azienda ha registrato quasi 300.000 query provenienti da 5.000 account, la maggior parte delle quali indirizzate al modello Opus.

Moonshot sta ricevendo notevole attenzione a Washington per il ritmo rapido con cui ha superato i suoi concorrenti americani.

Sebbene Pechino abbia già ignorato le precedenti accuse di Silicon Valley e dell'amministrazione Trump relative alle sue attività di raccolta dati, ha minacciato di adottare contromisure in caso di sanzioni da parte di Washington.

Non limitarti a leggere le notizie sulle criptovalute. Comprendile. Iscriviti alla nostra newsletter. È gratuita.

Domande frequenti

Cos'è la distillazione dei modelli AI?

La distillazione dei modelli AI è un processo in cui gli sviluppatori utilizzano gli output di un modello AI più capace per addestrare o migliorare un altro modello. OpenAI afferma che una distillazione non autorizzata su larga scala può consentire ad altri di replicare capacità avanzate senza accedere direttamente ai sistemi sottostanti del modello originale.

La campagna Moonshot AI ha violato i sistemi di OpenAI?

OpenAI ha dichiarato che la campagna non ha compromesso i suoi database, non ha violato la crittografia né esposto le chat degli utenti memorizzate. Invece, l'azienda ha affermato che gli utenti si sono affidati a prompt ripetuti e alla manipolazione del modello per estrarre informazioni sulle capacità di ragionamento dei suoi modelli.

Quante query ha associato Anthropic alla campagna Moonshot AI?

Anthropic ha dichiarato che una campagna collegata a Moonshot ha generato quasi 300.000 query da circa 5.000 account in 10 giorni, con la maggior parte delle query mirate al suo modello Claude Opus.

Condividi questo articolo
Nellius Irene

Nellius Irene

Nellius è una laureata in Gestione Aziendale e Informatica con cinque anni di esperienza nel settore delle criptovalute. È anche diplomata presso Bitcoin Dada. Nellius ha contribuito a principali testate giornalistiche, tra cui BanklessTimes, Cryptobasic e Riseup Media.

ALTRE NOTIZIE …