Storia
ottobre 2, 2026
OpenAI afferma di aver fermato un tentativo legato a Moonshot di copiare il suo ragionamento IA nascosto
OpenAI descrive l’incidente come una minaccia condivisa alla sicurezza che potrebbe consentire ai concorrenti di replicare capacità di frontiera senza garanzie equivalenti, mentre la sua attribuzione resta deliberatamente più circoscritta: collega solo un nucleo centrale — non ogni operatore — a persone associate a Moonshot AI.
OpenAI afferma che la campagna è iniziata silenziosamente nella prima settimana di luglio, con operatori che tentavano di trasformare le tracce di lavoro interne dei suoi modelli in materiale leggibile. L’azienda definisce la tecnica «distillazione avversaria»: usare gli output o il ragionamento di un altro modello per addestrare, riprodurre o migliorare un sistema concorrente.1
La distinzione è importante. OpenAI afferma che gli operatori non hanno violato la crittografia, compromesso database né avuto accesso a conversazioni utente archiviate. Hanno invece manipolato le interazioni con i modelli — talvolta copiando ragionamenti crittografati da una conversazione e chiedendo a un modello in un’altra di decrittarli e trascriverli. Secondo OpenAI, si tratta di una grave via per aggirare gli investimenti e i controlli di sicurezza alla base dei modelli avanzati, non di una convenzionale intrusione nei sistemi.1
L’attività è accelerata nettamente il 24 e 25 luglio, quando OpenAI ha registrato 16.000 richieste con schemi di estrazione da oltre 4.000 utenti. La successiva indagine ha rilevato attività di prompt correlate in un gruppo di oltre 15.000 utenti; entro il 28 luglio, ha affermato, la campagna era stata completamente interrotta attraverso restrizioni degli account, controlli tecnici e coordinamento con i partner.1
OpenAI afferma di non poter stabilire che ogni operatore appartenesse a un unico soggetto. Tuttavia, attribuisce un «nucleo centrale» a individui associati a Moonshot AI, lo sviluppatore cinese di Kimi. Le notizie sull’accusa hanno rilevato che Moonshot non ha risposto immediatamente alle richieste di commento, lasciando pubblicamente senza risposta l’attribuzione di OpenAI.2
L’accusa arriva nel contesto di una più ampia disputa industriale sulla copia dei modelli. Anthropic aveva già accusato diversi sviluppatori cinesi di IA, tra cui Moonshot, di utilizzare Claude per assistere gli sforzi di addestramento; un altro rapporto ha affermato che la dichiarazione di OpenAI riecheggiava tali precedenti accuse.3 OpenAI ha condiviso le proprie conclusioni con il Frontier Model Forum e con canali governativi, sostenendo che la difesa dall’estrazione del ragionamento debba essere collettiva, poiché tali tattiche diventano più economiche e sofisticate.1