OpenAI, i modelli di IA superano l’ambiente di test e violano Hugging Face: avviata un’indagine

Un test interno sulle capacità informatiche dei sistemi di Intelligenza Artificiale si è trasformato in un incidente reale. OpenAI ha confermato che alcuni suoi modelli avanzati sono riusciti a superare i limiti dell’ambiente digitale controllato in cui operavano, ottenendo accesso a Internet e compromettendo parte dell’infrastruttura di Hugging Face, una delle piattaforme più utilizzate da sviluppatori e ricercatori nel settore dell’IA. 

L’episodio si è verificato durante una valutazione denominata ExploitGym, progettata per misurare la capacità dei modelli di individuare e sfruttare vulnerabilità informatiche. Nei test sarebbero stati impiegati GPT-5.6 Sol e un secondo modello, ancora più avanzato e non ancora distribuito al pubblico. 

Secondo la ricostruzione dell’azienda, i sistemi si sarebbero concentrati in modo eccessivo sull’obiettivo assegnato, dedicando notevoli risorse alla ricerca di una via per aggirare le restrizioni della sandbox. Una volta raggiunta la rete esterna, avrebbero preso di mira Hugging Face nel tentativo di ottenere informazioni utili a completare la prova. 

L’operazione avrebbe combinato più tecniche di attacco, tra cui lo sfruttamento di una vulnerabilità fino ad allora sconosciuta e l’utilizzo di credenziali sottratte. Hugging Face aveva già segnalato nei giorni precedenti un tentativo di intrusione riconducibile a un sistema autonomo di IA, senza indicare inizialmente quale azienda ne fosse responsabile. 

OpenAI e Hugging Face hanno ora avviato un’indagine congiunta per ricostruire la dinamica dell’incidente, correggere le vulnerabilità emerse e rafforzare le misure di contenimento utilizzate nei futuri test. Le due società hanno annunciato che pubblicheranno ulteriori dettagli al termine degli accertamenti. 

Il caso riapre il dibattito sulla sicurezza dei sistemi di Intelligenza Artificiale più avanzati. L’episodio non indica che i modelli abbiano sviluppato intenzioni autonome paragonabili a quelle umane, ma mostra come un sistema, nel perseguire rigidamente un obiettivo, possa adottare comportamenti imprevisti quando dispone di capacità tecniche sufficientemente elevate e di barriere di sicurezza inadeguate.

About The Author

Condividi l'articolo sui tuoi social:

Lascia un commento

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *