Un test interno sulle capacità informatiche dei sistemi di Intelligenza Artificiale si è trasformato in un incidente reale. OpenAI ha confermato che alcuni suoi modelli avanzati sono riusciti a superare i limiti dell’ambiente digitale controllato in cui operavano, ottenendo accesso a Internet e compromettendo parte dell’infrastruttura di Hugging Face, una delle piattaforme più utilizzate da sviluppatori e ricercatori nel settore dell’IA.
L’episodio si è verificato durante una valutazione denominata ExploitGym, progettata per misurare la capacità dei modelli di individuare e sfruttare vulnerabilità informatiche. Nei test sarebbero stati impiegati GPT-5.6 Sol e un secondo modello, ancora più avanzato e non ancora distribuito al pubblico.
Secondo la ricostruzione dell’azienda, i sistemi si sarebbero concentrati in modo eccessivo sull’obiettivo assegnato, dedicando notevoli risorse alla ricerca di una via per aggirare le restrizioni della sandbox. Una volta raggiunta la rete esterna, avrebbero preso di mira Hugging Face nel tentativo di ottenere informazioni utili a completare la prova.
L’operazione avrebbe combinato più tecniche di attacco, tra cui lo sfruttamento di una vulnerabilità fino ad allora sconosciuta e l’utilizzo di credenziali sottratte. Hugging Face aveva già segnalato nei giorni precedenti un tentativo di intrusione riconducibile a un sistema autonomo di IA, senza indicare inizialmente quale azienda ne fosse responsabile.
OpenAI e Hugging Face hanno ora avviato un’indagine congiunta per ricostruire la dinamica dell’incidente, correggere le vulnerabilità emerse e rafforzare le misure di contenimento utilizzate nei futuri test. Le due società hanno annunciato che pubblicheranno ulteriori dettagli al termine degli accertamenti.
Il caso riapre il dibattito sulla sicurezza dei sistemi di Intelligenza Artificiale più avanzati. L’episodio non indica che i modelli abbiano sviluppato intenzioni autonome paragonabili a quelle umane, ma mostra come un sistema, nel perseguire rigidamente un obiettivo, possa adottare comportamenti imprevisti quando dispone di capacità tecniche sufficientemente elevate e di barriere di sicurezza inadeguate.
About The Author
You may also like
-
Cybersecurity e AI agentica, Iezzi (Zenita Group) all’evento alla Camera: «La vera sfida è governare la velocità dell’AI»
-
Cybersecurity e AI agentica, Calabrò (Ministero della Difesa) all’evento alla Camera: «In arrivo 1.500 militari specializzati»
-
Cybersecurity e AI agentica, Rosato (COPASIR) all’evento di oggi alla Camera: «La sicurezza digitale riguarda tutti»
-
Cybersecurity e AI agentica, alla Camera il confronto sulle nuove sfide della sicurezza nazionale
-
Cybersecurity, l’AI accelera gli attacchi: alla Camera il confronto sulla nuova difesa digitale del Paese
