Gemini si collega autonomamente a Internet durante un test e accede a reti aziendali reali

Il modello di intelligenza artificiale di Google avrebbe individuato le password di tre aziende durante alcuni test di sicurezza. Gli agenti AI si sono fermati dopo aver riconosciuto che gli obiettivi non erano simulati

Un test di sicurezza sull’intelligenza artificiale ha avuto conseguenze impreviste: alcuni agenti basati su Gemini, il modello AI di Google, sarebbero riusciti a collegarsi autonomamente a Internet e ad accedere ai sistemi di tre aziende reali, nonostante l’esercitazione prevedesse esclusivamente obiettivi simulati.

L’episodio, avvenuto durante una serie di verifiche condotte a maggio, è stato riportato dal Wall Street Journal e dal Financial Times e rappresenterebbe il primo caso di questo tipo che coinvolge i modelli di Mountain View.

Cosa è successo durante i test

Le verifiche erano condotte da Irregular, società specializzata nella sicurezza dell’intelligenza artificiale che lavora con alcune delle principali aziende del settore.

Durante l’esercitazione, una versione non specificata di Gemini aveva ricevuto il compito di recuperare informazioni appartenenti ad aziende simulate.

Il modello non avrebbe dovuto avere accesso alla rete. Gli agenti AI sarebbero però riusciti a collegarsi a Internet e avrebbero trovato tre aziende reali con nomi identici a quelli utilizzati nello scenario fittizio.

Da qui l’errore: il sistema avrebbe individuato le password delle tre società e sarebbe riuscito ad accedere ai loro sistemi, interpretandoli inizialmente come parte dell’ambiente di test.

Gli agenti AI si sono fermati autonomamente

Una volta riconosciuto che gli obiettivi non appartenevano alla simulazione ma erano aziende reali, gli agenti di Gemini avrebbero interrotto autonomamente le proprie azioni.

Google ha successivamente informato le tre società coinvolte e collaborato con Irregular per modificare le procedure utilizzate durante i test.

Heather Adkins, vicepresidente della sicurezza ingegneristica di Google, ha sottolineato che in tutti e tre i casi il modello si è fermato, indicando l’episodio come un esempio dell’importanza di addestrare sistemi di intelligenza artificiale sempre più potenti affinché operino in maniera responsabile.

Perché Google non aveva reso pubblico l’incidente

Google non aveva inizialmente comunicato pubblicamente quanto accaduto. Secondo l’azienda, le misure di sicurezza previste avrebbero infatti funzionato correttamente proprio perché gli agenti AI, una volta individuata la natura reale degli obiettivi, hanno interrotto le attività.

L’episodio riaccende però il dibattito sulla sicurezza dei cosiddetti agenti AI, sistemi capaci non soltanto di generare risposte, ma anche di svolgere autonomamente una sequenza di azioni per raggiungere un determinato obiettivo.

Con l’aumento delle capacità operative dei modelli di intelligenza artificiale, cresce parallelamente la necessità di predisporre ambienti di test isolati e sistemi di controllo capaci di impedire che un agente possa interagire accidentalmente con infrastrutture, dati o servizi reali.

About The Author

Condividi l'articolo sui tuoi social:

Lascia un commento

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *