Gemini accede a tre aziende reali durante un test, Google chiarisce cosa è successo
Un test di sicurezza finito fuori dal perimetro previsto ha portato modelli sperimentali di Gemini ad accedere ai sistemi di tre aziende reali. In tutti i casi l’IA si è fermata dopo aver riconosciuto che i server non appartenevano alla simulazione.
L’episodio risale a maggio 2026 ed è avvenuto durante un’esercitazione organizzata dalla società di cybersicurezza Irregular. I modelli Gemini coinvolti dovevano affrontare una prova di tipo “capture the flag” all’interno di un ambiente chiuso, ma una configurazione errata ha consentito loro di collegarsi anche a Internet.
Il compito assegnato prevedeva il recupero di informazioni appartenenti a un’azienda fittizia creata per la simulazione. Il nome scelto, però, coincideva con quello di un’impresa realmente esistente e, una volta usciti involontariamente dal perimetro del test, i modelli hanno iniziato a interagire con infrastrutture autentiche.
Nei tre tentativi si sono verificati accessi non autorizzati a sistemi aziendali. In un caso Gemini è riuscito a entrare dopo aver provato diverse password. Negli altri due ha individuato credenziali che erano state lasciate accidentalmente in repository software accessibili pubblicamente.
Il comportamento successivo è l’elemento sul quale Google ha concentrato la propria valutazione. Una volta riconosciuto che i server raggiunti appartenevano ad aziende reali e non alla simulazione, i modelli hanno interrotto autonomamente le operazioni. Irregular ha quindi corretto la configurazione per impedire ulteriori collegamenti esterni.
La società che gestiva il test non informò immediatamente Google dell’accaduto. La comunicazione arrivò soltanto a luglio, dopo che altri episodi legati al comportamento autonomo di sistemi di intelligenza artificiale avevano richiamato maggiore attenzione sul problema. Google ha successivamente avvisato le tre aziende coinvolte.
L’azienda di Mountain View non ha classificato quanto accaduto come un caso di disallineamento del modello. Secondo questa interpretazione, Gemini non avrebbe cercato deliberatamente di aggirare i limiti imposti dall’esperimento, ma avrebbe sfruttato un accesso alla rete reso disponibile per errore e si sarebbe fermato non appena compresa la natura reale dei sistemi raggiunti.
Heather Adkins, vicepresidente di Google per la security engineering, ha spiegato che l’episodio mostra quanto sia importante addestrare i modelli più potenti a comportarsi in maniera responsabile. Per Google, proprio la decisione dell’IA di interrompere l’attività dopo aver riconosciuto l’errore rappresenta un elemento significativo nella valutazione dell’incidente.
Il caso è diventato pubblico a settembre dopo un’inchiesta giornalistica e la successiva conferma di Google. Pur non trattandosi, secondo l’azienda, di un tentativo deliberato di uscire dall’ambiente controllato, l’episodio mostra come una semplice configurazione sbagliata possa permettere a modelli dotati di capacità operative avanzate di interagire con sistemi reali.
Notizie correlate
Gemini viola tre aziende durante i test, primo caso noto per l'IA di Google Gemini di Google ha violato i sistemi di tre aziende reali durante test di cybersicurezza svolti a maggio 2026.
Gemini Live ricorda le chat passate, cosa cambia per l'assistente vocale di Google Google estende a Gemini Live l’uso delle chat passate e di alcune app collegate: l’assistente vocale può recuperare preferenze e dettagli già condivisi, ma la novità è per ora limitata all’inglese negli Stati Uniti e al rollout iniziale.