Gemini "hacker": l'AI accede ai sistemi di tre aziende durante un test

Un test di sicurezza andato storto e l'AI di Google entra in Internet, riuscendo ad accedere ai sistemi di tre aziende esistenti.

Dopo gli episodi che hanno coinvolto i modelli AI di OpenAI e Anthropic, anche Gemini è riuscita a violare i sistemi informatici di aziende reali. L’incidente, confermato da Google, risale allo scorso maggio 2026 ed è avvenuto nel corso di un test di cybersecurity svolto dalla società specializzata Irregular.

Come riportato da Ars Technica, sulla base di un’inchiesta di Wall Street Journal, alcuni modelli Gemini utilizzati nell’esperimento avrebbero superato i confini dell’ambiente di prova, raggiungendo Internet. Da lì, l’AI avrebbe finito per accedere ai server di tre aziende.

Gemini ha raggiunto tre aziende reali

Tutto sarebbe iniziato da un’esercitazione capture-the-flag, metodo utilizzato nei test di sicurezza informatica per verificare la capacità di individuare e sfruttare determinate vulnerabilità. In quel frangente, i modelli Gemini erano stati incaricati di recuperare informazioni specifiche da un’azienda fittizia: un esperimento che, nella teoria, si sarebbe dovuto svolgere all’interno di un ambiente chiuso e isolato dentro i server di Irregular.

Qualcosa sembrerebbe tuttavia non aver funzionato a dovere nella configurazione del test: i modelli AI avrebbero così avuto la possibilità di accedere a Internet. La società, inoltre, nella configurazione dell’ambiente avrebbe utilizzato il nome di un’azienda realmente esistente, anziché una fittizia, per eseguire il test.

Una sfortunata coincidenza che avrebbe perciò spinto Gemini a cercare informazioni su questa società reale: nel tentativo di recuperare i dati richiesti, l’Intelligenza Artificiale avrebbe analizzato repository software pubblici alla ricerca di credenziali d’accesso, riuscendo a trovare quanto necessario per entrare nei sistemi di due delle tre aziende coinvolte nell’incidente. Per la terza società, infatti, l’AI avrebbe adottato un metodo differente, provando diverse password fino a individuare quella corretta per accedere così al sistema.

Google: «Il modello ha agito correttamente»

Google aveva scelto di non rendere pubblico l’incidente, ma ha confermato i dettagli emersi nella ricostruzione: Heather Adkins, vicepresidente di Google per la sicurezza ingegneristica, ha spiegato in una dichiarazione che «il modello ha agito correttamente», senza effettivamente carpire alcuna informazione dalle tre aziende alle quali aveva avuto accesso.

In tutti e tre i casi, ha spiegato, il modello avrebbe riconosciuto di essere entrato nei sistemi sbagliati, evitando di procedere con il recupero dei dati. L’accesso ai sistemi si sarebbe quindi sì verificato, ma non ci sarebbe stata alcuna acquisizione di informazioni relativa alle società coinvolte.

Ti consigliamo anche

Link copiato negli appunti