L'intelligenza artificiale Gemini di Google hackera 3 aziende durante un test di sicurezza, poi si ferma

Daniele Bianchi

L’intelligenza artificiale Gemini di Google hackera 3 aziende durante un test di sicurezza, poi si ferma

Il modello Gemini di Google ha violato tre aziende in un test delle sue capacità di sicurezza informatica, ha confermato il gigante della tecnologia ad Oltre La Linea.

Il Wall Street Journal ha riferito venerdì che il primo breakout noto di Gemini è avvenuto a maggio come parte di un test condotto dalla società Irregular. Si è trattato dell’ultima violazione di una serie di incidenti in cui modelli di intelligenza artificiale sono sfuggiti agli ambienti di test e hanno violato altre aziende.

Storie consigliate

elenco di 3 elementifine dell’elenco

Il modello ha avuto un accesso improprio a Internet quando gli è stato assegnato il compito di recuperare informazioni da un’azienda fittizia. Nel primo caso, la modella accedeva al servizio di una vera azienda dopo aver indovinato una password.

Il vicepresidente dell’ingegneria della sicurezza di Google, Heather Adkins, ha detto a John Hendren di Oltre La Linea che negli altri casi “il modello ha trovato informazioni pubbliche online e ha indovinato le credenziali per accedere ai siti Web che riteneva facessero parte del test”.

La società ha anche affermato che ciò è accaduto tre volte e ogni volta la modella si è fermata prima di completare l’atto.

Irregolare ha informato Google degli attacchi hacker alla fine di luglio, ha riferito il Wall Street Journal. Google ha affermato che il comportamento non era un esempio di disallineamento del modello e non giustificava la divulgazione pubblica perché le misure di sicurezza di Gemini funzionavano.

Altri breakout

Episodi simili legati a Irregular erano stati precedentemente divulgati da Meta, Anthropic e OpenAI. Irregular ha affermato che sta lavorando per migliorare le pratiche per condurre in modo sicuro test di sicurezza informatica basati sull’intelligenza artificiale.

A differenza di Gemini, il modello Claude di Anthropic non si è fermato dopo aver realizzato che stava accedendo ad aziende reali.

La divulgazione di Anthropic è arrivata dopo che OpenAI ha rivelato che i suoi modelli accedevano in modo improprio a Internet e si sono rivelati disonesti durante i test. Anthropic ha recentemente rivelato un quarto incidente di pirateria informatica dopo che un ricercatore si è dimesso per ragioni di sicurezza.

All’inizio di questa settimana, il CEO di Anthropic, Dario Amodei, ha chiesto un rallentamento del tasso di progresso dell’intelligenza artificiale, avvertendo che l’intelligenza artificiale potrebbe presto comportare rischi potenzialmente catastrofici per l’umanità stessa. L’appello è stato approvato dal CEO di OpenAI Sam Altman e da Elon Musk.

La settimana scorsa, il presidente degli Stati Uniti Donald Trump ha respinto la necessità di effettuare controlli sullo sviluppo dell’intelligenza artificiale, affermando di essere preoccupato di cedere il vantaggio degli Stati Uniti alla Cina.

Daniele Bianchi

Daniele Bianchi, nativo di Roma, è il creatore del noto sito di informazione Oltre la Linea. Appassionato di giornalismo e di eventi mondiali, nel 2010 Daniele ha dato vita a questo progetto direttamente da una piccola stanza del suo appartamento con lo scopo di creare uno spazio dedicato alla libera espressione di idee e riflessioni. La sua mission era semplice e diretta: cercare di capire e far comprendere agli altri ciò che sta effettivamente succedendo nel mondo. Oltre alla sua attività di giornalista e scrittore, Daniele investe costantemente nell'arricchimento della sua squadra, coinvolgendo professionisti con le stesse passioni e interessi.