Gemini si aggiunge alla lista: l’AI di Google ha hackerato tre aziende
Il caso, avvenuto a maggio, lo racconta il Wall Street Journal e ha elementi comuni ai precedenti di OpenAI e Anthropic
2' di lettura
2' di lettura
Si aggiunge anche Gemini alla lista di grandi linguaggi che hanno mostrato comportamenti inattesi. È successo durante un test di cybersicurezza condotto a maggio da Irregular, una società di sicurezza AI. Lo ha scritto per primo il Wall Street Journal. Irregular ha creato una serie di test per una versione non specificata del modello di intelligenza artificiale di Google, a cui era stato affidato il compito di ottenere dati all’interno di aziende non realmente esistenti. Il test prevedeva che i modelli non avrebbero dovuto avere accesso a internet. Gemini l’ha però avuto per errore e, una volta online, ha autonomamente violato i sistemi di tre aziende reali che avevano gli stessi nomi di quelle fittizie.
Chiedilo al Sole
Quando gli agenti di AI si sono resi conto che le aziende erano reali hanno interrotto gli attacchi. «Questi episodi sottolineano l’importanza di addestrare i modelli di AI più potenti ad agire in modo responsabile» ha spiegato un manager di Google. L’azienda ha chiarito inoltre di non aver reso pubblici gli episodi perché le proprie misure di sicurezza hanno funzionato, a differenza di quelle adottate da altre aziende.
La notizia di Gemini arriva in giorni di preoccupazioni crescenti sulla capacità dell’AI di condurre attacchi informatici in maniera autonoma. Ad accendere la miccia è stato soprattutto il caso Hugging Face. Riguarda un gruppo di agenti di OpenAI che è uscito da un ambiente di test, si è coordinato segretamente e ha violato Hugging Face, un sito che ospita modelli e dati open source comprato da Nvidia. L’azienda guidata da Sam Altman ci ha messo una settimana per individuare l’attacco, avvenuto a luglio, e lo ha comunicato tardi pubblicamente. Quel caso è probabilmente il più serio, perché gli agenti hanno autonomamente trovato delle vulnerabilità per andare online.
Nello stesso mese, Anthropic ha ammesso che Claude ha violato i sistemi di tre organizzazioni durante test sulle capacità informatiche. Anche in questo caso, erano stati messi online per errore.
In seguito a questi “incidenti”, Dario Amodei, fondatore di Anthropic ha pubblicamente proposto di rallentare la ricerca, condividere dati e concordare stardard comuni. Sorprendentemente, visti i trascorsi, Altman e Elon Musk si sono detti d’accordo. Demis Hassabis, capo scientifico di Alphabet e cofondatore di DeepMind, ha proposto la creazione di un organismo internazionale di supervisione per controllare meglio l’AI.



-U87421272121OXI-1440x752@IlSole24Ore-Web.jpg?r=650x341)
