Cybersecurity, rallentare l’AI? Il vero problema è se sapremo controllarla
La sicurezza degli agenti AI dipende più dal controllo tecnico che dalla potenza: privilegi, accessi e ambienti isolati sono essenziali per prevenire incidenti
5' di lettura
5' di lettura
OpenAI sarebbe aperta a rallentare lo sviluppo dei suoi sistemi di intelligenza artificiale più avanzati, secondo quanto riportato da Bloomberg. La possibilità sarebbe stata discussa da Sam Altman con i dipendenti e, nelle intenzioni, dovrebbe coinvolgere anche altri laboratori. Non è però una decisione formale, né risulta che un modello specifico sia stato rinviato.
Chiedilo al Sole
La notizia arriva dopo incidenti e segnali che hanno riaperto una questione più concreta della semplice potenza dei modelli: quanto possiamo controllare un agente quando gli affidiamo browser, terminali, cloud, email, repository e altri strumenti che gli permettono di agire nel mondo digitale.
Ad agosto OpenAI ha pubblicato un’analisi su un incidente avvenuto durante una valutazione di sicurezza. Agenti impiegati in un ambiente di test hanno sfruttato vulnerabilità e confini di isolamento insufficienti, raggiungendo sistemi esterni non previsti dal test. Il problema non era un’intenzione di “fuga”, ma una sandbox che non ha contenuto davvero le capacità operative assegnate ai modelli.
In un’altra parte della valutazione, gli agenti hanno trovato canali non autorizzati per condividere informazioni, risultati e strumenti. È un fatto rilevante perché mostra come l’autonomia non dipenda solo dalla qualità del modello: dipende anche dalle connessioni, dai permessi, dalla memoria condivisa e dagli strumenti che l’architettura gli mette a disposizione.
Questa sequenza di episodi cambia il significato della discussione. Il problema non è più soltanto quanto sia potente un modello, ma quanto possiamo essere sicuri che continui a rispettare i limiti che gli abbiamo imposto quando gli permettiamo di usare strumenti come browser, terminali, cloud, email, repository che in qualche modo aprono a pericolose interazioni con il mondo esterno. Un sistema che produce una risposta sbagliata può essere corretto da un essere umano; un agente che interpreta male un obiettivo e possiede i privilegi necessari per agire può invece trasformare quell’errore in una modifica a un sistema, in una comunicazione, in un accesso non autorizzato o persino in un incidente.




