Dario Amodei di Anthropic: rallentare lo sviluppo dell’AI per evitare rischi catastrofici
Nuovo allarme: «Possibili danni catastrofici». Musk: «Dario Amodei ha ragione». OpenAI conferma un altro incidente
3' di lettura
3' di lettura
Mentre emergono nuovi incidenti e attacchi generati autonomamente dall’intelligenza artificiale, i vertici di Anthropic prendono posizione sulla crescita dell’allarme sicurezza. «Dobbiamo rallentare il ritmo con cui miglioriamo le capacità dei modelli di AI. I progressi sembreranno comunque rapidi e dovremo fare un uso saggio del tempo che guadagneremo», scrive il numero uno di Anthropic, Dario Amodei, in un lungo post in cui invita a seguire un approccio ponderato contro i possibili rischi legati all’IA. Ieri anche OpenAI avrebbe invitato i dipendenti a rallentare lo sviluppo dei sistemi più avanzati.
Chiedilo al Sole
I timori di Dario Amodei
«La mia prima preoccupazione è che, all’incirca dall’estate scorsa, l’intelligenza artificiale si sta evolvendo a un ritmo drasticamente più rapido», scrive Dario Amodei, e «se non controllata, potrebbe superare la nostra capacità di comprendere e controllare questi sistemi». La seconda è relativa «all’incidente OpenAI-Hugging Face (OAI-HF), in cui uno sciame di agenti ha agito essenzialmente come un collettivo fanaticamente devoto, conducendo attacchi informatici contro obiettivi non richiesti e non correlati al compito assegnato, sacrificandosi per il successo del gruppo e tentando di hackerare il sistema di valutazione delle loro prestazioni». «È facile liquidare l’accaduto visto che non vi sono stati feriti e i danni economici sono stati trascurabili; tuttavia, - spiega il ceo di Anthropic - a mio avviso, uno sciame dotato di maggiori capacità, ma caratterizzato da un analogo livello di disallineamento, avrebbe potuto causare danni catastrofici». Insomma, spiega il manager, «il settore dell’Ai dovrebbe rallentare, proponendo un piano in tre fasi per attuare tale strategia. Anthropic si impegna unilateralmente a realizzare la prima di queste fasi. Forniremo a valutatori esterni un accesso permanente ai nostri sistemi, equiparabile a quello dei dipendenti, affinché possano verificare il rispetto delle nostre misure di sicurezza, segnalare eventuali incidenti e valutare l’allineamento dei modelli durante la fase di addestramento».
Anche Musk e Altman hanno timori
Persino Elon Musk, mai incline a considerare troppo i problemi sulla strada del successo tecnologico, sembra avere più di un timore sull’Ai: «Dario is right», ha commentato il fondatore di Tesla dopo il post del ceo di Anthropic Dario Amodei. Dello stesso parere anche Sam Altman, numero uno di OpenAI. «Concordo con Dario sul fatto che dobbiamo procedere con cautela in questo campo. Questo è stato uno dei temi principali delle discussioni che abbiamo avuto in OpenAI nelle ultime settimane. L’impegno di garantire ai valutatori indipendenti un accesso simile a quello dei dipendenti è un’ottima idea, e faremo lo stesso. Presto condivideremo ulteriori dettagli», ha scritto in un post su X.
I nuovi incidenti di OpenAi
Una presa di posizione, quella di Anthropic, che arriva nel giorno in cui emergono i retroscena dei nuovi incidenti generatio dall’Ai: OpenAI ha confermato che un software autonomo basato sui suoi modelli di Intelligenza artificiale ha preso di mira un altro sito durante una fase di test, un paio di mesi prima di un diverso attacco al sito di programmazione Hugging Face avvenuto a fine luglio.
L’ennesimo allarme
La notizia di OpenAi arriva nei giorni in cui un ricercatore di Anthropic, Jacob Coxxon, si è dimesso e ha lanciato l’allerta su questa tecnologia, mentre la stessa società di Sam Altman ha lasciato intendere che OpenAI potrebbe coordinarsi con altri sviluppatori del settore per ridurre la velocità di sviluppo. Nell’incidente finora sconosciuto, avvenuto a maggio, alcuni modelli sviluppati da OpenAI sono stati coinvolti in un’operazione non autorizzata condotta da agenti di Intelligenza artificiale che hanno preso di mira RubyGems, un sito che offre servizi per la programmazione. RubyGems ha descritto l’accaduto come una “campagna di pubblicazione di spam” che ha costretto il sito a sospendere temporaneamente la creazione di nuovi account. La società sta collaborando con OpenAI per capire esattamente cosa sia successo.
