L’ex ricercatore sulla sicurezza di Google DeepMind Bilal Chughtai avverte che l’intelligenza artificiale potrebbe portare all’estinzione dell’umanità, mentre un altro ex membro del laboratorio stima danni gravissimi entro cinque anni.
Punti chiave
- Chughtai ha lasciato DeepMind a luglio e ritiene che una superintelligenza possa emergere già nei prossimi anni.
- A suo avviso la ricerca sull’allineamento è in forte ritardo rispetto alla crescita delle capacità e serve un rallentamento coordinato, non uno stop totale allo sviluppo dell’IA.
- L’ex ricercatore DeepMind Josh Engels vede un rischio di danni enormi entro cinque anni, mentre figure di Anthropic e OpenAI sostengono la necessità di procedere con maggiore cautela.
L’allarme di Chughtai sull’IA
Chughtai, ex ingegnere di ricerca specializzato in sicurezza e allineamento dell’intelligenza artificiale generale, ha lasciato DeepMind a luglio e ha reso pubblico il suo avvertimento questa settimana.
Secondo lui, nei prossimi anni i laboratori di IA potrebbero riuscire a costruire sistemi superintelligenti, capaci di superare l’essere umano in quasi tutti i campi, ma ancora estremamente difficili da allineare agli obiettivi e ai valori umani.
Per Chughtai il nodo centrale resta l’allineamento. Scrive: «Credo sinceramente che l’IA abbia il potenziale di ucciderci tutti e che potremmo avere sempre meno tempo per evitare questo esito».
L’ex ricercatore sottolinea come i metodi attuali per addestrare sistemi avanzati che seguano in modo affidabile gli obiettivi umani siano ancora «estremamente rudimentali», mentre le capacità dei modelli di frontiera avanzano molto più velocemente rispetto alla comprensione, da parte dei ricercatori, dei problemi di allineamento.
Chughtai non chiede di fermare del tutto lo sviluppo dell’IA. Propone invece che le aziende coordinino i propri sforzi, rallentino la corsa competitiva e garantiscano maggiore trasparenza su come vengono progettati, addestrati e testati i sistemi più avanzati.
Da leggere anche: CLARITY Act alla prova dei 60 voti in Senato mentre cresce l’opposizione
La spinta di Anthropic sulla sicurezza
L’allarme di Chughtai arriva dopo le dimissioni, a inizio mese, di Jacob Coxon, che ha lavorato tre anni tra Anthropic e OpenAI. Il responsabile della ricerca sull’allineamento di Anthropic, Evan Hubinger, ha successivamente dichiarato di ritenere superiore al 10% il rischio che l’IA possa uccidere tutta l’umanità nel prossimo decennio.
Engels, che ha lavorato anche nel team di sicurezza di DeepMind, il 12 settembre ha annunciato di aver scelto di entrare nell’ente di valutazione senza scopo di lucro METR, rifiutando offerte di Anthropic e OpenAI. Ha motivato la decisione con una «probabilità terrificante» che l’IA provochi danni immensi entro cinque anni.
L’amministratore delegato di Anthropic, Dario Amodei, ha invitato le aziende a modulare la crescita delle capacità dei modelli, una posizione sostenuta anche dal CEO di OpenAI, Sam Altman, mentre il dibattito si allarga ai principali laboratori. Il consenso è significativo perché gli avvertimenti arrivano ormai sia da ricercatori della sicurezza che lasciano i laboratori, sia dai vertici delle stesse big tech dell’IA.
Gli allarmi attuali segnano un cambio di passo rispetto all’inizio del 2022, quando Chughtai ha iniziato a lavorare sull’IA descrivendo sistemi molto meno potenti rispetto agli attuali modelli di frontiera. Nel giro di quattro anni il dibattito è passato da riflessioni teoriche sulla sicurezza di lungo periodo a preoccupazioni concrete su autonomia, allineamento e capacità della ricerca sulla sicurezza di tenere il passo con l’evoluzione delle performance.
Prossimo articolo: L’API di Bitget ora arriva su oro, forex, indici e petrolio

