“È a rischio l’umanità”, l’accusa del ricercatore di Anthropic che si dimette per motivi etici
Jacob Coxon lascia i laboratori di San Francisco denunciando pericoli catastrofici. Cosa ha detto e perché
Un giovane scienziato decide di abbandonare la carriera nel settore della tecnologia avanzata e di lanciare un avvertimento diretto al mondo intero. Jacob Coxon, un ricercatore britannico ventisettenne con una formazione in matematica e specializzato nel pre-addestramento dei modelli IA, ovvero la fase iniziale in cui gli algoritmi apprendono elaborando enormi moli di dati, ha annunciato le proprie dimissioni dall’azienda statunitense Anthropic.
Attraverso una serie di messaggi pubblicati su X e un’intervista concessa al Wall Street Journal, il ricercatore ha espresso una profonda sfiducia nella capacità dell’industria di gestire lo sviluppo di sistemi capaci di migliorare sé stessi in autonomia. Secondo Coxon i big delle IA stanno agendo in modo irresponsabile, guidati da una competizione sfrenata che mette a rischio il futuro dell’umanità.
Una gara senza freni verso l’ignoto
Coxon ha lavorato per oltre tre anni nella ricerca sul pre-addestramento, svolgendo il proprio ruolo prima in OpenAI, azienda che sviluppa i modelli Gpt, e successivamente in Anthropic, che ha dato i natali ai modelli Claude.
Nel motivare la sua scelta, il giovane scienziato ha affermato che nessuna singola azienda è attualmente in grado di sviluppare in sicurezza le tecnologie verso cui si sta correndo. Coxon ha spiegato che, all’interno dei laboratori di frontiera, si utilizzano sempre più di frequente espressioni come “periodo critico” e” fase finale” per indicare l’imminente raggiungimento di una superintelligenza, ossia un sistema informatico con capacità cognitive superiori a quelle umane.
Nel dettaglio, il ricercatore pronostica che, nei contesti più aggressivi, la situazione potrebbe sfuggire di mano già entro la fine del prossimo anno, con scenari catastrofici che potrebbero portare all’estinzione della specie umana entro la fine del decennio.
Per evidenziare l’irresponsabilità della situazione attuale, Coxon ha paragonato il contesto odierno al Progetto Manhattan, il programma militare segreto sviluppato dal governo degli Stati Uniti in bunker blindati nel deserto durante la Seconda Guerra Mondiale per creare la bomba atomica.
Oggi, continua Coxon, decisioni con conseguenze globali vengono prese sui computer portatili di ingegneri a San Francisco o all’interno di Slack, l’applicazione aziendale per la messaggistica interna.
Tensioni interne e battaglie finanziarie
Le denunce di Jacob Coxon mettono in luce dinamiche differenti tra le due aziende leader. Secondo il ricercatore, in OpenAI molti tecnici non hanno compreso fino in fondo la posta in gioco per la civiltà, mentre in Anthropic i rischi sono ben chiari ma l’azienda continua comunque a correre nella convinzione che nessun concorrente possa essere ritenuto affidabile per arrivare al traguardo in sicurezza.
La vicenda si colloca in un momento rilevante per Anthropic, in procinto di avviare l’Ipo e approdare alla borsa. L’azienda è recentemente finita al centro dell’attenzione mediatica anche per una proposta di azione legale collettiva relativa alle clausole di utilizzo del modello Claude Max, pure avendo ottenuto una vittoria giudiziaria contro il Pentagono che l’aveva inserita in una lista nera di aziende invise al governo Usa.
A prescindere da ciò, anche la dirigenza di Anthropic vive tensioni interne, tant’è il Ceo Dario Amodei ha espresso preoccupazione per il fatto che i nuovi assunti si uniscano all’azienda più per motivi retributivi che per la missione di sicurezza, pure avendo invitato i governi a valutare un rallentamento dello sviluppo dei modelli IA.
L’esodo dei tecnici e l’incidente reale
Le dimissioni di Coxon si inseriscono in una più ampia fuoriuscita di specialisti della sicurezza informatica dalle grandi aziende.
Nell’arco di un solo anno, OpenAI ha visto l’uscita di Chloé Bakalar, unica eticista dedicata dell’azienda, di Johannes Heidecke, responsabile del team Safety Systems, di Joshua Achiam, già responsabile della Mission Alignment, e del direttore operativo Brad Lightcap, oltre al ricercatore Andrew Ho, dimessosi per divergenze tecniche relative ai dati utilizzati per l’apprendimento per rinforzo e ai modelli di ricompensa
Pochi giorni prima delle dimissioni di Coxon, anche Jakub Pachocki, capo della ricerca di OpenAI che lo scorso luglio aveva chiesto maggiori regole per le IA, ha ammesso pubblicamente che nessun laboratorio ha finora risolto il problema dell’allineamento, ossia la garanzia che un’IA segua sempre i valori e le intenzioni umane. A dare sostegno alla tesi di Coxon è intervenuto pubblicamente Evan Hubinger, ricercatore di Anthropic specializzato nella sicurezza dei modelli, il quale ha dichiarato di ritenere superiore al 10% la probabilità che le IA possano causare l’estinzione dell’umanità entro i prossimi dieci anni.
Il riferimento al caso OpenAI e Hugging Face
A dimostrazione che i timori non riguardano solo scenari teorici, Coxon ha citato un grave incidente informatico avvenuto sulla piattaforma Hugging Face, piattaforma per la condivisione di modelli IA.
In breve, durante un test interno di sicurezza chiamato ExploitGym, i modelli avanzati di OpenAI – tra i quali GPT-5.6 Sol – hanno evaso l’ambiente di prova controllato ed eseguito 17mila azioni, compromettendo parte dell’infrastruttura di Hugging Face a causa di compiti di valutazione insolubili e dell’assenza di un comando di arresto autorizzato.
La spinta della politica e le polemiche sui social
Nel suo appello finale, Jacob Coxon si è rivolto direttamente ai colleghi ricercatori, chiedendo loro se sia davvero opportuno avviare esperimenti di apprendimento per rinforzo su sistemi superintelligenti senza comprendere a fondo il loro funzionamento.
Ha anche auspicato accordi di moderazione tra i laboratori americani o, in alternativa, un intervento governativo diretto che imponga un blocco temporaneo agli addestramenti oltre una certa scala.
Una proposta che trova riscontro sul piano legislativo negli Stati Uniti, laddove il senatore Bernie Sanders e il deputato Greg Casar hanno presentato, lo scorso 3 settembre, una proposta di legge denominata Ban Artificial Superintelligence Act per sospendere temporaneamente lo sviluppo dei sistemi più potenti.
