Il ricercatore di Anthropic Evan Hubinger ha dichiarato di ritenere che la probabilità che l’intelligenza artificiale possa uccidere tutti gli esseri umani entro 10 anni sia superiore al 10%. Rispondendo su X a un post di Jacob Coxon, che si è dimesso da Anthropic, Hubinger ha affermato che credono davvero in questa possibilità. Pur sottolineando che Anthropic sta facendo tutto il possibile, Hubinger ha dichiarato che non dispongono ancora di un piano o di una tabella di marcia chiara per risolvere il problema dell’allineamento con la superintelligenza. Coxon, che negli ultimi tre anni ha lavorato come ricercatore presso OpenAI e Anthropic, si era dimesso sostenendo che le aziende non agivano in modo sufficientemente responsabile. Coxon aveva affermato che le aziende stavano conducendo una corsa senza controllo per raggiungere una superintelligenza capace di migliorarsi autonomamente, che questi sistemi avrebbero potuto acquisire potere e risorse grazie a capacità sovrumane e che, nel frattempo, i dirigenti avevano paura a porte chiuse.
Perché è importante
Queste dichiarazioni mostrano che le preoccupazioni sui rischi dell’intelligenza artificiale non si limitano alle critiche provenienti dall’esterno delle aziende, ma sono presenti anche tra i ricercatori che sviluppano questi sistemi. Il fatto che Hubinger, pur affermando che Anthropic si sta impegnando, abbia ammesso l’assenza di un piano o di una tabella di marcia chiara per l’allineamento con la superintelligenza rende evidente il divario tra l’obiettivo di sicurezza e l’attuale livello di preparazione. Le dimissioni di Coxon dopo la sua esperienza presso OpenAI e Anthropic, motivate dalle critiche sulla responsabilità e sulla corsa incontrollata, trasformano il dibattito in una questione non soltanto tecnica, ma anche di gestione aziendale e di responsabilità dei ricercatori. L’affermazione secondo cui i dirigenti avrebbero paura a porte chiuse indica inoltre che il rapporto tra le posizioni pubbliche delle istituzioni e le preoccupazioni interne non è stato chiarito. La principale questione ancora aperta è con quale piano concreto queste aziende gestiranno i rischi posti da sistemi che, secondo quanto sostenuto, potrebbero migliorarsi autonomamente e possedere capacità sovrumane.
Contesto
Anthropic non è un nome nuovo nell’archivio di FikirPilot: negli ultimi 90 giorni abbiamo pubblicato 9 notizie in cui compare questo nome; la più recente è datata 10 settembre 2026.