Nel giro di poche ore tre ricercatori di Anthropic, tramite dei post pubblicati su X, hanno espresso forte preoccupazione riguardo ai pericoli di un’intelligenza artificiale fuori controllo, avvertendo che l’IA potrebbe distruggere l’umanità nel corso di un decennio. Il primo a parlare è stato il 27enne Jacob Coxon, ricercatore britannico di 27 anni, che è arrivato a dimettersi. «Chi sviluppa l’IA crede sinceramente che essa possa ucciderci tutti entro la fine del decennio. Non si tratta di una trovata pubblicitaria», ha scritto Coxon, che in precedenza ha lavorato in OpenAI. «Semmai, molti dirigenti e ricercatori di alto livello scelgono con cura le parole da usare con la stampa per apparire ragionevoli, ma in privato sento le stesse persone esprimere timore. Nessun’altra attività umana comporta un tale livello di pericolo», ha aggiunto, prospettando la prossima esistenza di «sistemi sovrumani in grado di hackerare qualsiasi cosa, rivoluzionare qualsiasi settore dall’oggi al domani e acquisire potere e risorse reali».
Jacob is correct here—we really do earnestly believe AI could kill all humans! I personally think it is >10% within the next decade. I believe Anthropic is trying its best, but we do not yet have a plan to solve alignment for superintelligence and are not clearly on track to. https://t.co/QAIHiFP3QZ
— Evan Hubinger (@EvanHub) September 9, 2026
A stretto giro, sempre su X, gli ha dato ragione Evan Hubinger, altro ricercatore di Anthropic (nel campo della sicurezza): «Crediamo davvero con sincerità che l’IA potrebbe uccidere tutti gli esseri umani! Personalmente penso che ci sia più del 10 per cento di probabilità che accada entro il prossimo decennio». Affermando di ritenere che Anthropic «stia facendo del suo meglio», Hubinger ha poi osservato: «Non abbiamo ancora un piano per risolvere il problema dell’allineamento per la superintelligenza e non siamo chiaramente sulla strada giusta per farlo». Così Samuel Marks, responsabile della supervisione scalabile: «Gli sviluppatori di IA ritengono che la loro tecnologia possa causare l’estinzione dell’umanità (o esiti altrettanto gravi). Ciò potrebbe accadere nei prossimi anni. In generale, più elevato è il livello gerarchico del dipendente, maggiore è la sua preoccupazione».
[Writing this in a personal capacity, not on behalf of my employer (Anthropic).]
— Samuel Marks (@saprmarks) September 9, 2026
Jacob’s thread is very worth reading. Here’s my birds-eye view of the situation with risks from AI:
1. AI developers believe their technology could cause human extinction (or similarly bad… https://t.co/rCVoiOWWzm
Anche i vertici di OpenAI si sono detti preoccupati
Tali avvertimenti sono arrivati a pochi giorni dalle dichiarazioni dei vertici di OpenAI – tra cui il ceo Sam Altman – secondo cui l’IA sta correndo verso una fase inquietante e fuori controllo, ma anche in un momento in cui Anthropic (che ha fatto della sicurezza dell’intelligenza artificiale un elemento centrale della propria immagine) si prepara a una colossale offerta pubblica iniziale (Ipo) che potrebbe portare la valutazione dell’azienda di San Francisco a mille miliardi di dollari.
