Dopo le dimissioni di Jacob Coxon, ricercatore di Anthropic, che ha denunciato i rischi di una superintelligenza capace di auto-migliorarsi, il responsabile dell’Alignment Science, Evan Hubinger, ha confermato pubblicamente che l’azienda crede seriamente che l’IA potrebbe uccidere tutti gli esseri umani entro la fine del decennio.
Hubinger ha stimato personalmente una probabilità superiore al 10% che questo scenario si verifichi nei prossimi dieci anni, ammettendo che non esiste ancora un piano risolto per il problema dell’allineamento della superintelligenza.
Anche Samuel Marks, responsabile della supervisione scalabile, ha aggiunto che molti sviluppatori senior ritengono che la tecnologia possa causare l’estinzione dell’umanità nei prossimi anni.



