Riformulazione dei modelli di modellazione delle minacce IAG
Altruismo Efficace, July 24, 2026
Abstract
Richard Ngo sostiene che la distinzione convenzionale tra “uso improprio” e “disallineamento” dell’IA sia priva di utilità sia dal punto di vista tecnico che da quello della governance dell’IA: man mano che i sistemi acquisiscono maggiore autonomia, l’uso improprio di un’IA consiste essenzialmente nel dirle di agire in modo autonomo, il che fa crollare il confine tra le due categorie. Egli propone di sostituire questa dicotomia con il concetto di \emphcoalizioni disallineate — gruppi di esseri umani e sistemi di IA che perseguono congiuntamente l’acquisizione illegittima del potere — e suggerisce che questa riformulazione tenga conto di diverse prospettive di minaccia, dai rischi legati al decentramento alle preoccupazioni relative alla concentrazione del potere, unificando potenzialmente le comunità di ricerca sulla sicurezza attualmente frammentate. – Abstract generato dall’IA.