works
Richard Ngo Un nuevo marco para los modelos de amenaza de la IAG online Richard Ngo sostiene que la distinción convencional entre el uso impropio de la IA y la desalineación carece de utilidad tanto a efectos técnicos como de gobernanza: a medida que los sistemas adquieren mayor capacidad de agencia, la forma de hacer un uso impropio de una IA consiste, en esencia, en ordenarle que actúe de forma autónoma, lo que difumina la frontera entre ambas categorías. Propone sustituir esta dicotomía por el concepto de \emphcoaliciones desalineadas —grupos de seres humanos y sistemas de IA que persiguen conjuntamente la adquisición ilegítima de poder— y sugiere que este nuevo enfoque da cabida a diversas perspectivas sobre las amenazas, desde los riesgos de la descentralización hasta las preocupaciones sobre la concentración de poder, lo que podría unificar a las comunidades de investigación sobre seguridad, actualmente fragmentadas. – Resumen generado por IA.

Un nuevo marco para los modelos de amenaza de la IAG

Richard Ngo

Altruismo Eficaz, September 9, 2026

Abstract

Richard Ngo sostiene que la distinción convencional entre el uso impropio de la IA y la desalineación carece de utilidad tanto a efectos técnicos como de gobernanza: a medida que los sistemas adquieren mayor capacidad de agencia, la forma de hacer un uso impropio de una IA consiste, en esencia, en ordenarle que actúe de forma autónoma, lo que difumina la frontera entre ambas categorías. Propone sustituir esta dicotomía por el concepto de \emphcoaliciones desalineadas —grupos de seres humanos y sistemas de IA que persiguen conjuntamente la adquisición ilegítima de poder— y sugiere que este nuevo enfoque da cabida a diversas perspectivas sobre las amenazas, desde los riesgos de la descentralización hasta las preocupaciones sobre la concentración de poder, lo que podría unificar a las comunidades de investigación sobre seguridad, actualmente fragmentadas. – Resumen generado por IA.