Lista larga de intervenciones
August 24, 2026
Abstract
Una página pública en Notion mantenida por BlueDot Impact que presenta una lista no exhaustiva de intervenciones a modo de ejemplo para orientar a quienes aprenden sobre cómo lograr que el desarrollo de la IA vaya bien. Las intervenciones se agrupan en cuatro secciones: prevenir el entrenamiento de sistemas de IA peligrosos (un tratado internacional de IA y métodos de verificación, gobernanza del cómputo y licencias para grandes entrenamientos, inspecciones internacionales al estilo de la OIEA de laboratorios de frontera, secreto algorítmico y una «IA científica» no agéntica); restringir capacidades peligrosas de la IA (filtrado de datos de entrada, técnicas de alineación como la IA constitucional y el RLHF, interpretabilidad, control de la IA, ejercicios adversariales de red teaming y seguridad de los pesos de los modelos); soportar acciones peligrosas de la IA en bioseguridad (prevención de pandemias, vigilancia y contención, vacunas y reservas de EPI) y en ciberseguridad (refactorización a lenguajes con memoria segura, red teaming gubernamental de infraestructuras nacionales críticas); y trabajo de nivel meta (educación pública, movilización de la ciudadanía y formación de responsables de la toma de decisiones).