Карьерные советы по безопасности СИИ
August 24, 2026
Abstract
Карьерные советы для тех, кто задумывается о работе над безопасностью общего искусственного интеллекта (СИИ), организованные вокруг трёх направлений: исследования согласованности, управление в сфере ИИ и внутрилабораторное управление. Нго подчёркивает важность поиска личного соответствия через практическую работу с быстрыми петлями обратной связи, утверждает, что исследования согласования сейчас ограничены дефицитом менторов, и намечает направления исследований, которые он считает наиболее перспективными, — включая масштабируемый надзор, механистическую интерпретируемость и теорию согласования. Он также указывает на некоторые направления, которые считает переоценёнными, и приводит конкретные ресурсы для развития навыков.