works
Richard Ngo 重新构架 AGI 威胁模型 online 理查德·吴(Richard Ngo)认为,AI“滥用”与“未对齐”之间的传统区分在技术和治理层面均缺乏实用价值:随着系统日益具备自主性,滥用AI的方式本质上就是命令其脱离控制并自主行动,这使得这两个类别之间的界限变得模糊。 他提议用“未对齐联盟”(misaligned coalitions)这一概念——即人类与AI系统共同追求非法权力获取的群体——来取代这种二元区分,并指出这种重新定义能够兼顾从去中心化风险到权力集中担忧等多元化的威胁视角,有望将分散的安全性研究社群统一起来。——AI生成的摘要。

重新构架 AGI 威胁模型

Richard Ngo

July 24, 2026

Abstract

理查德·吴(Richard Ngo)认为,AI“滥用”与“未对齐”之间的传统区分在技术和治理层面均缺乏实用价值:随着系统日益具备自主性,滥用AI的方式本质上就是命令其脱离控制并自主行动,这使得这两个类别之间的界限变得模糊。 他提议用“未对齐联盟”(misaligned coalitions)这一概念——即人类与AI系统共同追求非法权力获取的群体——来取代这种二元区分,并指出这种重新定义能够兼顾从去中心化风险到权力集中担忧等多元化的威胁视角,有望将分散的安全性研究社群统一起来。——AI生成的摘要。