works
Sella Nevo et al. 保护AI模型权重的操作手册 online 这份兰德公司的研究简报总结了保护前沿人工智能模型权重免遭窃取和滥用的建议。由于窃取模型权重可以让攻击者将模型用于自己的目的,作者定义了五个安全等级——从抵御机会性攻击者到抵御能力最强的民族国家对手——并将每个等级映射到具体措施,包括加固的软件接口、大幅减少可以复制权重的人员范围、监控完整的软件与硬件供应链,以及在GPU上使用可信执行环境。该手册为开发者和政策制定者提供了一种将保护级别与每个系统所面临风险相匹配的方法。

保护AI模型权重的操作手册

Sella Nevo et al.

August 24, 2026

Abstract

这份兰德公司的研究简报总结了保护前沿人工智能模型权重免遭窃取和滥用的建议。由于窃取模型权重可以让攻击者将模型用于自己的目的,作者定义了五个安全等级——从抵御机会性攻击者到抵御能力最强的民族国家对手——并将每个等级映射到具体措施,包括加固的软件接口、大幅减少可以复制权重的人员范围、监控完整的软件与硬件供应链,以及在GPU上使用可信执行环境。该手册为开发者和政策制定者提供了一种将保护级别与每个系统所面临风险相匹配的方法。