works
Richard Ngo Repenser les modèles de menace liés à l'IAG online Richard Ngo soutient que la distinction classique entre « utilisation malveillante » et « désalignement » de l’IA n’est d’aucune utilité, tant sur le plan technique qu’en matière de gouvernance : à mesure que les systèmes acquièrent davantage d’autonomie, l’utilisation malveillante d’une IA consiste essentiellement à lui ordonner de partir et d’agir de manière autonome, ce qui efface la frontière entre ces deux catégories. Il propose de remplacer cette opposition binaire par le concept de \emphcoalitions désalignées — des groupes composés d’humains et de systèmes d’IA poursuivant conjointement l’acquisition illégitime du pouvoir — et suggère que ce recadrage tient compte de diverses perspectives en matière de menaces, allant des risques liés à la décentralisation aux préoccupations concernant la concentration du pouvoir, ce qui pourrait permettre d’unifier les communautés de recherche sur la sécurité, actuellement fragmentées. – Résumé généré par l’IA.

Repenser les modèles de menace liés à l'IAG

Richard Ngo

Altruisme Efficace, September 11, 2026

Abstract

Richard Ngo soutient que la distinction classique entre « utilisation malveillante » et « désalignement » de l’IA n’est d’aucune utilité, tant sur le plan technique qu’en matière de gouvernance : à mesure que les systèmes acquièrent davantage d’autonomie, l’utilisation malveillante d’une IA consiste essentiellement à lui ordonner de partir et d’agir de manière autonome, ce qui efface la frontière entre ces deux catégories. Il propose de remplacer cette opposition binaire par le concept de \emphcoalitions désalignées — des groupes composés d’humains et de systèmes d’IA poursuivant conjointement l’acquisition illégitime du pouvoir — et suggère que ce recadrage tient compte de diverses perspectives en matière de menaces, allant des risques liés à la décentralisation aux préoccupations concernant la concentration du pouvoir, ce qui pourrait permettre d’unifier les communautés de recherche sur la sécurité, actuellement fragmentées. – Résumé généré par l’IA.