CeSIA
fr | en
Article 20 juillet 2026

Une méthodologie pour harmoniser les seuils de risques entre les différentes entreprises d’IA

Par Markov Grey

harmonizing thresholds article

Les entreprises d'IA de pointe ont publié des seuils de capacité qui diffèrent considérablement les uns des autres, ce qui complique la vérification par des tiers du franchissement d'un seuil, ainsi que la comparaison des exigences entre entreprises. De plus, en l'absence de seuils minimaux communs, l'atténuation des risques peut se révéler incohérente, créant un possible nivellement par le bas des normes de sécurité. Nous développons une méthodologie permettant de dériver des seuils harmonisés dans trois domaines de risque. Pour les risques de mésusage (cyber et biologique), nous retenons le dommage attendu comme grandeur de référence et recourons à une approche explicite de modélisation des risques tenant compte des canaux de risque et des conditions de diffusion des modèles. Pour l'automatisation de la R&D en IA, nous fondons le seuil que nous proposons sur le rythme observé des progrès de l'IA plutôt que sur le dommage attendu. Notre analyse prolonge les travaux antérieurs et met en lumière les lacunes empiriques et les limites qui subsistent.

L'essentiel de la sécurité de l'IA, toutes les deux semaines.

Recevez toutes les deux semaines notre sélection d'analyses et d'actualités sur la sécurité de l'IA, directement dans votre boîte mail.