SAFETY
Vers une harmonisation des seuils de sécurité en IA
Des chercheurs proposent une méthode commune pour comparer et unifier les seuils de risque définis par les grands laboratoires d'IA.
arXiv cs.AI · cs.LG · cs.CL·Wilber Sean Anterola, Matthew Ball, Luis F. Lafuerza, Markov Grey·17 juillet 2026

Image · Source originale
Les entreprises d'IA de pointe publient des seuils de capacité très hétérogènes, rendant difficile toute vérification indépendante ou comparaison entre acteurs. Les auteurs proposent une méthodologie d'harmonisation couvrant trois domaines de risque : cyber, biologique et R&D automatisée en IA. L'approche combine modélisation explicite du risque attendu et, pour la R&D automatisée, un critère fondé sur le rythme observé des progrès de l'IA.