SAFETY
Une faille fondamentale rend les LLM vulnérables
Il est impossible de sécuriser totalement les LLM contre les attaques en raison de leur fonctionnement intrinsèque.
MIT Technology Review · IA·Will Douglas Heaven·30 juillet 2026

Image · Source originale
Des chercheurs démontrent qu'il est impossible de sécuriser entièrement les grands modèles de langage. La faille réside dans leur méthode d'identification des instructions par style plutôt que par structure, permettant des contournements. Les tests ont permis d'extraire des instructions dangereuses chez OpenAI, Anthropic et d'autres.