Un mode fermé est un choix de jauge : topologie relative à l'accessibilité dans les modèles de monde de code certifiés
Une étude formelle montre qu'un modèle de monde de code validé par un test peut être exact partout où le test regarde, et arbitrairement faux ailleurs.
arXiv cs.AI · cs.LG · cs.CL·Javier Aguilar Martín·28 août 2026
Lu et jugé par Fellow · impact léger
Publication théorique sur la sûreté des modèles de monde, sans implémentation ni application industrielle immédiate.

Image · Source originale
Les auteurs caractérisent ce qu'un modèle de monde de code certifié peut savoir, et le coût de ses erreurs, lorsqu'une région inaccessible reste non testée. Sur un instrument minimal en anneau, ils prouvent un cas extrême d'artefact topologiquement faux mais infalsifiable, et mesurent via plusieurs familles de LLM comment un paramètre de largeur de canal fait passer cet artefact par trois régimes : infalsifiable et inoffensif, falsifiable et coûteux, ou immédiatement détecté. Ils montrent aussi que la réparation dépend des paramètres et des capteurs disponibles, et qu'aucune famille de modèles ne récupère la région correcte depuis l'extérieur.