RECHERCHE
ERUnderstand : un benchmark pour évaluer les VLM sur les diagrammes entité-relation
Un nouveau benchmark de 2 960 diagrammes ER révèle les limites des modèles vision-langage sur les schémas conceptuels complexes.
arXiv cs.AI · cs.LG · cs.CL·Ali Ansari, Yasmin Mohammadi, Farnoush Nili, Parsa Esmaeilkhani·27 juillet 2026

Image · Source originale
ERUnderstand est le premier benchmark à grande échelle pour l'évaluation de la compréhension structurée des diagrammes entité-relation (ERD) par des modèles vision-langage. Si les éléments courants sont bien reconnus (F1 > 0,74), les performances chutent fortement sur les entités faibles, les attributs multivalués et les relations n-aires (jusqu'à 0,07 F1). Les modèles à raisonnement renforcé améliorent les résultats de 15 à 25 %, mais restent sensibles à la complexité des diagrammes.