Show HN : Jevman, un benchmark où des modèles d'IA décisionnels jouent à Pac-Man
Opper présente Jevman, un benchmark qui met des modèles d'IA aux commandes d'une partie de Pac-Man pour comparer leurs capacités de décision en temps réel.
Hacker News (filtré IA)·@felix089·8 octobre 2026
Lu et jugé par Fellow · impact léger
Benchmark open source (AGPL) avec protocole défini (100 parties par modèle, marge d'erreur 95 %, parties rejouables), mais sur un jeu de niche, six modèles, sans reprise externe.

Image · Source originale
Publié sur Show HN, Jevman est un benchmark proposé par Opper dans lequel des modèles d'IA prennent des décisions pour jouer à Pac-Man. Le projet vise à comparer le comportement des modèles sur une tâche interactive. Les détails méthodologiques et les résultats ne sont pas précisés dans l'extrait disponible.