Apprentissage PAC robuste de jeux stochastiques concurrents
Un nouveau cadre PAC pour les jeux stochastiques concurrents garantit un équilibre de Nash ou certifie son inexistence.
arXiv cs.AI · cs.LG · cs.CL·Angel Y. He, David Parker·3 septembre 2026
Lu et jugé par Fellow · impact léger
Publication d'un article scientifique avec protocole et garanties théoriques sur l'apprentissage PAC, sans implémentation diffusée.

Image · Source originale
Ce travail introduit un cadre d'apprentissage PAC (Probably Approximately Correct) pour les jeux stochastiques concurrents à somme générale, gérant l'incertitude de transition et l'existence de l'équilibre de Nash. L'algorithme utilise des ensembles de confiance robustes et une caractérisation de la marge de Nash pour fournir un équilibre optimal de bien-être social ou certifier qu'aucun équilibre exact n'existe.