Le jeu de concentration : mise à jour bayésienne, regret et information
Un cadre théorique unifie mise à jour bayésienne, regret en poids exponentiels et bornes de concentration via un jeu répété apprenant-nature.
arXiv cs.AI · cs.LG · cs.CL·Akshay Balsubramani·18 août 2026
Lu et jugé par Fellow · impact léger
Contribution théorique unifiant des résultats connus (regret, bornes de concentration) sans validation empirique ni preuve d'impact pratique.

Image · Source originale
L'article formalise un jeu à somme nulle entre un apprenant et la nature dont l'identité de valeur produit simultanément la mise à jour bayésienne et une comptabilité exacte du regret en poids exponentiels. Les poids de Gibbs/Bayes émergent comme équilibre de Bellman unique, et le regret se décompose exactement en trois termes information-théoriques. Ce cadre generalise et explique les bornes classiques de grande déviation.