Optimisation inverse en ligne : un algorithme optimal et efficace en temps polynomial
Un algorithme déterministe résout en temps polynomial un problème ouvert d'optimisation linéaire inverse en ligne, avec un regret optimal.
arXiv cs.AI · cs.LG · cs.CL·Anupam Gupta, Guru Guruganesh, Honghao Lin, Vahab Mirrokni·6 octobre 2026
Lu et jugé par Fellow · impact léger
Résout une question ouverte théorique précise, mais portée limitée à un cadre d'optimisation inverse en ligne spécifique.

Image · Source originale
Dans l'optimisation linéaire inverse en ligne, un apprenant propose une action puis observe le choix d'un expert maximisant un objectif linéaire inconnu. Sakaue avait obtenu le regret optimal O(√d) mais avec un algorithme randomisé coûteux en calcul, et demandait si ce résultat était atteignable en temps polynomial. Les auteurs répondent positivement avec un algorithme déterministe, variante des méthodes à métrique variable, qui révoque une mise à jour de métrique lorsque le point de requête s'en éloigne suffisamment.
#online-learning#optimisation#inverse-optimization#algorithmique#regret-bounds