Online Learning

Learning in Continuous Games from Pairwise Preference Feedback

Online Learning on Hidden-Convex Losses via Algorithmic Equivalence: Optimal Regret, Geometric Barrier, and Bandit Feedback