Follow-the-Regularized-Leader

Also known as FTRL

Latest papers 15

All topics
CardsList
  1. Constant regret in general games via higher-order optimism

    Sep 3, 2026Omar Abbadi, Rida Laraki, Panayotis MertikopoulosFollow-the-Regularized-LeaderRegret Minimization

  2. Constant Individual Regret in General Games

    Aug 31, 2026Mingyang Liu, Gabriele Farina, Asuman OzdaglarGame TheoryFollow-the-Regularized-Leader

  3. Dec-BFTRL: Squre-Root Regret for Decentralized Online Upper-Linearizable Optimization under Separation Access with Application to Continuous Submodular Maximization

    Aug 31, 2026Yiyang Lu, Mohammad Pedramfar, Vaneet AggarwalSubmodular OptimizationFollow-the-Regularized-Leader

  4. Online Convex Optimization with Dueling Feedback

    Aug 15, 2026Yiyang Lu, Hareshkumar Jadav, Mohammad Pedramfar +2Online Convex OptimizationFollow-the-Regularized-Leader

  5. Revisiting Decentralized Online Convex Optimization with Compressed Communication

    Jul 2, 2026Hao Zhou, Xiaoyu Wang, Chang Yao +2Online Convex OptimizationFollow-the-Regularized-Leader

  6. Policy Optimization Achieves Data-Dependent Regret Bounds in MDPs with Unknown Transitions

    Jun 30, 2026Mingyi Li, Taira Tsuchiya, Kenji YamanishiRegret Minimization in RLMarkov Decision Processes

  7. Capacity-Constrained Online Convex Optimization with Delayed Feedback

    Jun 10, 2026Alexander Ryabchenko, Idan Attias, Daniel M. RoyOnline Convex OptimizationBandit Convex Optimization

  8. SEArch: Optimistic Policy Selection Between Scene Noise and Drift for UAV Radar Search

    May 31, 2026Noor Khial, Naram Mhaisen, Loay Ismail +1Multi-Armed BanditsNon-Stationary Bandits

  9. Data- and Variance-dependent Regret Bounds for Online Tabular MDPs

    Feb 2, 2026Mingyi Li, Taira Tsuchiya, Kenji YamanishiRegret Minimization in RLMarkov Decision Processes

  10. Self-Concordant Perturbations for Linear Bandits

    Oct 28, 2025Lucas Lévy, Jean-Lou Valeau, Arya Akhavan +1Multi-Armed BanditsExploration-Exploitation Tradeoff

  11. Best-of-Both Worlds for linear contextual bandits with paid observations

    Oct 8, 2025Nathan Boyer, Dorian Baudry, Patrick RebeschiniMulti-Armed BanditsFollow-the-Regularized-Leader