Interval Regret

Momentum

5 papers in the last four weeks, with none the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 19

All topics
CardsList
  1. Challenges and Solutions for Bandits in the Wild: Warm-Started Mixture Bandits for Cross-Cohort Slate Recommendation

    Sep 29, 2026Serafima Lebedeva, Sumantrak Mukherjee, Ali Arshad Sadal +8RecommendationBandits

  2. On the Relation Between Interval Regret and Dynamic Regret

    Sep 28, 2026Yi-Han Wang, Peng Zhao, Zhi-Hua ZhouInterval RegretLearning-Augmented Algorithms

  3. Exact Bayes Regret and Asymptotic Optimality in High-Dimensional Gaussian Bandits

    Sep 23, 2026Prakhar Singhvi, Yi Zou, Abhishek BhattacharjeeInterval RegretGaussian Mixture Models

  4. Meta-LinEXP3: Online-within-Online Learning for Adversarial Linear Contextual Bandits

    Sep 9, 2026Hao Li, Jie Xu, Zheng XieContextual Bandit FrameworkMeta-Learning

  5. The Greedy Advantage in Finite-Horizon Bandits

    Jul 31, 2026Kai Zhou, Michael Lingzhi Li, Kai WangStochastic Multi-Armed BanditsInterval Regret

  6. Optimizing the Preconditioner: A Black-box Online-to-Nonconvex Conversion with Static Regret Minimization Oracles

    Jul 20, 2026Haichen Hu, David Simchi-LeviStochastic Convex OptimizationInterval Regret

  7. Functional Bilevel Optimization for Predictive Fairness

    Jul 6, 2026Ieva Petrulionyte, Julien Mairal, Michael ArbelAlgorithmic FairnessBilevel Optimization

  8. TRACER: Turn-level Regret Matching with Inner Reinforcement Credit for Cooperative Multi-LLM Reasoning

    May 27, 2026Chusen Li, Zhou Liu, Shuigeng Zhou +1LLM Reasoning StrategiesInterval Regret

  9. The Power of Second Order Methods for Sequence Preconditioning

    May 8, 2026Annie Marsden, Elad HazanAutoregressive ModelInterval Regret

  10. Optimal Contextual Pricing under Agnostic Non-Lipschitz Demand

    May 7, 2026Jianyu Xu, Yu-Xiang WangDynamic PricingInterval Regret

  11. FedSEA: Achieving Benefit of Parallelization in Federated Online Learning

    Apr 21, 2026Harekrushna Sahu, Pratik Jawanpuria, Pranay SharmaFederated LearningLearning-Augmented Algorithms

  12. Demystifying the unreasonable effectiveness of online alignment methods

    Apr 19, 2026Enoch Hyunwook KangInterval RegretKullback-Leibler Regularization

  13. Small Gradient Norm Regret for Online Convex Optimization

    Jan 20, 2026Wenzhi Gao, Chang He, Madeleine UdellInterval RegretRegret