Optimal Regret

Momentum

3 papers in the last four weeks, against 2 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 27

All topics
CardsList
  1. From Switching to Dynamic Regret: A Simple Reduction via Unbiased Random Sequences

    Sep 17, 2026Yibo Wang, Wenhao Yang, Sifan Yang +3Optimal RegretLearning-Augmented Algorithms

  2. Bandits in Prod: Hyperparameter Optimization at Inference Time

    Sep 1, 2026Louis Abraham, Tuan-Anh Nguyen, Nicolas DevatineGeneral Grid Search FrameworkAgentic Optimization

  3. Tracking the Best Strategy in an Extensive-Form Game

    Aug 10, 2026Stephen Pasteris, Rahul Savani, Theodore TurocyOptimal RegretImperfect-Information Games

  4. Nonlinear Bandit

    Jul 8, 2026Tianshuo Zheng, Ting Wu, Zhi-Hua Zhou +1Optimal RegretLoss Function

  5. Constrained Online Convex Optimization without Slater's Condition

    Jun 30, 2026Kihyun Yu, Junehee Lee, Dabeen LeeConvex Loss\Widetilde{\Mathcal{O}}(\Sqrt{T})$ Regret

  6. Stochastic Linear Contextual Bandits with Bounded Noise: A Set-Membership Approach

    Jun 18, 2026Haonan Xu, Yingying LiContextual Bandit FrameworkOptimal Regret

  7. Matching Markets meet Cumulative Prospect Theory: Towards Optimal and Adversarially Robust Learning

    Jun 18, 2026Ananya Kunisetty, Avishek GhoshOptimal RegretMatching Markets

  8. A Solver-Free Training Method for Predict-then-Optimize

    Jun 17, 2026Beichen Wan, Mo LiuOptimization ModelingSurrogate Gradient

  9. Toward Simultaneously Optimal Regret in U-Calibration

    Jun 16, 2026Rafael Frongillo, Haipeng Luo, Nishant A. Mehta +1Optimal RegretRegret

  10. Optimal Gap-Dependent Regret for Private Stochastic Decision-Theoretic Online Learning

    May 27, 2026Tommaso Cesari, Roberto ColomboniOptimal RegretStandard Differential-Privacy

  11. Online Learning on Hidden-Convex Losses via Algorithmic Equivalence: Optimal Regret, Geometric Barrier, and Bandit Feedback

    May 25, 2026Anas Barakat, Andreas Kontogiannis, Vasilis Pollatos +2Convex Loss\Widetilde{\Mathcal{O}}(\Sqrt{T})$ Regret

  12. Infra-Bayesian Reinforcement Learning Agents Outperform Classical RL For Worst-Case Robustness

    May 22, 2026Manish Aryal, Faiyaz Azam, Agnivo Banerjee +11Offline Reinforcement LearningOptimal Regret

  13. Regret-Based (ε,δ)(ε,δ)-optimal Stopping Criteria for Bayesian Optimization

    May 21, 2026Haowei Wang, Jingyi Wang, Qiyu WeiBayesian OptimizationOptimal Stopping

  14. Tighter Regret Bounds for Contextual Action-Set Reinforcement Learning

    May 15, 2026Zijun Chen, Zihan ZhangOptimal RegretOffline Reinforcement Learning

  15. IGT-OMD: Implicit Gradient Transport for Decision-Focused Learning under Delayed Feedback

    May 12, 2026Benjamin Amoh, Geoffrey G. Parker, Wesley MarreroBilevel OptimizationOptimal Regret

  16. Learning Weakly Communicating Average-Reward CMDPs: Strong Duality and Improved Regret

    May 12, 2026Kihyun Yu, Beomhan Baek, Dabeen LeeMarkov Decision ProcessesOptimal Regret

  17. Online Sharp-Calibrated Bayesian Optimization

    May 11, 2026Marshal Arijona Sinaga, Julien Martinelli, Teemu Turpeinen +1Bayesian OptimizationGaussian Process

  18. PFN-TS: Thompson Sampling for Contextual Bandits via Prior-Data Fitted Networks

    May 11, 2026Yan Shuo Tan, Kenyon Ng, Ruizhe Deng +3Thompson SamplingTabular Prior-Data Fitted Network

  19. Optimal Regret for Single Index Bandits

    May 10, 2026Devdan Dey, Sujoy Bhore, Avishek GhoshStochastic Multi-Armed BanditsOptimal Regret

  20. Cost-Ordered Feasibility for Multi-Armed Bandits with Cost Subsidy

    May 8, 2026Ishank Juneja, Carlee Joe-Wong, Osman YağanStochastic Multi-Armed BanditsOptimal Regret

  21. Bandit Learning in General Open Multi-agent Systems

    May 7, 2026Mengfan XuBanditsOptimal Regret

  22. Thompson Sampling for Infinite-Horizon Discounted Decision Processes

    May 14, 2024Daniel Adelman, Cagla Keceli, Alba V. Olivares-NadalThompson SamplingMarkov Decision Processes