Regret

Momentum

5 papers in the last four weeks, down 17% on the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 80

All topics
CardsList
  1. The Curvature of Regret in Contextual Linear Optimization

    Oct 1, 2026Konstantinos Ziliaskopoulos, Alexander Vinel, Alice E. SmithLinear ProgrammingRegret

  2. Minimax Optimal Regret for Causal Logistic Bandits with Counterfactual Fairness

    Oct 1, 2026Junhyuk Huh, Seoungbin Bae, Dabeen LeeStochastic Multi-Armed BanditsAlgorithmic Fairness

  3. Prediction with Expert Advice: Anytime Regret with Many Experts Matches the Fixed-Time Constant

    Sep 23, 2026Yang Cai, Vineet Gupta, Yanchen Jiang +4\Widetilde{\Mathcal{O}}(\Sqrt{T})$ RegretRegret

  4. RegRet: Enhancing Region-Level Retrieval in Large Multimodal Models

    Sep 15, 2026Xun Liang, Honghui Yang, Weihang Pan +6Multimodal RetrievalLarge Multimodal Models

  5. Constant regret in general games via higher-order optimism

    Sep 3, 2026Omar Abbadi, Rida Laraki, Panayotis Mertikopoulos\Widetilde{\Mathcal{O}}(\Sqrt{T})$ RegretRegret

  6. Posterior Tempering Explains Variance Inflation in Linear and Generalized Linear Thompson Sampling

    Sep 2, 2026Prateek Jaiswal, Debdeep Pati, Anirban Bhattacharya +1Thompson Sampling\Widetilde{\Mathcal{O}}(\Sqrt{T})$ Regret

  7. Coordinating the Unknown Lipschitz Constant in Multiplayer Bandits

    Aug 11, 2026Ricardo Parada, Chenzhang Zhao, William ChangStochastic Multi-Armed BanditsLipschitz Continuity

  8. Regret, equilibrium, and learning in games: A guided tour

    Aug 10, 2026Panayotis MertikopoulosImperfect-Information GamesEquilibrium

  9. Sharp Characterization of Bias in Post-Bandit Inference

    Aug 2, 2026Lisu Wang, Yilun Chen, Jiaqi LuStochastic Multi-Armed BanditsStochastic Exploration

  10. Convergence and Regret of the Policy Gradient for Multi-Armed Bandits in Diffusion Environment

    Jul 31, 2026Yanwei Jia, Du OuyangPolicy GradientStochastic Multi-Armed Bandits

  11. Self-Adaptive Learning and Model Predictive Control for Tracking Unknown Dynamics with No Regret

    Jul 29, 2026Atharva Navsalkar, Hongyu Zhou, Vasileios TzoumasModel Predictive ControlOptimal Control

  12. One More Turn, Less Regret: A Regret-Based Multi-Turn Benchmark for LLMs' Clarification Policies

    Jul 23, 2026Minh Ngoc Ta, My Anh Tran Nguyen, Duong D. Nguyen +2ClarificationQuestion

  13. Asymptotically Optimal Regret for Reinforcement Learning without Horizon Dependence

    Jul 22, 2026Runlong Zhou, Zihan Zhang, Maryam Fazel +1Model-Free Reinforcement LearningValue Functions

  14. Optimizing Regret

    Jul 21, 2026Irene AldridgeRegretPolicy Gradient

  15. Bandit PCA with Minimax Optimal Regret

    Jul 12, 2026Moïse Blanchard, Dmitrii Ostrovskii, Aadirupa SahaPrincipal Component Analysis\Widetilde{\Mathcal{O}}(\Sqrt{T})$ Regret

  16. Probably Correct Optimal Stable Matching under Two-Sided Uncertainty

    Jul 6, 2026Andreas Athanasopoulos, Anne-Marie George, Christos DimitrakakisDistribution MatchingMatching Markets

  17. Dynamic Regret for Non-Stationary Linear Bandits via Misspecification Reductions

    Jul 3, 2026Zihao Hu, Yuan Yao, Jiheng Zhang +1Contextual Bandit FrameworkRegret

  18. When Classic Cache Policies Fail: Learning-Augmented Replacement for Semantic Retrieval Buffers

    Jul 1, 2026Yushi Sun, Bowen Cao, Wai LamCacheFeedback

  19. Contextual Slate GLM Bandits with Limited Adaptivity

    Jun 30, 2026Tanmay Goyal, Sukruta Prakash Midigeshi, Gaurav SinhaContextual Bandit FrameworkGeneralized Linear Model

  20. Improved Multi-Dimensional Forecasting for Swap Regret

    Jun 28, 2026Joey Rivkin, Ramiro N. Deo-Campo Vuong, Robert Kleinberg +3RegretDownstream Reasoning

  21. Leveraging Similarities in Multi-Armed Bandits

    Jun 22, 2026Khaled Eldowa, Thibaud Rahier, Augustin Cablant +2Stochastic Multi-Armed BanditsRegret

  22. Adversarial Bandit Optimization with Globally Bounded Perturbations to Convex Losses

    Jun 18, 2026Zhuoyu Cheng, Kohei Hatano, Eiji TakimotoConvex LossConvex Optimization

  23. Toward Simultaneously Optimal Regret in U-Calibration

    Jun 16, 2026Rafael Frongillo, Haipeng Luo, Nishant A. Mehta +1Optimal RegretRegret

  24. When Does q-error Predict Plan Regret? Three Regimes of Cardinality-Estimation Error

    Jun 14, 2026Madhulatha Mandarapu, Sandeep KunkunuruPrediction ErrorPlan Regret

  25. Repeated Bilateral Trade: The Quest for Fairness

    Jun 13, 2026François Bachoc, Roberto Colomboni, Emilie KaufmannNash EquilibriumAlgorithmic Fairness

  26. Online Convex Optimization with Sublinear Noisy Probes

    Jun 12, 2026Simone Di Gregorio, Anupam Gupta, Stefano Leonardi +1\Widetilde{\Mathcal{O}}(\Sqrt{T})$ RegretConvex Optimization

  27. Learning with Simulators: No Regret in a Computationally Bounded World

    Jun 11, 2026Sasha Voitovych, Abhishek Shetty, Noah Golowich +1LearnabilityRegret

  28. Regret Pre-training: Bridging Prior and Posterior Views for Enhanced Knowledge Grounding

    Jun 2, 2026Mingkuan Zhao, Xiayu Sun, Wentao Hu +5Token-Level SupervisionCausal Attention

  29. Coherent Swap Regret and Channel-Proof Learning

    Jun 1, 2026Sohail SarkarRegret

  30. Efficient Exploration for Iterative Nash Preference Optimization

    May 31, 2026Tianlong Nan, Xiaopeng Li, Christian Kroer +1Reinforcement Learning From Human FeedbackNash Equilibrium

  31. Instance-dependent Stochastic Lipschitz bandit

    May 28, 2026Marius Potfer, Vianney PerchetStochastic Multi-Armed BanditsOptimality

  32. On the Learnability of Test-Time Adaptation: A Recovery Complexity Perspective

    May 27, 2026Zhi Zhou, Ming Yang, Shi-Yu Tian +3Stable Test-Time AdaptationTest-Time Adaptation

  33. Near-Optimal Regret in Adversarial Kernel Bandits

    May 26, 2026Yu-Jie Zhang, Hao Qiu, Jonathan Scarlett +1\Widetilde{\Mathcal{O}}(\Sqrt{T})$ RegretMinimax Rate

  34. Prudent-Banker: No Extra Fees for Baseline Safety in Adversarial Bandits With and Without Delays

    May 22, 2026Ting Hu, Luanda Cai, Emmanouil-Vasileios Vlatakis-GkaragkounisBanditsBounded Adversary

  35. Regret Analysis of Retry-Based Bandits

    May 20, 2026Bingkui Tong, Junpei Komiyama, Soichiro Nishimori +1Stochastic Multi-Armed BanditsRegret

  36. Minimax Optimal Variance-Aware Regret Bounds for Multinomial Logistic MDPs

    May 19, 2026Pierre Boudart, Pierre Gaillard, Alessandro RudiMarkov Decision ProcessesMinimax

  37. Tighter Regret Bounds for Contextual Action-Set Reinforcement Learning

    May 15, 2026Zijun Chen, Zihan ZhangOptimal RegretOffline Reinforcement Learning

  38. Polyhedral Instability Governs Regret in Online Learning

    May 13, 2026Yuetai Li, Fengqing Jiang, Yichen Feng +6\Widetilde{\Mathcal{O}}(\Sqrt{T})$ RegretSubmodular Functions

  39. A Regret Perspective on Online Multiple Testing

    May 13, 2026Qingyang Hao, Kongchang Zhou, Fang Kong +1False Discovery RateTwo-Sample Testing

  40. Learning Weakly Communicating Average-Reward CMDPs: Strong Duality and Improved Regret

    May 12, 2026Kihyun Yu, Beomhan Baek, Dabeen LeeMarkov Decision ProcessesOptimal Regret

  41. Regret Analysis of Guided Diffusion for Black-Box Optimization over Structured Inputs

    May 11, 2026Masaki Adachi, Anita Yang, Yakun Wang +1Black-Box OptimizationDiffusion Models

  42. Optimal Regret for Single Index Bandits

    May 10, 2026Devdan Dey, Sujoy Bhore, Avishek GhoshStochastic Multi-Armed BanditsOptimal Regret

  43. Learning Pure Quantum States in Any Dimension (Almost) Without Regret

    May 9, 2026Josep Lumbreras, Marco TomamichelQubit\Widetilde{\Mathcal{O}}(\Sqrt{T})$ Regret

  44. Interpreting Reinforcement Learning Agents with Susceptibilities

    May 8, 2026Chris Elliott, Einar Urdshals, David Quarel +1PosteriorRegret

  45. Toward Optimal Regret in Robust Pricing: Decoupling Corruption and Time

    May 8, 2026Kalana Kalupahana, Francesco Emanuele Stradi, Matteo Castiglioni +1Dynamic PricingRegret

  46. Unified Framework of Distributional Regret in Multi-Armed Bandits and Reinforcement Learning

    May 6, 2026Harin Lee, Min-hwan OhStochastic Multi-Armed BanditsRegret

  47. Pandora's Regret: A Proper Scoring Rule for Evaluating Sequential Search

    May 3, 2026Gerardo A. Flores, Yash Deshpande, Jannis R. Brea +1RegretEvaluation Metrics