Non-Stationary Bandits

Momentum

4 papers in the last four weeks, against 2 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 24

All topics
CardsList
  1. Best Arm Identification for Bandits with Shifting Means

    Oct 7, 2026Lukas Zierahn, Wouter M. Koolen, Shubhada Agrawal +2Multi-Armed BanditsBest-Arm Identification

  2. Bellman-Centric Learning: Near-Optimal Regret for Linear Bandits with Memory

    Oct 5, 2026Jingyuan Liu, Huiwen JiaMulti-Armed BanditsNon-Stationary Bandits

  3. Block Optimism for Nonstationary Bandits with Latent Linear Dynamics

    Oct 1, 2026Taehyun Hwang, Hyunjun Choi, Heesang Ann +1Multi-Armed BanditsStochastic Linear Dynamical Systems

  4. Future Information-Directed Sampling for Bayesian Nonstationary Bandits

    Sep 27, 2026Yichen Song, Alessio Russo, Aldo PacchianoMulti-Armed BanditsNon-Stationary Bandits

  5. Pooling and Drift in Delayed Bandits

    Sep 1, 2026Melika BaghiMulti-Armed BanditsNon-Stationary Bandits

  6. Progressive Content Refinement with Decaying Reward Joint LinUCB

    Aug 7, 2026Shion Ishikawa, Pablo Loyola, Young-joo Chung +1LLM Self-RefinementLarge Language Model-Guided Optimization

  7. 402Pilot: An x402 Decision Layer for Autonomous Agent Micropayments

    Aug 2, 2026Yin Li, Yanbo He, Boo-Ho Yang +5Multi-Armed BanditsNon-Stationary Bandits

  8. On Non-Stationary Dynamic Pricing: Adaptivity and Optimality

    Jul 27, 2026Feiyu Jiang, Zifeng ZhaoNon-Stationary BanditsDynamic Pricing

  9. Periodic Bootstrap Thompson Sampling For Periodically Non-Stationary Bandit Problems

    Jul 18, 2026Boning ShaoThompson SamplingNon-Stationary Bandits

  10. From Novice to Expert: Cost-Aware Bandits for Evolving Worker Performance in Crowdsensing

    Jul 15, 2026Yin Huang, Qingsong Liu, Jie XuMulti-Armed BanditsNon-Stationary Bandits

  11. Dynamic Regret for Non-Stationary Linear Bandits via Misspecification Reductions

    Jul 3, 2026Zihao Hu, Yuan Yao, Jiheng Zhang +1Dynamic Regret MinimizationNon-Stationary Bandits

  12. Flow-Corrected Thompson Sampling for Non-Stationary Contextual Bandits

    Jun 22, 2026AmirHossein Naghdi, Ali BaheriThompson SamplingNon-Stationary Bandits

  13. Online LLM Selection via Constrained Bandits with Time-Varying Demand

    Jun 16, 2026Yin Huang, Qingsong Liu, Jie XuMulti-Armed BanditsCost-Aware Inference

  14. Bandits for Efficient Experimentation: Adapting to Control Group, Preferences, and Context Drifts

    Jun 8, 2026Udvas Das, Waris Radji, Debabrota Basu +1Multi-Armed BanditsNon-Stationary Bandits

  15. SEArch: Optimistic Policy Selection Between Scene Noise and Drift for UAV Radar Search

    May 31, 2026Noor Khial, Naram Mhaisen, Loay Ismail +1Multi-Armed BanditsNon-Stationary Bandits

  16. Nonparametric Learning and Earning with One-Point Feedback under Nonstationarity

    May 20, 2026Xiangyu Yang, Feng Xu, Jian-Qiang Hu +1Non-Stationary BanditsDynamic Pricing

  17. Catching a Moving Subspace: Low-Rank Bandits Beyond Stationarity

    May 18, 2026Hamed Khosravi, Xiaoming HuoMulti-Armed BanditsNon-Stationary Bandits

  18. Bandit Learning in General Open Multi-agent Systems

    May 7, 2026Mengfan XuMulti-Armed BanditsNon-Stationary Bandits

  19. A single algorithm for both restless and rested rotting bandits

    Apr 23, 2026Julien Seznec, Pierre Ménard, Alessandro Lazaric +1Multi-Armed BanditsNon-Stationary Bandits