UCB Algorithms

UCB: Upper Confidence Bound

Latest papers 38

All topics
CardsList
  1. Sampling Allocation of LinUCB: Optimal Design Limits in the Small-Gap Regime

    Oct 5, 2026Yujie Liu, Vincent Y. F. Tan, Yunbei XuAdaptive InferenceContextual Bandits

  2. Pay to Learn, Share to Earn: Incentivized Federated Multi-Player Bandits

    Oct 5, 2026Pavamana K J, Chandramani SinghMulti-Armed BanditsUCB Algorithms

  3. Ranking Bandits for Carousel Interfaces with Observable Browsing Depth

    Oct 4, 2026Takuma Yasuda, Atsuyoshi NakamuraThompson SamplingMulti-Armed Bandits

  4. Block Optimism for Nonstationary Bandits with Latent Linear Dynamics

    Oct 1, 2026Taehyun Hwang, Hyunjun Choi, Heesang Ann +1Multi-Armed BanditsStochastic Linear Dynamical Systems

  5. Reoptimization Algorithms for Contextual Bandits with Knapsack Constraints

    Aug 11, 2026Zhen XuContextual BanditsUCB Algorithms

  6. Sharp Characterization of Bias in Post-Bandit Inference

    Aug 2, 2026Lisu Wang, Yilun Chen, Jiaqi LuMulti-Armed BanditsAlgorithmic Bias

  7. Price of Fairness in Bandits: A Tight Minimax Characterization

    Jul 15, 2026Dhruv Sarkar, Soumyadeep Dutta, Sayak Ray ChowdhuryMulti-Armed BanditsMinimax Regret

  8. Randomized Exploration for Linear Bandits via Absolute Perturbations

    Jun 26, 2026Toshinori Kitamura, Shuai Liu, Csaba SzepesváriThompson SamplingMulti-Armed Bandits

  9. Learning in Markovian bandits with non-observable states and constrained decision epochs

    Jun 25, 2026Thomas Hira, Victor Boone, Urtzi Ayesta +1Multi-Armed BanditsMarkov Models

  10. Selective Ensemble Based on Preference-Directed Multi-Objective Bandits

    Jun 20, 2026Lanjihong Ma, Zhen-Yu Zhang, Masashi Sugiyama +1Multi-Armed BanditsEnsemble Learning

  11. Stochastic Linear Contextual Bandits with Bounded Noise: A Set-Membership Approach

    Jun 18, 2026Haonan Xu, Yingying LiMulti-Armed BanditsContextual Bandits

  12. Efficient Multinomial Logistic Bandit via Frequent Directions

    Jun 10, 2026Linzhe He, Yu-Jie Zhang, Sifan Yang +1Multi-Armed BanditsContextual Bandits

  13. Bellman-sufficient Information Complexity

    Jun 9, 2026Yunbei XuMulti-Armed BanditsMinimax Regret

  14. Algorithm for Contextual Queueing Bandits with Rate-Optimal Queue Length Regret

    Jun 8, 2026Seoungbin Bae, Dabeen LeeExploration-Exploitation TradeoffRegret Minimization

  15. Multi-Armed Bandits with Arriving Arms: Sequential Screening, Dynamic Regret, and Sublinear Guarantees

    Jun 8, 2026Deqi Zheng, Xiaoyang Xu, Yuhong YangMulti-Armed BanditsDynamic Regret Minimization

  16. Regret-Based (ε,δ)(ε,δ)-optimal Stopping Criteria for Bayesian Optimization

    May 21, 2026Haowei Wang, Jingyi Wang, Qiyu WeiBayesian OptimizationOptimal Stopping

  17. Signature Approach for Contextual Bandits with Nonlinear and Path-dependent Rewards

    May 11, 2026Xin Guo, Grace He, Xinyu LiContextual BanditsUCB Algorithms

  18. Beyond Static Bias: Adaptive Multi-Fidelity Bandits with Improving Proxies

    May 8, 2026Muyun Lu, Haoyang Hong, Huazheng Wang +1Multi-Fidelity OptimizationMulti-Armed Bandits

  19. Finite-Time Analysis of MCTS in Continuous POMDP Planning

    May 8, 2026Da Kong, Vadim IndelmanMonte Carlo Tree SearchPartially Observable Markov Decision Processes

  20. Latent Order Bandits

    May 8, 2026Emil Carlsson, Newton Mwai, Fredrik D. JohanssonMulti-Armed BanditsUCB Algorithms

  21. Conformal-Style Quantile Analyses for Stochastic Bandits

    May 8, 2026Chengyu Du, Mengfan XuMulti-Armed BanditsConformal Prediction

  22. Bandit Learning in General Open Multi-agent Systems

    May 7, 2026Mengfan XuMulti-Armed BanditsNon-Stationary Bandits

  23. Optimal Contextual Pricing under Agnostic Non-Lipschitz Demand

    May 7, 2026Jianyu Xu, Yu-Xiang WangContextual BanditsUCB Algorithms

  24. Stochastic simultaneous optimistic optimization

    Apr 27, 2026Michal Valko, Alexandra Carpentier, Rémi MunosStochastic OptimizationMulti-Armed Bandits

  25. A Comparative Analysis on the Performance of Upper Confidence Bound Algorithms in Adaptive Deep Neural Networks

    Apr 27, 2026Grigorios Papanikolaou, Ioannis Kontopoulos, Konstantinos TserpesMulti-Armed BanditsDynamic Neural Networks

  26. Direction-Aware Offline-to-Online Learning in Linear Contextual Bandits

    Apr 27, 2026Zean Han, Ruihan Lin, Zezhen Ding +1Contextual BanditsUCB Algorithms

  27. A single algorithm for both restless and rested rotting bandits

    Apr 23, 2026Julien Seznec, Pierre Ménard, Alessandro Lazaric +1Multi-Armed BanditsNon-Stationary Bandits

  28. Replicable Bandits with UCB based Exploration

    Apr 21, 2026Rohan Deb, Udaya Ghai, Karan Singh +1Multi-Armed BanditsContextual Bandits