Exploration-Exploitation Tradeoff

Momentum

3 papers in the last four weeks, with none the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 32

All topics
CardsList
  1. Human-inspired, Task-Dimension-Guided Exploration for Efficient Learning in High Dimensions

    Sep 29, 2026Fanyu Zhu, Jiahui An, Ni JiExploration-Exploitation TradeoffRL Exploration

  2. Signatures of semantic search in the activations of large language models

    Sep 28, 2026Luke Leckie, Peter M. Todd, Jacob G. FosterExploration-Exploitation TradeoffLLM Interpretability

  3. VRL-Bench: Benchmarking agents on computer control tasks under finite trial budgets

    Sep 14, 2026Yu Bai, Yukai Miao, Dawei Wang +8RL BenchmarksReinforcement Learning

  4. Situation Aware Frontier Prioritization for Quadruped Search and Rescue

    Aug 3, 2026Kevin Farias, Santiago Martin, Barbara Flores +5Exploration-Exploitation TradeoffRobotics

  5. Collaborative Spatial Learning with Multi-LLM Agents in Networked Social Experiments

    Jul 16, 2026Hao He, Chris J. Kuhlman, Xinwei DengExploration-Exploitation TradeoffMulti-Agent LLMs

  6. Learning from Local Walks on Dynamic Graphs with Bandit Feedback

    Jul 12, 2026Sourav Chakraborty, Amit Kiran Rege, Claire Monteleoni +1Multi-Armed BanditsGraph Bandits

  7. Towards Self-Evolving Agents: A Human-Inspired Adaptive Exploration-Exploitation Framework for Genetic Network Programming

    Jul 4, 2026Ali Kohan, Mohamad Roshanzamir, Roohallah Alizadehsani +1Exploration-Exploitation TradeoffGenetic Programming

  8. Analysis of Parameter Settings for the Bat Algorithm Using Variance Evolution

    Jun 26, 2026Xin-She Yang, Mehmet KaramanogluExploration-Exploitation TradeoffEvolutionary Optimization

  9. Reward-free Pretraining for Reinforcement Learning via Occupancy Coverage Maximization

    Jun 19, 2026Marco Pratticò, Pietro Novelli, Massimiliano Pontil +1Reinforcement LearningExploration-Exploitation Tradeoff

  10. TreeSeeker: Tree-Structured Trial, Error, and Return in Deep Search

    Jun 10, 2026Zhuofan Shi, Mingzhe Ma, Lu Wang +8Inference-Time SearchExploration-Exploitation Tradeoff

  11. Exploratory Responsiveness and Adaptive Rigidity under AI-Assisted Optimization

    Jun 8, 2026Balaraju BattuExploration-Exploitation TradeoffAdaptive Learning

  12. Algorithm for Contextual Queueing Bandits with Rate-Optimal Queue Length Regret

    Jun 8, 2026Seoungbin Bae, Dabeen LeeExploration-Exploitation TradeoffRegret Minimization

  13. Oblivious Learning and Collusive Pricing

    Jun 3, 2026Yuhang Wu, Assaf ZeeviExploration-Exploitation TradeoffGame Theory

  14. Mind the Gaps: Multi-Robot Feedback-Driven Ergodic Coverage in Unknown Environments

    May 20, 2026Thales Costa Silva, Nora AyanianTrajectory OptimizationMulti-Robot Systems

  15. Not all uncertainty is alike: volatility, stochasticity, and exploration

    May 19, 2026Payam PirayMulti-Armed BanditsExploration-Exploitation Tradeoff

  16. Uncertainty-Calibrated Recommendations for Low-Active Users

    May 18, 2026Bob Junyi Zou, Sai Li, Tianyun Sun +2Uncertainty QuantificationExploration-Exploitation Tradeoff

  17. FML-bench: A Controlled Study of AI Research Agent Strategies from the Perspective of Search Dynamics

    May 17, 2026Qiran Zou, Hou Hei Lam, Wenhao Zhao +11AI Agents for Scientific DiscoveryInference-Time Search

  18. Learning to Sparsify Stochastic Linear Bandits

    May 11, 2026Zhengmiao Wang, Ming Chi, Zhi-Wei Liu +2Multi-Armed BanditsExploration-Exploitation Tradeoff

  19. HTPO: Towards Exploration-Exploitation Balanced Policy Optimization via Hierarchical Token-level Objective Control

    May 8, 2026Xincheng Yao, Ruoqi Li, Cheng Chen +4RL for Language ModelsExploration-Exploitation Tradeoff

  20. Trading off rewards and errors in multi-armed bandits

    May 1, 2026Akram Erraqabi, Alessandro Lazaric, Michal Valko +2Multi-Armed BanditsExploration-Exploitation Tradeoff

  21. Efficient learning by implicit exploration in bandit problems with side observations

    Apr 27, 2026Tomas Kocak, Gergely Neu, Michal Valko +1Multi-Armed BanditsExploration-Exploitation Tradeoff

  22. Extreme bandits

    Apr 27, 2026Alexandra Carpentier, Michal ValkoMulti-Armed BanditsExploration-Exploitation Tradeoff

  23. Resilient Decentralized Ergodic Coverage for Scalable Multi-Robot Systems in Unknown Time-Varying Environments

    Apr 5, 2026Maria G. Mendoza, Victoria Marie Tuck, Chinmay Maheshwari +1Multi-Robot SystemsExploration-Exploitation Tradeoff

  24. Mixture-Greedy for Online Generative Model Selection: Is UCB Necessary in Diversity-Aware Multi-Armed Bandits?

    Mar 23, 2026Bahar Dibaei Nia, Farzan FarniaMulti-Armed BanditsExploration-Exploitation Tradeoff