Exploration

Momentum

38 papers in the last four weeks, up 375% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 246

All topics
CardsList
  1. When Do Intrinsic Rewards Lead to Exploration?

    Oct 1, 2026Scott W. Viteri, Laura Gomezjurado Gonzalez, Clark BarrettStochastic ExplorationExploration

  2. Extreme Length Generalization in a Compact Recurrent Architecture for One-Shot Exploration

    Oct 1, 2026Izen Thornton, Aaron Shey, William SuRecurrent Neural NetworksMobile Robots

  3. GPU-Accelerated Path-Dependent Marginal Information Gain for Autonomous Exploration

    Sep 30, 2026João Félix Mendes, Rodrigo Ventura, Meysam BasiriExplorationVoxel

  4. Centralized Multi-UAV Exploration and 3D Reconstruction Using Single-UAV Planners

    Sep 30, 2026João Félix Mendes, Meysam Basiri, Rodrigo VenturaMulti-UavUnmanned Aerial Vehicles

  5. Towards Better Exploration in Sequential Test-Time Scaling

    Sep 30, 2026Joseph Rance, Fabio Pizzati, Juil Sock +4Test-Time ScalingSequential Scaling

  6. ExploreNet: Learning Where to Explore in Diffusion GRPO

    Sep 29, 2026Shuyue Stella Li, Xiaochuang Han, Yulia Tsvetkov +1Diffusion-Based Reinforcement Learning MethodsDiffusion Models

  7. MUGEN: Interactive Panoramic World Exploration via Camera Control

    Sep 29, 2026Jiaming Tan, Zhen Li, Shuwei Shi +6Omnidirectional ImagesCamera Control

  8. All Roads Lead to Rome: Flow-driven Multi-Anchor Exploration for Open-Environment Active 3D Mapping

    Sep 29, 2026Yang Li, Aming Wu, Zihao Zhang +33D MappingViewpoint-Dependent Active Perception

  9. Human-inspired, Task-Dimension-Guided Exploration for Efficient Learning in High Dimensions

    Sep 29, 2026Fanyu Zhu, Jiahui An, Ni JiEfficient ExplorationExploration

  10. Going Beyond State-Reaching: Learning Abstractions for Intrinsically Motivated Option Discovery

    Sep 29, 2026Akhil Bagaria, Anita De Mello Koch, George KonidarisExplorationState Space

  11. Deep Epistemic Value Functions for Optimistic Exploration

    Sep 28, 2026Leander Diaz-Bone, Marco Bagatella, Jonas Hübotter +1Stochastic ExplorationValue Functions

  12. Terrain-Aware Autonomous Planetary Exploration for Exteroceptive-Proprioceptive Mapping with Quadruped Scouts

    Sep 28, 2026Alberto Sanchez-Delgado, João Carlos Virgolino Soares, Victor Barasuol +1Planetary ExplorationProprioception

  13. TIDE: Teacher-Student Transition via Informative Distillation and Exploration for Agentic RL

    Sep 28, 2026Yibin Huang, Xinming Xu, Conghui ZhuAgentic Reinforcement LearningTeacher

  14. SOR-Nav: Search or Relocate? Context-Gated Exploration and Cross-Region Relocation for Object Navigation

    Sep 28, 2026Yuan Ji, Zirui Li, Yuxin Cai +3Object Goal NavigationNavigation

  15. ICMAPE: In-Context Multiagent Pure Exploration

    Sep 27, 2026Xinyi Hu, Alessio Russo, Aldo PacchianoMulti-Agent PlanningStochastic Exploration

  16. Future Information-Directed Sampling for Bayesian Nonstationary Bandits

    Sep 27, 2026Yichen Song, Alessio Russo, Aldo PacchianoBanditsStochastic Exploration

  17. TGRL: Temperature-Grouped Reinforcement Learning for Efficient Exploration in LLMs

    Sep 27, 2026Zihan Lin, Xiaohan Wang, Jie Cao +4Large Language Model Reinforcement LearningGroup-Based Reinforcement Learning

  18. AlphaDiverse: Post-Training Local Quantitative Research Agents for Diverse Exploration in Alpha Factor Mining

    Sep 24, 2026Qingzhuo Wang, Zikun Wei, Zhihua Wei +1Stochastic ExplorationDiversity

  19. Hierarchical Floorplan-Guided Vision-Language Exploration for Embodied Question Answering

    Sep 22, 2026Albert Gassol Puigjaner, Kostas AlexisVision-Language NavigationKnowledge-Based Visual Question Answering

  20. Video-HopChain: Multi-Hop Questions and Confidence-Gated Exploration for Video Reasoning Models

    Sep 22, 2026Trung Nguyen Quang, Yuhao Dong, Shuo Sun +4Multi-Hop ReasoningExploration

  21. Efficient Reasoning Exploration via State-Conditioned Latent Steering with Progress Guidance

    Sep 21, 2026Hengyuan Zhang, Chenming Shang, Zunhai Su +10Reasoning PathsEfficient Exploration

  22. WOLF: World Model Guided LiDAR Exploration with Predictive Frontiers

    Sep 20, 2026Yuyang Tian, Penghui Yang, Pengyuan Wu +7Aerial Vision-Language NavigationLatent World Models

  23. Exact Fusion and Coordinated Exploration in Multi-Robot Active Inference

    Sep 15, 2026Peng Wu, Mohsen Imani, Amidu Kamara +3Multi-Robot SystemsExploration

  24. RSIAgent: Autonomous Exploration for Recursive Self-improvement in New Environments

    Sep 14, 2026Sibo Zhu, Shicheng Fan, Xinyue Wang +3Self-Improving AgentsMixture-Of-Agents

  25. Enabling Creative Exploration for Vibe Design Agents

    Sep 14, 2026Yifan Zhang, Nghi D. Q. Bui, Georgios Evangelopoulos +1Interaction DesignVibe Coding

  26. Communication-Constrained Multi-Robot Exploration With Adaptive Communication Windows

    Sep 14, 2026Ben Rossano, Jaein Lim, Jonathan P. HowMulti-Robot SystemsEfficient Exploration

  27. Optimizing for the decision not the prediction: an exploration of Smooth Net Benefit as a training objective

    Sep 14, 2026Koen M. F. Gorgels, Lasai Barreñada, Maarten van Smeden +3Logistic RegressionClinical Prediction

  28. When Information is Worth the Risk: Behavioral Valuation for Hazardous Robotic Exploration

    Sep 11, 2026Alkesh K. Srivastava, Aamodh Suresh, Carlos Nieto-Granda +1RiskExploration

  29. Valerant: An Automatic Navigable Game Map Generator via Action-Conditioned World Model Exploration

    Sep 8, 2026Yiran Qiao, Feng Wang, Jing Ma3D World3D Mapping

  30. Application of curiosity driven exploration methods for hardware interference identification

    Sep 8, 2026Ludovic Matar, Clement Moulin-Frier, Pierre-Yves OudeyerInterferenceHardware Efficiency

  31. SUN: Reaching for Novelty in Reinforcement Learning

    Sep 8, 2026Wenyan Yang, Arsenii Mustafin, Dominik Baumann +2Goal-Conditioned Reinforcement LearningExploration

  32. TASG-Explore: Traversability-Aware Sector-Guided Exploration for Ground Robot on Uneven Terrain

    Sep 8, 2026Shaocong Wang, Shiliang Shao, Ting Wang +2TraversabilityTerrain

  33. Agentic ML Exploration (A-MLE) for Ads Ranking

    Sep 8, 2026Erwin Gao, Vinodh Kumar Sunkara, Jingyi Guan +36AdsAgentic

  34. OpenWAM: An Open, Modular Exploration Towards Systematic World-Action Model Pretraining

    Sep 7, 2026Yuran Wang, Siqiao Huang, Mingleyang Li +21Faster-WamWorld Models

  35. Explore Before Committing: Hypothesis-Guided Search for Deep Research Agents

    Sep 1, 2026Ruochen Zhou, Zhengyu Chen, Luan Zhang +3Search AgentsDeepseek

  36. Towards Generalizable Visually Grounded Exploration of Household Devices

    Sep 1, 2026Linhao Zheng, Zeming Liu, Wangke Chen +4Embodied AgentsWeak Visual Grounding

  37. TSExplorer: An interactive data annotation and exploration tool for time-series data

    Aug 31, 2026Einari Vaaras, Manu Airaksinen, Okko RäsänenVisual AnalyticsTime Series

  38. Answer Probing-Guided Search for Diverse Solution Exploration of LLMs

    Aug 31, 2026Yi Fang, Que Shen, Chengpeng Li +6LLM Reasoning StrategiesReasoning Paths

  39. Scalable Multi-Agent Maze Traversal with Local Communication

    Aug 12, 2026Julian Rau, Jahir Argote-Gerald, Grace McFassel +3Multi-Agent Path FindingMaze Task

  40. Parameter Exploration for RLVR via Variational Learning

    Aug 10, 2026Vatsal Venkatkrishna, Nico Daheim, Iryna GurevychLarge Language Model Reinforcement LearningReinforcement Learning With Verifiable Reward

  41. Sekai2: From World Exploration to Interactive World Modeling

    Aug 10, 2026Kang He, Wenshuo Peng, Zihui Gao +3Video World ModelsVideo Dataset

  42. Explore, Map, Remember, Decide: Are Embodied VLMs Ready for Safety-Critical Scenarios?

    Aug 8, 2026Gabriele La Malfa, Nitay Alon, Emanuele La Malfa +2Recent Vision-Language ModelsSpatial Reasoning

  43. SkillHEX: Improving Agent Skills via Hypothesis-Driven Autonomous Exploration and Exploitation

    Aug 6, 2026Yuru Feng, Yaoqi Chen, Beidi Zhao +7Self-Evolving Skill LibrariesSkills

  44. Explore Beyond the Boundary Using Entropic Information

    Jul 31, 2026Bumgeun Park, Donghwan LeeExplorationEntropy

  45. Cooperative Multi-UAV Navigation in Complex Environments via Systematic Multi-Agent Deep Reinforcement Learning

    Jul 28, 2026Yu Su, Nabil AoufMulti-UavMulti-Agent Reinforcement Learning

  46. Decentralized Scalable Exploration via Emergent Adaptive Lévy Walks on Minimal-Sensing Platforms

    Jul 28, 2026Wai Lun Leong, Teo Swee Huat RodneyMulti-UavUnmanned Aerial Vehicles

  47. WARL: Wrench-Augmented Reinforcement Learning for Task-Agnostic Learning in Legged Robots

    Jul 27, 2026Keita Yoneda, Kento Kawaharazuka, Kei OkadaScalable Robot LearningLegged Robots

  48. Try Once, Then Optimal: De-Redundified Procedure Memory for Cross-Episode Exploration Amortization

    Jul 26, 2026Haizhou Ge, Haochen Ouyang, Zhixing Chen +6Episodic MemoryExploration

  49. Exploration of the generative capabilities of Boltzmann machines applied to social systems under the majority rule

    Jul 25, 2026Mauricio A. Valle, Gonzalo A. RuzBoltzmann DistributionsModern Deep Networks

  50. Information-Based Exploration via Random Features for Reinforcement Learning

    Jul 20, 2026Waris Radji, Odalric-Ambrym MaillardStochastic ExplorationExploration

  51. Exploration Matters for Escaping the Blur Trap in 3D Gaussian Splatting

    Jul 20, 2026Chengbo Wang, Guozheng Ma, Jinhong Wu +2Recent 3D Gaussian SplattingNovel View Synthesis

  52. DeLIVeR: Decomposed Learning for Information-grounded Veracity Recognition via Reinforced Knowledge Graph Exploration

    Jul 20, 2026Cong Hoan Nguyen, Thomas Hoang, Hieu Minh Duong +1Fact-CheckingLarge Language Model Reliability