Partially Observable RL

RL: Reinforcement Learning

Latest papers 81

All topics
CardsList
  1. Partially Observable Zero-shot coordination by Predicting Intention of Partner

    Oct 6, 2026Jinnyeong Yang, Yuhwan Jeong, Hoyong Kwon +3Multi-Agent CoordinationPartially Observable RL

  2. Ramp Metering Control via Hybrid State Deep Reinforcement Learning in Partially Observable Connected Vehicle Environments

    Oct 5, 2026Youcef Mehamlia, Nadir Farhi, Meriem BoualiRL ControlDeep Q-Learning

  3. EpicWorldModel: Exploration-driven Planning with Latent World Models

    Oct 5, 2026Bowen Feng, Julian Ost, May Mei +2Partially Observable RLWorld Model-Based Planning

  4. ALER: Adaptive Learnable Experience Rewriting for Reinforcement Learning

    Sep 30, 2026Oleg Shchendrigin, Egor Cherepanov, Aleksandr I. Panov +1RL BenchmarksReinforcement Learning

  5. Whole-Body Aerial Grasping and Lifting via Partial Visual Observations

    Sep 30, 2026Jiaye Jin, Rui Jin, Xinhang Xu +6Aerial RoboticsPartially Observable RL

  6. Belief-Based Maximum Occupancy Principle and Active Inference

    Sep 30, 2026Manolis Mylonas, Rubén Moreno BoteBelief-Space PlanningIntrinsic Reward Methods

  7. Reinforcement Learning with Complex (valued) Memories

    Sep 29, 2026Sathya Kamesh Bhethanabhotla, Efstratios Gavves, André BiedenkappPartially Observable RLRecurrent Neural Networks

  8. Escaping Local Views: Discovering Latent Concepts for Interpretable Multi-Agent Reinforcement Learning

    Sep 28, 2026Yijie Sun, Sanquan Sun, Yanda Zhu +3Reinforcement LearningPartially Observable RL

  9. OSCC: Certified Observation-Safe Coupling Optimization for Gradient-Noise Control in Imperfect-Information Learning

    Sep 27, 2026Miaobo Hu, Shuhao Hu, Xiaobo Guo +5Partially Observable RLPolicy Gradient Methods

  10. Learning to Sell: Reinforcement Learning for Strategic Large Language Model Agents in Multi-Product Markets

    Sep 27, 2026Shuze Daniel Liu, Claire Chen, Jiuqi Wang +2Multi-Agent NegotiationAutomated Negotiation

  11. Reinforcement Learning under State and Outcome Uncertainty: A Foundational Distributional Perspective

    Sep 21, 2026Larry Preuett, Qiuyi Zhang, Muhammad Aurangzeb AhmadDistributional RLMarkov Decision Processes

  12. CoRe-MARL: Cooperative Redistribution Under Unknown Dynamics Using Recurrent Multi-Agent Reinforcement Learning

    Sep 16, 2026Naimur Rahman Chowdhury, Shatabdi Sen Prapti, Md. Salehin Seyam +1Partially Observable RLMulti-Agent Systems

  13. Hierarchical Belief Modeling for Zero-Shot Opponent Adaptation in Partially Observable Multi-Agent Navigation

    Sep 14, 2026Kowei Shih, Lu Cheng, Zeyu Wang +2Opponent ModelingPartially Observable RL

  14. Update for Decisions, Not Freshness: Goal-Oriented Status Updating and Selective Offloading at the Network Edge

    Sep 1, 2026Jianpeng Qi, Qiyang Zhang, Chao Liu +5Partially Observable RLCooperative MARL

  15. Towards a Belief-Based World Model for LLM Agents

    Aug 31, 2026Shubham Kumar, Harshit Kumar, Narendra Ahuja +1Belief-Space PlanningPartially Observable RL

  16. SleepWalking: Privileged Representation Shaping for End-to-End Blind Locomotion in Legged Robots

    Aug 31, 2026Zheng Pan, Tenghui Wang, Peilin Li +5Robot Policy LearningPartially Observable RL

  17. Learning Suffers More Than the Policy Class Under Partial Observability: A Closed-Form Analysis

    Aug 7, 2026Idil GözelRL ControlReinforcement Learning

  18. Unified Planning-Learning Framework for Robust UUV Navigation Under Partial Observability

    Aug 5, 2026Md Ether Deowan, Eleni KelasidiRL ControlPartially Observable RL

  19. Reward Structure Shapes the Interaction Between Episodic Exploration and Neural Memory in Reinforcement Learning

    Aug 5, 2026Jai Malegaonkar, Rohan Patil, Henrik I. ChristensenReinforcement LearningPartially Observable RL

  20. Minimal Markovization via Stable Quotients in Holonomy-Cover Decision Processes

    Jul 29, 2026Zuyuan Zhang, Yongshan Chen, Mahdi Imani +1Markov Decision ProcessesPartially Observable RL

  21. Reinforcement Learning on Cost-Constrained Quadrupedal Hardware

    Jul 29, 2026Javier C. Weddington, Bence P. Ölveczky, Stephen A. BaccusDynamical SystemsReinforcement Learning

  22. Adaptive Undulatory Locomotion of Snake-like Robots in Dynamic Viscous Environments via Deep Reinforcement Learning

    Jul 24, 2026Tsuyoshi Kimoto, Akio Yamano, Kohei Honda +1Partially Observable RLRobotic RL

  23. Dreamer-CPC: Message Learning with World Models for Decentralized Multi-agent Reinforcement Learning

    Jul 22, 2026Taisuke Takayama, Naoto Yoshida, Tadahiro TaniguchiPredictive CodingPartially Observable RL

  24. Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making

    Jul 21, 2026Yuyang Shen, Shan Dai, Daimin ChenNon-Stationary RLSequential Decision Making

  25. Neuro-Symbolic Meta-Policies for Temporal Knowledge-Graph Memory under Partial Observability

    Jul 20, 2026Taewoon Kim, Vincent François-Lavet, Michael CochezReinforcement LearningPartially Observable RL

  26. Reward-Driven LLM Agent Workflows: Synthesizing POMDP Routing and Self-Correction for Autonomous Decision-Making

    Jul 19, 2026Amez Amanj Ali, Kuo-Kun TsengReward ModelingLLM Self-Correction