Partially Observable Markov Decision Processes

Latest papers 53

All topics
CardsList
  1. Know You Before You Speak: User-State Modeling for LLM Personalization in Multi-Turn Conversation

    May 23, 2026Jiani Luo, Xiaoyan Zhao, Yang Zhang +4LLM PersonalizationUser Modeling

  2. Scaling Observation-aware Planning in Uncertain Domains

    May 21, 2026Adrian Zvizdenco, Arthur Conrado Veiga Bosquetti, Alberto Lluch Lafuente +1Partially Observable Markov Decision Processes

  3. Synthesizing POMDP Policies: Sampling Meets Model-checking via Learning

    May 14, 2026Debraj Chakraborty, Anirban Majumdar, Prince Mathew +2Formal VerificationPartially Observable Markov Decision Processes

  4. Learning POMDP World Models from Observations with Language-Model Priors

    May 13, 2026Valentin Six, Frederik Panse, Mathis Fajeau +7World Model LearningMarkov Models

  5. Adaptive mine planning under geological uncertainty: A POMDP framework for sequential decision-making

    May 13, 2026Hamza Khalifi, Jef Caers, Yassine Taha +2Sequential Decision MakingPartially Observable Markov Decision Processes

  6. Ensuring Logic in the Fog: Sound POMDP Synthesis with LTL Objectives

    May 12, 2026Can Zhou, Yulong Gao, Pian YuBelief-Space PlanningReward Shaping

  7. Missingness-MDPs: Bridging the Theory of Missing Data and POMDPs

    May 12, 2026Joshua Wendland, Markel Zubia, Roman Andriushchenko +6Markov ModelsLearning with Missing Data

  8. CLR-voyance: Reinforcing Open-Ended Reasoning for Inpatient Clinical Decision Support with Outcome-Aware Rubrics

    May 10, 2026Aishik Nagar, Arun-Kumar Kaliya-Perumal, Yu-Hsuan Han +5HealthcareClinical Decision Support

  9. Finite-Time Analysis of MCTS in Continuous POMDP Planning

    May 8, 2026Da Kong, Vadim IndelmanMonte Carlo Tree SearchPartially Observable Markov Decision Processes

  10. Multi-Environment POMDPs with Finite-Horizon Objectives

    May 8, 2026Léonard Brice, Filip Cano, Krishnendu Chatterjee +2Belief-Space PlanningMarkov Models

  11. The Context Gathering Decision Process: A POMDP Framework for Agentic Search

    May 7, 2026Chinmaya Kausik, Adith Swaminathan, Nathan KallusAgentic SearchLLM Agents

  12. Structural Equivalence and Learning Dynamics in Delayed MARL

    May 5, 2026Jules Sintes, Ana Bušić, Jiamin ZhuPartially Observable Markov Decision ProcessesCooperative MARL

  13. Optimal sequential decision-making for error propagation mitigation in digital twins

    Apr 24, 2026Annice Najafi, Shokoufeh MirzaeiMarkov Decision ProcessesPartially Observable Markov Decision Processes

  14. SLAM as a Stochastic Control Problem with Partial Information: Optimal Solutions and Rigorous Approximations

    Apr 23, 2026Ilir Gusija, Fady Alajaji, Serdar YükselSimultaneous Localization and MappingStochastic Optimal Control

  15. Robustness Analysis of POMDP Policies to Observation Perturbations

    Apr 23, 2026Benjamin Kraske, Qi Heng Ho, Federico Rossi +2Partially Observable Markov Decision Processes

  16. Interval POMDP Shielding for Imperfect-Perception Agents

    Apr 22, 2026William Scarbro, Ravi MangalSafety-Critical ControlAI Agent Safety

  17. POMDP-based Object Search with Growing State Space and Hybrid Action Domain

    Apr 16, 2026Yongbo Chen, Hesheng Wang, Shoudong Huang +1Mobile RoboticsMonte Carlo Tree Search

  18. Communication Gain and Delay Cost Under Cross-Timestep Delays in Cooperative Multi-Agent Reinforcement Learning

    Apr 4, 2026Zihong Gao, Hongjian Liang, Lei Hao +1Partially Observable Markov Decision ProcessesMulti-Agent Communication

  19. Fundamental Limits for Sensor-Based Control via the Gibbs Variational Principle

    Mar 19, 2026Vincent Pacelli, Evangelos A. TheodorouFeedback ControlPartially Observable Markov Decision Processes

  20. Toward Learning POMDPs Beyond Full-Rank Actions and State Observability

    Jan 26, 2026Seiji Shaw, Travis Manderson, Chad Kessens +1Partially Observable Markov Decision Processes