Sequential Decision Making

Latest papers 101

All topics
CardsList
  1. Transformers as Bayesian In-Context Experimenters: Smoothness-Adaptive Efficient ATE Estimation

    Jun 30, 2026Jiachun Li, David Simchi-LeviCausal Effect EstimationTransformer

  2. Uncertainty-Aware Sequential Decision Rules for Event-Triggered LLM Invocation in Streaming Systems

    Jun 27, 2026Zhaohui WangSequential Decision MakingCost-Aware Inference

  3. Asymptotically Optimal Learning for Parametric Prophet Inequalities

    Jun 25, 2026Jung-hun Kim, Anna Grebennikova, Vianney PerchetSequential Decision MakingOptimal Stopping

  4. AdaReP:Adaptive Re-Planning under Model Mismatch for Neural World-Model Predictive Control

    Jun 22, 2026Yutian Cheng, Xiaojian Ma, Xianhao Wang +6World Models for RoboticsSequential Decision Making

  5. Beyond the Current Observation: Evaluating Multimodal Large Language Models in Controllable Non-Markov Games

    Jun 17, 2026Shengyuan Ding, Xilin Wei, Xinyu Fang +4Multimodal MemorySequential Decision Making

  6. Fair Online Resource Allocation

    Jun 17, 2026Christopher En, Yuri Faenza, Andrea Lodi +1Sequential Decision MakingFair Resource Allocation

  7. Continuous-time Optimal Stopping through Deep Reinforcement Learning

    Jun 16, 2026Cosmin Borsa, Michael LudkovskiQuantitative FinanceSequential Decision Making

  8. When Should a Robot Replan? Regret-Guided Update Scheduling in Time-Varying MDPs

    Jun 15, 2026Negin Musavi, Gokul Puthumanaillam, Ruben Hernandez +2Non-Stationary RLRobot Policy Adaptation

  9. Trading Utility for Dynamic Fairness in Multiple Resource Division with Sequential Demand

    Jun 9, 2026Kaiqi Jiang, Karim El Husseini, Wenzhe Fan +1Sequential Decision MakingFair Resource Allocation

  10. Decision-Calibrated Conformal Uncertainty for Pacing Decisions in Streaming Advertising

    Jun 8, 2026Prashant Shekhar, Caroline HowardSequential Decision MakingOnline Advertising

  11. Multi-Armed Bandits with Arriving Arms: Sequential Screening, Dynamic Regret, and Sublinear Guarantees

    Jun 8, 2026Deqi Zheng, Xiaoyang Xu, Yuhong YangMulti-Armed BanditsDynamic Regret Minimization

  12. Cross-Epoch Adaptive Rollout Optimization for RL Post-Training

    Jun 4, 2026Yiming Zong, Yige Wang, Jiashuo JiangSequential Decision MakingRL for Language Model Reasoning

  13. Dynamic Objective Selection with Safeguards and LLM Oversight for Financial Decision-Making

    Jun 2, 2026Keigo Sakurai, Takahiro Ogawa, Miki Haseyama +2Quantitative FinanceSequential Decision Making

  14. Two-Fidelity Best-Action Identification for Stochastic Minimax Tree

    Jun 1, 2026Peter Chen, Xi ChenMulti-Fidelity OptimizationMulti-Armed Bandits

  15. Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment

    May 31, 2026Xun Shen, Yuepeng Wang, Akifumi Wachi +13Reinforcement LearningSequential Decision Making

  16. Decision-focused learning for optimal PV-Battery scheduling

    May 27, 2026Joris Depoortere, Hussain Kazmi, Johan DriesenSequential Decision MakingTime Series Forecasting

  17. Balancing Plasticity and Stability with Fast and Slow Successor Features

    May 25, 2026Raymond Chua, Doina Precup, Blake RichardsStability-Plasticity DilemmaNon-Stationary RL

  18. FAST-ME: Foundation-aware Adaptive Stopping for Motion Estimation for Efficient IoT Video Analysis

    May 22, 2026Kakia Panagidi, Stathes HadjieftymiadisSequential Decision MakingOptimal Stopping

  19. The Secretary Problem with a Stochastic Precursor

    May 21, 2026Franziska Eberle, Alexander LindermayrSequential Decision MakingOptimal Stopping

  20. When to Switch, Not Just What: Transition Quality Prediction in Clash Royale

    May 21, 2026Heeyun Heo, Huy Kang KimSequential Decision Making

  21. D3^3-Subsidy: Online and Sequential Driver Subsidy Decision-Making for Large-Scale Ride-Hailing Market

    May 19, 2026Taijie Chen, Rui Su, Siyuan Feng +6Diffusion-Based PlanningSequential Decision Making

  22. Learning to Hand Off: Provably Convergent Workflow Learning under Interface Constraints

    May 18, 2026Jiayu Li, Enpei Zhang, Dawei Zhou +2Sequential MARLSequential Decision Making

  23. Delay-Adaptive Speculation Control for Low-Latency Edge-Cloud LLM Inference

    May 17, 2026Kangkang Sun, Jianhua Li, Xiuzhen Chen +2Sequential Decision MakingOptimal Stopping

  24. Lifelong LaCAM with Local Guidance for Lifelong MAPF

    May 16, 2026Tomoki Arita, Keisuke OkumuraSequential Decision MakingRobust MAPF

  25. Boundedly Rational Meta-Learning in Sequential Consumer Choice

    May 15, 2026Mehrzad Khosravi, Max Kleiman-Weiner, Hema YoganarasimhanMeta-LearningSequential Decision Making

  26. Adaptive mine planning under geological uncertainty: A POMDP framework for sequential decision-making

    May 13, 2026Hamza Khalifi, Jef Caers, Yassine Taha +2Sequential Decision MakingPartially Observable Markov Decision Processes