Learning Policy

Latest papers 35

All topics
CardsList
  1. Neuro-Symbolic Computer Use: Learning Reusable Policies for Reliable and Efficient Execution

    Sep 29, 2026Hyewon Suh, Thanh Minh Nguyen, Chih-Lun Lee +5Neuro-Symbolic FrameworkComputer-Use Agents

  2. Factorized Scheduling Principle: Learning Interpretable and Transferable Policies via Structured Additive Functions

    Sep 29, 2026Hong Je-Gal, Hyun-Suk LeeSchedulersSchedule

  3. Hyper Algorithm Design Agent: Evolving Learnable Optimizer from Zero

    Sep 28, 2026Zipei Yu, Yue-Jiao Gong, Zeyuan Ma +2Agentic OptimizationBlack-Box Optimization

  4. Learning-Guided Planning in Large Dynamic Action Spaces: Budgeted Tree Search for One-to-Many Mobile Charging

    Sep 15, 2026Liang-Ching Tao, Pi-Chung WangClassical PlanningLearning Policy

  5. Conformal Policy Learning with Distribution-Free Safety Guarantees

    Sep 15, 2026Ying Jin, Naoki EgamiLearning PolicyProbabilistic Safety

  6. Policy-Induced Hand Priors in Humanoid Dual-Arm Manipulation: Diagnosing and Mitigating Initial-Pose Dependence

    Aug 12, 2026Chaeyeon Jung, Juyoun ParkRobotic Manipulation PoliciesLearning Policy

  7. RoboSynChallenge: Mastering Real-World Dexterity via Generalizing Synthesized Manipulation Skills

    Aug 12, 2026Runyi Zhao, Ruixin Wu, Chengkun Li +15Robotic ManipulationDexterous Manipulation

  8. Let it Cook: Learning to Wait in Sequential Decision Making

    Aug 11, 2026Christopher Watson, Arjun Krishna, Dinesh Jayaraman +1Sequential Decision MakingLearning Policy

  9. Learning an Interior Layout Policy in a Domain Specific Language Action Space

    Jul 31, 2026Yuhao Lu, Weichen Zhang, Wenyi Xiao +23D Layout GenerationLayouts

  10. Sling2Sim2Real: One-Shot Elastic System Identification for Non-Destructive Slingshot Policy Learning

    Jul 25, 2026Wonjae Kang, Geonwoo Kim, Minseok Song +1Sim-To-Real Reinforcement LearningSim-To-Real Gap

  11. Automated Data Engineering and Feature Selection for the Case Study of Warpage Detection in Fused Deposition Modeling

    Jul 20, 2026Saleh Valizadeh Sotubadi, Nazanin Mahjourian, Vinh NguyenFeature SelectionShapley Additive Explanations

  12. Data and Learning Where it Matters for Contact-Rich Manipulation

    Jul 17, 2026Oliver Hausdörfer, Linus Schwarz, Gabor Marko +7Contact-Rich ManipulationRobotic Manipulation Policies

  13. Learning from Mistakes: Rollout-Retrieval Lifelong Policy Learning for Autonomous Driving

    Jun 29, 2026Cheng Gong, Haoyang Wang, Chao Lu +2Autonomous DrivingLearning Policy

  14. Efficient Adaptive Data Acquisition via Pretrained Belief Representations

    Jun 23, 2026Daolang Huang, Zhuoyue Huang, Conor Hassan +3Learning Policy

  15. Safe and Generalizable Hierarchical Multi-Agent RL via Constraint Manifold Control

    Jun 22, 2026Zihao Guo, Jianing Zhao, Ling Li +3Multi-Agent Reinforcement LearningSafety Constraints

  16. SQLConductor: Search-to-Policy Learning for Step-wise Text-to-SQL Orchestration

    Jun 22, 2026Yizhang Zhu, Zhangyang Peng, Boyan Li +1Text-To-SqlQueries

  17. Overcoming Imperfect Kinematics in Surgical Robotics Through Sim-to-Real Visuomotor Learning

    Jun 19, 2026Zhaoxuan Yan, Kaizhong Deng, Zhaoyang Jacopo Hu +2Surgical RobotsVisual Servoing

  18. Learning Policy from a Single Trajectory in Average-Reward Markov Decision Process

    Jun 15, 2026Jongmin Lee, Ernest K. Ryu, Vaneet AggarwalMarkov Decision ProcessesModel-Free

  19. Adversarial Vulnerabilities of Learned Telesurgery Policies

    Jun 10, 2026Shutong Jin, Ziyang Chen, Preethi Satish +3Surgical RobotsLearning Policy

  20. Learning to Assign Prediction Tasks to Agents with Capacity Constraints

    May 27, 2026Shang Wu, Saatvik Kher, Padhraic SmythLearning PolicyArtificial Intelligence Agents

  21. Set-Valued Policy Learning

    May 19, 2026Laura Fuentes-Vicente, Mathieu Even, Gaëlle Dormion +3Treatment AllocationLearning Policy

  22. Efficient Lookahead Encoding and Abstracted Width for Learning General Policies in Classical Planning

    May 18, 2026Michael Aichmüller, Simon Ståhlberg, Martin Funkquist +1Classical PlanningLearning Policy

  23. gym-invmgmt: An Open Benchmarking Framework for Inventory Management Methods

    May 12, 2026Reza Barati, Qinmin Vivian HuInventory ControlLearning Policy

  24. Kintsugi: Learning Policies by Repairing Executable Knowledge Bases

    May 10, 2026Teng Cao, Yu Deng, Hikaru Shindo +6Embodied AgentsLearning Policy

  25. Model-Based Proactive Cost Generation for Learning Safe Policies Offline with Limited Violation Data

    May 2, 2026Ruiqi Xue, Lei Yuan, Kainuo Cheng +2Safety ConstraintsLearning Policy

  26. Kernelized Advantage Estimation: From Nonparametric Statistics to LLM Reasoning

    Apr 30, 2026Shijin Gong, Kai Ye, Jin Zhu +3Large Language Model Reinforcement LearningLLM Reasoning Strategies

  27. VLANeXt: Recipes for Building Strong VLA Models

    Feb 20, 2026Xiao-Ming Wu, Bin Fan, Kang Liao +6Vision-Language-Action FrameworkLearning Policy

  28. Humanoid Everyday: A Comprehensive Robotic Dataset for Open-World Humanoid Manipulation

    Oct 9, 2025Zhenyu Zhao, Hongyi Jing, Xiawei Liu +7Large-Scale Robot Demonstration DatasetsHumanoid

  29. Sample Complexity of Linear Quadratic Regulator Without Initial Stability

    Feb 20, 2025Amirreza Neshaei Moghaddam, Alex Olshevsky, Bahman GharesifardLinear Quadratic RegulatorQ-Learning