RL from Human Feedback

RL: Reinforcement Learning

Momentum

5 papers in the last four weeks, level with the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 84

All topics
CardsList
  1. A Scoping Review and Experimental Study on Reinforcement Learning from Human Feedback for Human-Robot Collaboration

    Oct 7, 2026Alexandra Coroiu, Andrea Vogt, Viktor Werbilo +3RL from Human FeedbackHuman-Robot Collaboration

  2. Constraint Tree Exploration for Learning from Language Feedback

    Oct 6, 2026Shaoang Li, Daniel R. Jiang, Jian LiRL ExplorationRL from Human Feedback

  3. EnGRICH: Enhancing Generative Reward Modeling with Critiques from Humans

    Oct 4, 2026Xuancheng Li, Beining Wang, Haitao Li +7Reward ModelingProcess Reward Models

  4. Robust Risk-Sensitive Reinforcement Learning from Corrupted Human Feedback

    Sep 30, 2026Xinyi Ni, Lifeng LaiRisk-Sensitive RLRobust RL

  5. ReF-HIL: Shaping the Critic around Human Action Neighborhoods for Efficient Human-in-the-Loop Reinforcement Learning

    Sep 29, 2026Shaoyin Luo, Song Wang, Shibo Xia +5RL for RoboticsReward Shaping

  6. Diffusion Reward Models

    Sep 27, 2026Xiangyang Wang, Bingxiang He, Zeyuan Liu +13Reward ModelingMultimodal Reward Modeling

  7. Subspace Inference Enables Efficient Active Reward Learning from Preferences

    Sep 3, 2026Yutai Zhou, Erdem BıyıkBayesian RLPreference Learning

  8. User Feedback Provides a Unique Signal that LLMs Can not Detect

    Sep 2, 2026Shachar Don-Yehiya, Leshem Choshen, Omri AbendLLM EvaluationRL from Human Feedback

  9. From Answers to Policies: Efficient In-Context Learning System through Emulating Expert Investigation

    Aug 17, 2026Minh-Ha Nguyen, Ngoc-Ngo Quang Tran, Thuy Dung Nguyen +1In-Context LearningIn-Context RL

  10. Learning from Online User Feedback for Shopping Agents

    Aug 12, 2026Haobo Zhang, Kelong Mao, Sulong Xu +2Large Language Model-Based RecommendationUser Preference Modeling

  11. Procedural Fairness Failures in RLHF from Preference Averaging

    Aug 10, 2026M P V S Gopinadh, Karthik Kamuju, Kummari Avinash +2Reward ModelingAlgorithmic Fairness

  12. LEMUR: Learning to Align with Multi-Objective Reinforcement Learning from Preference Feedback

    Jul 31, 2026Manith Adikari, Bei Peng, Samuele Vinanzi +1Multi-Objective Reinforcement LearningReinforcement Learning

  13. An offline approach to fNIRS-guided reinforcement learning for robot behavior

    Jul 15, 2026Julia Santaniello, Madelaine Brower, Benson Jiang +3Reinforcement LearningRobot Learning

  14. RENEW: Towards Learning World Models and Repairing Model Exploitation from Preferences

    Jul 15, 2026Logan Mondal Bhamidipaty, Mykel Kochenderfer, Subramanian RamamoorthyWorld Model LearningOffline RL

  15. Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning

    Jul 9, 2026Ali Larian, Qian Lin, Chang Zong Wu +1Reinforcement LearningHuman-in-the-Loop AI

  16. Attention Limited Reward Learning

    Jul 6, 2026Wenqian XingPairwise Preference LearningReward Modeling

  17. Human-Centric Reflective Architecture for Human-AI Collaborative Decision-Making

    Jul 3, 2026Andreas Kouridakis, Dimitrios Patiniotis Spyropoulos, George VourosHuman Preference ModelingHuman-in-the-Loop AI

  18. PS-PPO: Prefix-Sampling PPO for Critic-Free RLHF

    Jun 29, 2026Doo Hwan Hwang, Kee-Eung KimReinforcement LearningRL for Language Model Reasoning

  19. Qwen-Image-2.0-RL Technical Report

    Jun 25, 2026Yixian Xu, Kaiyuan Gao, Yuxiang Chen +25Reward ModelingRL for Diffusion Models

  20. Retroactive Advantage Correction: Closed-Form V-Trace Bias Correction for Delay-Aware RLHF

    Jun 25, 2026Arnav RajAsynchronous RLReinforcement Learning

  21. PEBS: Per-rater Empirical-Bayes Shrinkage for RLHF Reward-Model Calibration

    Jun 25, 2026Arnav RajReward ModelingPost-Hoc Calibration

  22. Sculpting NeRF Geometry: Human-Preference Fine-Tuning of a 3D-Aware Face GAN

    Jun 25, 2026Archer Moore, Mingming Gong, Liam Hodgkinson3D Shape GenerationRL for Generative Models

  23. Themis: An explainable AI-enabled framework for Reinforcement Learning with Human Feedback

    Jun 23, 2026Andreas Chouliaras, Luke Connolly, Dimitris ChatzpoulosReward ModelingHuman-in-the-Loop AI

  24. AI Alignment From Social Choice Perspectives

    Jun 19, 2026Daniel Halpern, Evi Micha, Ariel D. Procaccia +3LLM AlignmentAI Alignment

  25. Uncertainty-Aware Reward Modeling for Stable RLHF

    Jun 18, 2026Licheng Pan, Haocheng Yang, Haoxuan Li +7Reward ModelingReward Hacking

  26. Generating Natural and Expressive Robot Gestures through Iterative Reinforcement Learning with Human Feedback using LLMs

    Jun 17, 2026Chris Lee, Flora Salim, Benjamin Tag +1Language Model-Based ControlHuman Motion Generation

  27. ROVE: Unlocking Human Interventions for Humanoid Manipulation via Reinforcement Learning

    Jun 15, 2026Wei Xiao, Weiliang Tang, Yuying Ge +4RL for RoboticsRobotic Manipulation

  28. Hidden Consensus:Preference-Validity Compression in Human Feedback

    Jun 9, 2026Dorcas Chia Ern Chua, Karen Myn Hui Lee, Jia Yue Tan +9Human Preference ModelingPreference Alignment