Process Reward Model

Latest papers 69

All topics
CardsList
  1. rePIRL: Learn PRM with Inverse RL for LLM Reasoning

    Feb 8, 2026Xian Wu, Kaijie Zhu, Ying Zhang +2Process Reward ModelLarge Language Model Reinforcement Learning

  2. SCRIBE: Structured Mid-Level Supervision for Tool-Using Language Models

    Jan 7, 2026Yuxuan Jiang, Francis FerraroProcess Reward ModelProcess-Level Supervision

  3. ScalePRM: Training Process Reward Models by Scaling Verification Compute Without Ground Truth

    Dec 2, 2025Salman Rahman, Sruthi Gorantla, Arpit Gupta +3Process Reward ModelMathematical Reasoning Benchmarks

  4. Who Gets the Reward & Who Gets the Blame? Evaluation-Aligned Training Signals for Multi-LLM Agents

    Nov 11, 2025Chih-Hsuan, Yang, Tanwi Mallick +5Multi-Llm AgentsProcess Reward Model

  5. MASPRM: Multi-Agent System Process Reward Model

    Oct 28, 2025Milad Yazdani, Mahdi Mostajabdaveh, Zirui Zhou +1Process Reward ModelBeam Search

  6. Rethinking Reward Models for Multi-Domain Test-Time Scaling

    Oct 1, 2025Dong Bok Lee, Seanie Lee, Sangwoo Park +12Process Reward ModelLLM Reasoning Strategies

  7. GUI-PRA: Process Reward Agent for GUI Tasks

    Sep 27, 2025Tao Xiong, Xavier Hu, Yurun Chen +6Process Reward Model

  8. TagPR: Tag-Guided Process Supervision for Personalization Reasoning in Large Language Models

    Sep 27, 2025Song Jin, Juntian Zhang, Ruyu Lyu +7PersonalizationProcess Reward Model

  9. The Bidirectional Process Reward Model

    Aug 3, 2025Lingyin Zhang, Jun Gao, Xiaoxue Ren +1Process Reward ModelLLM Reasoning Strategies