Fine-Grained Credit Assignment

Latest papers 32

All topics
CardsList
  1. My FAULT: Self-Diagnosis as Credit Assignment in Self-Evolving Agentic Reinforcement Learning

    Oct 1, 2026Yihua Zhu, Qianying Liu, Weixu Qiao +10Agentic RLCredit Assignment in RL

  2. SCA: Spatial Credit Assignment for Reinforcement Learning of GUI Agents

    Sep 29, 2026Shengtian Yang, Ziyu Xiong, Kaibing Yang +6Reinforcement LearningRL for GUI Agents

  3. Targeting Pivotal Decisions for Credit Assignment in Agentic Reinforcement Learning

    Sep 28, 2026Dongwon Jung, Hemanth Neelgund Ramesh, Yifan Wang +7Agentic RLGroup Relative Policy Optimization

  4. From Interests to Semantic IDs: Retrieval-Grounded Credit Assignment for Generative Recommendation

    Sep 24, 2026Mengdan Zhu, Yufan Zhao, Yao Zhao +5Semantic ID RecommendationCredit Assignment

  5. From Citations to Contributions: LLM-Assisted Credit Scoring of Research Articles

    Sep 7, 2026Sana Ebrahimi, Suraj Shetiya, Abolfazl AsudehImportance WeightingBibliometric Analysis

  6. DRACO: Fine-Grained Credit Assignment with Dynamic Rubrics for Long-Horizon Agent Training

    Sep 3, 2026Shubham Gandhi, Saurabh Goyal, Kiran Kate +1Agentic RLStep-Level Credit Assignment in RL

  7. How Much, Then Where: Credit-Conserving Action-to-Token Allocation for Multi-Turn Agent Reinforcement Learning

    Aug 7, 2026Lichao Ma, Yang Sun, Shuaitao Zhao +9Token-Level Credit AssignmentCredit Assignment in RL

  8. Shared Prefixes, Better Credit: Adaptive Routing for Multi-Agent Reasoning

    Aug 3, 2026Yiqing Liu, Zihao Wang, Hantao Yao +2Adaptive Model RoutingMulti-Agent Collaboration

  9. MARS-RA: Rank Aggregation for Credit Assignment via Multimodal Comparisons in Embodied Multi-Agent Cooperation

    Jul 30, 2026Dawei Wang, Di Zhao, Xinyuan Liu +5Credit Assignment in RLCooperative MARL

  10. MJ: Multi-turn LLM Jailbreaking via Decomposed Credit Assignment

    Jul 13, 2026Junyoung Park, Namgyu Park, Sechan Lee +3RL for Language ModelsLLM Jailbreak Attacks

  11. TRIAGE: Role-Typed Credit Assignment for Agentic Reinforcement Learning

    Jun 30, 2026Yuanda Xu, Zhengze Zhou, Hejian Sang +6Agentic RLStep-Level Credit Assignment in RL

  12. Towards Value-Constrained Credit Assignment in Fully Delegated AI Cooperatives

    Jun 26, 2026Young Yoon, Jimin Kim, Soyeon ParkGradient-Based AttributionValue Alignment

  13. The Weakest Link Tells It All: Outcome-Supervised Process Reward Modeling via Learnable Credit Assignment

    Jun 26, 2026Tianyu Jia, Yue Fang, Hongxin Ding +6Process Reward ModelsFine-Grained Credit Assignment

  14. Attributed, But Not Incremental: Cannibalization-Corrected Attribution for Large-Scale Advertising

    Jun 25, 2026Donghui Li, Bowen Yuan, Zili Yang +2Causal Effect EstimationOnline Advertising

  15. Blame is easier than praise: Measuring off-ball defensive performance in football

    Jun 18, 2026Jonas Bischofberger, Runqing Ma, Pascal Bauer +2Automated EvaluationFine-Grained Credit Assignment

  16. Beyond Trajectory Rewards: Step-level Credit Assignment for Agentic Search via Graph Modeling

    May 28, 2026Yuchen Liu, Yingjie Feng, Lixiong Qin +5Reward ModelingAgentic RL

  17. Credit-assigned Policy Gradient for Early Stage Retrieval in Two-stage Ranking

    May 25, 2026Haruka Kiyohara, Mihaela Curmei, Ariel Evnine +7Learning to RankInformation Retrieval

  18. Credit Assignment with Resets in Language Model Reasoning

    May 25, 2026Ankur Samanta, Akshayaa Magesh, Ayush Jain +7RL for Language Model ReasoningCredit Assignment in RL

  19. Market Regime Council for Dynamic Credit Assignment in Multi-Agent LLM Decision Systems

    May 23, 2026Yunhua Pei, Zerui Ge, Jin Zheng +1Multi-Agent LLM SystemsMulti-Agent Systems

  20. Signal Reshaping for GRPO in Weak-Feedback Agentic Code Repair

    May 8, 2026Jia Li, Yuxin Su, Ting Peng +3RL for Code GenerationReward Shaping

  21. EXPO-SQL: Execution-based Clause-level Policy Optimization for Text-to-SQL

    Apr 29, 2026Jaehoon Lee, CheolWon Na, Suyoung Bae +4Reward ShapingText-to-SQL

  22. Stabilizing Efficient Reasoning with Step-Level Advantage Selection

    Apr 27, 2026Han Wang, Xiaodong Yu, Jialian Wu +4RL for Language Model ReasoningEfficient Language Model Reasoning

  23. Hidden States Know Where Reasoning Diverges: Credit Assignment via Span-Level Wasserstein Distance

    Apr 25, 2026Xinzhu Chen, Wei He, Huichuan Fan +7Token-Level Credit AssignmentGroup Relative Policy Optimization

  24. Reducing Credit Assignment Variance via Counterfactual Reasoning Paths

    Apr 20, 2026Fei Ding, Yongkang Zhang, Youwei Wang +1RL for Language Model ReasoningCredit Assignment in RL