Rubric-Guided Generation

Latest papers 30

All topics
CardsList
  1. Rubric-Based Optimization for Text-to-Music Generation

    Oct 2, 2026Ping Wang, Guang Yang, Shao-Rong Su +3Text-to-Music GenerationRubric-Based RL

  2. Scoring Higher, Answering Worse: Mitigating Reward Hacking in Rubric-Based RL via Protocol-Level Rubrics

    Sep 30, 2026Maoqi Liu, Junwei He, Bowen Zhang +5Reward HackingRubric-Based RL

  3. Mubric: Mutation Testing-Guided Rubric Generation for LLM Evaluation

    Sep 29, 2026Jiayuxuan Yang, Jie M. Zhang, Yiling Lou +1Language Model Generation EvaluationRubric-Based Evaluation

  4. FinAutoRubric: Expert-Guided Automatic Rubric Generation for Evaluating Financial Research Agents

    Sep 28, 2026Hoyoung Lee, Suyeol Yun, Jack Haverty +17LLM Agent EvaluationRubric-Based Evaluation

  5. Rubric-Aware On-Policy Self-Distillation for LLM Personalization

    Sep 28, 2026Yilun Qiu, Xiaoyan Zhao, Chengbing Wang +6LLM PersonalizationOn-Policy Self-Distillation

  6. PaperGym: Rubric-Centered Evolution for Research-Plan Generation

    Aug 31, 2026Yuhan Wang, Zhengxi Lu, Yuchen Yan +6AI Agents for Scientific DiscoveryRubric-Based RL

  7. Learning to Evaluate Before Improving: Automatic Rubric Induction for Automatic Research Agents

    Aug 31, 2026Xuehai Wang, Haowei Qin, Tongxin Liu +6AI Agent EvaluationAutonomous Scientific Discovery

  8. GenRubric: Self-Evolving Rubric Generation for Scalable LLM Evaluation

    Aug 30, 2026Yifan Chen, Haitao Li, Qingyao Ai +4LLM-as-a-JudgeLanguage Model Generation Evaluation

  9. Rubric-to-Code Credit Assignment for Reinforcement Learning

    Aug 28, 2026Rui Jin, Jikai Chen, Yihan Chen +6RL for Code GenerationCode Generation

  10. Rubric Dropout: A Simple Way to Mitigate Reward Hacking in Rubric-as-Reward RL

    Aug 12, 2026Minglai Yang, Xinyu Guo, Utkarsh Tyagi +6Reward HackingRubric-Based RL

  11. ConRub-Med: Reinforcement Learning with Consensus Rubrics for Open-Ended Medical Question Answering

    Aug 11, 2026Taojie Zhu, Yuan Xia, Tao Sun +8Rubric-Based RLMedical QA

  12. RISE-RL: Rubric-Informed Selective Exploration for Open-Ended Reinforcement Learning

    Aug 10, 2026Jinkun Hou, Zhuo Liu, Huimin Ren +3Open-Ended GenerationRL for Language Models

  13. CriPO: Enhancing Rubric-based RL via Self-Distillation

    Jul 20, 2026Mingxuan Xia, Yuhang Yang, Chao Ye +7Credit Assignment in RLRubric-Based RL

  14. Can LLMs Write Reliable Rubrics? A Meta-Evaluation for Experiment Reproduction

    Jul 14, 2026Hanhua Hong, Yizhi Li, Jiaoyan Chen +4LLM EvaluationRubric-Based Evaluation

  15. EvoRubrics: Dynamic Rubrics as Rewards via Adversarial Co-Evolution for LLM Reinforcement Learning

    Jun 22, 2026Hongxin Ding, Baixiang Huang, Yue Fang +6RL for Language ModelsRubric-Based RL

  16. DEEPRUBRIC: Evidence-Tree Rubric Supervision for Efficient Reinforcement Learning of Deep Research Agents

    Jun 15, 2026Minghang Zhu, Chuyang Wei, Junhao Xu +3Deep Research AgentsRubric-Based RL

  17. Support Vector Rubrics: Closing the Gap Between Self-Generated and Human Rubrics

    Jun 6, 2026Mengyuan Sun, Yu Li, Zhuohao Yu +2Reward ModelingRubric-Based Evaluation

  18. Deep Research as Rubric for Reinforcement Learning

    May 31, 2026Wangyi Mei, Zhouhong Gu, Zhenhan Bai +9Open-Ended GenerationReinforcement Learning

  19. EvoRubric: Self-Evolving Rubric-Driven RL for Open-Ended Generation

    May 28, 2026Xin Guan, Xiaomeng Hu, Shen Huang +6Open-Ended GenerationRL for Language Models

  20. Tournament-GRPO: Group-Wise Tournament Rewards for Reinforcement Learning in Open-Ended Long-Form Generation

    May 26, 2026Zixuan Yang, Yiqun Chen, Wei Yang +7Open-Ended GenerationReward Modeling

  21. Co-ReAct: Rubrics as Step-Level Collaborators for ReAct Agents

    May 22, 2026Jiazheng Kang, Bowen Zhang, Zixin Song +4Deep Research AgentsAgentic Reasoning

  22. When Reasoning Supervision Hurts: TTCW-Based Long-Form Literary Review Generation

    May 19, 2026Jinlong Liu, Mohammed Bahja, Mark LeeSupervised Fine-TuningCreativity Assessment

  23. Not Every Rubric Teaches Equally: Policy-Aware Rubric Rewards for RLVR

    May 19, 2026Utkarsh Tyagi, Xingang Guo, MohammadHossein Rezaei +5Reward ModelingRubric-Based RL

  24. Step-wise Rubric Rewards for LLM Reasoning

    May 17, 2026Weichu Xie, Haozhe Zhao, Wenpu Liu +15Reward ModelingCredit Assignment in RL

  25. RubricEM: Meta-RL with Rubric-guided Policy Decomposition beyond Verifiable Rewards

    May 11, 2026Gaotang Li, Bhavana Dalvi Mishra, Zifeng Wang +9Reinforcement LearningRubric-Based RL

  26. Think-with-Rubrics: From External Evaluator to Internal Reasoning Guidance

    May 8, 2026Jiachen Yu, Zhihao Xu, Junjie Wang +1Instruction FollowingRubric-Based Evaluation

  27. Learning Query-Specific Rubrics from Human Preferences for DeepResearch Report Generation

    Feb 3, 2026Changze Lv, Jie Zhou, Wentao Zhao +14Rubric-Guided GenerationDeep Research Agents