Rubric-Based Scoring

Momentum

1 paper in the last four weeks, against 1 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 28

All topics
CardsList
  1. Evaluating and Benchmarking the System One Model Jev

    Sep 29, 2026Tobias Deußer, Lorenz Sparrenberg, Rafet SifaNatural Language InferenceRubric-Based Scoring

  2. Comparative Validation of GPT-4o-mini and Teacher Mean Scores for Automated Scoring of Music Analysis Responses: Single-Pass Deployment, Repeatability, and Strategy-Specific Bias

    Aug 3, 2026Baicheng Lin, Lingxi Jin, Kyung-Seok MinRubric-Based ScoringScoring

  3. SciFigAlign: Scoring Scientific Figures by Fine-tuned Alignment of Visuals with Manuscript Evidence

    Jul 29, 2026Chuanzhi Xu, Zihan Deng, Huiqi Liang +4Scientific FigurePeer Review

  4. Earthquaker-AI: A Retrieval-Augmented Generation Framework with Rubric-Based Assessment for Primary School Earthquake Education

    Jul 15, 2026Xanthi Kokkinou, Chaido Mizeli, Nafsika Koulaxidou +2Artificial Intelligence EducationCrisis

  5. A rubric-based controlled comparison of frontier language models on expert-authored clinical reasoning tasks

    Jul 2, 2026Samiha A. Ismail, Fan X. Chen, Ali MeraliRubric-Based ScoringComparison

  6. Can LLM-as-a-Judge Reliably Verify Rubrics in Agentic Scenarios?

    Jun 29, 2026Yangda Peng, Yunjia Qi, Haotian Xia +8Rubric-Based ScoringLlm-As-A-Judge

  7. The Confident Liar: Diagnosing Multi-Agent Debate with Log-Probabilities and LLM-as-Judge

    Jun 9, 2026Ali Keramati, Justin Cheok, Jacob Horne +1Multi-Agent DebateDebate

  8. ComplexConstraints and Beyond: Expert Rubrics for RLVR

    Jun 8, 2026Sushant Mehta, Liudas Panavas, Suhaas Garre +1Rubric-Based ScoringInstruction-Tuned Models

  9. Proof-Refactor: Refactoring Generated Formal Proofs into Modular Artifacts

    Jun 2, 2026Yiming Fu, Peixuan Liu, Zichen Wang +1Theorem ProvingProof

  10. Learnable Assessment Skills for LLM-based Automated Scoring: Rubric Construction via Iterative Optimization

    May 28, 2026Yun Wang, Xin Xia, Xuansheng Wu +2Rubric-Based ScoringTask-Specific Rubrics

  11. JudgmentBench: Comparing Rubric and Preference Evaluation for Quality Assessment

    May 24, 2026Russell Yang, Ruishi Chen, Pierce Kelaita +6Rubric-Based ScoringModel Judgments

  12. Not Every Rubric Teaches Equally: Policy-Aware Rubric Rewards for RLVR

    May 19, 2026Utkarsh Tyagi, Xingang Guo, MohammadHossein Rezaei +5Rubric-Based ScoringReward Functions

  13. Step-wise Rubric Rewards for LLM Reasoning

    May 17, 2026Weichu Xie, Haozhe Zhao, Wenpu Liu +15Reinforcement Learning With Verifiable RewardRubric-Based Scoring

  14. RETUYT-INCO at BEA 2026 Shared Task 2: Meta-prompting in Rubric-based Scoring for German

    May 11, 2026Ignacio Sastre, Ignacio Remersaro, Facundo Díaz +4Rubric-Based Scoring

  15. DeltaRubric: Generative Multimodal Reward Modeling via Joint Planning and Verification

    May 10, 2026Rui Liu, Dian Yu, Zhenwen Liang +6Rubric-Based ScoringVisual Reasoning

  16. Rubric-Grounded RL: Structured Judge Rewards for Generalizable Reasoning

    May 8, 2026Manish Bhattarai, Ismael Boureima, Nishath Rajiv Ranasinghe +2Rubric-Based ScoringReasoning Benchmark

  17. Prosa: Rubric-Based Evaluation of LLMs on Real User Chats in Brazilian Portuguese

    May 2, 2026Roseval Malaquias Junior, Giovana Kerche Bonás, Thales Sales Almeida +6Llm-As-A-JudgeRubric-Based Scoring

  18. WaferSAGE: Large Language Model-Powered Wafer Defect Analysis via Synthetic Data Generation and Rubric-Guided Reinforcement Learning

    Apr 30, 2026Ke Xu, Zhongyuan LianSynthetic DataRubric-Based Scoring

  19. Bootstrapping Post-training Signals for Open-ended Tasks via Rubric-based Self-play on Pre-training Text

    Apr 21, 2026Chengyu Huang, Sheng-Yen Chou, Zhengxin Zhang +1Self-PlayPost-Training

  20. From Scoring to Explanations: Evaluating SHAP and LLM Rationales for Rubric-based Teaching Quality Assessment

    Apr 18, 2026Ivo Bueno, Babette Bühler, Philipp Stark +5Rubric-Based ScoringFree-Form Textual Rationales

  21. The Hitchhikers Guide to Rubric Quality Understanding and Enrichment

    Apr 1, 2026Ankit Aich, Zhengyang Qi, Charles Dickens +7Rubric-Based ScoringRubrics

  22. Learning in Blocks: A Multi Agent Debate Assisted Personalized Adaptive Learning Framework for Language Learning

    Mar 29, 2026Nicy Scaria, Silvester John Joseph Kennedy, Deepak SubramaniMultilingual AgentsMulti-Agent Debate

  23. From Rubrics to Reliable Scores: Evidence-Grounded Text Evaluation with LLM Judges

    Jan 13, 2026Yihan Hong, Huaiyuan Yao, Bolin Shen +3Rubric-Based ScoringRubrics