Pairwise Ranking

Momentum

2 papers in the last four weeks, against 2 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 50

All topics
CardsList
  1. JudgmentBench: Comparing Rubric and Preference Evaluation for Quality Assessment

    May 24, 2026Russell Yang, Ruishi Chen, Pierce Kelaita +6Human Preference EvaluationLLM Evaluation

  2. Entrywise Error Bounds for Spectral Ranking with Semi-Random Adversaries

    May 22, 2026Dongmin Lee, Anuran Makur, Japneet SinghLearning to RankPairwise Ranking

  3. RankJudge: A Multi-Turn LLM-as-a-Judge Synthetic Benchmark Generator

    May 20, 2026Zhenwei Tang, Zhaoyan Liu, Rasa Hosseinzadeh +3LLM EvaluationPairwise Comparison

  4. VersusQ: Pairwise Margin Reasoning for Generalizable Video Quality Assessment

    May 20, 2026Shibei Meng, Binxin Yang, Yuan Liu +4Pairwise ComparisonLearning to Rank

  5. Preferences Order, Ratings Anchor: From Fused Expert Aesthetic Ground Truth to Self-Distillation

    May 19, 2026Yuanpei Zhao, Jie Lin, Chao Zhang +5Pairwise Preference LearningPersonalized Image Aesthetics Assessment

  6. A Unified Perturbation Framework for Analyzing Leaderboard Stability and Manipulation

    May 15, 2026Hosna Oyarhoseini, Jimmy Lin, Amir-Hossein KarimiLLM EvaluationLearning to Rank

  7. Active Learners as Efficient PRP Rerankers

    May 14, 2026Jeremías Figueiredo Paschmann, Juan Kaplan, Francisco Nattero +3Pairwise Preference LearningPairwise Comparison

  8. TokenRatio: Principled Token-Level Preference Optimization via Ratio Matching

    May 12, 2026Truong Nguyen, Tien-Phat Nguyen, Linh Ngo Van +3Pairwise Preference LearningLLM Alignment

  9. Why Global LLM Leaderboards Are Misleading: Small Portfolios for Heterogeneous Supervised ML

    May 7, 2026Jai Moondra, Ayela Chughtai, Bhargavi Lanka +1Multilingual Language Model EvaluationLLM Evaluation

  10. Pair2Score: Pairwise-to-Absolute Transfer for LLM-Based Essay Scoring

    May 3, 2026İbrahim Rıza Hallaç, Hasan OğulPairwise Preference LearningPairwise Comparison

  11. Explanation Quality Assessment as Ranking with Listwise Rewards

    Apr 27, 2026Thomas Bailleux, Tanmoy Mukherjee, Emmanuel Lonca +2Reward ModelingLearning to Rank

  12. Preferences of a Voice-First Nation: Large-Scale Pairwise Evaluation and Preference Analysis for TTS in Indian Languages

    Apr 23, 2026Srija Anand, Ashwin Sankar, Ishvinder Sethi +10Pairwise Preference LearningHuman Preference Evaluation

  13. Beyond Logit Adjustment: A Residual Decomposition Framework for Long-Tailed Reranking

    Apr 2, 2026Zhanliang Wang, Hongzhuo Chen, Quan Minh Nguyen +2Long-Tailed ClassificationLearning to Rank

  14. Aligning Language Model Benchmarks with Pairwise Preferences

    Feb 2, 2026Marco Gutierrez, Xinyi Leng, Hannah Cyberey +3LLM EvaluationLearning to Rank

  15. Dropping Just a Handful of Preferences Can Change Top Large Language Model Rankings

    Aug 16, 2025Jenny Y. Huang, Yunyi Shen, Dennis Wei +1Pairwise Preference LearningLLM Evaluation

  16. Pairwise Comparisons without Stochastic Transitivity: Model, Theory and Applications

    Jan 13, 2025Sze Ming Lee, Yunxiao ChenPairwise ComparisonPairwise Preference Evaluation