Pairwise Comparison

Momentum

0 papers in the last four weeks, with none the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 70

All topics
CardsList
  1. Comparison Patrols on Drifting Orders: Certified Rank Maintenance, Evolving Planar Maxima, and Selection under Drifting Fitness

    Jun 12, 2026Faruk Alpay, Levent SariogluPairwise ComparisonEvolutionary Optimization

  2. LAUKIN: A Multi-jurisdictional Common Law Contract Dataset

    Jun 11, 2026Amrita Singh, Aditya Joshi, Jiaojiao Jiang +2Legal NLPPairwise Comparison

  3. Correct Looks Better: Pairwise Comparisons Reveal Accuracy Rankings

    Jun 8, 2026Mina Remeli, Moritz HardtPairwise ComparisonLLM-as-a-Judge

  4. Differences in Detection: Explainability Where it Matters

    Jun 5, 2026Johannes Theodoridis, Johannes Maucher, Andreas SchillingPairwise ComparisonObject Detection

  5. Bradley-Terry Rankings for Recommender Systems Across Dataset Taxonomies

    Jun 5, 2026Ekaterina Grishina, Stepan Kuznetsov, Askar Tsyganov +8Algorithm SelectionPairwise Comparison

  6. Language Models Compare Quantities Using Number-specific and Unit-specific Heuristics

    Jun 2, 2026Mutsumi Sasaki, Go kamoda, Ryosuke Takahashi +4Numerical Reasoning in Language ModelsLLM Evaluation

  7. Doing well with less! On Sampling Techniques for Empirical Pairwise Loss Estimation/Minimization

    Jun 1, 2026Louise Davy, Stephan Clémençon, Charlotte LaclauPairwise ComparisonImportance Sampling

  8. Reward Learning from Best-of-NN Preference Data: Targets, Tradeoffs, and Design Principles

    May 28, 2026Rattana Pukdee, Maria-Florina Balcan, Pradeep RavikumarPairwise Preference LearningReward Modeling

  9. Improving Selective Classification with Pairwise Queries for Binary Classification

    May 28, 2026Harsh Vardhan, Sunav Choudhary, Natwar Modani +1Pairwise ComparisonSelective Prediction

  10. Resolution Diagnostics for Paired LLM Evaluation

    May 28, 2026Anany KotawalaLLM EvaluationPairwise Comparison

  11. Preferred, Not Safer: Pairwise Preference Is a Poor Proxy for Clinical Safety

    May 25, 2026Fay Elhassan, David Sasu, Alexandra Kulinkina +2LLM Safety BenchmarksHuman Preference Evaluation

  12. SafetyRepro: Configuration-Conditional Rank Instability on Alignment Benchmarks

    May 25, 2026Yanhang Li, Zhichao Fan, Zexin ZhuangPairwise ComparisonPairwise Preference Evaluation

  13. JudgmentBench: Comparing Rubric and Preference Evaluation for Quality Assessment

    May 24, 2026Russell Yang, Ruishi Chen, Pierce Kelaita +6Human Preference EvaluationLLM Evaluation

  14. RankJudge: A Multi-Turn LLM-as-a-Judge Synthetic Benchmark Generator

    May 20, 2026Zhenwei Tang, Zhaoyan Liu, Rasa Hosseinzadeh +3LLM EvaluationPairwise Comparison

  15. VersusQ: Pairwise Margin Reasoning for Generalizable Video Quality Assessment

    May 20, 2026Shibei Meng, Binxin Yang, Yuan Liu +4Pairwise ComparisonLearning to Rank

  16. Preferences Order, Ratings Anchor: From Fused Expert Aesthetic Ground Truth to Self-Distillation

    May 19, 2026Yuanpei Zhao, Jie Lin, Chao Zhang +5Pairwise Preference LearningPersonalized Image Aesthetics Assessment

  17. CAPS: Cascaded Adaptive Pairwise Selection for Efficient Parallel Reasoning

    May 15, 2026Fangzhou Lin, Shuo Xing, Peiran Li +6Pairwise ComparisonPairwise Preference Evaluation

  18. OpenDeepThink: Parallel Reasoning via Bradley-Terry Aggregation

    May 14, 2026Shang Zhou, Wenhao Chai, Kaiyuan Liu +3Pairwise ComparisonTest-Time Optimization

  19. Generalized Priority-Aware Shapley Value

    May 14, 2026Kiljae Lee, Ziqi Liu, Weijing Tang +1Pairwise ComparisonGame Theory

  20. Active Learners as Efficient PRP Rerankers

    May 14, 2026Jeremías Figueiredo Paschmann, Juan Kaplan, Francisco Nattero +3Pairwise Preference LearningPairwise Comparison

  21. Efficient Ensemble Selection from Binary and Pairwise Feedback

    May 10, 2026Tzeh Yuan Neoh, Nicholas Teh, Je Qin Chooi +2Pairwise ComparisonPairwise Preference Evaluation

  22. Sufficient conditions for a Heuristic Rating Estimation Method application

    May 9, 2026Jacek Szybowski, Konrad Kułakowski, Jiri MazurekPairwise ComparisonPairwise Preference Evaluation

  23. Why Global LLM Leaderboards Are Misleading: Small Portfolios for Heterogeneous Supervised ML

    May 7, 2026Jai Moondra, Ayela Chughtai, Bhargavi Lanka +1Multilingual Language Model EvaluationLLM Evaluation