Multiple-Choice Question Answering

Also known as MCQA

Momentum

7 papers in the last four weeks, up 75% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 27

All topics
CardsList
  1. Penalty-Framed No-Valid-Option MCQA: Analyzing LLM Abstention under Invalid Choices

    Oct 6, 2026Jinhyeok Kim, Hye-Young JungLLM EvaluationMultiple-Choice Question Answering

  2. AnyJev Technical Report

    Sep 30, 2026Jiamu Zhang, Tianze Yang, Yucheng Shi +6Multiple-Choice Question AnsweringLanguage Model Calibration

  3. Likelihood Ranking doesn't Scale Like Prompting in LLMs

    Sep 24, 2026Alessandro Bondielli, Lucia Passaro, Davide Bacciu +1LLM EvaluationLanguage Model Generation Evaluation

  4. Option-Aware Retrieval and Task-Specific VLM Adaptation for Medical VQA

    Sep 14, 2026Tristan Kirscher, Niklas C. Koser, Soren PirkVLM AdaptationMultiple-Choice Question Answering

  5. Turkish MMLU Pro: Traceable Option Augmentation and Its Validity Limits in Turkish Multiple-Choice Evaluation

    Sep 14, 2026M. Ali BayramMultilingual Language Model EvaluationLLM Evaluation

  6. EAR: Entity-Aware Partitioning Approach for Retrieval-Augmented Generation Development

    Sep 14, 2026Cenab Batu Bora, Oylum Alatl\i, Sebnem Bora +1Document ChunkingRetrieval-Augmented Generation

  7. When Models Defer to Wrong Answers: A Robustness Audit of Source-Attributed Cues in Multiple-Choice QA

    Sep 8, 2026Manikandan Ravikiran, Siddharth VohraMultiple-Choice Question AnsweringLLM Reliability

  8. StateSwap: Probing Support-Elimination Hidden States in Multiple-Choice Questions

    Sep 1, 2026Chao Gao, Haijiang Liu, Qiyuan Li +3Prompt SensitivityMultiple-Choice Question Answering

  9. Check The Scoreboard: An Analysis of Scoring Schemes on Multiple-Choice Evaluation

    Aug 30, 2026Nishant Balepur, Paiheng Xu, Wei Ai +3LLM EvaluationMultiple-Choice Question Answering

  10. Isotropy Cliffs: The Geometric Signature of Decision-Making in Large Language Models

    Aug 1, 2026Okan S. Coskun, Florian Rottach, Carsten Eickhoff +1Multiple-Choice Question AnsweringLLM Decision-Making

  11. Overview of FinMMEval 2026 Task 1: Multilingual Financial Multiple-Choice Question Answering

    Jul 22, 2026Zhuohan Xie, Yuyang Dai, Rania Elbadry +18Multilingual Language Model EvaluationMultiple-Choice Question Answering

  12. Persona Non Grata: LLM Persona-Driven Generations in MCQA are Unstable in Distinct Dimensions

    Jul 1, 2026César Guerra-Solano, Xiang Lorraine LiLLM EvaluationLanguage Model Generation Evaluation

  13. Are We Evaluating Knowledge or Phrasing? Mitigating MCQA Sensitivity with ParaEval

    Jun 9, 2026João Maria Janeiro, Mathurin Videau, Andrea Caciolai +3LLM EvaluationMultiple-Choice Question Answering

  14. Second Guess: Detecting Uncertainty Through Abstention and Answer Stability in Small Language Models

    May 25, 2026Ashwath Vaithinathan Aravindan, Mayank KejriwalConfidence Estimation in Language ModelsMultiple-Choice Question Answering

  15. Code-Guided Reasoning for Small Language Models: Evaluating Executable MCQA Scaffolds

    May 12, 2026Prateek Biswas, Dhaval Patel, Vedant Khandelwal +2Multiple-Choice Question AnsweringSmall Language Models

  16. Evaluating Large Language Models on Computer Science University Exams in Data Structures

    Apr 25, 2026Edan Gabay, Yael Maoz, Jonathan Stahl +7LLM EvaluationComputer Science Education

  17. Pushing the Boundaries of Multiple Choice Evaluation to One Hundred Options

    Apr 16, 2026Nahyun Lee, Guijin SonLLM EvaluationMultiple-Choice Question Answering

  18. Corpus Prevalence of Multiple-Choice Question Options

    Feb 19, 2026Leonidas Zotos, Hedderik van Rijn, Malvina NissimMultiple-Choice Question AnsweringGenerative AI in Education

  19. Robustness assessment of large audio language models in multiple-choice evaluation

    Oct 6, 2025Fernando López, Santosh Kesiraju, Jordi LuqueAudio-Language Model EvaluationAudio QA

  20. Listening to the Wise Few: Query-Key Alignment Unlocks Latent Correct Answers in Large Language Models

    Oct 3, 2024Eduard Tulchinskii, Kristian Kuznetsov, Laida Kushnareva +5Self-AttentionMultiple-Choice Question Answering