Question Answering

Also known as QA

Momentum

23 papers in the last four weeks, up 28% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 165

All topics
CardsList
  1. Domain Fine-Tuning vs. Retrieval-Augmented Generation for Medical Multiple-Choice Question Answering: A Controlled Comparison at the 4B-Parameter Scale

    Apr 26, 2026Avi-ad Avraam BuskilaRetrieval-Augmented GenerationHealthcare

  2. Evaluating Large Language Models on Computer Science University Exams in Data Structures

    Apr 25, 2026Edan Gabay, Yael Maoz, Jonathan Stahl +7LLM EvaluationComputer Science Education

  3. EverydayGPT: Confidence-Gated Routing for Efficient and Safe Hybrid GPT-RAG Conversational QA

    Apr 24, 2026Jaspreet Singh NahalLLM Inference EfficiencyRetrieval-Augmented Generation

  4. STRIDE: Strategic Iterative Decision-Making for Retrieval-Augmented Multi-Hop Question Answering

    Apr 19, 2026Wei Chen, Lili Zhao, Zhi Zheng +2Multi-Hop QASelf-Training for Language Models

  5. BAGEL: Benchmarking Animal Knowledge Expertise in Language Models

    Apr 17, 2026Jiacheng Shen, Masato Hagiwara, Milad Alizadeh +9LLM EvaluationQuestion Answering

  6. CoPA: Benchmarking Personalized Question Answering with Data-Informed Cognitive Factors

    Apr 16, 2026Hang Su, Zequn Liu, Chen Hu +3LLM PersonalizationQuestion Answering

  7. Indirect Question Answering in English, German and Bavarian: A Challenging Task for High- and Low-Resource Languages Alike

    Mar 16, 2026Miriam Winkler, Verena Blaschke, Barbara PlankQuestion AnsweringMultilingual QA

  8. Agentic Very Long Video Understanding

    Jan 26, 2026Aniket Rege, Arka Sadhu, Yuliang Li +5Question AnsweringEgocentric Video Understanding

  9. OGD4All: A Framework for Accessible Interaction with Geospatial Open Government Data Based on Large Language Models

    Nov 30, 2025Michael Siebenmann, Javier Argota Sánchez-Vaquerizo, Stefan Arisona +3Question AnsweringAgentic RAG

  10. HarmReduction: Benchmarking LLMs in Harm Reduction Information Provision to Support People Who Use Drugs

    Jul 29, 2025Kaixuan Wang, Chenxin Diao, Jason T. Jacques +2HealthcareQuestion Answering

  11. Popular but Wrong: Understanding and Mitigating LLM Overconfidence through Knowledge Popularity

    May 23, 2025Shiyu Ni, Keping Bi, Jiafeng Guo +1LLM Hallucination MitigationConfidence Estimation in Language Models

  12. QDA-SQL: Questions Enhanced Dialogue Augmentation for Multi-Turn Text-to-SQL

    Jun 15, 2024Yinggang Sun, Ziming Guo, Haining Yu +5Synthetic Data GenerationQuestion Answering