Question Answering

Also known as QA

Momentum

23 papers in the last four weeks, up 28% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 165

All topics
CardsList
  1. Decompose-and-Refine: Structured Legal Question Answering with Parametric Retrieval

    May 23, 2026Jihyung lee, Hyounghun Kim, Gary LeeMulti-Hop QALegal IR

  2. Evaluating Commercial AI Chatbots as News Intermediaries

    May 21, 2026Mirac Suzgun, Emily Shen, Federico Bianchi +5LLM EvaluationQuestion Answering

  3. SPATIOROUTE: Dynamic Prompt Routing for Zero-Shot Spatial Reasoning

    May 18, 2026Pawat Chunhachatrachai, Gueter Josmy Faure, Hung-Ting Su +1Visual Spatial Reasoning3D Spatial Reasoning

  4. Analyzing Error Propagation in Korean Spoken QA with ASR-LLM Cascades

    May 17, 2026Donghyuk Jung, Youngwon ChoiAudio-Language Model EvaluationQuestion Answering

  5. Training LLMs with Reinforcement Learning for Intent-Aware Personalized Question Answering

    May 12, 2026Maryam Amirizaniani, Benjamin Charles Germain Lee, Jevin West +1RL for Language ModelsLLM Personalization

  6. Context Convergence Improves Answering Inferential Questions

    May 12, 2026Jamshid Mozafari, Bhawna Piryani, Adam JatowtQuestion AnsweringLLM Reasoning

  7. Unlocking UML Class Diagram Understanding in Vision Language Models

    May 12, 2026Artem Naboichenko, René PeinlVLM EvaluationVisual Question Answering

  8. SpatialForge: Bootstrapping 3D-Aware Spatial Reasoning from Open-World 2D Images

    May 12, 2026Zishan Liu, Ruoxi Zang, Yanglin Zhang +5Visual Spatial Reasoning3D Spatial Reasoning

  9. IndustryBench: Probing the Industrial Knowledge Boundaries of LLMs

    May 11, 2026Songlin Bai, Xintong Wang, Linlin Yu +12LLM EvaluationQuestion Answering

  10. ASTRA-QA: A Benchmark for Abstract Question Answering over Documents

    May 11, 2026Shu Wang, Shansong Zhou, Xinyang Wang +3Question AnsweringDocument QA

  11. Assessment of RAG and Fine-Tuning for Industrial Question-Answering-Applications

    May 10, 2026Jakob Sturm, Josef Pichlmeier, Christian Bernhard +4LLM Fine-TuningCost-Aware Inference

  12. OmicsLM: A Multimodal Large Language Model for Multi-Sample Omics Reasoning

    May 7, 2026Maciej Sypetkowski, Joanna Krawczyk, Łukasz Smoliński +4Multimodal Large Language ModelsQuestion Answering

  13. Multi-agent decision making: A Blackwell's informativeness approach

    May 7, 2026Zheng Zhang, Cuong C. Nguyen, Kevin Wells +1Multi-Agent DebateQuestion Answering

  14. Tatarstan Toponyms: A Bilingual Dataset and Hybrid RAG System for Geospatial Question Answering

    May 7, 2026Mullosharaf K. ArabovQuestion AnsweringGeospatial Reasoning

  15. Retrieval from Within: An Intrinsic Capability of Attention-Based Models

    May 7, 2026Elad Hoffer, Yochai Blau, Edan Kinderman +3Retrieval-Augmented GenerationQuestion Answering

  16. CANDI: Contextual Alignment for Niche Domains Question Answering

    May 6, 2026Megha Chakraborty, Darssan L. Eswaramoorthi, Het Riteshkumar Shah +5LLM EvaluationLLM Grounding

  17. Temporal Reasoning Is Not the Bottleneck: A Probabilistic Inconsistency Framework for Neuro-Symbolic QA

    May 5, 2026Tran Quang LiemTemporal ReasoningQuestion Answering

  18. SURE-RAG: Sufficiency and Uncertainty-Aware Evidence Verification for Selective Retrieval-Augmented Generation

    May 5, 2026Jingxi Qiu, Zeyu Han, Cheng HuangRetrieval-Augmented GenerationLLM Answer Verification

  19. Maistros: A Greek Large Language Model Adapted Through Knowledge Distillation From Large Reasoning Models

    May 3, 2026Nikolaos Giarelis, Charalampos Mastrokostas, Nikos KaracapilidisLLM Fine-TuningQuestion Answering

  20. DIAGRAMS: A Review Framework for Reasoning-Level Attribution in Diagram QA

    Apr 29, 2026Anirudh Iyengar Kaniyar Narayana Iyengar, Tampu Ravi Kumar, Manan Suri +4Visual Question AnsweringHuman-in-the-Loop Annotation

  21. DRAGON: A Benchmark for Evidence-Grounded Visual Reasoning over Diagrams

    Apr 28, 2026Anirudh Iyengar Kaniyar Narayana Iyengar, Tampu Ravi Kumar, Gaurav Najpande +4VLM EvaluationVisual Reasoning

  22. CAN-QA: A Question-Answering Benchmark for Reasoning over In-Vehicle CAN Traffic

    Apr 27, 2026Jing Chen, Abhijay Deevi, Onat Gungor +1Temporal ReasoningNetwork Intrusion Detection

  23. Interactive Episodic Memory with User Feedback

    Apr 27, 2026Nikesh Subedi, Loris Bazzani, Ziad Al-HalahEgocentric Video QAEpisodic Memory

  24. Can LLMs Act as Historians? Evaluating Historical Research Capabilities of LLMs via the Chinese Imperial Examination

    Apr 27, 2026Lirong Gao, Zeqing Wang, Yuyan Cai +6LLM EvaluationQuestion Answering

  25. Less is More: Lightweight Prompt Compression for Question Answering Applications on Edge Devices

    Apr 27, 2026Zihuai Xu, Ruofei Hou, Yang Xu +3Retrieval-Augmented GenerationOn-Device Language Model Inference