Question Answering

Also known as QA

Momentum

23 papers in the last four weeks, up 28% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 165

All topics
CardsList
  1. RIT-RAG: Navigating Document Corpora with Retrieval-Induced Trees

    Oct 8, 2026Meghanadh Pulivarthi, Swaraj Kumar Biswal, Kushagra Bhushan +3Retrieval-Augmented GenerationAgentic RAG

  2. Mem++: Non-Destructive Memory for Long-Term Organizational LLM Agents

    Oct 1, 2026Ahmad Yehia, Aly O. Abdelkareem, Islam Ahmed +4LLM Agent MemoryPersistent Memory for Language Models

  3. Distilling Directional Verification

    Oct 1, 2026Jungseob Lee, Sugyeong Eo, Seongtae Hong +4Question AnsweringLanguage Model Distillation

  4. SEPAL: Separated Expert Pairs with Answer-Level Fusion for Reliable LLM Collaboration

    Sep 30, 2026Weijie Ren, Yanwen Zhang, Hao Li +3Multi-Agent LLM SystemsQuestion Answering

  5. When Can Text Replace Vision? Structural Bottlenecks in Diagram Reasoning

    Sep 30, 2026Yunbei Zhang, Janet Wang, Jihun Hamm +1Visual ReasoningQuestion Answering

  6. Beyond the Timeline: Augmenting Long-Video Memory with Grounded Entity Biographies

    Sep 29, 2026Hui Ren, Lei Fan, Henry Pao +5Multimodal MemoryQuestion Answering

  7. Memory in the Sky: Low-Altitude Question Answering with Multi-Agent Memory Aggregation

    Sep 28, 2026Chengyang Li, Yujie Wan, Shuai Wang +6Question AnsweringMulti-Agent Systems

  8. Rubric-Aware On-Policy Self-Distillation for LLM Personalization

    Sep 28, 2026Yilun Qiu, Xiaoyan Zhao, Chengbing Wang +6LLM PersonalizationOn-Policy Self-Distillation

  9. Meet, Compare, or Abstain: LatWeave for Deterministic Multi-Hop Question Answering on Knowledge Lattices

    Sep 23, 2026Yuze Ren, Shaoheng Fan, Tao Wang +2Multi-Hop QAQuestion Answering

  10. Intrinsic Sequence-Likelihood Confidence in Retrieval-Dominated Extractive QA: Two Pre-Specified Negatives, and What They Do and Do Not Attribute

    Sep 17, 2026Gunwoo Lee, Changmin Sung, Sang-Hwan Gwak +3LLM EvaluationSelective Prediction

  11. VākQA: A Benchmark and Evaluation Study for Telugu Spoken Factoid Question Answering

    Sep 17, 2026Bhavana Akkiraju, Ravi Sastry Kolluru, Sri Charan D +3Audio QALLM-as-a-Judge

  12. Less Is More: Graph-free Multimodal RAG via Multi-signal Late Fusion

    Sep 16, 2026Tithi Rakshit, Hongkuan Zhou, Lavdim Halilaj +1Multimodal RAGMultimodal IR

  13. Knowledge-Graph Based Augmentation versus Retrieval Augmented Generation for Cultural-Related Question Answering

    Sep 16, 2026Pablo Poulenard, Yannis Karmim, Valentin BarrièreRetrieval-Augmented GenerationGraph Retrieval-Augmented Generation

  14. One Size Does Not Fit All! Dynamic Retriever and Generator Selection for RAG

    Sep 15, 2026Neeraj Anand, Payel Santra, Partha Basuchowdhuri +2Retrieval-Augmented GenerationAdaptive RAG

  15. When Should LLMs Abstain? Chain-of-Self-Questioning for Selective Risk Control

    Sep 15, 2026Ali ŞenolSelective PredictionLLM Prompting

  16. The Cost of Compression: A Rate-Distortion Limit on Factual Hallucination

    Sep 14, 2026Xi Wang, Shijia Xu, Rongfeng GuoMemorization in Language ModelsHallucination in Language Models

  17. Judging by the Cover: Cleaning LLM Truthfulness Benchmarks to Avoid Surface-Level Feature Leakage

    Sep 14, 2026Foad Namjoo, Remy Ogasawara, Amirali Abdullah +3Data LeakageLLM Evaluation

  18. Benchmarking Hybrid Deep Research Across Database Querying and Web Search

    Sep 8, 2026Ruofan Wu, Peiran Xu, Xiaolong Li +9Deep Research AgentsAgentic Search

  19. STSG-VQA: Evidence-Grounded Temporal Question Answering from Surgical Spatio-Temporal Scene Graphs

    Sep 8, 2026Jing Li, Duygu SarikayaMedical VQAQuestion Answering

  20. SentryLine: Evidence-Grounded Question Answering over Evolving Documents in Oncology Care

    Sep 8, 2026Tampu Ravi Kumar, Gaurav Najpande, Muhammad Ali Khan +7Question AnsweringClinical QA

  21. CIVI: A Framework for Diagnosing Search Agent Failures in Civic Information

    Sep 8, 2026Dingying Liu, Yunshun Zhong, Wentao Zhang +1Agent Failure AnalysisAI Agent Reliability

  22. Does the Selected Object Reach the Reader? Auditing Identity Handoffs in Grounded Language-Model Pipelines

    Sep 4, 2026Siddharth Vohra, Runmin Jiang, Xiaomo Li +1Question AnsweringRAG Evaluation

  23. RuleMem: Active Rule Memory for Long-Term Conversational Agents

    Sep 3, 2026Xingyuan Zeng, Zuohan Wu, Quanming Yao +5Question AnsweringLong-Term Conversational Memory

  24. When Retrieval Helps: Selective Retrieval for Single-Turn Mental-Health QA

    Sep 3, 2026Hyunseo Oh, Chong-Kwon Kim, Yoonhyuk ChoiRetrieval-Augmented GenerationMental Health Counseling