Question Answering

Also known as QA

Momentum

23 papers in the last four weeks, up 28% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 165

All topics
CardsList
  1. D3VL: Understanding Driving Scenes from 3D Time Series Data and Video with Language Models

    Jul 21, 2026Heesang Han, A. Lynn Abbott, Abhijit SarkarVLMs for Autonomous DrivingCamera-LiDAR Fusion

  2. Presentation, Not Mechanism: A Render Confound in Deprecation-Aware Memory Evaluation

    Jul 17, 2026Zhaoyang Jiang, Zhizhong Fu, Zicheng Li +5LLM MemoryQuestion Answering

  3. CoTu at EXACT 2026: Neuro-Symbolic Reasoning for Transparent Educational QA

    Jul 16, 2026Quoc-Khang Tran, Minh-Thien Nguyen, Phu-An Thai +3Explainable Artificial IntelligenceLLM-Based Program Synthesis

  4. CityLLM: A framework for natural-language querying of semantic 3D city models

    Jul 16, 2026Rabindra Lamsal, Sisi Zlatanova, Johnson Xuesong ShenQuestion Answering

  5. Task-Specific Multimodal Question Answering Agents via Confidence Calibration and Incremental Reasoning for QANTA 2026

    Jul 10, 2026Nirjhar Das, Md. Al-Mamun ProvathQuestion AnsweringMultimodal QA

  6. PolyUQuest: Verifiable Structure-Aware Web RAG over Heterogeneous Graphs

    Jul 9, 2026Ying Liu, Yi Ye, Quanyu Feng +5Retrieval-Augmented GenerationGraph Retrieval-Augmented Generation

  7. Comprehensive Evaluation of Large Language Model Responses: A Multi-Factor Scoring System

    Jul 8, 2026Yiming Gai, Junde Lu, Xuefei HuangLLM EvaluationQuestion Answering

  8. Mitigating Factual Hallucination in Large Reasoning Models via Mixed-Mode Advantage Regularization

    Jul 7, 2026Kaishen Wang, Tong Zheng, Xuehao Cui +3LLM Hallucination MitigationRL for Language Model Reasoning

  9. Hierarchical Evidence-Driven Reasoning for Long Document Understanding

    Jul 6, 2026Junyu Xiong, Yonghui Wang, Rongjian Gu +4Multi-Hop QADocument Understanding

  10. LuxSQA: Ask Me in Luxembourgish with TTS-Augmented Spoken Question Answering

    Jul 2, 2026Nina Hosseini-Kivanani, Marco Matassoni, Alessio BruttiSpoken Language UnderstandingSynthetic Data Augmentation

  11. NAVER LABS Europe Submission to the Instruction-following 2026 Short Track

    Jul 2, 2026Marcely Zanon Boito, Hemant Yadav, Jean-Luc Meunier +1Speech TranslationQuestion Answering

  12. Prompting GPT-5 on Scrum Certification Questions: An Empirical Accuracy Study

    Jun 29, 2026Mirko Perkusich, Danyllo Albuquerque, João Paiva +6Software EngineeringLLM Evaluation

  13. Comparing Large Language Models on Scrum Certification-Style Questions: Accuracy, Stability, and Error Patterns

    Jun 29, 2026Robson Alves Vilar, Emanuel Dantas Filho, Ademar França de Sousa Neto +5Software EngineeringLLM Evaluation

  14. ARMOR: Adaptive Retriever Optimization for Low-Resource Telecom Question Answering

    Jun 29, 2026Heshan Fernando, Quan Xiao, Yan Xin +1Retrieval-Augmented GenerationAdaptive RAG

  15. Travel-Oriented Reasoning Large Language Model via Domain-Specific Knowledge Graphs

    Jun 28, 2026Vignesh Ram Nithin Kappagantula, Shayan Hassantabar, Samuel Simpson +1LLM GroundingLLM Reasoning with Graphs

  16. KrishokChat: A Citation-Grounded Dataset and Benchmark for Bengali Agricultural Advisory

    Jun 28, 2026Khan Raiyan Ibne Reza, Omar Ibne ShahidLLM GroundingQuestion Answering

  17. Matching Tasks to Objectives: Fine-Tuning and Prompt-Tuning Strategies for Encoder-Decoder Pre-trained Language Models

    Jun 23, 2026Ahmad Pouramini, Hesham FailiLanguage Model PretrainingFine-Tuning

  18. TIPS: Topological Ill-Posedness Probing and Steering in Large Language Models

    Jun 22, 2026Guangyu Jiang, Sizhe Tang, Mahdi Imani +2Language Model SteeringQuestion Answering

  19. The Benchmark Illusion: Pruned LLMs Can Pass Multiple Choice but Fail to Answer

    Jun 16, 2026Rui Wen, Lu Sun, Jiayang Liu +3Open-Ended GenerationLLM Evaluation