Question

Momentum

32 papers in the last four weeks, up 68% on the four weeks before. 0.4% of all new papers.

Jul 6Week of Sep 21

Latest papers 194

All topics
CardsList
  1. UniHEAR: Unified Heterogeneous-Source Attentive Retrieval for Knowledge-Based Visual Question Answering

    Aug 2, 2026Ganzhong Luo, Yang Ren, Hanyong Wang +2Knowledge-Based Visual Question AnsweringReranking

  2. PMMC: Prospective Multimodal Memory Compilation for Long-Term LVLM Agents

    Aug 2, 2026Jingyu Sun, Yan Lin, Yuyang Xue +10Multimodal MemoryVisual Evidence

  3. Exploiting Intrinsic Duality for Multi-Hop Question Generation

    Aug 1, 2026Maodong Li, Xinyue Kang, Yuanchen Shi +1Multi-Hop ReasoningFaithful Question Generation

  4. One More Turn, Less Regret: A Regret-Based Multi-Turn Benchmark for LLMs' Clarification Policies

    Jul 23, 2026Minh Ngoc Ta, My Anh Tran Nguyen, Duong D. Nguyen +2ClarificationQuestion

  5. Overview of FinMMEval 2026 Task 2: Multilingual Financial Short-Answer Question Answering

    Jul 22, 2026Zhuohan Xie, Xueqing Peng, Georgi Georgiev +18Financial Question AnsweringQuestion

  6. Reference-Free Evaluation of Reasoning in Open-Ended Question Answering

    Jul 22, 2026Guneet Singh Kohli, Yuxiang Zhou, Michael Sejr Schlichtkrull +2LLM Reasoning StrategiesNatural Language Inference

  7. AILQA: Evaluating AI-Driven Legal Question Answering Systems for the Indian Legal System

    Jul 21, 2026Shubham Kumar Nigam, Shubham Kumar Mishra, Noel Shallum +2Legal Reasoning TasksQuestion

  8. FinSAgent: Corpus-Aligned Multi-Agent RAG Framework for Evidence-Grounded SEC Filing Question Answering

    Jul 20, 2026Jijun Chi, Zhenghan Tai, Hanwei Wu +21Financial Question AnsweringQuestion

  9. High-Order Question Generation in a Multilingual Educational Context

    Jul 15, 2026Suna-Şeyma Uçar, Itziar Aldabe, Nora Aranberri +1Faithful Question GenerationMultilingual

  10. Evidence-Backed Video Question Answering

    Jul 13, 2026Shijie Wang, Honglu Zhou, Ziyang Wang +5Long Video Question AnsweringVideo Understanding

  11. WasteAssistant: Regulation-Guided Visual Question Answering Framework for Intelligent Waste Segregation and Sustainable Managemen

    Jul 12, 2026Khush Kataruka, Harshit Maurya, Anuja Vats +3WasteKnowledge-Based Visual Question Answering

  12. Two Axes of LLM Abstention: Answer Correctness and Question Answerability

    Jul 9, 2026Benedikt J. WagnerAnswerInstruction-Tuned Models

  13. Incentivizing Vision Language Models to Search for Long Video Question Answering

    Jul 3, 2026Harsh Goel, S P Sharan, Sahil Shah +4Long Video Question AnsweringVideo Understanding

  14. LuxSQA: Ask Me in Luxembourgish with TTS-Augmented Spoken Question Answering

    Jul 2, 2026Nina Hosseini-Kivanani, Marco Matassoni, Alessio BruttiQuestion-Answer PairsLuxembourgish

  15. Self-Study Reconsidered: The Hidden Fragility of Learning from Self-Generated QA

    Jun 30, 2026Ekaterina Alimaskina, Denis Shveykin, Gleb Molodtsov +3Faithful Question GenerationQuestion

  16. Clinically Structured Rank-Gated LoRA for Cross-Benchmark Medical Question Answering

    Jun 30, 2026Hao Gong, Ruilin Gong, Yining HuangMedical Visual Question AnsweringClinical Reasoning Training

  17. Prompting GPT-5 on Scrum Certification Questions: An Empirical Accuracy Study

    Jun 29, 2026Mirko Perkusich, Danyllo Albuquerque, João Paiva +6Large Language Model ResponsesQuestion

  18. Comparing Large Language Models on Scrum Certification-Style Questions: Accuracy, Stability, and Error Patterns

    Jun 29, 2026Robson Alves Vilar, Emanuel Dantas Filho, Ademar França de Sousa Neto +5Multiple-Choice QuestionsQuestion

  19. AB-RAG: Adaptive Budgeted Retrieval-Augmented Generation for Reliable Question Answering

    Jun 27, 2026Ansh KamthanAgentic Retrieval-Augmented Generation SystemsQuestion-Answering Benchmarks

  20. Latent Bridges for Multi-Table Question Answering

    Jun 27, 2026Simone Varriale, Tamara Cucumides, Floris Geerts +1QuestionCompact Latent Sensor Tokens

  21. ProMSA:Progressive Multimodal Search Agents for Knowledge-Based Visual Question Answering

    Jun 26, 2026ZhengXian Wu, Hangrui Xu, Kai Shi +8Knowledge-Based Visual Question AnsweringMultimodal Search Agents

  22. EG-VQA: Benchmarking Verifiable Video Question Answering with Grounded Temporal Evidence

    Jun 23, 2026Linpeng Huang, Weixing Chen, Zexin Chen +2Long Video Question AnsweringTemporal Grounding

  23. BLUEX v2: Benchmarking LLMs on Open-Ended Questions from Brazilian University Entrance Exams

    Jun 21, 2026João Guilherme Alves Santos, Giovana Kerche Bonás, Thiago Laitz +2Open-Ended ResponsesPortuguese

  24. Efficient Multimodal Clinical Question Answering for Pulmonary Embolism Risk Assessment

    Jun 21, 2026Xiangyuan Xue, Yang Yu, Yan Gao +5Multimodal Clinical DataElectronic Health Records

  25. EvidenceLens: A Claim-Evidence Matrix for Auditing Financial Question Answering

    Jun 19, 2026Fengchen Gu, Xiaotian Ren, Zhengyong Jiang +6Financial Question AnsweringCategory-Aware Atomic Claims

  26. RECOM: A Validity Discrimination Tradeoff in Automatic Metrics for Open Ended Reddit Question Answering

    Jun 17, 2026Pushwitha Krishnappa, Amit Das, Vinija Jain +2Large Language Model EvaluationPerformance Metric

  27. Lost at the End: Primacy Bias in Multimodal Retrieval-Augmented Question Answering

    Jun 15, 2026Jieyuan Liu, Jianyang Gu, Shijie Chen +2Knowledge-Based Visual Question AnsweringQuestion

  28. From Question Answering to Task Completion: A Survey on Agent System and Harness Design

    Jun 14, 2026Jianyuan Guo, Zhiwei Hao, Chengcheng Wang +14Agent HarnessArtificial Intelligence Agents

  29. VeriGeo: Controllable Geometry Question Generation with Numerical and Analytical Verification

    Jun 12, 2026Xiaoxian Duan, Zequn Liu, Yingce XiaTheorem ProvingSynthesis

  30. Self-Evolving Visual Questioner

    Jun 11, 2026Yijun Liang, Hengguang Zhou, Ming Li +3Faithful Question GenerationQuestion

  31. Operadic consistency: a label-free signal for compositional reasoning failures in LLMs

    Jun 11, 2026Nathaniel Bottman, Yinhong Liu, Kyle RichardsonLLM Reasoning StrategiesSelf-Consistency

  32. Towards Fully Automated Exam Grading: Fairness-Aware Recognition of Handwritten Answers with Foundation Models

    Jun 9, 2026Hartwig GrabowskiGradingHandwriting

  33. Do Vision-Language Models See or Guess? Measuring and Reducing Textual-Prior Reliance with a Phrasing-Controlled Benchmark

    Jun 9, 2026Pratham Singla, Shivank Garg, Vihan Singh +1Textual PriorsQuestion

  34. SPARC: A Multi-Agent System for Electrical Circuit Question Answering

    Jun 5, 2026Mushtari Sadia, Zhenning Yang, Umme Habiba Lamia +3CircuitsQuestion

  35. EASE-TTT: Evidence-Aligned Selective Test-Time Training for Long-Context Question Answering

    Jun 5, 2026Xiaopeng Yuan, Zebin Wang, Suwen Wang +3Efficient Long-Context InferenceQuestion-Answering Benchmarks

  36. Reducing Hallucinations in Complex Question Answering using Simple Graph-based Retrieval-Augmented Generation (long version)

    Jun 4, 2026Christopher J. Wedge, Joshua Stutter, Danny Dixon +1Question-Answering BenchmarksHallucination Mitigation

  37. Synthetic Contrastive Reasoning for Multi-Table Q&A

    Jun 3, 2026Ankit Pratap Singh, Xin Su, Phillip HowardTable Reasoning DatasetsQuestion

  38. Zero-Shot 3D Question Answering via Hierarchical View-to-Token Transportation

    Jun 2, 2026Dongsheng Wang, Dawei Su, Hui Huang3D Scene Understanding3D Representation

  39. RASER: Recoverability-Aware Selective Escalation Router for Multi-Hop Question Answering

    Jun 1, 2026Yuyang Li, Zihe Yan, Tobias KäferMulti-Hop ReasoningAgentic Retrieval-Augmented Generation Systems

  40. InsightVQA: High-Dimensional Emotion-Cognitive Visual Question Answering Benchmark

    Jun 1, 2026Shiyu Wang, Ziyu Liu, Chaoyi Yu +6Emotion RecognitionHuman-Annotated Benchmark

  41. Question Type, Cognitive Load, and CEFR Alignment: Evaluating LLM-Generated EFL Grammar Drill Exercises

    Jun 1, 2026Steve Woollaston, Brendan Flanagan, Yuko Toyokawa +1Cognitive LoadPedagogical Frameworks

  42. Ask4VG: Risk-Aware Question Selection for Reducing Prior-Driven Answers in Medical VQA

    May 31, 2026Xiaorong Zhu, Qiang Li, Zibo Xu +2Medical Visual Question AnsweringCitation Hallucination

  43. CASTLE2026 Team WDL Technical Report

    May 30, 2026Zhengyang Li, Zhenglin Du, Yi Wen +3Long Video Question AnsweringEgocentric Video

  44. OCC-RAG: Optimal Cognitive Core for Faithful Question Answering

    May 30, 2026Maksim Savkin, Mikhail Goncharov, Alexander Gambashidze +7Multi-Hop ReasoningLLM Reasoning Strategies

  45. KG-Guard: Graph-Based Hallucination Detection for Knowledge Base Question Answering

    May 29, 2026Albert Sawczyn, Piotr Bielak, Tomasz KajdanowiczKnowledge GraphsHallucination Detection

  46. On Wednesdays, We Ask Questions: Optimizing "Active Listening" in Automated Legal Triage and Referral

    May 29, 2026Quinten Steenhuis, Jacqueline HarveyLegal Reasoning TasksLegal Domain

  47. MAAT: Multi-phase Adapter-Aware Targeted Unlearning

    May 28, 2026Suryash Yagnik, Shubham Gaur, Saksham Thakur +3Exact UnlearningQuestion

  48. Citation-Closure Retrieval and Per-Rule Attribution for Real-World Regulatory Compliance Question Answering

    May 28, 2026Yeong-Joon Ju, Seong-Whan LeeComplianceCitations

  49. ConRAG: Consensus-Driven Multi-View Retrieval for Multi-Hop Question Answering

    May 27, 2026Yikai Zhu, Kunfeng Chen, Qihuang Zhong +2Multi-Hop ReasoningQuestion

  50. Knowledge Dependency Estimation for Reliable Question Answering

    May 27, 2026Chaodong Tong, Qi Zhang, Nannan Sun +2Knowledge GraphsQuestion-Answering Benchmarks

  51. PetroBench: A Benchmark for Large Language Models in Petroleum Engineering

    May 27, 2026Xiang Wang, Tingting Zhang, Sen Wang +4Large Language Model BenchmarksQuestion

  52. Asking Is Not Enough: Protocol Sensitivity in LLM Confidence Calibration

    May 26, 2026Hankyeol Kim, Pilsung KangQuestionProvenance