Audio QA

QA: Question Answering

Momentum

11 papers in the last four weeks, with none the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 29

All topics
CardsList
  1. AudioJev: Direct Audio Decisions with Order-Calibrated Probabilities

    Oct 1, 2026Sihan Lv, Zhen Li, Zhiqi Cao +4Audio QAAudio Reasoning

  2. RMS-AQA: A Two-Stage Spatial Audio Question Answering Benchmark for Real-World Domestic Environments

    Oct 1, 2026Peihao Chen, Qing Wang, Lichun Fan +12Audio-Language Model EvaluationAudio QA

  3. When Capabilities Fail to Compose: Diagnosing the Compositionality Gap in Large Audio-Language Models

    Sep 29, 2026Chien-Feng Liu, Chih-Kai Yang, Bo-Han Feng +3Audio-Language Model EvaluationAudio QA

  4. Seeing What Should Be Heard: Diagnosing and Repairing Cross-Modal Shortcuts in Omni-Modal LLMs

    Sep 29, 2026Yueran Ma, Ronghao LinAudio QAMultimodal Large Language Models

  5. TEMA: Evidence-Grounded Temporal Question Answering in Multi-Turn Multi-Audio Dialogs

    Sep 24, 2026Kaidi Yang, Hualei Wang, Zhaohui Wang +3Audio QATemporal Audio Grounding

  6. Broadening Uncertainty Estimation for Audio Question Answering Across Methods, Formats, and Inputs

    Sep 24, 2026Aaron Isidore Grace, Weiran WangAudio-Language Model EvaluationAudio QA

  7. Mizar: A 159M-Parameter Audio-Language Model for Audio Understanding

    Sep 23, 2026Kaiyang Li, Shaobo Han, Yue Tian +1Audio QAAudio-Language Models

  8. VākQA: A Benchmark and Evaluation Study for Telugu Spoken Factoid Question Answering

    Sep 17, 2026Bhavana Akkiraju, Ravi Sastry Kolluru, Sri Charan D +3Audio QALLM-as-a-Judge

  9. Nuha-Speech: Building General-Purpose Arabic Speech-LLMs

    Sep 11, 2026Yingzhi Wang, Reem Alhazzani, Muhammad AlqurishiAudio-Language Model EvaluationAudio QA

  10. S3S^3-Bench: Evaluating Speech Interaction Models as Scientific Voice Assistants

    Sep 9, 2026Heyang Liu, Jiayi Huang, Wenyang Xiao +8Audio QASpoken Dialogue Systems

  11. ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions

    Jul 20, 2026Fernando López, Ana Ayala, Guillermo Segovia +4Audio-Language Model EvaluationSpoken Language Understanding

  12. GigaChat Audio: Time-aware Large Audio Language Model

    Jul 11, 2026Aleksandr Kutsakov, Mariia Sadovina, Georgii Gospodinov +4Audio QAAudio Understanding

  13. EChO-Agent: Evidence Chain Orchestration Agent for Audio Reasoning

    Jun 13, 2026Siyuan Zhang, Jian Zong, Junyu Wang +7Audio QATool-Augmented Language Model Agents

  14. Audio-Mind: An Auditable Agentic Framework for Audio Understanding

    May 27, 2026Yucheng Wang, Jing Peng, Hanqi Li +6Audio QAAudio Reasoning

  15. Learning When to Think While Listening in Large Audio-Language Models

    May 26, 2026Zhiyuan Song, Weici Zhao, Yang Xiao +3Audio QARL for Language Model Reasoning

  16. Heterogeneity-Aware Dataset Scheduling for Efficient Audio Large Language Model Training

    May 18, 2026Yanru Wu, Jianning Wang, Chongxin Gan +1Audio QAEfficient Language Model Training

  17. MedMosaic: A Challenging Large Scale Benchmark of Diverse Medical Audio

    May 1, 2026Harshit Rajgarhia, Shuubham Ojha, Asif Shaik +4Audio QAHealthcare

  18. All That Glitters Is Not Audio: Rethinking Text Priors and Audio Reliance in Audio-Language Evaluation

    Apr 27, 2026Leonardo Haw-Yang Foo, Chih-Kai Yang, Chen-An Li +2Audio-Language Model EvaluationAudio QA

  19. AUDITA: A New Dataset to Audit Humans vs. AI Skill at Audio QA

    Apr 23, 2026Tasnim Kabir, Dmytro Kurdydyk, Aadi Palnitkar +3Audio QAAudio Reasoning

  20. Listen, Pause, and Reason: Toward Perception-Grounded Hybrid Reasoning for Audio Understanding

    Apr 16, 2026Jieyi Wang, Yazhe Niu, Dexuan Xu +1Audio QAAudio Reasoning

  21. Event-Grounded Question Answering over Long Audio via Structured Retrieval

    Feb 16, 2026Kartik Hegde, Arvind Krishna Sridhar, Naveen Vakada +2Multimodal RAGAudio QA

  22. RA-QA: A Benchmarking System for Respiratory Audio Question Answering Under Real-World Heterogeneity

    Feb 4, 2026Gaia A. Bertolino, Yuwei Zhang, Tong Xia +2Audio-Language Model EvaluationAudio QA

  23. ORCA: Open-ended Response Correctness Assessment for Audio Question Answering

    Nov 28, 2025Šimon Sedláček, Sara Barahona, Bolaji Yusuf +9Audio-Language Model EvaluationLLM Evaluation

  24. Silence is Golden: Mitigating Hallucinations in Large Audio-Language Models via Layer-Weighted Vector Steering

    Oct 14, 2025Tsung-En Lin, Kuan-Yi Lee, Hung-Yi LeeAudio QAHallucination in Language Models

  25. Robustness assessment of large audio language models in multiple-choice evaluation

    Oct 6, 2025Fernando López, Santosh Kesiraju, Jordi LuqueAudio-Language Model EvaluationAudio QA

  26. OpenBEATs: A Fully Open-Source General-Purpose Audio Encoder

    Jul 18, 2025Shikhar Bharadwaj, Samuele Cornell, Kwanghee Choi +4Audio Representation LearningAudio QA