IR Evaluation

IR: Information Retrieval

Momentum

15 papers in the last four weeks, up 36% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 122

All topics
CardsList
  1. Guardian Crawler: Retrieval-First Knowledge Discovery with Bounded LLM Augmentation for Noisy Web Intelligence

    Aug 10, 2026Joshua Castillo, Santosh Nukavarapu, Ravi MukkamalaHybrid IRInformation Retrieval

  2. FinRank: An Evidence-Grounded Benchmark for Financial Question Answering and Retrieval over SEC Filings

    Aug 7, 2026Sasan Mansouri, Daniel Saad, Mark Wahrenburg +2Data ProvenanceFinancial QA

  3. Mapping Similarity Spaces across Embedding Models with Synthetic Query Probing

    Aug 6, 2026Marcin Rozmus, Peter van der PuttenText Embedding EvaluationText Embedding Models

  4. Search, Inspect, Fetch: Exploiting Structure-Aware Boolean Retrieval for Deep-Research Agents

    Aug 3, 2026Shuai Wang, Haodong Chen, Yu Yin +3Deep Research AgentsWeb Search Agents

  5. Advancing Relevance Measurement with Vision-Language Models for Web-Scale Search

    Aug 3, 2026Han Wang, Alex Whitworth, Pak Ming Cheung +5VLM EvaluationAutomated Evaluation

  6. Diagnosing Search Behavior and Failure Modes in Long-Horizon Search Agents

    Aug 3, 2026Qi Liu, Jiaxin Mao, Fengbin Zhu +1Deep Research AgentsLong-Horizon Agent Evaluation

  7. Towards Query-Agnostic RAG Evaluation via Query Coverage and Claim Verifiability

    Jul 31, 2026Jeonghwan Choi, Taewon Yun, Minjeong Ban +3Reference-Free EvaluationRAG Evaluation

  8. Human Preference aligned Tabular Similarity

    Jul 27, 2026Frederik Hoppe, Astrid Franz, Marianne Michaelis +2Human Preference EvaluationTabular Representation Learning

  9. A Comparative Evaluation of Embeddings and LLMs in a Greek Book Publisher Setting - The CUP Dataset

    Jul 23, 2026Katerina Papantoniou, Panagiotis Papadakos, Theodore Patkos +3Text Embedding EvaluationMultilingual IR

  10. Achieving Text-based Person Retrieval with Any Granularity

    Jul 23, 2026Jialong Zuo, Hanyu Zhou, Dongyue Wu +5Cross-Modal RetrievalInformation Retrieval

  11. Beyond Relevance-Centric Retrieval: Rubric-Oriented Document Set Selection and Ranking

    Jul 22, 2026Kailin Jiang, Lei Liu, Jian Xi +7Learning to RankRubric-Based Evaluation

  12. Presentation, Not Mechanism: A Render Confound in Deprecation-Aware Memory Evaluation

    Jul 17, 2026Zhaoyang Jiang, Zhizhong Fu, Zicheng Li +5LLM MemoryQuestion Answering

  13. Finding the Right Tables and Columns: A Benchmark and Corpus-Adaptive Embeddings for SQL Schema Retrieval

    Jul 14, 2026Qingcheng Zeng, Puxuan Yu, Aman Mehta +2Schema LinkingText-to-SQL

  14. FindMyText: Robust, Scalable Detection of Text Containment in Large Web-Crawled Corpora

    Jul 10, 2026Lars Henry Berge Olsen, Pierre Lison, Martin Jullum +1IR Evaluation

  15. Faithful or Findable? Evaluating LLM-Generated Metadata for RDF Dataset Search

    Jul 7, 2026Riccardo Terrenzi, Serkan AyvazIR EvaluationSynthetic Data Evaluation

  16. Scientific Code Search at Scale: A Multi-Domain Dataset and Benchmark

    Jul 3, 2026Nishan Pantha, Pranath Reddy Kumbam, Sajil Awale +8Benchmark DesignInformation Retrieval

  17. Bringing Agentic Search to Earth Observation Data Discovery

    Jul 2, 2026Minghan Yu, Youran Sun, Chugang Yi +2Agentic SearchRemote Sensing

  18. Field Order Should Not Matter: Permutation-Invariant Embedding Model Fine-Tuning for Structured Metadata Retrieval

    Jun 29, 2026Aivin V. Solatorio, Olivier Dupriez, Rafael MacalabaMultilingual IRInformation Retrieval

  19. SABER-Math: Automated Benchmark for Information Retrieval Evaluation in Mathematics

    Jun 29, 2026Nikolay Georgiev, Maria Drencheva, Kseniia Ibragimova +3Text Embedding EvaluationLLM Reranking

  20. ScholarQuest: A Taxonomy-Guided Benchmark for Agentic Academic Paper Search in Open Literature Environments

    Jun 18, 2026Tingyue Pan, Mingyue Cheng, Daoyu Wang +4Agentic SearchInformation Retrieval