Information Retrieval

Also known as IR

Momentum

38 papers in the last four weeks, up 111% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 306

All topics
CardsList
  1. Do AI chatbots find what experts would? Effects of model, user role, and sample size on study retrieval for medical questions

    Aug 13, 2026Qingfang Liu, Qiao Jin, Joe D. Menke +2Clinical QAInformation Retrieval

  2. Generative Universal Multimodal Retrieval with Dual-role Identifiers

    Aug 13, 2026Kaipeng Li, Haitao Yu, Xuanchen ZhouMultimodal IRGenerative Retrieval

  3. The Embedder's Dilemma: LLMs Are Better, but at What Cost?

    Aug 13, 2026Adnan El Assadi, Niklas Muennighoff, Jinhyuk LeeLLM Inference EfficiencyLLM Evaluation

  4. Self-Knowledge Retrieval Augmented Generation Framework for Patent Matching

    Aug 11, 2026Jian Zhang, Songlin Lei, Zhuohao Yang +6Retrieval-Augmented GenerationInformation Retrieval

  5. SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information

    Aug 11, 2026Junjie Ye, Zhuohui Sheng, Shaofan Liu +12LLM EvaluationAI Agent Benchmarks

  6. Guardian Crawler: Retrieval-First Knowledge Discovery with Bounded LLM Augmentation for Noisy Web Intelligence

    Aug 10, 2026Joshua Castillo, Santosh Nukavarapu, Ravi MukkamalaHybrid IRInformation Retrieval

  7. Tevatron-Elastic: A Unified Abstraction for Training Elastic Retrievers and Rerankers

    Aug 9, 2026Yu Wang, Shengyao Zhuang, Xueguang Ma +4Model CompressionDynamic Neural Networks

  8. Forgotten History or Test-of-Time? Retrospect and Prospect on RAG from an IR Perspective

    Aug 9, 2026Xiaoyan Zhao, Yujie Cai, Yang Zhang +2Retrieval-Augmented GenerationQuestion Answering

  9. MRBench: A Comprehensive Benchmark for Human Motion-Text Retrieval

    Aug 8, 2026Fulong Liu, Liang Xu, Chengqun Yang +3Cross-Modal AlignmentInformation Retrieval

  10. FinRank: An Evidence-Grounded Benchmark for Financial Question Answering and Retrieval over SEC Filings

    Aug 7, 2026Sasan Mansouri, Daniel Saad, Mark Wahrenburg +2Data ProvenanceFinancial QA

  11. Factorized Hypothesis Search for Evidence-to-Taxonomy Retrieval

    Aug 6, 2026Linhai Ma, Ethan F. Wei, Xueqing Peng +3Query ReformulationInformation Retrieval

  12. CertBind from Multimodal Connectivity to Certifiable Retrieval Decisions

    Aug 6, 2026Shuheng Cao, Zhenhao Zhang, Ruiqi Chen +7Selective PredictionConformal Prediction

  13. Beyond Top-K: Replacing Black-Box Retrieval with Interpretable Agentic Operations

    Aug 6, 2026Sagar Tamang, Ayush Vyas, Tabarakul HazarikaLong-Context RetrievalRetrieval-Augmented Generation

  14. DS@GT-ARC at eRisk 2026 Task 3: Sparse, Semantic, and LLM Reranking for ADHD Symptom Sentences

    Aug 4, 2026David GuechaMental HealthInformation Retrieval

  15. Search, Inspect, Fetch: Exploiting Structure-Aware Boolean Retrieval for Deep-Research Agents

    Aug 3, 2026Shuai Wang, Haodong Chen, Yu Yin +3Deep Research AgentsWeb Search Agents

  16. UEmbed: Unified Sparse and Dense Multimodal Embeddings

    Aug 3, 2026Tingyu Song, Mingxin Li, Yanzhao Zhang +5Multimodal IRLearned Sparse Retrieval

  17. DocNavRAG: Document-Structured Graph RAG with Stateful Evidence Construction for Complex Document Question Answering

    Aug 3, 2026Dongyang Xie, Yao Tian, Hao Zhang +5Graph Retrieval-Augmented GenerationAgentic RAG

  18. Retrieval Augmented Biomedical Question Answering with Weak Question Recovery and Neural Reranking for BioASQ Task 14b

    Aug 2, 2026Xueying Zhao, Lee Mai, Balaji AnandganeshRetrieval-Augmented GenerationLearning to Rank

  19. Tevatron Meets Megatron: Expert-Parallel LLM Reranker Training on an Academic Budget

    Aug 2, 2026Zhichao Xu, Xueguang Ma, Shengyao Zhuang +5Expert ParallelismCross-Encoder Reranking

  20. CeQe: Grounding Lexical Retrieval in Semantic Evidence

    Aug 1, 2026Adam Kahirov, Umesh Deshpande, Swaminathan SundararamanLexical RetrievalInformation Retrieval

  21. Hierarchical BM25: Lexical Search at Billion-Document Scale

    Jul 31, 2026Umesh Deshpande, Swaminathan SundararamanLexical RetrievalInformation Retrieval

  22. GoldenRetriever: Non-Interactive Homomorphic Encrypted Retrieval for Privacy-Preserving RAG

    Jul 31, 2026Yang Gao, Gang Quan, Scott Piersall +3Retrieval-Augmented GenerationHomomorphic Encryption

  23. LayoutBench: Performance Benchmarking of Cloud Storage Layouts for Multimedia Data

    Jul 30, 2026Debopam Sanyal, Hongjie Chen, Alexey Tumanov +1Benchmark DesignCloud Computing

  24. AskChem: Claim-Centered Infrastructure for Chemistry Literature Synthesis

    Jul 30, 2026Bing Yan, Gregory Wolfe, Stefano Martiniani +1AI-Assisted Scientific ResearchInformation Retrieval

  25. EMBL AI Librarian: Life-Sciences Knowledge Layer for AI Agents

    Jul 30, 2026Luigi Sigillo, Matteo Silvestri, Francesco Tabaro +9LLM Agent OrchestrationScientific QA

  26. A Structured Knowledge Infrastructure for Domain-Specific Data Asset Discovery

    Jul 30, 2026Mengdi Chen, Yuanxin Huang, Yulin Jiang +1Graph-Based RetrievalInformation Retrieval

  27. Improving Item Discoverability in e-Commerce Search via Related Intent Generation

    Jul 29, 2026Ji Xin, Xiao Xiao, Ishan Bhatt +6E-Commerce SearchInformation Retrieval

  28. MediaWiki Code2Code Search: Neural Retrieval for the Semantic Discovery of Open-Source Software Entities

    Jul 29, 2026Francesco TosoniSemantic SearchInformation Retrieval

  29. Scientific Knowledge Discovery in the Age of Large Language Models

    Jul 29, 2026Eleni Adamidi, Serafeim Chatzopoulos, Thanasis VergoulisAI-Assisted Scientific ResearchInformation Retrieval

  30. BM25 Wins at Scale: A Scaling Study of Retrieval-Augmented Generation Paradigms

    Jul 29, 2026Pengyu Wang, Benfeng Xu, Shaohan Wang +5Retrieval-Augmented GenerationGraph Retrieval-Augmented Generation

  31. TabRank: Chain-of-Thought Distillation for Table Re-Rankers

    Jul 28, 2026Adarsh Singh, Kushal Raj Bhandari, Jianxi Gao +2Table QACoT Distillation

  32. TEmBed-T: A Multi-Dimensional Benchmark for Table-Level Embeddings

    Jul 27, 2026Ayeen Poostforoushan, Liane Vogel, Carsten BinnigTabular Representation LearningInformation Retrieval

  33. VecTree-RAG: An Agentic Retrieval-Augmented Generation Framework Combining Vector and Tree Retrieval for Efficiency and Accuracy

    Jul 25, 2026Xinyan Zhong, Yuwei Shi, Yuqi Wei +3Scientific QAAgentic RAG

  34. PinEqualizer: Full Funnel Content Exploration and Debiasing System at Pinterest

    Jul 24, 2026Olafur Gudmundsson, Bo Zhao, Huayi Liao +15Cold-Start RecommendationInformation Retrieval

  35. A Comparative Evaluation of Embeddings and LLMs in a Greek Book Publisher Setting - The CUP Dataset

    Jul 23, 2026Katerina Papantoniou, Panagiotis Papadakos, Theodore Patkos +3Text Embedding EvaluationMultilingual IR

  36. Achieving Text-based Person Retrieval with Any Granularity

    Jul 23, 2026Jialong Zuo, Hanyu Zhou, Dongyue Wu +5Cross-Modal RetrievalInformation Retrieval

  37. SciExplore: Evaluating Autonomous Agents from Scientific Navigation to Information Integration

    Jul 23, 2026Yinhao Tang, Youqing Fang, Yanan Sun +6AI Agent BenchmarksInformation Retrieval

  38. Understanding Generative AI-mediated User Engagement with Academic Library Resources

    Jul 22, 2026Hae Min Kim, Stacy StanislawInformation Retrieval

  39. SkillSight: Calibrating Generic Content Bias for Skill Retrieval

    Jul 21, 2026Jinying Xiao, Bin Li, Xiaopeng Li +7Lexical RetrievalLLM Agent Skill Retrieval

  40. AutoIndex: Learning Representation Programs for Retrieval

    Jul 21, 2026Sam O'Nuallain, Nithya Rajkumar, Ramya Narayanasamy +3Automated Algorithm DiscoveryProgram Synthesis

  41. Semantically Similar, Yet Not Answerable: Diagnosing the Semantic-Answerability Gap in Table RAG

    Jul 20, 2026Jiaming Tian, Liyao Li, Wentao Ye +6Table QARetrieval-Augmented Generation

  42. GeneSpeak-FP: Target and Compound Retrieval from Observed Cell-Level Perturbation Signatures

    Jul 20, 2026Kseniia Vaniushkina, Jeongmin Lim, Jinyong ParkSingle-Cell Perturbation ModelingInformation Retrieval

  43. Fenced Citation-Context Retrieval for Case Law: Temporal Leakage and Degree Control Across Two Jurisdictions

    Jul 19, 2026Yao Liu, Tien-Ping Tan, Zhilan LiuData LeakageLegal IR

  44. From Overload to Insights: How AI Agents Can Support Scientists in Analyzing Complex Data

    Jul 18, 2026Tim Fuchs, Luca Gelisio, Steffen Hauf +1AI for ScienceAI-Assisted Scientific Research

  45. Practical Source Code Recovery from Binary Functions Using Anchor-Based Retrieval and LLM Reasoning

    Jul 10, 2026Charles Edward Gagnon, Steven H. H. Ding, Philippe Charland +1Software EngineeringSoftware Reverse Engineering

  46. Improving Ad-hoc Search Effectiveness for Conversational Information Retrieval via Model Merging

    Jul 9, 2026Ahmed Rayane Kebir, Jose G. Moreno, Lynda TamineConversational SearchInformation Retrieval

  47. DocMaster: A Hierarchical Structure-Aware System for Document Analysis

    Jul 9, 2026Ziqi Chen, Yingli Zhou, Fangyuan Zhang +3Document UnderstandingDocument QA

  48. Answering Without Referring: How AI Search Rewrites the Web's Economic Bargain

    Jul 8, 2026Qiaoni Shi, Kai Zhu, Kai GuInformation Retrieval