Information Retrieval

Also known as IR

Momentum

38 papers in the last four weeks, up 111% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 314

All topics
CardsList
  1. Scientific Code Search at Scale: A Multi-Domain Dataset and Benchmark

    Jul 3, 2026Nishan Pantha, Pranath Reddy Kumbam, Sajil Awale +8Benchmark DesignInformation Retrieval

  2. Relevance-Based Embeddings: Lightweight Candidate Retrieval via Heavy-Ranker Calls

    Jul 3, 2026Kirill Shevkunov, Andrey Ploskonosov, Liudmila ProkhorenkovaLearning to RankInformation Retrieval

  3. APeB: Benchmarking Personalization Ability of Large Language Model Agents

    Jul 3, 2026Garry Yang, Zizhe Chen, Xinru Chen +9LLM PersonalizationLLM Agent Evaluation

  4. Alignment-Guided Largest Table Overlap Size Estimation

    Jul 3, 2026Ge Lee, Shixun Huang, Zhifeng Bao +2Information Retrieval

  5. Linkify: Learning from Interface-Augmented Assembly Graphs

    Jul 1, 2026Anushrut Jignasu, Daniele GrandiGraph Representation LearningInformation Retrieval

  6. Svarna: An Open Corpus Workbench for Modern Greek

    Jul 1, 2026Stergios ChatzikyriakidisInformation Retrieval

  7. Multi-Turn Agentic Scientific Literature Search via Workflow Induction

    Jul 1, 2026Jisen Li, Bingxuan Li, Nanyi Jiang +10Agentic SearchAgentic Workflows

  8. VideoSearch-R1: Iterative Video Retrieval and Reasoning via Soft Query Refinement

    Jul 1, 2026Seohyun Lee, Seoung Choi, Dohwan Ko +2Temporal Video GroundingTemporal IR

  9. Field Order Should Not Matter: Permutation-Invariant Embedding Model Fine-Tuning for Structured Metadata Retrieval

    Jun 29, 2026Aivin V. Solatorio, Olivier Dupriez, Rafael MacalabaMultilingual IRInformation Retrieval

  10. SABER-Math: Automated Benchmark for Information Retrieval Evaluation in Mathematics

    Jun 29, 2026Nikolay Georgiev, Maria Drencheva, Kseniia Ibragimova +3Text Embedding EvaluationLLM Reranking

  11. ARMOR: Adaptive Retriever Optimization for Low-Resource Telecom Question Answering

    Jun 29, 2026Heshan Fernando, Quan Xiao, Yan Xin +1Retrieval-Augmented GenerationAdaptive RAG

  12. ALM2Vec: Learning Audio Embeddings for Universal Audio Retrieval with Large Audio-Language Models

    Jun 27, 2026Fengjie Lu, Chenang Jiang, Jiarui Hai +2Audio Representation LearningAudio-Language Models

  13. SemFlowRAG: Directed Semantic Flow from Abstraction to Evidence for Complex Reasoning

    Jun 26, 2026Houyuan Qin, Rong Wu, Qinyuan Qin +4Multi-Hop QAGraph Retrieval-Augmented Generation

  14. Lacuna: A Research Map for Machine Learning

    Jun 24, 2026Martin Weiss, Miles Q. Li, Alejandro H. Artiles +4Information RetrievalLarge Language Model-Guided Scientific Discovery

  15. AutoRelAnnotator: Calibrated Model Cascades for Cost-Efficient Relevance Evaluation in Sponsored Search

    Jun 24, 2026Md Omar Faruk Rokon, Shasvat Desai, Hong Yao +1Online AdvertisingCost-Aware Inference

  16. Recall Before Rerank: Benchmarking Deep Learning Models for Large-Scale Code-to-Code Retrieval

    Jun 24, 2026Leonardo Venuta, Francesco Tosoni, Paolo FerraginaLLM EvaluationSemantic Search

  17. TheoremGraph: Bridging Formal and Informal Mathematics

    Jun 24, 2026Simon Kurgan, Evan Wang, Eric Leonen +6KG ConstructionGraph-Based Retrieval

  18. DREAM: Dense Retrieval Embeddings via Autoregressive Modeling

    Jun 23, 2026Yixuan Tang, Yi YangInformation RetrievalText Embedding Models

  19. PETRA: Transforming Web Text for Petroleum-Engineering Domain Adaptation

    Jun 23, 2026Kirill Dubovikov, Omar El Mansouri, Hachem Madmoun +12Domain AdaptationSynthetic Data Generation

  20. MMed-Bench-IR: A Heterogeneous Benchmark for Multilingual Medical Information Retrieval

    Jun 23, 2026Junhyeok Lee, Han Jang, Hyeonjin Goh +1Multilingual IRInformation Retrieval

  21. Does My Embedding Reflect That A=BA = B? Evaluating Mathematical Equivalence in Embedding Models

    Jun 22, 2026Jiaying Ye, Samarth Rao, Leo Carlin +9Contrastive LearningText Embedding Evaluation

  22. LightSTAR: Efficient Visual Document Retrieval via Lightweight Selection with Vision-Adaptive Refinement

    Jun 22, 2026Tongkun Guan, Haocheng Wang, Wei Shen +1Information RetrievalVisual Document Retrieval

  23. KaLM-Reranker-V1: Fast but Not Late Interaction for Compressed Document Reranking

    Jun 22, 2026Xinping Zhao, Jiaxin Xu, Ziqi Dai +9Representation LearningLearning to Rank

  24. Topic-to-Timestamp Alignment by Constrained Evidence Selection

    Jun 18, 2026Zeynep Yılbırt, Marina Litvak, Michael FärberRetrieval-Augmented GenerationTemporal IR

  25. ScholarQuest: A Taxonomy-Guided Benchmark for Agentic Academic Paper Search in Open Literature Environments

    Jun 18, 2026Tingyue Pan, Mingyue Cheng, Daoyu Wang +4Agentic SearchInformation Retrieval

  26. Vortex: Multi-Modal Fusion System for Intelligent Video Retrieval

    Jun 18, 2026Duc-Tho Nguyen, Hieu-Hoc Tran-Minh, Khanh-Hoa Lam +4Multimodal IRInformation Retrieval

  27. Rescaling MLM-Head for Neural Sparse Retrieval

    Jun 17, 2026Youngjoon Jang, Seongtae Hong, Jonah Turner +1Masked Language ModelingLearned Sparse Retrieval

  28. MCompassRAG: Topic Metadata as a Semantic Compass for Paragraph-Level Retrieval

    Jun 16, 2026Amirhossein Abaskohi, Raymond Li, Gaetano Cimino +3Retrieval-Augmented GenerationInformation Retrieval

  29. SproutRAG: Attention-Guided Tree Search with Progressive Embeddings for Long-Document RAG

    Jun 16, 2026Amirhossein Abaskohi, Issam H. Laradji, Peter West +1Document ChunkingRetrieval-Augmented Generation

  30. Non-negative Elastic Net Decoding for Information Retrieval

    Jun 16, 2026Koki Okajima, Yasutoshi Ida, Tsukasa Yoshida +1Representation LearningInformation Retrieval

  31. Multimodal and Multiscale Spatial-Temporal Semantic Search and Recommendation with AI Foundation Models

    Jun 15, 2026Yuanyuan Tian, Wenwen Li, Xiao Chen +4Multimodal IRMultimodal Embedding

  32. Connecting Speech to Words through Images

    Jun 15, 2026Gabriel Pirlogeanu, Dan Oneata, Horia Cucu +1Multimodal GroundingUnsupervised Learning

  33. Entity Labels Are Not Entity Signals: A Framework for Observable Relevance in Document Re-Ranking

    Jun 14, 2026Utshab Kumar Ghosh, Shubham ChatterjeeLearning to RankInformation Retrieval

  34. CAMI: Cost-Aware Agent-Guided Multi-Indexing for Semantic Retrieval

    Jun 14, 2026Adnan Qidwai, Anand Eswaran, Sonam Mishra +2Semantic SearchInformation Retrieval

  35. M-CTX: Exact and Scalable Spatial Context Retrieval for Trajectory Analytics

    Jun 13, 2026Kun Ma, Qilong Han, Chengjing Song +4Information Retrieval

  36. Risk-Aware LLM Agents for Geospatial Data Retrieval: Design and Preliminary Adversarial Evaluation

    Jun 13, 2026Kyle Gao, Joel Cumming, Jonathan Li +2Multi-Agent LLM SystemsLLM Tool Use

  37. ADORE: Iterative Query Expansion with Retrieval-Grounded Relevance Feedback

    Jun 11, 2026Amin Bigdeli, Negar Arabzadeh, Radin Hamidi Rad +3Information RetrievalQuery Expansion

  38. Uncertainty-Aware Hybrid Retrieval for Long-Document RAG

    Jun 11, 2026Hoin Jung, Xiaoqian WangRetrieval-Augmented GenerationInformation Retrieval

  39. LEDGER: A Long-Context Benchmark of Corporate Annual Reports for Grounded Financial Retrieval and Extraction

    Jun 11, 2026Charles Moslonka, Amaury de Vitry, Arthur Garnier +2Long-Context RetrievalDocument Information Extraction

  40. Findings of the MAGMaR 2026 Shared Task

    Jun 10, 2026Alexander Martin, Dengjia Zhang, Joel Brogan +7Multimodal RAGMultimodal Grounding

  41. The Voronoi Bottleneck: Capacity-Aware Dense Retrieval for Product Search

    Jun 9, 2026Charith Chandra Sai Balne, Rithwik Maramraju, Siddharth Pratap Singh +4Contrastive LearningInformation Retrieval

  42. When More Documents Hurt RAG: Mitigating Vector Search Dilution with Domain-Scoped, Model-Agnostic Retrieval

    Jun 9, 2026Nabaraj Subedi, Ahmed Abdelaty, Shivanand Venkanna SheshappanavarRetrieval-Augmented GenerationAgentic RAG

  43. STORM: Stepwise Token Optimization with Reward-Guided Beam Search

    Jun 9, 2026Arthur Satouf, Giulio D'Erasmo, Yuxuan Zong +3Language Model DecodingLexical Retrieval

  44. LakeQA: An Exploratory QA Benchmark over a Million-Scale Data Lake

    Jun 9, 2026Haonan Wang, Jiaxiang Liu, Yurong Liu +11Multi-Hop QAAI Agent Benchmarks

  45. MAVIS: Multi-Agent Video Retrieval via Structured Video Understanding

    Jun 8, 2026Jie Zhang, Qilang Ye, Hao Zhou +2Video UnderstandingMulti-Agent Collaboration

  46. Report on CHIIR 2026 Workshop on Generative AI and Academic Search (GAI&AS)

    Jun 8, 2026Yifan Liu, Jaime Arguello, Orland Hoeber +30Information RetrievalHuman-AI Collaboration

  47. PaperFlow: Profiling, Recommending, and Adapting Across Daily Paper Streams

    Jun 5, 2026Fuqiang Wang, Song Tan, Zheng Guo +8Information RetrievalRecommender Systems

  48. SWE-Explore: Benchmarking How Coding Agents Explore Repositories

    Jun 5, 2026Shaoqiu Zhang, Yuhang Wang, Jialiang Liang +8AI Coding AgentsAgentic Search

  49. QueryAgent-R1: Bridging Query Generation and Product Retrieval for E-Commerce Query Recommendation

    Jun 4, 2026Dike Sun, Zheng Zou, Jingtong Zang +3E-Commerce SearchAgentic Retrieval

  50. Agent-Orchestrated Adaptive RAG: A Comparative Study on Structured and Multi-Hop Retrieval

    Jun 4, 2026Anuj Maharjan, Devinder Kaur, Richard MolyetRetrieval-Augmented GenerationAdaptive RAG

  51. BEATS: Bootstrapping E-commerce Attribute Taxonomies for Search through Iterative Human-AI Collaboration

    Jun 3, 2026Yung-Yu Shih, Shang-Yu Su, Tzu-I Ho +2Semantic SearchLLM-Assisted Annotation