Document

Momentum

17 papers in the last four weeks, up 89% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 126

All topics
CardsList
  1. Follow the Entities: A Corpus Map for Agentic Search

    Sep 29, 2026Soyeong Jeong, Sujay Kumar Jauhar, Sung Ju Hwang +1Agentic SearchText Corpora

  2. Zero-Shot Cue-Grounded Topic Segmentation of Spoken Documents

    Sep 28, 2026Suhwan Choi, Myeongho Jeon, Myungjoo KangTranscriptDocument

  3. DocuTeam: Mixed-Initiative Multi-Agent Discussions around Evolving Documents

    Sep 24, 2026Heechan Lee, Juhyeon Choi, Tae Soo Kim +2CollaborationArtificial Intelligence Agents

  4. Same Scores, Different Decisions: Evaluating JEV and Language Models for Legal Document Understanding

    Sep 23, 2026Fan Zhang, Yankai Chen, Zhuohan Xie +11ContractsLanguage Model Computes

  5. LexLattice: Multilingual Extractive Summarization via Neural Cellular Automata on Document Hierarchies

    Sep 22, 2026Sujay Uday Rittikar, Sheela RamannaSummarizationDocument

  6. Knowledge Pull Requests for Continual Document Authoring

    Sep 22, 2026Alexander Martin, Benjamin Van DurmeMultimodal Knowledge EditingPull Requests

  7. Document Retrieval-Aware Chunking (D-RAC): Universal Retrieval-Aware Ingestion of Enterprise Documents via PDF Normalization and Multimodal Markdown Conversion

    Sep 21, 2026Uday Allu, Abhivanth Sivaprakash, Pratik Singh +1ChunkDocument

  8. DocAttriBench: Benchmarking Answer Grounding in Document Visual Question Answering

    Sep 17, 2026Luca De Grandis, Silvia Cappelletti, William Raccagni +3Human-Annotated BenchmarkDocument

  9. WeVisDoc: From Coverage to Capability for Robust End-to-End Document Parsing

    Sep 17, 2026Hao Yu, Kang Liu, Linnan Zhao +4Document ParsingDocument

  10. Size Matters: Foundation Model for Czech HTML documents

    Sep 16, 2026Martin Dvořák, Vít Tlustoš, Artyom Voronin +4Wireless Foundation ModelsDocument

  11. GVD: Governed Versioning and Deduplication for Document Repositories

    Sep 15, 2026Mohammadreza Sediqin, Shivali Dalmia, Sumukha Thoppanahalli +1VersionDocument

  12. Diagnosing the Fact-Grounding Gap in Multi-Hop Question Answering

    Sep 15, 2026Kevin Mo, Nathan Mo, Richard ZhuMulti-Hop ReasoningQuestion-Answering Benchmarks

  13. SyntheticDoc: A Large Synthetic Dataset for Document Unwarping and Illumination Correction

    Sep 14, 2026Daniel Woortmann, Tanguy Magne, Olga Sorkine-HornungSynthetic-To-Real Domain GapLarge-Scale 3D Editing Dataset

  14. Automated Detection and Structuring of Social Tipping Point Evidence in Climate related Documents: A Modular AI Framework

    Sep 14, 2026Kavindu Perera, Mohammad Abaeiani, Ekaterina Gilman +14Large Language Model ClassificationBert-Based Models

  15. SentryLine: Evidence-Grounded Question Answering over Evolving Documents in Oncology Care

    Sep 8, 2026Tampu Ravi Kumar, Gaurav Najpande, Muhammad Ali Khan +7Evidence-Grounded QuestionsQuestion

  16. When Superpixels Fail on Documents: A Study of Segmentation for LIME Explanations

    Sep 7, 2026Quentin Telnoff, Emanuela Boros, Mickaël Coustaty +3InterpretabilityDocument

  17. SciDocBench: A Workflow-Centered Benchmark and Data Pipeline for Scientific Document Understanding

    Sep 4, 2026Shenxi Wu, Yuhong Liu, Haosong Zhang +8Scientific DiscoveryDocument

  18. Jina-OCR-v1: Efficient Document Parsing with Speculative Decoding and Dense Verifiable Rewards

    Sep 2, 2026Alejandro Barón García, Feng Wang, Emilia Garcia Casademont +1Lingdt-Vl-OcrDocument Parsing

  19. MIDR: Enrichment-Augmented Indexing for Multimodal Document Retrieval

    Sep 1, 2026Debanjan Mahata, Atharva Tendle, Daniel Preotiuc-Pietro +2Multimodal RetrievalDocument

  20. Joint Training Is Not Enough: Conditioned Cross-Granularity Training for Multimodal Document Understanding

    Sep 1, 2026Chengguang Gan, Yunhao Liang, Hanjun Wei +2Multimodal DocumentsDocument

  21. InSight-doc: Agentic Visual Perception for Long-Document Understanding

    Aug 11, 2026Kaican Li, Weiyan Xie, Lewei Yao +4Visual Document RetrievalRecent Vision-Language Models

  22. FormStruct-Bench:A Hierarchical and Diagnostic Benchmark for Table-Form Document Structure Recognition

    Aug 11, 2026Lujie Ban, Jiangtao Zhu, Yuanheng Yu +2Structured ContextDocument

  23. Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution

    Aug 8, 2026Lewei Xu, Yihao Ding, Zihan Xu +5Visual Document RetrievalDocument

  24. DocMemo: Dynamic Evidence Discovery via Probabilistic Memory-Guided Retrieval for Multi-Modal Document Understanding

    Aug 7, 2026Hanshu Yao, Janfeng Zhong, Niu Lian +1DocumentMulti-Hop Reasoning

  25. TeXFix-Bench: An Empirically Grounded Multi-Format Benchmark for LLM-Based Document Source Repair

    Aug 7, 2026Prajwal S. VenkateshmurthyRepairDocumentation

  26. Pre-Inference Routing for Cost-Efficient Document Field Extraction

    Aug 6, 2026Sreerekha RajendranExtractionDocument

  27. Confidence Estimation for Financial Vision-Language Models in Chart and Document Understanding

    Aug 6, 2026Reza Khanmohammadi, Simerjot Kaur, Charese H. Smiley +2Confidence EstimationRecent Vision-Language Models

  28. Benchmarking and Enhancing LLMs for Rule-Intensive Review of National Standard Documents

    Aug 6, 2026Tao Wang, Qihao Yang, Rongjiao Liang +4ReviewDocument

  29. Beyond Top-K: Replacing Black-Box Retrieval with Interpretable Agentic Operations

    Aug 6, 2026Sagar Tamang, Ayush Vyas, Tabarakul HazarikaDocumentChunk

  30. PaDoc: Layout-Grounded Parallel Decoding for Document Parsing

    Aug 6, 2026Hao Yu, Jiabo Zhan, Kang Liu +8Document ParsingDocument

  31. Thinking with Anchors: Grounded and Efficient Document Reasoning

    Aug 5, 2026Sichen Zhu, Yuchen Zhu, Wenzhuo Xu +13Weak Visual GroundingDocument

  32. Training Documents Reranker with Search Rubrics for Deep Research Agent

    Aug 4, 2026Wenhan Liu, Yu Lu, Qiaolin Xia +8Cross-Encoder RerankingDeep Research

  33. DocPO: Advancing Document Policy Optimization via Tailored Step-Aware Rewards

    Aug 1, 2026Yunhao Wang, Binghong Wu, Zhenyu Huang +4Frictive Policy OptimizationDocument

  34. Evidence-Grounded Constraint Checking in Construction Documents

    Jul 31, 2026Rashid Mushkani, Hugo Berard, Shin KosekiConstructionDocument

  35. GVR-Coder: A Visual-Feedback Framework for Structured SVG Generation in Complex Document and Meeting Scenarios

    Jul 30, 2026Yiming Xu, Jihua Kang, Chunsai Du +5Scalable Vector GraphicDiagrams

  36. HVM-GraphRAG: Holistic-View Multimodal Graph Retrieval-Augmented Generation on Complex Document

    Jul 26, 2026Xin He, Yili Wang, Wenqi Fan +4Graph-Based Retrieval Augmented GenerationGraph-Llm Integrations

  37. On Improving Faithfulness of Podcasts from Documents

    Jul 24, 2026Soumya Dutta, Tejas Indulal Dhamecha, Pannaga ShivaswamyExplanation FaithfulnessFaithfulness

  38. Khondo: A Multimodal Benchmark for Document Packet Splitting of Bangla Forms

    Jul 23, 2026Abu Tyeb Azad, Fahim Ahmed, Ishita Sur Apan +7DocumentBangla

  39. DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations

    Jul 22, 2026Jiazhen Jiang, Boxi Cao, Lingyong Yan +6Autonomous AgentsDocument

  40. Beyond Relevance-Centric Retrieval: Rubric-Oriented Document Set Selection and Ranking

    Jul 22, 2026Kailin Jiang, Lei Liu, Jian Xi +7RelevanceDocument

  41. Visual Information Extraction from Documents via Classification-Guided Large Vision-Language Models

    Jul 22, 2026Huafu Li, Guo Chen, Jia Xia +5Visual Document RetrievalRecent Vision-Language Models

  42. XL-DocBench: Benchmarking Evidence-Grounded Extra-Long Document Understanding

    Jul 21, 2026Hongchen Wei, Yuanzhe Wang, Bei Liu +9DocumentQuestion-Answering Benchmarks

  43. MonkeyOCRv2: A Visual-Text Foundation Model for Document AI

    Jul 13, 2026Yuliang Liu, Zhang Li, Ziyang Zhang +11Lingdt-Vl-OcrVisual Document Retrieval

  44. Leveraging Interpretable Tsetlin Machine for PDF Malware Detection

    Jul 10, 2026Rahul JaiswalMalwareDocument

  45. Secret Scanner Agent: Extracting Secrets and Access Context from Unstructured Documents

    Jul 10, 2026Zixiao Chen, Mariko Wakabayashi, Charlotte SiskaSecurity EvaluationData Leakage

  46. DocMaster: A Hierarchical Structure-Aware System for Document Analysis

    Jul 9, 2026Ziqi Chen, Yingli Zhou, Fangyuan Zhang +3DocumentDocumentation

  47. A Vision Based System for Guided and Collaborative Reconstruction of Fragmented Documents

    Jul 3, 2026Oliver Krumpek, Diana LeoCultural HeritageDocument

  48. Can Language Models Actually Retrieve In-Context? Drowning in Documents at Million Token Scale

    Jul 1, 2026Siddharth Gollapudi, Nilesh Gupta, Prasann Singhal +1In-ContextText Corpora