Lingdt-Vl-Ocr

Latest papers 28

All topics
CardsList
  1. Color Independent Word Segmentation From Transcribed Bangla Passages

    Oct 1, 2026Faias Satter, Noor Masrur, Sk. Md. Masudul AhsanDocument SegmentationOptical Character Recognition

  2. Xiaomi-OCR-0 Technical Report

    Sep 28, 2026Xin Chen, Anan Du, Feng Feng +7Lingdt-Vl-OcrDocument Parsing

  3. Diffusion Drafts, AR Verifies: Accelerating Document OCR with Self-Speculative Decoding

    Sep 22, 2026Dohyun Kim, Sungjun Han, Hyungguk Kim +4Lingdt-Vl-OcrBlock-Diffusion Drafter

  4. All-in-One Multilingual Scene Text Recognition with Script-aware Mixture-of-Experts

    Sep 21, 2026Xingsong Ye, Yongkun Du, Jiaxin Zhang +6Scene Text RecognitionLingdt-Vl-Ocr

  5. How Far Can Synthetic Data Take Thai OCR?

    Sep 3, 2026Kunat PipatanakulLingdt-Vl-OcrOptical Character Recognition

  6. Jina-OCR-v1: Efficient Document Parsing with Speculative Decoding and Dense Verifiable Rewards

    Sep 2, 2026Alejandro Barón García, Feng Wang, Emilia Garcia Casademont +1Lingdt-Vl-OcrDocument Parsing

  7. RAGOCR: Optical Compression of Retrieval-Augmented Text via Visual Representation

    Aug 1, 2026Jiayang Yu, Jialun Zhong, Lei ZouKnowledge-Based Visual Question AnsweringLingdt-Vl-Ocr

  8. MonkeyOCRv2: A Visual-Text Foundation Model for Document AI

    Jul 13, 2026Yuliang Liu, Zhang Li, Ziyang Zhang +11Lingdt-Vl-OcrVisual Document Retrieval

  9. HunyuanOCR-1.5: Making Lightweight OCR VLMs Faster and Better

    Jul 6, 2026Gengluo Li, Xingyu Wan, Shangpin Peng +20Lingdt-Vl-OcrRecent Vision-Language Models

  10. Cross-Temporal Sinhala OCR: Page-Level Adaptation and Diachronic Analysis

    Jun 28, 2026Avisha Dilhara, Nevidu JayatillekeLingdt-Vl-OcrOptical Character Recognition

  11. How Robust is OCR-Reasoning? Evaluating OCR-Reasoning Robustness of Vision-Language Models under Visual Perturbations

    Jun 24, 2026Yuxing Cheng, Yuan Wu, Yi ChangLingdt-Vl-OcrOptical Character Recognition

  12. Unlimited OCR Works

    Jun 22, 2026Youyang Yin, Huanhuan Liu, YY +14Lingdt-Vl-OcrOptical Character Recognition

  13. POTATR: A Lightweight Image-to-Graph Model for Page-Level Table Extraction

    Jun 8, 2026Brandon Smock, Libin Liang, Max Sokolov +4Lingdt-Vl-OcrImage-Text Pairs

  14. ABot-OCR Technical Report

    May 27, 2026Kaitao Jiang, Ruiyan Gong, Xiaolong Cheng +3Lingdt-Vl-OcrRecent Vision-Language Models

  15. FastOCR: Dynamic Visual Fixation via KV Cache Pruning for Efficient Document Parsing

    May 17, 2026Zihan Tang, Leqi Shen, Hui Chen +7Lingdt-Vl-OcrOptical Character Recognition

  16. Chronicles-OCR: A Cross-Temporal Perception Benchmark for the Evolutionary Trajectory of Chinese Characters

    May 12, 2026Gengluo Li, Shangpin Peng, Xingyu Wan +16Lingdt-Vl-OcrMultimodal Benchmarks

  17. RTPrune: Reading-Twice Inspired Token Pruning for Efficient DeepSeek-OCR Inference

    May 1, 2026Ben Wan, Yan Feng, Zihan Tang +4Visual Token PruningLingdt-Vl-Ocr

  18. The Structured Output Benchmark: A Multi-Source Benchmark for Evaluating Structured Output Quality in Large Language Models

    Apr 28, 2026Abhinav Kumar Singh, Harsha Vardhan Khurdula, Yoeven D Khemlani +1Large-Scale BenchmarkLingdt-Vl-Ocr

  19. When the Forger Is the Judge: GPT-Image-2 Cannot Recognize Its Own Faked Documents

    Apr 28, 2026Jiaqi Wu, Yuchen Zhou, Dennis Tsang Ng +5Lingdt-Vl-OcrDocument

  20. Benchmarking OCR Pipelines with Adaptive Enhancement for Multi-Domain Retail Bill Digitization

    Apr 28, 2026Vijaysinh GaikwadOptical Character RecognitionLingdt-Vl-Ocr

  21. TexOCR: Advancing Document OCR Models for Compilable Page-to-LaTeX Reconstruction

    Apr 24, 2026Chengye Wang, Lin Fu, Zexi Kuang +1Lingdt-Vl-OcrOptical Character Recognition

  22. TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents

    Date pendingPeng Cai, Zhaofan Zou, Shifa Liu +7Document ParsingLingdt-Vl-Ocr