Large Multimodal Models

Latest papers 75

All topics
CardsList
  1. Latent Denoising Improves Visual Alignment in Large Multimodal Models

    Apr 23, 2026Dhruv Parikh, Jacob Fein-Ashley, Rajgopal Kannan +1Large Multimodal ModelsVisual Representations

  2. Revisiting Change VQA in Remote Sensing with Structured and Native Multimodal Qwen Models

    Apr 20, 2026Yakoub Bazi, Mohamad M. Al Rahhal, Mansour Zuair +1Remote SensingLarge Multimodal Models

  3. UniCon: Unified Framework for Efficient Contrastive Alignment via Kernels

    Apr 17, 2026Hangke Sui, Yuqing Wang, Minh N DoContrastive AlignmentLarge Multimodal Models

  4. Find, Fix, Reason: Context Repair for Video Reasoning

    Apr 17, 2026Haojian Huang, Chuanyu Qin, Yinchuan Li +1Reasoning SkillsLarge Multimodal Models

  5. Robust Multispectral Semantic Segmentation under Missing or Full Modalities via Structured Latent Projection

    Apr 17, 2026Irem Ulku, Erdem Akagündüz, Ömer Özgür TanrıöverAmodal SegmentationComplementary Modalities

  6. GeoHeight-Bench: Towards Height-Aware Multimodal Reasoning in Remote Sensing

    Mar 26, 2026Xuran Hu, Zhitong Xiong, Zhongcheng Hong +3Geospatial ReasoningRemote Sensing

  7. HART: High-Resolution Annotation-Free Reasoning Technique through a Closed-loop Framework

    Feb 27, 2026Jiacheng Yang, Anqi Chen, Yunkai Dang +5Large Multimodal ModelsRecent Vision-Language Models

  8. Visual Species Recognition with Large Multimodal Models as Post-Hoc Correctors

    Dec 10, 2025Tian Liu, Anwesha Basu, James Caverlee +1Species IdentificationLarge Multimodal Models

  9. From Charts to Code: A Hierarchical Benchmark for Multimodal Models

    Oct 20, 2025Jiahao Tang, Henry Hengyuan Zhao, Lijian Wu +8Image-To-Code GenerationChart

  10. LM Fight Arena: Benchmarking Large Multimodal Models via Game Competition

    Oct 10, 2025Yushuo Zheng, Tongrui Ye, Zicheng Zhang +3Chatbot ArenaLarge Multimodal Models

  11. Q-SiT: Teaching LMMs for Image Quality Scoring and Interpreting

    Mar 12, 2025Zicheng Zhang, Haoning Wu, Ziheng Jia +2Image Quality AssessmentLarge Multimodal Models

  12. ZeroBench: An Impossible Visual Benchmark for Contemporary Large Multimodal Models

    Feb 13, 2025Jonathan Roberts, Mohammad Reza Taesiri, Ansh Sharma +31Large Multimodal Models