Large Vision-Language Models

Also known as LVLM

Momentum

30 papers in the last four weeks, up 36% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 248

All topics
CardsList
  1. TokenSwap: Backdoor Attack on the Compositional Understanding of Large Vision-Language Models

    Sep 29, 2025Zhifang Zhang, Qiqi Tao, Jiaqi Lv +3VLM RobustnessAdversarial Attacks on VLMs

  2. Mitigating Cross-Image Information Leakage in Multi-Image Understanding with Large Vision-Language Models

    Aug 19, 2025Yeji Park, Minyoung Lee, Sanghyuk Chun +1Large Vision-Language ModelsVLM Reasoning

  3. SAVER: Mitigating Hallucinations in Large Vision-Language Models via Style-Aware Visual Early Revision

    Aug 5, 2025Zhaoxu Li, Chenqi Kong, Yi Yu +6VLM EvaluationLLM Hallucination Mitigation

  4. Seeing Isn't Orienting: A Cognitively Informed Hierarchical Benchmark for Object Orientation in MLLMs

    May 27, 2025Nazia Tasnim, Keanu Nichols, Yuting Yan +4VLM EvaluationVisual Spatial Reasoning

  5. ToDRE: Effective Visual Token Pruning via Token Diversity and Task Relevance

    May 24, 2025Duo Li, Zuhao Yang, Xiaoqin Zhang +2Efficient VLM InferenceLarge Vision-Language Models

  6. Mitigating Hallucinations via Inter-Layer Consistency Aggregation in Large Vision-Language Models

    May 18, 2025Kai Tang, Jinhao You, Yichen Guo +8Vision-Language ModelsHallucination in Language Models

  7. Image-based Geo-localization for Robotics: Are Black-box Vision-Language Models there yet?

    Jan 28, 2025Sania Waheed, Bruno Ferrarini, Michael Milford +2VLM RobustnessCross-View Geo-Localization

  8. Exploiting Vision Encoder Vulnerabilities for Universal Adversarial Perturbations on Large Vision-Language Models

    Dec 11, 2024Hee-Seon Kim, Minbeom Kim, Seokil Ham +1VLM RobustnessAdversarial Attacks on VLMs

  9. Privacy-Aware Visual Language Models

    May 27, 2024Laurens Samson, Nimrod Barazani, Sennay Ghebreab +1VLM EvaluationVLM Adaptation

  10. InstructTA: Instruction-Tuned Targeted Attack for Large Vision-Language Models

    Dec 4, 2023Xunguang Wang, Pingchuan Ma, Zhenlan Ji +3Adversarial Attacks on VLMsLarge Vision-Language Models

  11. Geometric Coastline Localization using Vision-Language Models

    Date pendingRafia Malik, Bernhard Pfahringer, Karin Bryan +2Remote Sensing Image UnderstandingGeospatial Foundation Models