VLM Robustness

VLM: Vision-Language Model

Latest papers 295

All topics
CardsList
  1. Sens-VisualNews: A Benchmark Dataset for Sensational Image Detection

    May 11, 2026Andreas Goulas, Damianos Galanopoulos, Evlampios Apostolidis +1VLM EvaluationVLM Robustness

  2. RePO-VLA: Recovery-Driven Policy Optimization for Vision-Language-Action Models

    May 10, 2026Weijia Liufu, Xiaoyu Guo, Ruiyi Chen +16VLM RobustnessRobot Failure Recovery

  3. Reinforcing Multimodal Reasoning Against Visual Degradation

    May 10, 2026Rui Liu, Dian Yu, Haolin Liu +6VLM RobustnessImage Corruption Robustness

  4. KEPIL: Knowledge-Enhanced Prompt-Image Learning for Prompt-Robust Disease Detection

    May 9, 2026Haozhe Luo, Shelley Zixin Shu, Ziyu Zhou +2VLM RobustnessRadiology VLMs

  5. FragileFlow: Spectral Control of Correct-but-Fragile Predictions for Foundation Model Robustness

    May 9, 2026Zhuoyun Li, Boxuan Wang, Jinwei Hu +2VLM RobustnessSpectral Regularization

  6. MedVIGIL: Evaluating Trustworthy Medical VLMs Under Broken Visual Evidence

    May 8, 2026Hanqi Jiang, Junhao Chen, Mingyu Kang +12VLM EvaluationVLM Robustness

  7. Sparse Autoencoders as Plug-and-Play Firewalls for Adversarial Attack Detection in VLMs

    May 8, 2026Hao Wang, Yiqun Sun, Pengfei Wei +2VLM RobustnessAdversarial Attacks on VLMs

  8. Weather-Robust Scene Semantics with Vision-Aligned 4D Radar

    May 8, 2026Kali Hamilton, Christoffer HeckmanCross-Modal LearningVLM Robustness

  9. Hard to Read, Easy to Jailbreak: How Visual Degradation Bypasses MLLM Safety Alignment

    May 8, 2026Zhixue Song, Boyan Han, Yiwei Wang +1VLM RobustnessAdversarial Attacks on VLMs

  10. When Relations Break: Analyzing Relation Hallucination in Vision-Language Model Under Rotation and Noise

    May 6, 2026Philip Wootaek Shin, Ajay Narayanan Sridhar, Sivani Devarapalli +3VLM RobustnessVLM Hallucination

  11. Test-Time Training for Visual Foresight Vision-Language-Action Models

    May 6, 2026Sangwu Park, Wonjoong Kim, Yeonjun In +3VLM RobustnessTest-Time Training

  12. Laundering AI Authority with Adversarial Examples

    May 5, 2026Jie Zhang, Pura Peetathawatchai, Florian Tramèr +1VLM RobustnessAdversarial Attacks on VLMs

  13. Does it Really Count? Assessing Semantic Grounding in Text-Guided Class-Agnostic Counting

    May 4, 2026Giacomo Pacini, Luca Ciampi, Nicola Messina +3VLM EvaluationVLM Robustness

  14. LAGO: Language-Guided Adaptive Object-Region Focus for Zero-Shot Visual-Text Alignment

    May 4, 2026Junyi Hu, Qiji Zhou, Lei Zhang +1VLM RobustnessEfficient VLM Inference

  15. CBV: Clean-label Backdoor Attacks on Vision Language Models via Diffusion Models

    May 4, 2026Ji Guo, Xiaolong Qin, Cencen Liu +3VLM RobustnessAdversarial Attacks on VLMs

  16. Self-Captioning Multimodal Interaction Tuning: Amplifying Exploitable Redundancies for Robust Vision Language Models

    May 3, 2026Yuriel Ryan, Hei Man Ip, Adriel Kuek +2VLM RobustnessMultimodal Hallucination

  17. Exploring Prompt Alignment with Clinical Factors in Zero-Shot Segmentation VLMs for NSCLC Tumor Segmentation

    May 2, 2026Suraj Pai, Thibault Heintz, Cosmin Ciausu +3VLM RobustnessImage Segmentation

  18. Persistent Visual Memory: Sustaining Perception for Deep Generation in LVLMs

    May 1, 2026Siyuan Huang, Xiaoye Qu, Yafu Li +6Memory-Augmented VLMsVLM Robustness

  19. Embodied Interpretability: Linking Causal Understanding to Generalization in Vision-Language-Action Models

    May 1, 2026Hanxin Zhang, Mingshuo Xu, Abdulqader Dhafer +3VLM RobustnessVLM Interpretability

  20. Beyond Shortcuts: Mitigating Visual Illusions in Frozen VLMs via Qualitative Reasoning

    Apr 29, 2026Hao Guo, Fei Wang, Junjie Chen +4VLM RobustnessVisual Reasoning

  21. SIEVES: Selective Prediction Generalizes through Visual Evidence Scoring

    Apr 28, 2026Hector G. Rodriguez, Marcus RohrbachVisual Question AnsweringVLM Robustness

  22. FCMBench-Video: Benchmarking Document Video Intelligence

    Apr 28, 2026Runze Cui, Fangxin Shang, Yehui Yang +3VLM EvaluationDocument Understanding

  23. Majorization-Guided Test-Time Adaptation for Vision-Language Models under Modality-Specific Shift

    Apr 27, 2026Lixian Chen, Yanhui Chen, Junyi LinVLM RobustnessTest-Time Adaptation