VLM Robustness

VLM: Vision-Language Model

Latest papers 295

All topics
CardsList
  1. TrustCLIP: Learning Private Visual Features via Adversarial Reconstruction

    Jul 5, 2026Nikos Athanasiou, Ilya A. Petrov, Angela Yao +7Gradient Inversion AttacksVLM Robustness

  2. Text as Partial Constraint: Core-Residual Alignment for Robust Vision-Language Learning

    Jul 3, 2026Chengzhen Yu, Canran Xiao, Siyuan Ma +1VLM RobustnessContrastive Learning

  3. Overloading Large Vision-Language Models for Jailbreaking

    Jul 3, 2026Haoyu Zhang, Yangyang Guo, Mohan KankanhalliVLM RobustnessAdversarial Attacks on VLMs

  4. Towards Robustness against Typographic Attack with Training-free Concept Localization

    Jul 2, 2026Bohan Liu, Wenqian Ye, Guangzhi Xiong +3VLM RobustnessAdversarial Attacks on VLMs

  5. Visually Grounded Self-Reflection for Vision-Language Models via Reinforcement Learning

    Jul 2, 2026Liyan Tang, Fangcong Yin, Greg DurrettVLM RobustnessVision-Language Models

  6. Domain Generalization via Text-Anchored Information Bottleneck

    Jul 2, 2026Eunyi Lyou, Yunjeong Choi, Junho Lee +1VLM RobustnessInformation Bottleneck

  7. StochasT: Learning with Stochastic Turn Depth for Visual Instruction Tuning

    Jul 1, 2026Yuan Qing, Chengzhi Mao, Boqing GongVLM EvaluationVLM Robustness

  8. Information-Regularized Attention for Visual-Centric Reasoning

    Jul 1, 2026Guohao Sun, Xiaofang Wang, Yash Patel +3VLM RobustnessVision-Language Grounding

  9. HyFL-CLIP: Hyperbolic Fine-Tuning of CLIP for Robust Long-Context Understanding

    Jul 1, 2026Ji Ha Jang, Hayeon Kim, Chulwon Lee +2VLM RobustnessVision-Language Models

  10. EgoSafetyBench: A Diagnostic Egocentric Video Benchmark for Evaluating Embodied VLMs as Runtime Safety Guards

    Jun 30, 2026Siddhant Panpatil, Arth Singh, Mijin Koo +3VLM RobustnessEgocentric Video Understanding

  11. Resolution Thresholds in VLM Detection of Harmful ASCII Art Across Construction Modes and Languages

    Jun 28, 2026Yikai Hua, Peter WestVLM EvaluationVLM Robustness

  12. Aloe-Vision: Robust Vision-Language Models for Healthcare

    Jun 25, 2026Jaume Guasch-Martí, Enrique Lopez-Cuena, Martín Suárez-Fernández +3VLM EvaluationVLM Robustness

  13. Confidence-Aware Tool Orchestration for Robust Video Understanding

    Jun 25, 2026Yangfan He, Yujin Choi, Jaehong YoonVLM RobustnessTool Use in VLMs

  14. Robust Onion: Peeling Open Vocab Object Detectors Under Noise

    Jun 25, 2026Priyank Pathak, Mukilan Karuppasamy, Aaditya Baranwal +2Open-Vocabulary Object DetectionVLM Robustness

  15. How Robust is OCR-Reasoning? Evaluating OCR-Reasoning Robustness of Vision-Language Models under Visual Perturbations

    Jun 24, 2026Yuxing Cheng, Yuan Wu, Yi ChangVLM EvaluationVLM Robustness

  16. PHANTOM: A Large-Scale Dataset of Multimodal Adversarial Attacks for Vision-Language Models

    Jun 23, 2026Simone Gallivanone, Hossein Khodadadi, Mauro Dore +2VLM EvaluationVLM Robustness

  17. REALM: A Unified Red-Teaming Benchmark for Physical-World VLMs

    Jun 22, 2026Yifei Zhao, Qian Lou, Mengxin ZhengVLM EvaluationVLM Robustness

  18. T-VSS: Test-Time Visual Subspace Steering for Adversarial Robustness of Vision-Language Models

    Jun 22, 2026Jaehyuk Jang, Minseok Seo. Seungju Cho, Kangwook Ko +1VLM RobustnessVLM Adaptation

  19. NegAS: Negative Label Guided Attention and Scoring for Out-of-Distribution Object Detection with Vision-Language Models

    Jun 21, 2026Yingjie Zhang, Shuai Li, Peng WangVLM RobustnessObject Detection

  20. FlowDec: Temporal Conditional Flow Decorruptor for Robust Continuous Vision-Language Navigation

    Jun 21, 2026Yufei Zhang, Changhao ChenVLM RobustnessVision-Language Navigation

  21. Robusto-2: Benchmarking Humans & VLMs for Autonomous Driving in Lima & New York City

    Jun 18, 2026Adrian Cespedes, Marcelo Chincha, Dunant Cusipuma +3VLM EvaluationAutonomous Driving Datasets

  22. SPOT-E: Test-Time Entropy Shaping with Visual Spotlights for Frozen VLMs

    Jun 18, 2026Bo Yin, Xiaobin Hu, Chengming Xu +6VLM RobustnessVLM Adaptation

  23. Benchmarking Large Vision-Language Models on Fine-Grained Image Tasks: From Evaluation to Diagnosis

    Jun 17, 2026Hong-Tao Yu, Chen-Wei Xie, Yuxin Peng +2VLM EvaluationVLM Robustness

  24. Semantic Robustness Certification for Vision-Language Models

    Jun 17, 2026Peiyu Yang, Paul Montague, Feng Liu +4VLM RobustnessDistribution Shift

  25. MLLMs Get It Right, Then Get It Wrong: Tracing and Correcting Late-Layer Textual Bias

    Jun 16, 2026Xingming Li, Ao Cheng, Qiyao Sun +4VLM RobustnessVision-Language Models

  26. Beyond Native Success: Auditing Deployment-Interface Exposure of CLIP Backdoors

    Jun 16, 2026Kunlan Xiang, Haomiao Yang, Wenbo JiangVLM RobustnessAdversarial Attacks on VLMs