VLM Evaluation

VLM: Vision-Language Model

Latest papers 649

All topics
CardsList
  1. PlantExpertVQA: A Visual Question Answering Dataset for Benchmarking Vision-Language Models in Plant Science

    Aug 23, 2025Syed Nazmus Sakib, Nafiul Haque, Mohammad Zabed Hossain +1VLM EvaluationAgricultural Image Analysis

  2. MedRepBench: A Comprehensive Benchmark for Medical Report Interpretation

    Aug 21, 2025Fangxin Shang, Yuan Xia, Dalu Yang +2VLM EvaluationHealthcare

  3. A Study of Commonsense Reasoning over Visual Object Properties

    Aug 14, 2025Abhishek Kolari, Mohammadhossein Khojasteh, Yifan Jiang +2VLM EvaluationVisual Question Answering

  4. SAVER: Mitigating Hallucinations in Large Vision-Language Models via Style-Aware Visual Early Revision

    Aug 5, 2025Zhaoxu Li, Chenqi Kong, Yi Yu +6VLM EvaluationLLM Hallucination Mitigation

  5. Can Argus Judge Them All? Comparing VLMs Across Domains

    Jun 23, 2025Harsh Joshi, Gautam Siddharth Kashyap, Rafiq Ali +5VLM EvaluationVLM Robustness

  6. What's Missing in Vision-Language Models? Probing Their Struggles with Causal Order Reasoning

    Jun 1, 2025Zhaotian Weng, Haoxuan Li, Xin Eric Wang +2VLM EvaluationVLM Reasoning

  7. Seeing Isn't Orienting: A Cognitively Informed Hierarchical Benchmark for Object Orientation in MLLMs

    May 27, 2025Nazia Tasnim, Keanu Nichols, Yuting Yan +4VLM EvaluationVisual Spatial Reasoning

  8. VIBE: Annotation-Free Video-to-Text Information Bottleneck Evaluation for TL;DR

    May 23, 2025Shenghui Chen, Po-han Li, Sandeep Chinchali +1VLM EvaluationVideo Summarization

  9. SurgXBench: Explainable Vision-Language Model Benchmark for Surgery

    May 16, 2025Jiajun Cheng, Xianwu Zhao, Sainan Liu +5VLM EvaluationSurgical Video Understanding

  10. LightEMMA: A Longitudinal Evaluation of Vision-Language Models for Autonomous Driving

    May 1, 2025Zhijie Qiao, Haowei Li, Zhong Cao +1VLM EvaluationAutonomous Driving Benchmarks

  11. SpurLens: Automatic Detection of Spurious Cues in Multimodal LLMs

    Mar 11, 2025Parsa Hosseini, Sumit Nawathe, Mazda Moayeri +2VLM EvaluationVLM Robustness

  12. Enhanced Vision-Language Models for Diverse Sensor Understanding: Cost-Efficient Optimization and Benchmarking

    Dec 30, 2024Sangyun Chung, Youngjoon Yu, Se Yeon Kim +2VLM EvaluationVision-Language Models

  13. Privacy-Aware Visual Language Models

    May 27, 2024Laurens Samson, Nimrod Barazani, Sennay Ghebreab +1VLM EvaluationVLM Adaptation

  14. Prompting with Sign Parameters for Low-resource Sign Language Instruction Generation

    Date pendingMd Tariquzzaman, Md Farhan Ishmam, Saiyma Sittul Muna +2VLM EvaluationVision-Language Models

  15. Do Vision-Language Models Understand Visual Persuasiveness? A Diagnosis via Visual Persuasive Factors

    Date pendingGyuwon Park, Hyounghun KimVLM EvaluationVLM Reasoning

  16. Can Foundation Models Moderate Online Content? Evaluating Instruction- vs. Example-Driven Policy Operationalization

    Date pendingAyan Majumdar, Shounak Paul, Pushpdeep Singh +6VLM EvaluationLLM Prompting