Multilingual VLM Evaluation

VLM: Vision-Language Model

Latest papers 34

All topics
CardsList
  1. Vroom-Vroom at SHROOM-Visions: A Multi-Judge Committee for Detecting Hallucinated Spans in Vision-Language Outputs

    Sep 15, 2026Toqeer Ehsan, Nico Penttilä, Richard Schmidt +2VLM EvaluationHallucination Detection in VLMs

  2. ChitraMiti: Benchmarking Visual Grounding and Modality Reliance in Bengali Geometric Reasoning

    Sep 14, 2026Khan Raiyan Ibne Reza, Sanjana Aktar Maria, Sumaiya Tabassum Nimi +1Mathematical Reasoning BenchmarksMultilingual VLM Evaluation

  3. BanglaMemeX: Advancing Cultural Metaphoric Image Interpretation in Bangla with a Multimodal Explainable Dataset

    Sep 7, 2026Md. Sadman Sakib, Zisan Mahmud, Md. Fahim Arefin +1Figurative Language UnderstandingMultilingual VLM Evaluation

  4. MM-IFEval-Pro: A Multilingual and Attack-Resistant Benchmark for Instruction-Following in Vision-Language Models

    Sep 4, 2026Changming Xiao, Zhenliang Ni, Jinhui He +2VLM RobustnessAdversarial Attacks on VLMs

  5. IchthyoNoma: Nomenclature and Context Sensitivity of Zero-Shot Biological Vision--Language Models for Bangladeshi Freshwater Fish Recognition

    Sep 3, 2026Nazim-E-Alam, Tarek Rahman, Md Kishor MorolVLM RobustnessPrompt Sensitivity

  6. CulturalMenuBench: Probing the Knowledge-Application Gap in Multimodal Culinary Reasoning

    Sep 3, 2026Bo Zeng, Linfeng Gao, Peiqin Lin +9Multimodal ReasoningMultilingual VLM Evaluation

  7. MemeCULT-1K: Benchmarking South Asian Cultural Context and Humor Understanding of Multimodal Models

    Sep 1, 2026Tawsif Tashwar Dipto, Mehedi Ahamed, Radib Bin Kabir +5VLM EvaluationMultilingual VLM Evaluation

  8. ImageEval 2026: Culturally Grounded Arabic Multimodal Evaluation

    Aug 31, 2026Samir Abdaljalil, Hunzalah Hassan Bhatti, Ahlam Bashiti +11Hallucination DetectionT2I Generation

  9. Read the Room, Read the Image: Understanding Indirect Speech Acts in Multimodal Visual Contexts

    Aug 31, 2026Jaehee Kim, Ji Hoon Chung, Seoyoon Park +5Multimodal QAMultilingual VLM Evaluation

  10. NARU: A Benchmark for NARrative Evolution and Cultural Nuance Understanding in Japanese Extreme Long Video

    Aug 13, 2026Yuheng Huang, Jianlang Chen, Jiayang Song +6Video UnderstandingVideo-Language Model Evaluation

  11. Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence

    Aug 13, 2026Jakub Pokrywka, Łukasz Grzybowski, Antoni Lasik +3Medical VQAMultilingual VLM Evaluation

  12. Jako Tako or Fluent? Presenting PoVisLE: A Polish Vision-Language Evaluation

    Aug 7, 2026Anna Kołos, Grzegorz Statkiewicz, Karolina Seweryn +3VLM EvaluationVisual Question Answering

  13. Khondo: A Multimodal Benchmark for Document Packet Splitting of Bangla Forms

    Jul 23, 2026Abu Tyeb Azad, Fahim Ahmed, Ishita Sur Apan +7Document ChunkingMultilingual VLM Evaluation

  14. Test-Time Scaling for Small VLMs on Multilingual Visual MCQ

    Jul 10, 2026Spiros Baxevanakis, Peng-Jian YangVisual Question AnsweringTest-Time Scaling for VLMs

  15. Evaluation of Multilingual Ability to Use Spatial Deictic Expressions in Vision-Language Models

    Jul 8, 2026Kaito Watanabe, Taisei Yamamoto, Tomoki Doi +1Visual Spatial ReasoningMultilingual VLM Evaluation

  16. MORE: A Multilingual Document Parsing Benchmark and Evaluation

    Jul 3, 2026Long Xu, Binghong Wu, Tinghao Yu +6Document ParsingMultilingual VLM Evaluation

  17. Resolution Thresholds in VLM Detection of Harmful ASCII Art Across Construction Modes and Languages

    Jun 28, 2026Yikai Hua, Peter WestVLM EvaluationVLM Robustness

  18. Not Truly Multilingual: Script Consistency as a Missing Dimension in VLM Evaluation

    Jun 15, 2026Prabhjot Singh, Bhushan Pawar, Madhu Reddiboina +1VLM EvaluationMultilingual Language Models

  19. MLingualFC: Evaluating Jailbreak Vulnerabilities in Multilingual Vision-Language Models

    Jun 5, 2026Rishabh Makwana, Mamta, Deeksha Varshney +1VLM EvaluationVLM Robustness

  20. Almieyar-Oryx-BloomBench: A Bilingual Multimodal Benchmark for Cognitively Informed Evaluation of Vision-Language Models

    Jun 4, 2026Mohammad Mahdi Abootorabi, Omid Ghahroodi, Anas Madkoor +4VLM EvaluationMultilingual VLM Evaluation

  21. Exploring Adversarial Robustness and Safety Alignment in Multilingual Multi-Modal Large Language Models

    Jun 2, 2026Hashmat Shadab Malik, Muzammal Naseer, Salman KhanMultilingual Language Model EvaluationAdversarial Attacks on VLMs

  22. Does Language Shift Break Medical Vision-Language Models? Indonesian Radiology Visual Question Answering Case Study

    Jun 2, 2026Pieter Christy Yan Yudhistira, Dzaki Rafif Malik, Novanto YudistiraVLM EvaluationVLM Robustness

  23. A Pilot Study on Curator-Guided Multilingual Art Description for Blind and Low-Vision Audiences with Small Vision-Language Models

    May 29, 2026Iosif Tsangko, Andreas Triantafyllopoulos, George Margetis +2Image CaptioningVLM Adaptation

  24. Language-Conditioned Visual Grounding with CLIP Multilingual

    May 9, 2026J. de Curtò, Mauro Liz, I. de ZarzàVLM EvaluationMultilingual VLM Evaluation