VLM Calibration

VLM: Vision-Language Model

Momentum

13 papers in the last four weeks, up 30% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 47

All topics
CardsList
  1. Towards Reliable Vision-Language Models for Autonomous Driving

    Oct 1, 2026Manasa Mariam Mammen, Priyanka Mary Mammen, Zafer Kayatas +1VLM RobustnessImage Corruption Robustness

  2. SubRot: Signed Gradient Subspace Calibration for VLM Rotation Quantization

    Sep 28, 2026Zhenhao Shang, Haizhao Jing, Haokui Zhang +4VLM QuantizationRotation-Based Quantization

  3. Domain Recentering and Confidence-Weighted Prior Calibration for Vision-Language Models

    Sep 24, 2026Youngeun Seol, Jimin Shin, Heeseo Yoon +1Source-Free Domain AdaptationUnsupervised Domain Adaptation

  4. Calibrated Probabilistic Obstruction Reasoning with Vision-Language Models for Grasping in Clutter

    Sep 16, 2026Thanh-Tuan Tran, Ngoc-Chien Chu, Thanh Nguyen Canh +3Robotic GraspingRobotic Manipulation

  5. The Mirage of Calibrated Confidence: Trajectory-Independence of Verbalized Confidence in Vision-Language Models

    Sep 16, 2026Jisoo Yang, Jaeho Han, Trung X. Pham +1VLM EvaluationConfidence Estimation in Language Models

  6. Can VLMs Reliably Assess Sidewalk Accessibility Attributes from Pedestrian-Level Imagery?

    Sep 15, 2026Seung Jae Lieu, Diego Morra, Chiara Cadoni +3VLM EvaluationUrban Planning

  7. Bridging the Confidence Gap: Temperature Scaling for Calibrating Test-Time Prompt Tuning

    Sep 15, 2026Yuwei Liang, Jian Liang, Dapeng Hu +2Post-Hoc CalibrationTest-Time Adaptation of VLMs

  8. Human-Grounded Calibration for Long-Text Image-Text Congruence in Vision-Language Models

    Sep 14, 2026Alessandro Gambetti, Qiwei HanText-Image AlignmentVision-Language Retrieval

  9. IntroConformal: Conformal Factuality Guarantees for Large Vision-Language Models via Introspective Signals

    Sep 1, 2026Md. Atabuzzaman, Christian Alexander, Chris ThomasVLM EvaluationLarge Vision-Language Models

  10. Good Memory Has ECC: Evaluating the Memory of Vision-Language Models Beyond Accuracy

    Aug 31, 2026Shmuel Berman, Jia DengVLM EvaluationMemory-Augmented VLMs

  11. Rethinking the Test-Time Prompt Tuning Objective from the Perspective of Calibration

    Aug 31, 2026Jungwon Choi, Hyeonseo Jang, Kibok Lee +1VLM CalibrationUncertainty Calibration

  12. Frontier vision-language models have overtaken young adults at detecting AI-generated portraits -- but not their calibration

    Aug 31, 2026Sunwhi Kim, Sunyul Kim, Meounggun Jo +1VLM EvaluationVision-Language Models

  13. SpanCalib-VLM: Calibrated Hallucination Span Detection in Vision-Language Models

    Aug 30, 2026Amanuel Gizachew Abebe, Yasmin MoslemHallucination Detection in VLMsHallucination Detection

  14. MVC-Bench: Benchmarking Calibration of Medical Vision-Language Models

    Aug 27, 2026Ashshak Sharifdeen, Shihab Aaqil Ahamed, Ufaq Khan +6VLM EvaluationVLM Robustness

  15. TRAPSBench: Vision-Language Models Encode but Fail to Express Epistemic Restraint

    Aug 13, 2026Fnu Pramono, John Cai, Sourabh KulkarniVLM EvaluationVision-Language Models

  16. CARE: Confidence-Aware Reasoning for Reliable Medical VQA

    Aug 11, 2026Yuetian Du, Yucheng Wang, Zhenyuan Chen +9Medical VQAMedical VLMs

  17. Vision-Language Model Confidence Is Not a Property of the Answer

    Aug 6, 2026Reza Khanmohammadi, Erfan Miahi, Ivan Brugere +4VLM RobustnessAdversarial Attacks on VLMs

  18. Confidence Estimation for Financial Vision-Language Models in Chart and Document Understanding

    Aug 6, 2026Reza Khanmohammadi, Simerjot Kaur, Charese H. Smiley +2Visual Question AnsweringSelective Prediction

  19. Respect Your Zero-Shot Uncertainty: Conservative Calibration for Test-Time-Adapted Vision-Language Models

    Aug 6, 2026Jingyan Jiang, Yaru Sun, Xiao Chen +5VLM AdaptationTest-Time Adaptation of VLMs

  20. Perceptual Anchoring: Prototype-Guided Text Calibration for Training-free Open-Vocabulary Semantic Segmentation

    Aug 4, 2026Wanli Ma, Jiangwen Lu, Qinmu Peng +1Open-Vocabulary Semantic SegmentationVision-Language Alignment

  21. Confident but Unreliable: A Behavioral Safety Audit of Vision-Language Models on Brain MRI

    Aug 3, 2026Amir Sabbaghziarani, Mohammadsajad Abavisani, Sergey PlisVLM EvaluationVLM Hallucination

  22. When Model Priors Conflict with Visual Evidence: Mitigating Commonsense-Driven Hallucinations by Selective Prior Calibration

    Jul 31, 2026Kesheng Chen, Yamin Hu, Wenjian LuoVLM HallucinationVLM Calibration

  23. Mitigating Class-Tail Undercoverage in Medical Vision-Language Models under Clinical Shift

    Jul 30, 2026Mushir Akhtar, M. TanveerGroup-Conditional Conformal PredictionConformal Prediction

  24. Confidence Scores in Open-Vocabulary Detection Are a Biased Mixture of Scale and Semantics

    Jul 13, 2026Yi Tang Soon, Jun-Wei HsiehOpen-Vocabulary Object DetectionObject Detection

  25. MED-DSLC: Multi-Expert-Domain Classification via Domain Supervision and Logit Calibration

    Jul 13, 2026Zheng Zeng, Deepak Sridhar, Nuno VasconcelosVLM RobustnessVLM Adaptation

  26. When Prompts Ignore Structure: Graph-Based Attribute Reasoning for Calibrated VLMs

    Jul 8, 2026Tanay Sodha, Aditya Sharma, Ramya Hebbalaguppe +2Vision-Language ModelsVLM Adaptation

  27. Just how sure are you? Improving Verbalized Uncertainty Calibration in Medical VQA

    Jun 25, 2026Eren Senoglu, Federico Toschi, Nicolo Brunello +2Medical VQALanguage Model Calibration

  28. Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation

    Jun 22, 2026Yu Cao, Ziquan Liu, Zhensong Zhang +3VLM EvaluationPhysical Consistency in Video Generation

  29. Look Again Before You Abstain:Budgeted Conformal Evidence Acquisition for Reliable Vision-Language Model

    Jun 15, 2026Jian Xu, Delu Zeng, John Paisley +1Hallucination Detection in VLMsActive Perception

  30. Density-Aware Translation of Spurious Correlations in Zero-Shot VLMs

    Jun 1, 2026Afsaneh Hasanebrahimi, Hanxun Huang, Christopher Leckie +1VLM RobustnessVision-Language Models

  31. CHASD: Language Increment-Calibrated Contrastive Decoding against Hallucination in LVLMs

    May 22, 2026Xiaoyi Huang, Kejia Zhang, Zhiming LuoHallucination Detection in VLMsEfficient VLM Inference

  32. Ranking-Aware Calibration for Reliable Multimodal Reinforcement Learning

    May 16, 2026Peng Cui, Boyao Yang, Jun ZhuMultimodal RobustnessVLM Reasoning

  33. Grounded or Guessing? LVLM Confidence Estimation via Blind-Image Contrastive Ranking

    May 11, 2026Reza Khanmohammadi, Erfan Miahi, Simerjot Kaur +4VLM EvaluationVision-Language Models

  34. Online Self-Calibration Against Hallucination in Vision-Language Models

    May 1, 2026Minghui Chen, Chenxu Yang, Hengjie Zhu +3Vision-Language ModelsHallucination in Language Models

  35. Overconfidence and Calibration in Medical VQA: Empirical Findings and Hallucination-Aware Mitigation

    Apr 2, 2026Ji Young Byun, Young-Jin Park, Jean-Philippe Corbeil +1Vision-Language ModelsVLM Hallucination

  36. How (Mis)calibrated is your Federated CLIP and what to do about it?

    Dec 3, 2025Mainak Singha, Masih Aminbeidokhti, Paolo Casari +3Vision-Language ModelsVLM Adaptation