Multimodal Robustness

Momentum

22 papers in the last four weeks, up 120% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 183

All topics
CardsList
  1. Forced Deferral: Manipulating Routing Decisions in Multimodal LLM Cascades

    Jun 13, 2026Zhongye Liu, Yaopei Zeng, Yurui Chang +1Adversarial Attacks on VLMsMultimodal Robustness

  2. Augmentation techniques for video surveillance in the visible and thermal spectral range

    Jun 11, 2026Vanessa Buhrmester, Ann-Kristin Grosselfinger, David Munch +1Multimodal RobustnessData Augmentation

  3. Does AI Reviewer See the Full Picture? Attacking and Defending Multimodal Peer Review

    Jun 10, 2026Xinyu Zhao, Rana Muhammad Shahroz Khan, Zhen Xu +2Adversarial Attacks on VLMsMultimodal Robustness

  4. Missing-Token Prompted Reliability-Aware Fusion for Robust Polyglot Speaker Identification

    Jun 10, 2026Peng Jia, Li Dai, Jia Li +3Missing-Modality LearningMultimodal Robustness

  5. Heterogeneous 2D/1D Signal Representation Fusion for Underwater Acoustic Modulation Recognition Under Distribution Shift

    Jun 8, 2026Ronglai Qian, Liang An, Xiaoyan Wang +3Multimodal RobustnessMultimodal Fusion

  6. CAMF-Det: Closure-Aware Multimodal Fusion for LiDAR-Camera 3D Object Detection on UAV Platforms

    Jun 8, 2026Yanze Jiang, Yanfeng Gu, Xian LiLidar-Based 3D Object DetectionMultimodal Robustness

  7. LongMoE: Longitudinal Multimodal Learning via Trajectory-Aware Mixture-of-Experts

    Jun 6, 2026Maxx Richard Rahman, Prakhar Kumar, Wolfgang MaassMissing-Modality LearningMultimodal Robustness

  8. A robust PPG foundation model using multimodal physiological supervision

    Jun 5, 2026Eloy Geenjaar, Vince Calhoun, Scott Daly +4Multimodal RobustnessMultimodal Pretraining

  9. From Vision to Text: A Compact Multimodal Approach for Robust, Cross-Domain Presentation Attack Detection on ID Cards

    Jun 5, 2026Qingwen Zeng, Juan E. Tapia, Sneha Das +1Multimodal RobustnessDomain Generalization

  10. M2S-AVSR: Modality-aware Multi-view Self-supervised Representation for Robust Audio-Visual Speech Recognition

    Jun 4, 2026Fei Su, Cancan Li, Ming Li +1Multimodal RobustnessAudio-Visual Representation Learning

  11. PereStruct: Multimodal Semantic Assembly for Robust Historical Document Parsing

    Jun 3, 2026Maksim Shandybo, Ivan Bespalov, Daniil Yefimov +2Historical Document AnalysisMultimodal Robustness

  12. Exploring Adversarial Robustness and Safety Alignment in Multilingual Multi-Modal Large Language Models

    Jun 2, 2026Hashmat Shadab Malik, Muzammal Naseer, Salman KhanMultilingual Language Model EvaluationAdversarial Attacks on VLMs

  13. FAF-CD: Frequency-Aware Fusion for Change Detection under Imperfect Multimodal Remote Sensing

    Jun 2, 2026Yufan Wang, Sokratis Makrogiannis, Chandra KambhamettuMultimodal RobustnessFrequency-Domain Feature Learning

  14. AVI-Bench: Toward Human-like Audio-Visual Intelligence of Omni-MLLMs

    Jun 1, 2026Yaoting Wang, Ziyi Zhang, Wenming Tu +10Audio-Visual UnderstandingMultimodal Robustness

  15. Multi-modal Video Representation Alignment for Robust Self-supervised Driver Distraction Detection

    Jun 1, 2026David J. Lerch, Livien Majer, Zeyun Zhong +3Multimodal RobustnessCross-Modal Alignment

  16. Before Fusion, Ask What to Keep: Contextual Calibration of Multimodal Signals

    Jun 1, 2026Jiyuan Liu, Liangwei Nathan Zheng, Wei Emma Zhang +2Multimodal RobustnessMultimodal Fusion

  17. Jailbreaking Multimodal Large Language Models using Multi-Clip Video

    Jun 1, 2026Choongwon Kang, Seungjong Sun, Hyunmin Jun +1Multimodal RobustnessVideo-Language Models

  18. MMDG-Bench: A Benchmark for Multimodal Domain Generalization

    May 30, 2026Qianshan Zhan, Qian Wang, Da Li +2Multimodal RobustnessDomain Generalization

  19. Beyond the Mouth: Upper-Face Affective Cues in Audiovisual Sentence Recognition under Acoustic Uncertainty

    May 30, 2026Zhou Yang, Yueyi YangMultimodal RobustnessAutomatic Speech Recognition

  20. 4D Radar Meets LiDAR and Camera: Cooperative Perception under Adverse Weather

    May 29, 2026Melih Yazgan, Iramm Hamdard, Qiyuan Wu +1Camera-Radar FusionMultimodal Robustness

  21. Geometry-based Schrödinger Bridges for Trustworthy Multimodal Fusion

    May 29, 2026Jiayu Xiong, Jing Wang, Qi Zhang +2Multimodal RobustnessMultimodal Fusion

  22. Can BEV Perception Gracefully Degrade under Sensor Failures?

    May 29, 2026Haifa Zhang, Yijing Wang, Haoyu Wang +2Missing-Modality LearningMultimodal Robustness

  23. Text-guided Feature Disentanglement for Cross-modal Gait Recognition

    May 29, 2026Zhiyang Lu, Ming ChengDisentangled Representation LearningMultimodal Robustness

  24. Context-driven Missing-Modality Learning for Robust Medical Diagnosis with Image-Tabular Data

    May 25, 2026Tianling Liu, Lequan Yu, Tong Han +1Missing-Modality LearningMultimodal Robustness

  25. Do Image-Text Metrics Respect Semantic Invariances?

    May 23, 2026Amit Agarwal, Hitesh Laxmichand Patel, Meizhu Liu +9VLM EvaluationMultimodal Robustness