Vision Foundation Model Adaptation

Latest papers 204

All topics
CardsList
  1. VAN-AD: Visual Masked Autoencoder with Normalizing Flow For Time Series Anomaly Detection

    Mar 27, 2026PengYu Chen, Shang Wan, Xiaohou Shi +3Masked AutoencodersVision Foundation Model Adaptation

  2. SIMPLER: Efficient Foundation Model Adaptation via Similarity-Guided Layer Pruning for Earth Observation

    Mar 20, 2026Víctor Barreiro, Johannes Jakubik, Francisco Argüello +1Geospatial Foundation ModelsVision Foundation Model Adaptation

  3. FMMC: Harnessing the Power of Foundation Models for Accurate Material Classification

    Mar 18, 2026Qingran Lin, Fengwei Yang, Chaolun ZhuVision-Language ModelsSynthetic Data Generation

  4. RePer-360: Releasing Perspective Priors for 360∘^\circ Depth Estimation via Self-Modulation

    Mar 6, 2026Cheng Guan, Chunyu Lin, Zhijie Shen +2Domain AdaptationDepth Estimation

  5. Spanning the Visual Analogy Space with a Weight Basis of LoRAs

    Feb 17, 2026Hila Manor, Rinon Gal, Haggai Maron +2Vision Foundation Model AdaptationLow-Rank Adaptation

  6. STORM: Slot-based Task-aware Object-centric Representation for robotic Manipulation

    Jan 28, 2026Alexandre Chapin, Emmanuel Dellandréa, Liming ChenVision Foundation Model AdaptationGeneralization in Robotic Manipulation

  7. Attentive multilayer fusion for vision transformers

    Jan 14, 2026Laure Ciernik, Marco Morik, Lukas Thede +4Linear ProbingVision Transformer

  8. Multi-View Foundation Models

    Dec 17, 2025Leo Segre, Or Hirschorn, Shai AvidanMulti-View ConsistencyVision Foundation Model Adaptation

  9. AD-SAM: Adapting the Segment Anything Model for Semantic Segmentation in Autonomous Driving

    Oct 30, 2025Het Patel, Mario Camarena, Fatemeh Nazari +3Vision Foundation Model AdaptationAutonomous Driving Perception

  10. Evaluating Fundus-Specific Foundation Models for Diabetic Macular Edema Detection

    Oct 8, 2025Franco Javier Arellano, José Ignacio OrlandoMedical Imaging Foundation ModelsVision Foundation Model Adaptation

  11. Phantom-Insight: Adaptive Multi-cue Fusion for Video Camouflaged Object Detection with Multimodal LLM

    Sep 8, 2025Hua Zhang, Changjiang LuoVideo Object SegmentationVision Foundation Model Adaptation

  12. EndoUFM: Utilizing Foundation Models for Monocular depth estimation of endoscopic images

    Aug 25, 2025Xinning Yao, Bo Liu, Bojian Li +3Medical ImagingMonocular Depth Estimation

  13. Extending Foundational Monocular Depth Estimators to Fisheye Cameras with Calibration Tokens

    Aug 6, 2025Rit Gangopadhyay, Jung-Hee Kim, Xien Chen +3Domain AdaptationDepth Estimation

  14. WaRA: Wavelet Low-Rank Adaptation for Medical Image Classification

    Jun 25, 2025Moein Heidari, Yijin Huang, Yasamin Medghalchi +3Vision Foundation Model AdaptationLow-Rank Adaptation

  15. Unlocking Pretrained Vision Transformers for Time Series Classification

    Jun 10, 2025Simon Roschmann, Quentin Bouniot, Vasilii Feofanov +2Time Series ClassificationVision Transformer

  16. SARTM: Segment Any RGB Thermal Model with Language aided Distillation

    May 4, 2025Dong Xing, Jinhe Zhang, Hang Yang +1Vision Foundation Model AdaptationSemantic Segmentation

  17. C-LoRA: Continual Low-Rank Adaptation for Pre-trained Visual Models

    Feb 25, 2025Xin Zhang, Liang Bai, Xian YangLow-Rank AdaptationVision Foundation Model Adaptation

  18. Large Pretraining Datasets Don't Guarantee Robustness after Fine-Tuning in Image Classification

    Oct 28, 2024Jaedong Hwang, Brian Cheung, Zhang-Wei Hong +3Neural Network RobustnessOOD Generalization

  19. Early Intervention for VFM-based Multimodal Medical Image Classification

    Date pendingQijie Wei, Hailan Lin, Xirong LiCross-Modal Representation LearningVision Foundation Model Adaptation

  20. A2DINOv3: Rethinking Multi-Modal Object Detection via Socialized Collaboration

    Date pendingJiekang Feng, Zhihe Fan, Yunqi Zhu +6Multispectral Object DetectionInfrared Object Detection