Vision Foundation Model Adaptation

Latest papers 204

All topics
CardsList
  1. SV-TAD: Native Sparse Convs for Efficient Temporal Action Detection

    Oct 8, 2026Ricardo Pizarro, Roberto Valle, José M. Buenaposada +2Temporal Action DetectionEfficient ViTs

  2. Diffusion Meta-Prompting and Steering for Generalizable Foundation Model Adaptation

    Oct 8, 2026Deepak Sridhar, Yi Li, Kartikeya Bhardwaj +7Prompt LearningVision Foundation Model Adaptation

  3. One-Shot Adaptive Segmentation For Scientific Images

    Oct 7, 2026Tejaswi V. Panchagnula, Allison M. Davis, Fengqing ZhuImage SegmentationVision Foundation Model Adaptation

  4. BagDINO: Multi-View Baggage Re-Identification with DINOv3

    Oct 7, 2026Vita Santa Barletta, Danilo Caivano, Rebecca Margiotta +2Vision Foundation Model Adaptation

  5. Do Better Visual Representations Always Lead to Better End-to-End Autonomous Driving?

    Oct 7, 2026Zihao Zhang, Haochen Tian, Tianyu Li +5End-to-End Autonomous DrivingRepresentation Alignment

  6. Forensic Reserve: Eliciting Latent Knowledge for Image Forgery Detection

    Oct 6, 2026Jiahua Li, Zixu John, Tom Zhong +5Image Forgery DetectionVision Foundation Model Adaptation

  7. Beyond Training from Scratch: Foundation Models for Data-Efficient and Generalizable Cardiac MRI Reconstruction

    Oct 6, 2026Anam Hashmi, Mayug Maniparambil, Julia Dietlmeier +2Image ReconstructionVision Foundation Model Adaptation

  8. Localize Any Object in X-Ray Security Scans without Human Annotation

    Oct 5, 2026Yaqi Cai, Mingxuan Liu, Lorenzo Vaquero +5Self-Supervised LearningSynthetic Data Generation

  9. FAST: Flow Any Scene Transformer

    Sep 30, 2026Yongjian Zhang, Longguang Wang, Zhuo Song +3Optical FlowVision Transformer

  10. DCM-SAM: Defect-Conditioned Mixture of LoRA Experts for NPU-Deployed AM Defect Segmentation

    Sep 30, 2026Md Mushfiqur Rahaman, Md Mahedi Hasan, Imtiaz Ahmed +1Mixture of ExpertsVision Foundation Model Adaptation

  11. When to Adapt: Multi-Signal Domain Shift Detection for Efficient Training-Free Adaptation in Open-Vocabulary Segmentation

    Sep 29, 2026Michele Antonazzi, Alejandra C. Hernandez, José Araujo +2Distribution ShiftContinual Test-Time Adaptation

  12. HyperSAM: A Promptable Foundation Model for Hyperspectral Remote Sensing

    Sep 29, 2026Li Pang, Xinqiao Wu, Jing Yao +5Synthetic Data AugmentationVision Foundation Model Adaptation

  13. Forensic-Aware Continual Adaptation for Image Forgery Localization

    Sep 29, 2026Chenqi Kong, Song Xia, Anwei Luo +3Image Forgery DetectionVision Foundation Model Adaptation

  14. You Only Reprogram Once: Rethinking Prolonged Training for Visual Reprogramming

    Sep 29, 2026Zizhao Li, Mohammed Yaqoob Ansari, Xinyu Su +3VLM AdaptationVision Foundation Model Adaptation

  15. Boosting Metric Depth Completion via Training-Free Adaptive Response Geometry

    Sep 28, 2026Mia Zhang, Jizong PengPost-Hoc CalibrationDepth Completion

  16. DBCF: Dual-Branch Complementary Fusion of Foundation Models for Generalized Deepfake Detection

    Sep 28, 2026Fengming Gu, Mingjie He, Zonghui Guo +2Vision Foundation Model AdaptationDeepfake Detection

  17. WildHSR: Metric Feed-Forward 4D People-Scene Reconstruction from a 3D Foundation Model

    Sep 24, 2026Jerrin Bright, John ZelekVision Foundation Model AdaptationDynamic Scene Reconstruction

  18. Geometry-Conditioned Visual Place Recognition in Natural Environments

    Sep 23, 2026Walter Nedov, Saimunur Rahman, Kavindie Katuwandeniya +3Visual Representation LearningVisual Place Recognition

  19. nnFoundation: 3D Foundation Models for Radiology

    Sep 22, 2026Constantin Ulrich Harsy, Tassilo Wald, Karol Gotkowski +803D Foundation ModelsMedical Imaging Foundation Models

  20. Vision Foundation Models with Synthetic-Only Training for Monocular Spacecraft Pose Estimation

    Sep 22, 2026John Church, Vazghen NikolianVision Foundation Model AdaptationObject Pose Estimation

  21. RootQuantV2: Adapting a Vision Foundation Model for Root-Trait Regression from Minirhizotron Imagery

    Sep 22, 2026Kinjalk Parth, Sebastian Varela, Andrew D. B. LeakeyPlant PhenotypingVision Foundation Model Adaptation

  22. 0.5%>100%: Bidirectional Reciprocal Learning for Referring Image Segmentation

    Sep 21, 2026Xiaoqiang Lu, Licheng Jiao, Lingling Li +5VLM AdaptationVision Foundation Model Adaptation

  23. AnalogDepth: Multi-view Geometry from FPV drones under Analog Video Transmission

    Sep 21, 2026André Amorim, Pedro F. ProençaDepth EstimationMulti-View 3D Reconstruction

  24. Comparative Performance and Parameter-Efficient Adaptation of DINOv2 for Active Trachoma Classification

    Sep 20, 2026Kibrom Gebremedhin, Hadush Hailu, Bruk Gebregziabher +1Channel AttentionVision Foundation Model Adaptation

  25. GAPrompt++: Multi-Granular Geometry-Aware Point Cloud Prompt for 3D Vision Model

    Sep 17, 2026Zixiang Ai, Zhenyu Cui, Yufei Guo +4Point Cloud LearningVision Foundation Model Adaptation

  26. Bridging Vision Foundation Model Priors with CLIP for Spatial-aware Few-shot Anomaly Detection in Medical Images

    Sep 14, 2026Juzheng Miao, Yuchen Yuan, Cheng Chen +1Few-Shot Anomaly DetectionMedical Image Anomaly Detection

  27. Spectral Adapters for Segment Anything Model-based Segmentation of Colorectal Liver Metastases in Computed Tomography

    Sep 11, 2026Ramtin Mojtahedi, Mohammad Hamghalam, Jacob J. Peoples +6Promptable Image SegmentationVision Foundation Model Adaptation