Vision Foundation Model Adaptation

Latest papers 204

All topics
CardsList
  1. RepSAM: Bridging Foundation Models to Robotic Vision via Representation-Guided Adaptation

    May 25, 2026Wenhui ChuVision Foundation Model AdaptationRobotic Manipulation

  2. Self-Supervised Contrastive Learning for Cardiac MR Sequence Classification

    May 24, 2026Yuli Wang, Hyewon Jung, Dongshen Peng +10Vision TransformerVision Foundation Model Adaptation

  3. Rethinking Transfer Learning for Industrial Inspection: DINOv3 vs. ImageNet Pretraining Across RGB and X-ray Tasks

    May 22, 2026Mehdi Gharbage, Céline Teulière, Pierre Bouges +1Self-Supervised Pre-TrainingIndustrial Anomaly Detection

  4. Enhancing Gaze Reasoning in Vision Foundation Models for Gaze Following

    May 21, 2026Shijing Wang, Yaping Huang, Chaoqun Cui +4Vision Foundation Model Adaptation

  5. Segment Anything with Motion, Geometry, and Semantic Adaptation for Complex Nonlinear Visual Object Tracking

    May 21, 2026Deyi Zhu, Yuji Wang, Yong Liu +4Visual Object TrackingVision Foundation Model Adaptation

  6. Accelerating Vision Foundation Models with Drop-in Depthwise Convolution

    May 21, 2026Carmelo Scribano, Mohammad Mahdi, Nedyalko Prisadnikov +5Vision Foundation ModelsVision Foundation Model Adaptation

  7. Lighting-aware Unified Model for Instance Segmentation

    May 19, 2026Qisai Liu, Alloy Das, Zhanhong Jiang +4Instance SegmentationVision Foundation Model Adaptation

  8. UniRefiner: Teaching Pre-trained ViTs to Self-Dispose Dross via Contrastive Register

    May 19, 2026Congpei Qiu, Zhaoyu Hu, Wei Ke +3Vision TransformerVision Foundation Model Adaptation

  9. Towards Data-Efficient Video Pre-training with Frozen Image Foundation Models

    May 18, 2026Svetlana Orlova, Niccolò Cavagnero, Gijs DubbelmanStreaming Video UnderstandingVision Foundation Model Adaptation

  10. MedFM-Robust: Benchmarking Robustness of Medical Foundation Models

    May 18, 2026Xiangxiang Cui, Tianjin Huang, Yifang Wang +2Multimodal RobustnessNeural Network Robustness

  11. Weighted Reverse Convolution for Feature Upsampling

    May 17, 2026Wentong Li, Zhiyuan Qi, Zichen Zhao +2Vision Foundation Model AdaptationInverse Problems

  12. HyperVision: A Channel-Adaptive Ground-Based Hyperspectral Vision Pre-trained Backbone

    May 17, 2026Guanyiman Fu, Jingtao Li, Zihang Cheng +8Vision Foundation Model AdaptationHyperspectral Imaging

  13. LoCO: Low-rank Compositional Rotation Fine-tuning

    May 15, 2026An Nguyen, Jaesik Choi, Anh TongFine-TuningLLM Fine-Tuning

  14. GAP: Geometric Anchor Pre-training for Data-Efficient Visuomotor Learning of Manipulation Tasks

    May 15, 2026Davide Buoso, Andrea Protopapa, Stefano Di Carlo +2Vision Foundation Model AdaptationVisuomotor Policy Learning

  15. Weakly Supervised Segmentation as Semantic-Based Regularization

    May 13, 2026Stefano Colamonaco, Andrei-Bogdan Florea, Jaron MaeneImage SegmentationWeakly Supervised Image Segmentation

  16. Anomaly-Aware Vision-Language Adapters for Zero-Shot Anomaly Detection

    May 12, 2026Muhammad Aqeel, Maham Nazir, Uzair Khan +2VLM AdaptationMedical Image Anomaly Detection

  17. Vision Transformer-Conditioned UNet for Domain-Adaptive Semantic Segmentation

    May 12, 2026Joel Valdivia Ortega, Tingying Peng, Marion JasninHybrid CNN-Transformer ArchitecturesVision Foundation Model Adaptation

  18. BGG: Bridging the Geometric Gap between Cross-View images by Vision Foundation Model Adaptation for Geo-Localization

    May 11, 2026Wei Wang, Dou Quan, Ning Huyan +4Cross-View Geo-LocalizationGeospatial Representation Learning

  19. Frequency Adapter with SAM for Generalized Medical Image Segmentation

    May 11, 2026Phuoc-Nguyen Bui, Van-Nguyen Pham, Duc-Tai Le +2Frequency-Domain Feature LearningDomain Generalization

  20. MC-RFM: Geometry-Aware Few-Shot Adaptation via Mixed-Curvature Riemannian Flow Matching

    May 8, 2026Salim Khazem, Ibrahim Mohamed Serouis, Zakaria EzzahedFlow MatchingVision Foundation Model Adaptation

  21. Prompt-Free and Efficient SAM2 Adaptation for Biomedical Semantic Segmentation via Dual Adapters

    May 7, 2026Hinako Mitsuoka, Kazuhiro HottaPromptable Image SegmentationVision Foundation Model Adaptation

  22. Deep Reprogramming Distillation for Medical Foundation Models

    May 6, 2026Siyuan Du, Yuhang Zhou, Haolin Li +5Medical Imaging Foundation ModelsVision Foundation Model Adaptation