Frozen Encoder

Momentum

18 papers in the last four weeks, up 350% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 66

All topics
CardsList
  1. FD-AA: A Lightweight Focal-Diffuse And Attenuation-Aware Head for Incidental Abdominal Abnormality Detection in Chest CT

    Sep 28, 2026Haoyan Ding, Kritika Iyer, Halid Yerebakan +9Cone-Beam Computed TomographyFrozen Encoder

  2. Handwritten Text Recognition Lives in the High-Pixel Variance Subspace

    Sep 28, 2026Carlos Garrido-Munoz, Jorge Calvo-ZaragozaHandwritten Text RecognitionHandwriting

  3. Natural Image Autoencoder-Based fMRI Representations for Trait and State Prediction

    Sep 28, 2026Juhyeon Park, Yeonwoo Kim, Peter Yongho Kim +5Functional Magnetic Resonance ImagingElectroencephalography Foundation Models

  4. Approximating Softmax in Pretrained LLMs: Model Sensitivity and Kernel Acceleration

    Sep 27, 2026Shangzhen Zhu, Muyan Hu, Tomasz KozlowskiGumbel-Softmax RelaxationTransformer Architectures

  5. QuPID: Quantum Parameter-Efficient Input-Dependent Retrieval Adaptation for Medical RAG

    Sep 27, 2026Hyojun Ahn, Emily Jimin Roh, Soohyun Park +3QubitFrozen Encoder

  6. Video-to-Music Generation for Gameplay Videos

    Sep 25, 2026Felipe Marra, Lucas N. FerreiraFrozen Encoder

  7. Quieter Than the Room: Representation Drift and Task Robustness in Speech Encoders

    Sep 23, 2026Vsevolod Kovalev, Pranay ManochaSpeech EncoderFrozen Encoder

  8. MINER: Multi-crop INference-time Enhancement for Rare-Object Retrieval with Frozen Dual Encoders

    Sep 22, 2026Abdulmalik Alquwayfili, Faisal AlMeshal, Jumanah Almajnouni +2Multimodal RetrievalFrozen Encoder

  9. GeoRVQ: Decoder-aware geometry for residual-token prediction in physiological signals

    Sep 22, 2026Bo Cui, Yaowen ZhangResidual Vector QuantizationPhysiological Signals

  10. Compressing Long Context into Answer-Aligned Memory Embeddings for LLM Inference

    Sep 22, 2026Md Mostafizer Rahman, Md Faizul Ibne Amin, Md Shahajada Mia +2LLM Inference OptimizationLarge Language Model Memory

  11. Federated Multilingual Speech-LLMs: Architecture and Aggregation Strategy Benchmarking

    Sep 20, 2026Jordi Luque, Aleix Sant, Fernando LópezMultilingual Automatic Speech RecognitionSpeech Encoder

  12. BindCLIP: One Balanced Coupling For Compositional Vision Language Scoring

    Sep 20, 2026Liuyang Song, Yi Zhang, Zhongyi Deng +2Vision-Language Foundation ModelsFrozen Encoder

  13. An Efficient and Effective Watermarking Scheme for the Protection of the Intellectual Property Rights of Video Generative Models

    Sep 20, 2026Wenhong Huang, Jianwei Fei, Benedetta Tondi +2WatermarkingWatermarks

  14. Preserving Geometric Integrity in Graph Prompting via Measure-Constrained Optimal Transport

    Sep 20, 2026Xiangyu Wang, Shuo Wang, Ruiyi Fang +1Multiple Prompt Learning FrameworksParameter-Efficient Adaptation

  15. CoRELoop: Parameter-Efficient Controlled Recurrent Refinement for Audio Deepfake Detection

    Sep 17, 2026Kunyu Feng, Yuxiang Wang, Li Wang +2Audio Deepfake DetectionNeural Audio

  16. SCOUT: Sim-to-Real Text-Based Person Retrieval by Embedding-Space Prediction over Frozen Video Features

    Sep 16, 2026Abdarahmane Traoré, Andy Couturier, Éric HervetFrozen EncoderCross-Encoder

  17. Neuro-Symbolic Hierarchical Intention Anticipation in Human Behavior

    Sep 15, 2026Farnaz Soleimani, Abdelghani Chibani, Yacine Amirat +1Neuro-Symbolic FrameworkAgent Behavior Modeling

  18. Observation-Conditioned Latent Energy Priors for Sparse Implicit Neural Shape Completion

    Sep 3, 2026Paul Büschl, Ezequiel de la Rosa, Julia Wolleb +3Neural RepresentationsFrozen Encoder

  19. MR-JEPA: A General Purpose Video Foundation Model for Cardiac MRI

    Aug 31, 2026Athira J. Jacob, Puneet Sharma, Dorin Comaniciu +1Cardiac Magnetic Resonance ImagingLeft-Ventricular Ejection Fraction

  20. AdaDINO: Pair-Aware In-Backbone Adaptation of Frozen DINO for Efficient Remote Sensing Change Detection

    Aug 8, 2026Xu Zhang, Xinqing Li, Jianpeng Xie +3Change DetectionRemote Sensing

  21. WNM-3D: A World Navigation Model with 3D Scene Conditioning for Closed-Loop VLN

    Aug 7, 2026Yuehao Huang, Yunzi Wu, Xiaotao Zhang +7Vision-Language NavigationEfficient World-Action Model

  22. Support Operation Factorization: Compositional Readout of Frozen Vision Encoders under Controlled Interventions

    Aug 6, 2026Zhongyao Wang, Wanli Ouyang, Taoyong Cui +1ReadoutFrozen Encoder

  23. Predict, Then Retrieve: Cross-Instance Future-State Retrieval from Video Prefixes

    Aug 5, 2026Quynh Vo, Thong Nguyen, Vinh-Hien Do +2Future Video PredictionNext-State Prediction

  24. ChaosProbe: A Neurochaotic Lens on Frozen Transformer Input-Embedding Spaces

    Aug 3, 2026Kunal Kumar Pant, Nithin NagarajTransformer ArchitecturesBehavioral Embeddings

  25. Adjudicated Captioning: Multi-Agent Alignment Scoring and Consensus-Distilled Beam Arbitration for Strict Zero-Shot Image Captioning

    Jul 31, 2026Duy Tran Thanh, Thien-Phuc Doan, Long Nguyen-Vu +1Image Difference CaptioningZero-Shot Composed Image Retrieval

  26. Foundation Models for Face Presentation Attack Detection: A Unified Linear-Probing Benchmark

    Jul 29, 2026Peter Lorenz, Anjith George, Sébastien MarcelRecent Vision Foundation ModelsCross-Dataset Benchmark

  27. REPREC: Representation Driven Parameter-Efficient Recommendation System

    Jul 24, 2026Harshini Kavuru, Dwipam Katariya, Giri Iyengar +3Multimodal Recommendation ModelSequential Recommendation

  28. Cheap Probes Predict Expensive Training in 3D-CT Vision--Language Models

    Jul 24, 2026Renjie LiangFrozen EncoderSeparability

  29. Sparse Concept Channels in Frozen 3D CT Vision Encoders

    Jul 23, 2026Farhad Nooralahzadeh, Lea Bogensperger, Christian Bluethgen +1Medical Vision-Language ModelsFrozen Encoder

  30. CANDOR: Chance-Calibrated Neighborhood Discordance in Frozen Encoders for Medical Imaging

    Jul 20, 2026Soroosh Tayebi Arasteh, Sven Nebelung, Daniel TruhnFrozen EncoderEncoders

  31. GigaPath-Flash and GigaTIME-Flash: Efficient Pathology Foundation Models for Whole-Slide and Tumor Microenvironment Analysis

    Jul 20, 2026Naoto Usuyama, Jeya Maria Jose Valanarasu, Sicong Yao +27Pathology Foundation ModelsWhole-Slide Images

  32. VideoRAE: Taming Video Foundation Models for Generative Modeling via Representation Autoencoders

    Jul 15, 2026Zhihao Xie, Junfeng Wu, Xinting Hu +2Video Foundation ModelsConditional Variational Autoencoder

  33. Latent-Identity Tuning in Text-to-Image Personalization Models

    Jul 13, 2026Daniel Garibi, Ronen Kamenetsky, Hadar Averbuch-Elor +2Text-To-ImageFacial Images

  34. MonkeyOCRv2: A Visual-Text Foundation Model for Document AI

    Jul 13, 2026Yuliang Liu, Zhang Li, Ziyang Zhang +11Lingdt-Vl-OcrVisual Document Retrieval

  35. LaGuadia: Language-Guided Adaptive Distillation from Pathology Foundation Models

    Jul 13, 2026Gangsu Kim, Won-Ki JeongPathology Foundation ModelsMedical Vision-Language Models

  36. Naming the Concepts Classifiers Rely On: Language-Anchored Decomposition for Faithful Explanation

    Jul 8, 2026Ahsan Habib Akash, Dipkamal Bhusal, Stacey Jones +3Gradient-Weighted Class Activation MappingFaithful Explanation

  37. Multi-Teacher Contrastive Distillation for Edge-Efficient Pathology Foundation Models

    Jul 6, 2026Tim Lenz, Maurice Heide, Marco Gustav +2Pathology Foundation ModelsWhole-Slide Images

  38. 3D-PLOT-LLM: Part-Level Object Tokens for 3D Large Language Models

    Jun 18, 2026Jintang Xue, Xinyu Wang, Yixing Wu +2Multimodal Large Language ModelsVideo Captioning

  39. Distribution Alignment for One-Shot Federated Learning via Optimal Transport

    Jun 15, 2026Daniele Berardini, Vito Paolo Pastore, Vittorio MurinoFederated LearningFew-Shot Learning

  40. Building The Ph(ysical)AI Layer Of Machine Intelligence

    Jun 2, 2026Ulbert Jose Botero, Liam Smith, Brooks Olney +5Transfer LearningCross-Modal

  41. Video-Mirai: Autoregressive Video Diffusion Models Need Foresight

    Jun 2, 2026Yonghao Yu, Lang Huang, Runyi Li +2Autoregressive Video Diffusion ModelsDiffusion Models

  42. SEAOTTER: Sensor Embedded Autoencoding with One-Time Transcode for Efficient Reconstruction

    Jun 2, 2026Dan Jacobellis, Neeraja J. YadwadkarAffectcodecAutoencoder Architectures

  43. The Path Matters: Learning a Token-Commitment Policy for Diffusion Language Models

    May 23, 2026Bohang Sun, Max Zhu, Francesco Caso +5Diffusion Language ModelsFrozen Encoder

  44. GeoWeaver: Grounding Visual Tokens with Geometric Evidence before Scene Reasoning

    May 21, 2026Deshui Miao, Xingsen Huang, Yameng Gu +3Spatial ReasoningGeometry-Aware

  45. TrajTok: Adaptive Spatial Tokenization for Trajectory Representation Learning

    May 19, 2026Zhen Xiong, Shang-Ling Hsu, Cyrus ShahabiSpatial TokensTraccia

  46. Distributional Energy-Based Models for Uncertainty-Aware Structured LLM Reasoning

    May 15, 2026Shireen Kudukkil Manchingal, Abhey Kalia, Fernanda Gonçalves +1LLM Reasoning StrategiesLarge Language Model Uncertainty

  47. Pretraining Objective Matters in Extreme Low-Data FGVC: A Backbone-Controlled Study

    May 15, 2026Alexander Hackett, Srikanth Thudumu, Ginny Fisher +1Frozen EncoderPretraining

  48. Beyond the Last Layer: Multi-Layer Representation Fusion for Visual Tokenization

    May 11, 2026Xuanyu Zhu, Yan Bai, Yang Shi +4Visual TokenizersVision Encoders

  49. Can We Formally Verify Neural PDE Surrogates? SMT Compilation of Small Fourier Neural Operators

    May 9, 2026Ali Baheri, Ignacio Laguna PeraltaFourier Neural OperatorsNeural Network Verification

  50. Closed-Form Linear-Probe Dataset Distillation for Pre-trained Vision Models

    May 8, 2026Bincheng Peng, Guang Li, Ping Liu +2Diffusion-Based Dataset DistillationDataset Distillation

  51. EGA: Adapting Frozen Encoders for Vector Search with Bounded Out-of-Distribution Degradation

    May 7, 2026Dongfang ZhaoFrozen EncoderOut-Of-Distribution

  52. Channel Adaptation for EEG Foundation Models: A Systematic Benchmark Across Architectures, Tasks, and Training Regimes

    Apr 25, 2026Kuntal Kokate, Bruno Aristimunha, Dung Truong +1Electroencephalography Foundation ModelsParameter-Efficient Adaptation