3D Masked Autoencoders

Latest papers 36

All topics
CardsList
  1. The hidden advantage of mask resampling: a theory of masked autoencoders

    Oct 1, 2026Jorge Medina Moreira, Lorenzo Bardone, Lenka Zdeborová3D Masked AutoencodersAutoencoder Architectures

  2. Reading the Whole Heart: Latent-Attention Masked Autoencoders for Multimodal Cardiac Representation Learning

    Sep 14, 2026Andrea Agostini, Simon Böhi, Moritz Vandenhirtz +7Electrocardiogram Foundation ModelsCardiac

  3. MANAS-2: Constrained Reconstruction for EEG Foundation Models

    Sep 12, 2026Arvasu Kulkarni, Aditya Ray Mishra, Jeet Bandhu Lahiri +5Electroencephalography Foundation Models3D Masked Autoencoders

  4. MEOX: Compact Multimodal Mixture-of-Experts for Earth Observation

    Sep 4, 2026Mohanad AlbughdadiTrustworthy Earth Observation DecisionsEarth Observation

  5. Benchmarking Cyberattack Detection in Electric Vehicle Charging Infrastructure with Benign User Updates

    Aug 11, 2026Hannan Chen, Roshni Anna Jacob, Jie ZhangElectric VehiclesThreat Detection

  6. ReMiX-MAE: Learning Missing-Channel Cross-Modal Representations from RGB-Only Clinical Facial Videos for Sympathetic-Mediated Pain Assessment

    Aug 3, 2026Nan Bi, Taoyue Wang, Lijun Yin +13D Masked AutoencodersFacial Expression Recognition

  7. Understanding and Correcting Low-Frequency Bias in EEG Foundation Model

    Aug 3, 2026Junjie Yu, Zihan Deng, Jianyu Zhang +8Electroencephalography Foundation ModelsElectroencephalography

  8. A Masked Autoencoder Approach to Unsupervised Steel Surface Defect Recognition

    Jul 14, 2026Shrey PatelDefect Detection3D Masked Autoencoders

  9. ProsMAE: Multi-Source MAE Pretraining for ISUP Grade Classification

    Jul 9, 2026Anna Jung, Kyeonghun Kim, Youngung Han +6Computational Pathology3D Masked Autoencoders

  10. Lift3D-VLA: Lifting VLA Models to 3D Geometry and Dynamics-Aware Manipulation

    Jul 7, 2026Jiaming Liu, Qingpo Wuwu, Nuowei Han +8Diffusion-Based Vision-Language-Actions3D Geometry

  11. Moonstone: A Multimodal Foundation Model and Benchmark for Lunar Remote Sensing

    Jul 3, 2026Ayush Prasad, Swarnalee MazumderRemote SensingMultimodal Foundation Model

  12. MindAU: EEG-Conditioned Facial Action Unit Editing via Dual-Stream Manifold Alignment

    Jul 1, 2026Zhenhang Li, Xin Zhou, Hao Deng +1Electroencephalography DecodingFacial Expression Recognition

  13. SAMBA: A Scatter-Guided Masked Bidirectional Mamba Foundation Model for SAR Target Recognition

    Jun 30, 2026Ke Wang, Xiaoyi Pan, Zhaoyu Gu +43D Masked AutoencodersMamba-Based Models

  14. Mitigating Positional Leakage in 3D Masked Autoencoders for Robust Representation Learning

    Jun 30, 2026Xu Yan, Huiqun Wang, Chen Wang +23D Masked AutoencodersAutoencoder Architectures

  15. 3D Masked Autoencoders are Robust Learners of Volumetric and Multimodal Cellular Representations for Microscopy

    Jun 22, 2026Amirhossein Kardoost, Lion Gleiter, Tingying Peng +13D Masked AutoencodersMicroscopy

  16. Contrastive and Adaptive Multi-modal Masked Autoencoder for Spatial Transcriptomics

    Jun 19, 2026Joohyeok Kim, Taejin Jeong, Jinyeong Kim +1Spatial Transcriptomics3D Masked Autoencoders

  17. BrainG3N: A Dual-Purpose Tokenizer for Controllable 3D Brain MRI Generation

    Jun 17, 2026Max Van Puyvelde, Ibrahim Gulluk, Wim Van Criekinge +1Functional Magnetic Resonance Imaging3D Masked Autoencoders

  18. Exploring Adaptive Masked Reconstruction for Self-Supervised Skeleton-Based Action Recognition

    Jun 9, 2026Shengkai Sun, Zhiyong Cheng, Zefan Zhang +3Skeleton-Based Action Recognition3D Masked Autoencoders

  19. A multifractal-based masked auto-encoder: an application to medical images

    May 25, 2026Joao Batista Florindo, Viviane de Moura3D Masked AutoencodersMedical Images

  20. Semantics-Guided Multimodal Masked Autoencoder Pretraining for 3D BEV Object Detection

    May 24, 2026Prabuddhi Wariyapperuma, Rajitha de Silva, Marc Hanheide +23D Object Detection3D Masked Autoencoders

  21. DARE-EEG: A Foundation Model for Mining Dual-Aligned Representation of EEG

    May 18, 2026Yang Shao, Peiliang Gong, Qun Dai +1Electroencephalography Foundation ModelsSmall-Sample Electroencephalogram Datasets

  22. Biosignal Fingerprinting: A Cross-Modal PPG-ECG Foundation Model

    May 10, 2026Zhangdaihong Liu, Chang Liu, Fenglin Liu +4Electrocardiogram Foundation ModelsCardiac

  23. OphMAE: Bridging Volumetric and Planar Imaging with a Foundation Model for Adaptive Ophthalmological Diagnosis

    May 4, 2026Tienyu Chang, Zhen Chen, Renjie Liang +9OphthalmologyOptical Coherence Tomography

  24. Adaptive Texture-aware Masking for Self-Supervised Learning in 3D Dental CBCT Analysis

    May 3, 2026Xinquan Yang, Jianfeng Ren, Xuguang Li +4Occlusal Constraint3D Medical Image Segmentation

  25. Rhamba: Region-Aware Hybrid Attention-Mamba Framework for Self-Supervised Learning in Resting-State fMRI

    May 2, 2026Ruthwik Reddy Doodipala, Pankaj Pandey, Pratheek Eranki +3Functional Magnetic Resonance ImagingMamba-Based Models

  26. Do Masked Autoencoders Improve Downhole Prediction? An Empirical Study on Real Well Drilling Data

    Apr 21, 2026Aleksander Berezowski, Hassan Hassanzadeh, Gouri GindeDrilling Data3D Masked Autoencoders

  27. Better with Less: Tackling Heterogeneous Multi-Modal Image Joint Pretraining via Conditioned and Degraded Masked Autoencoder

    Apr 18, 2026Bowen Peng, Yongxiang Liu, Jie Zhou +4Multimodal Pretraining3D Masked Autoencoders

  28. Assessing the Potential of Masked Autoencoder Foundation Models in Predicting Downhole Metrics from Surface Drilling Data

    Apr 16, 2026Aleksander Berezowski, Hassan Hassanzadeh, Gouri Ginde3D Masked AutoencodersDrilling Data

  29. Beyond Independent Frames: Latent Attention Masked Autoencoders for Multi-View Echocardiography

    Apr 16, 2026Simon Böhi, Irene Cannistraci, Sergio Muñoz Gonzalez +83D Masked AutoencodersAutoencoder Architectures

  30. AFFMAE: Scalable Vision Pre-Training for High-Resolution Microscopy Segmentation on Desktop Hardware

    Feb 18, 2026David Smerkous, Zian Wang, Behzad Najafian3D Masked AutoencodersSelf-Supervised Vision Transformers

  31. ECGFlowCMR: Pretraining with ECG-Generated Cine CMR Helps Cardiac Disease Classification and Phenotype Prediction

    Jan 28, 2026Xiaocheng Fang, Zhengyao Ding, Guangkun Nie +9Cardiac Magnetic Resonance ImagingCardiac

  32. pyMEAL: A Multi-Encoder Augmentation-Aware-Learning Toolbox for Robust Medical Image Translation

    May 30, 2025Abdul-mojeed Olabisi Ilyas, Adeleke Maradesa, Jamal Banzi +3Unpaired Image-To-Image Translation3D Masked Autoencoders