Masked Language Modeling

Also known as MLM

Latest papers 26

All topics
CardsList
  1. The hidden advantage of mask resampling: a theory of masked autoencoders

    Oct 1, 2026Jorge Medina Moreira, Lorenzo Bardone, Lenka ZdeborováMasked AutoencodersMasked Language Modeling

  2. GeoRVQ: Decoder-aware geometry for residual-token prediction in physiological signals

    Sep 22, 2026Bo Cui, Yaowen ZhangMasked Language ModelingResidual VQ

  3. Learning Task-Specific Antibody Representations via Function-Aware Masking

    Sep 1, 2026Ayan Goel, Thomas A. Walton, Amirali AghazadehMasked Language ModelingProtein Language Models

  4. AraSSM: A bidirectional state-space encoder for Arabic masked language modeling

    Aug 8, 2026Ahmed Amine Aliane, Hassina Aliane, Nasredine SemmarLanguage Model PretrainingArabic NLP

  5. VESTIGE: A Knowledge-Guided Masking Strategy for Corruption-Aware Fine-Tuning of Genomic Transformers, Validated on Ancient DNA Reconstruction

    Jul 30, 2026Angshuman Chakravertty, Rahul MaheshwariMasked Language ModelingLanguage Modeling

  6. The JEPA Paradox in Language: The Geometry of Linguistic Alternatives

    Jul 26, 2026Anh Trac Duc Dinh, Khang Nhat Hoang VoRepresentation CollapseMasked Language Modeling

  7. Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models

    Jul 14, 2026Yubo Wang, Jiarong Liang, Yuxuan Zhang +5Masked Language ModelingCoding Agents

  8. A Unified Framework for In-Context Learning with Causal and Masked Language Models

    Jul 5, 2026Chenrui Liu, Chuanlong Xie, Falong Tan +2Masked Language ModelingAutoregressive Language Modeling

  9. Where Does the Signal Live? A Web Data Recipe for Medical Encoder Pretraining

    Jun 20, 2026Bofeng Huang, Jacques Sun, Diane Bouchacourt +2Language Model PretrainingMasked Language Modeling

  10. Rescaling MLM-Head for Neural Sparse Retrieval

    Jun 17, 2026Youngjoon Jang, Seongtae Hong, Jonah Turner +1Masked Language ModelingLearned Sparse Retrieval

  11. Knowledge Editing for Masked Diffusion Language Models

    Jun 2, 2026Haewon Park, Yohan JoKnowledge EditingMasked Diffusion Models

  12. Entropy-aware Masking for Masked Language Modeling

    May 27, 2026Gokul Srinivasagan, Kai Hartung, Munir GeorgesMasked Language ModelingSelf-Supervised Pre-Training

  13. Backdooring Masked Diffusion Language Models

    May 19, 2026Daniel Yiming Cao, Chengzhong Wang, Sheng-Yen Chou +3LLM Backdoor AttacksMasked Diffusion Models

  14. Structure-Aware Masking for Protein Representation Learning

    May 15, 2026Thomas Walton, Ayan Goel, Amirali AghazadehProtein Fitness PredictionMasked Language Modeling

  15. A Causal Language Modeling Detour Improves Encoder Continued Pretraining

    May 12, 2026Rian Touchent, Eric de la ClergerieLanguage Model PretrainingMasked Language Modeling

  16. Mixing Times of Glauber Dynamics on Masked Language Models

    May 11, 2026Suvadip Sana, Sami Wolf, Neer Mehta +4Dynamical SystemsMarkov Chain Monte Carlo

  17. ProteinJEPA: Latent prediction improves protein language model pretraining

    May 8, 2026Dan Ofer, Dafna Shahaf, Michal LinialLanguage Model PretrainingMasked Language Modeling

  18. On the Trainability of Masked Diffusion Language Models via Blockwise Locality

    Apr 27, 2026Yuxiang Wang, Yu Xiang, Baojian Zhou +4Masked Diffusion ModelsMasked Language Modeling

  19. In Search of Lost DNA Sequence Pretraining

    Apr 17, 2026Zhijiang Tang, Jiaxin Qi, Yan Cui +3Language Model PretrainingMasked Language Modeling

  20. Predict and Reconstruct: Joint Objectives for Self-Supervised Language Representation Learning

    Apr 16, 2026Aimen BoukhariRepresentation GeometryMasked Language Modeling

  21. General Phrase Debiaser: Debiasing Masked Language Models at a Multi-Token Level

    Nov 23, 2023Bingkang Shi, Xiaodan Zhang, Dehan Kong +4Gender Bias in Language ModelsDebiased ML