Language Model Post-Training

Momentum

23 papers in the last four weeks, up 283% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 132

All topics
CardsList
  1. Where does output diversity collapse in post-training?

    Apr 17, 2026Constantinos Karouzos, Xingwei Tan, Nikolaos AletrasLanguage Model Post-TrainingLLM Training

  2. Peer-Predictive Self-Training for Language Model Reasoning

    Apr 14, 2026Shi Feng, Hanlin Zhang, Fan Nie +2Self-Training for Language ModelsLanguage Model Post-Training

  3. GRRM: Group Relative Reward Modeling for Machine Translation

    Feb 15, 2026Sen Yang, Shanbo Cheng, Lu Xu +2Reward ModelingRL for Language Models

  4. LMSpell: Spell Correction with Pre-Trained Language Models

    Dec 5, 2025Akesh Gunathilake, Nadil Karunarathna, Tharusha Bandaranayake +3Low-Resource Language ProcessingLanguage Model Post-Training

  5. POPI: Personalizing LLMs via Optimized Natural Language Preference Inference

    Oct 17, 2025Yizhuo Chen, Xin Liu, Ruijie Wang +7LLM PersonalizationPersonalized Language Models

  6. Verbalized Sampling: How to Mitigate Mode Collapse and Unlock LLM Diversity

    Oct 1, 2025Jiayi Zhang, Simon Yu, Derek Chong +4LLM PromptingModel Collapse

  7. Agnostics: Learning to Code in Any Programming Language via Reinforcement with a Universal Learning Environment

    Aug 6, 2025Aleksander Boruch-Gruszecki, Yangtian Zi, Zixuan Wu +4RL for Code GenerationCode Generation

  8. LearNAT: Learning NL2SQL with AST-guided Task Decomposition for Large Language Models

    Apr 3, 2025Weibin Liao, Xin Gao, Tianyu Jia +6LLM PlanningRL for Language Model Reasoning