LLM Training

LLM: Large Language Model

Momentum

31 papers in the last four weeks, up 72% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 226

All topics
CardsList
  1. MemGuard-Alpha: Limits of Membership Inference for Detecting and Filtering Memorization-Contaminated Signals in LLM-Based Financial Forecasting

    Mar 26, 2026Anisha Roy, Dip RoyMembership Inference AttacksLLM Auditing

  2. Language Generation with Replay: A Learning-Theoretic View of Model Collapse

    Mar 12, 2026Giorgio Racca, Michal Valko, Amartya SanyalModel CollapseData Contamination in Language Models

  3. Maximizing Mutual Information Between Prompt and Response Improves LLM Performance With No Additional Data

    Mar 10, 2026Hyunji Nam, Haoran Li, Natasha JaquesLLM PersonalizationMutual Information Maximization

  4. .tmu: A Low-Entropy Tree-Structured Representation for LLM-Assisted Scientific Writing

    Mar 3, 2026Tianyou Liu, Ziqiang Li, Xurui Liu +2AI-Assisted Scientific ResearchLLM Training

  5. You Can Learn Tokenization End-to-End with Reinforcement Learning

    Feb 15, 2026Sam Dauncey, Roger WattenhoferSubword TokenizationLLM Training

  6. Quantifying the Effect of Test Set Contamination on Generative Evaluations

    Jan 7, 2026Rylan Schaeffer, Joshua Kazdan, Baber Abbasi +8Language Model Generation EvaluationBenchmark Contamination

  7. Distilling the Essence: Efficient Reasoning Distillation via Sequence Truncation

    Dec 24, 2025Wei-Rui Chen, Vignesh Kothapalli, Ata Fatahibaarzi +5CoT DistillationSelective Knowledge Distillation

  8. EDGC: Entropy-driven Dynamic Gradient Compression for Efficient LLM Training

    Nov 13, 2025Qingao Yi, Jiaang Duan, Jun Zhang +5Communication-Efficient Distributed TrainingGradient Compression

  9. The Environmental Impacts of Language Model Training Keep Rising Now is the Time to Catch Impacts on the Rebound

    Oct 10, 2025Clément Morand, Anne-Laure Ligozat, Aurélie NévéolEnergy-Efficient MLLLM Training

  10. Geometrically Principled Randomized Optimization for Efficient LLM Training

    Oct 2, 2025Sahar Rajabi, Nayeema Nonta, Sirisha RambhatlaLanguage Model PretrainingDeep Learning Optimization

  11. CHRONOBERG: Capturing Language Evolution and Temporal Awareness in Foundation Models

    Sep 26, 2025Niharika Hegde, Subarnaduti Paul, Lars Joel-Frey +4Language ModelingSemantic Change Detection

  12. Learning Composable Chains-of-Thought

    May 28, 2025Fangcong Yin, Zeyu Leo Liu, Liu Leqi +2LLM Fine-TuningCoT Reasoning

  13. Learning by Surprise: Adaptive Mitigation of Model Collapse in Large Language Models

    Oct 16, 2024Daniele Gambetta, Gizem Gezici, Fosca Giannotti +3Model CollapseTraining Data Selection

  14. Musec: MomentUm SpEctral Clipping for Stable Muon-type Training

    Date pendingZhuanghua Liu, Menglian Wang, Luo LuoMuon OptimizerLLM Training