LLM Fine-Tuning

LLM: Large Language Model

Momentum

42 papers in the last four weeks, up 83% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 509

All topics
CardsList
  1. Where to Adapt Matters: Layer-Selective Fine-Tuning for Capability Retention

    Oct 8, 2026Zhiqiang Pang, Zihong Sun, Qi Xie +3LLM Fine-TuningSelective Fine-Tuning

  2. SFT-as-Context Mitigates Forgetting in Supervised Fine-Tuning

    Oct 8, 2026Kenan Tang, Andong Hua, Chengxuan Qian +2LLM Fine-TuningCatastrophic Forgetting

  3. Large Language Model-Assisted Preparation of Transportation Management Plans: A Case Study with WisDOT WisTMP System

    Oct 7, 2026Zihao Sheng, Pei Li, Zilin Huang +6LLM Fine-Tuning

  4. A Deafening Silence: Catastrophic Forgetting Lives in the Output Embeddings of Tokens the Data Never Speaks

    Oct 7, 2026Jonghyun Han, Younghoon Song, Jongyoul ParkCatastrophic ForgettingContinual Learning for LLMs

  5. The Persona Hierarchy Model: Understanding Contextual Generalization in Fine-Tuning LLMs

    Oct 7, 2026Jiachen Zhao, Zhengxuan Wu, David Bau +1LLM Fine-TuningLLM Alignment

  6. When Forgetting is not Catastrophic: On the Mechanics of Spurious Forgetting

    Oct 6, 2026Vedant Palit, Florent Draye, Nicolas Zucchet +2Memorization in Language ModelsLLM Fine-Tuning

  7. HouseholdBench: Evaluating Large Language Models as Predictors of Household Economic Behavior

    Oct 6, 2026Jin Huang, Diego Ferreras Garrucho, Yutong Xie +4LLM EvaluationLLM Fine-Tuning

  8. HeuFouFT: Task-Guided Metaheuristic Coordinate Search for Fourier Fine-Tuning

    Oct 5, 2026Ruiheng Wang, Yubo Hou, Yakun Zhu +3Fine-TuningLLM Fine-Tuning

  9. ImproveAnyTask: An Autonomous Post-Training Harness for Iterative Model Self-Improvement

    Oct 5, 2026Xingbo Yao, Xiaoman Wang, Zhengwu Lei +11LLM Fine-TuningLLM Post-Training

  10. Fine-Tuning a 3B-Parameter LLM on a Smartphone: Characterizing Sustained Training

    Oct 5, 2026Andrew Geyko, Marius Mosbach, André BrinkmannOn-Device TrainingLLM Fine-Tuning

  11. RoSA: Rotational Sparse Adaptation for Memory-Efficient Fine-Tuning

    Oct 5, 2026Muhammad Azeem Lodhi, Chao Zhou, Rebekka BurkholzMemory-Efficient Fine-TuningLLM Fine-Tuning

  12. Turnslide: Scalable Multi-Turn Data Synthesis by Walking a Finite-State Machine

    Oct 5, 2026Aaron Fainman, Gabriela Kadlecová, Maciej Gryka +7LLM Fine-TuningSynthetic Data Generation

  13. VERA: Verdict-Conditioned Reliability for Adaptive LLM Judges

    Oct 4, 2026Qiushui Xu, Syamil Mohd Razak, Tao Yuan +1LLM-as-a-JudgeLLM Fine-Tuning

  14. Robust Parameter-Efficient LLM Adaptation on Analog Hardware

    Oct 4, 2026Jindan Li, Zhaoxian Wu, Tianyi ChenCompute-in-MemoryLLM Fine-Tuning

  15. TACO: Ternary Absolute-max Column-wise One-sparse Optimizer for LLM Fine-Tuning

    Oct 1, 2026Jichao Jiang, Cristian McGee, El Houcine Bergou +2Memory-Efficient Fine-TuningLLM Fine-Tuning

  16. Trust the Direction, Search the Step: Zero-and-First-Order Methods for LLM Fine-Tuning

    Oct 1, 2026Cristian McGee, El Houcine Bergou, Aritra DuttaZeroth-Order OptimizationLLM Fine-Tuning

  17. No Model Required: Text Entropy Rate Filtering Mitigates Iterative Fine-Tuning Collapse

    Oct 1, 2026Lewis MitchellLLM Fine-TuningModel Collapse

  18. TRACE: Trajectory Return Attribution and Contrastive Erasure for Multi-Turn Safety

    Oct 1, 2026Fengpeng Li, Kemou Li, Qizhou Wang +3LLM Fine-TuningAdversarial Attacks on LLMs

  19. RPTune: Learned Context Curation for LLM Catalog Search

    Oct 1, 2026Chuxuan Hu, Hejie Cui, Norman Huang +3In-Context RetrievalLLM Fine-Tuning

  20. Efficient Task Adaptation in Large Language Models: A Survey of Weight-Based, Prompt-Based, and Embedding-Based Adaptations

    Oct 1, 2026Jungwon Park, Changin Choi, Jimyeong Kim +2LLM Fine-TuningIn-Context Learning

  21. Training-Aware Target Coverage for Synthetic Data Selection

    Sep 30, 2026Yang Ba, Michelle V. Mancenido, Rong PanLLM Fine-TuningData Selection

  22. Towards Robust Numerical Claim Verification

    Sep 30, 2026Peter Røysland Aarnes, Vinay SettyNumerical Reasoning in Language ModelsClaim Verification

  23. Bayesian Fine-tuning Yields Language Models that are as Bayesian as their Beliefs Allow

    Sep 30, 2026Polina Tsvilodub, Andreas Waldis, Linlu Qiu +2Fine-TuningLLM Fine-Tuning

  24. Every Batch Is Its Own Validation Set: Leave-One-Out Gradient Matching for Online Data Selection in LLM Fine-Tuning

    Sep 30, 2026Hongyu Chen, Xinyi Luo, Ming Zhao +6LLM Fine-Tuning

  25. A helps B while B hurts A: directed transfer in instruction-tuning mixture

    Sep 30, 2026Nima H. Siboni, Vahid RostamiLLM Fine-TuningInstruction-Tuning Data Selection