LLM Fine-Tuning

LLM: Large Language Model

Momentum

42 papers in the last four weeks, up 83% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 509

All topics
CardsList
  1. Compiling Learning Problems into Adaptation Programs for Language Models

    Sep 29, 2026Rebecca Ramnauth, Brian ScassellatiMeta-LearningLLM Fine-Tuning

  2. VLM Fine-Tuning for End-to-End Combinatorial Optimization

    Sep 29, 2026Qingsong Yan, Xia Jiang, Yaoxin Wu +3LLM Fine-TuningNeural Combinatorial Optimization

  3. Transformers Stop Thinking Too Early, and a Tiny LoRA Fixes It

    Sep 29, 2026Zehao Jin, Ruixuan Deng, Junran WangTransformerLLM Fine-Tuning

  4. Population Fidelity: Evaluating Population Representativeness in LLMs

    Sep 28, 2026Neemias B. da Silva, Martin Lukk, Ali Sutani +5LLM EvaluationLLM Fine-Tuning

  5. AIM-ZO: Activation-Informed Subspace Maintenance for Zeroth-Order LLM Fine-Tuning

    Sep 28, 2026Yue Xie, Zhi Zheng, Yunpeng Ba +5Memory-Efficient Fine-TuningZeroth-Order Optimization

  6. How code helps different tasks? A decompositional lens on LLM post-training

    Sep 27, 2026Zheng Yu, Yiwei Li, Yishen Chen +4LLM Fine-TuningInstruction-Tuning Data Selection

  7. Beyond Average Safety: Chance-Constrained LLM Fine-tuning

    Sep 24, 2026Taha Entesari, Mahyar FazlyabStochastic OptimizationChance-Constrained Optimization

  8. Rufus-Air: An Open LLM Post-Training Recipe

    Sep 24, 2026Chia-Yuan Chang, Renyuan Cheng, Rui Feng +19LLM Fine-TuningRL for Language Model Reasoning

  9. The Fellowship of the Query: Learning Retrieval Actions

    Sep 23, 2026Mohammed Al-Maamari, Saber Zerhoudi, Michael Granitzer +1LLM Fine-TuningAgentic RAG

  10. Fine-Tuning LLMs for Translation: General Forgetting Mitigation Does Not Preserve MT-Specific Instruction Following

    Sep 23, 2026Niklas Scholz, David Thulke, Abdallah Nasir +3LLM Fine-TuningElastic Weight Consolidation

  11. Repurposing Pre-trained LLMs as High Fidelity Continuous Text Autoencoders

    Sep 23, 2026Arkanath Pathak, Unnat Jain, Alexander C. BergDecoder-Only Language ModelsAutoencoders

  12. Reasoning-Preserving Fine-Tuning of Post-RL LLMs with Null-Basis LoRA

    Sep 22, 2026Wenzhi Fang, Nicholas Tzou, Lazar Valkov +1LLM Fine-TuningLow-Rank Adaptation

  13. Circuit Hypernetworks for Quantum-Augmented Diffusion Language Models

    Sep 21, 2026Xiaoqiang Wang, Mengyang Xiong, Jun Dai +1LLM Fine-TuningQuantum Machine Learning

  14. SEA-LION-v4.8: A Technical Report

    Sep 16, 2026Ahmed Mohammad Dabeer, Ahn Jeongmi, Anocha Sutaveephamochanon +45Multilingual Language ModelsLLM Fine-Tuning

  15. Enhancing Accessibility of Medical Texts through Large Language Model-Driven Plain Language Adaptation

    Sep 15, 2026Ting-Wei Chang, Hen-Hsen Huang, Hsin-Hsi ChenLLM Fine-Tuning

  16. TAME: Token Attribution and Masking for Emergent misalignment

    Sep 15, 2026Md Rayhanul Masud, Md Rizwan ParvezLLM InterpretabilityLLM Fine-Tuning

  17. ReMova: Fine-tuning LLMs for English to Belarusian translation

    Sep 14, 2026Mikita Pilinka, Aliaksandr Kliujeŭ, David Samuel +1LLM Fine-TuningLow-Resource MT

  18. Doc2FRC: Length-Consistent Document-Level Machine Translation via Fixed-Range Chunking

    Sep 14, 2026Xiaotian Wang, Youyuan Lin, Zhan Shen +1Document ChunkingLLM Fine-Tuning

  19. Scaling Clinical Judgment to Evaluate Medical AI

    Sep 11, 2026Thomas A. Buckley, Zahir Kanjee, Peter G. Brodeur +15LLM-as-a-JudgeLLM Fine-Tuning

  20. Rebalancing Token Importance in Language Models with TF-IDF Weighted Cross-Entropy Loss

    Sep 10, 2026Zhijian Li, Stefan Larson, Kevin LeachMemorization in Language ModelsLLM Fine-Tuning

  21. Active Adaptation, Not Static Defense: Temporal Dynamics of Preventative Steering in Adversarial Fine-Tuning

    Sep 9, 2026Jing Guan, Yachao Yang, Zhaoliang Liu +3LLM Fine-TuningAdversarial Attacks on LLMs

  22. MpSub: A Momentum pp-Dimensional Subspace Trust-Region Method for Derivative-Free Fine-Tuning of Large Language Models

    Sep 7, 2026Yuyang Wang, Haoyu Yao, Pengcheng XieMemory-Efficient Fine-TuningZeroth-Order Optimization

  23. Task-Level Natural Language Priors as Learning Signals for Low-Resource LLM Training

    Sep 2, 2026Jian Gao, Xiao Zhang, Xun Zhu +2LLM Fine-TuningData-Efficient Learning

  24. When Safety Routing Breaks: Understanding Alignment Fragility under Benign Fine-Tuning

    Sep 1, 2026Yitong Guo, Xiaoyi Chen, Siyuan Zhang +2LLM Fine-TuningLLM Safety Alignment

  25. Automated Event Log Generation from Unstructured Text Using Finetuned LLMs

    Sep 1, 2026Maximilian Seeth, Gabriel Marques Tavares, Daniel SchusterProcess MiningLLM Fine-Tuning

  26. Prompt-Robust Language Models: Which Training Strategies Work?

    Sep 1, 2026Frederic Sadrieh, Michal ŠtefánikPrompt SensitivityLLM Fine-Tuning