LLM Fine-Tuning

LLM: Large Language Model

Momentum

42 papers in the last four weeks, up 83% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 509

All topics
CardsList
  1. TalkTag: Fine-Grained Morphosyntactic Error Annotation for Transcribed Speech

    Jun 1, 2026Shamira Venturini, Oliver Hennhöfer, Steffen Kinkel +1LLM Fine-TuningLLM-Assisted Annotation

  2. Two to Tango: Coupled Task-Reference Selection for Safe LLM Fine-tuning

    Jun 1, 2026Xinrui Chen, Jianhao Zhang, Ou Wu +1LLM Fine-TuningData Selection

  3. LongAttnComp: Cross-Family Context Compression for Long-Context Reasoning

    May 31, 2026Mengmeng Ji, Ravi Shanker Raju, Jonathan Lingjie Li +1LLM CompressionLLM Fine-Tuning

  4. Subliminal Learning is a LoRA Artifact

    May 30, 2026Todd Nief, Harvey Yiyun Fu, Mark Muchane +1LLM Fine-TuningLow-Rank Adaptation

  5. Escaping the Mode Lottery: Multi-Response Training Improves Language Model Generalization

    May 30, 2026Hasan Amin, Kian Ahrabian, Ming Yin +1LLM Fine-TuningOOD Generalization

  6. Short-form Text Rewriting with Phi Silica

    May 30, 2026Divya Tadimeti, Shawn Pan, Sameera Lanka +2LLM Fine-TuningSmall Language Models

  7. Isolating LLM Lexical Bias: A Curation-Free Triangulated Metric for Preference-Stage Learning

    May 29, 2026Xiaoyang Ming, Jose Hernandez, Thomas Stephan JuzekLLM AlignmentLLM Fine-Tuning

  8. What Gets Unmasked First? Trajectory Analysis of Diffusion Models for Graph-to-Text Generation

    May 29, 2026Qing Wang, Jacob Devasier, Chengkai LiMasked Diffusion ModelsLLM Fine-Tuning

  9. Balanced LoRA: Removing Parameter Invariance to Accelerate Convergence

    May 29, 2026Valérie Castin, Kimia Nadjahi, Pierre Ablin +1LLM Fine-TuningLow-Rank Adaptation

  10. TRACE: Discovering Task-Specific Parameter via Adaptation-Aware Probing for Continual Fine-Tuning

    May 29, 2026Xiaosong Han, Ke Chen, Xindi Dai +7Continual Learning for LLMsLLM Fine-Tuning

  11. Shortcuts in the Tail: Debiasing via Post-Hoc Spectral Compression of Fine-Tuning Updates

    May 29, 2026Edward Sun, Dmitrii TroitskiiLLM Fine-TuningAlgorithmic Fairness

  12. Fine-Tuning Improves Information Conveyance in Language Models

    May 29, 2026Yuwei Cheng, Weiyi Tian, Haifeng XuLanguage Model Generation EvaluationLLM Fine-Tuning

  13. The Long-Term Effects of Data Selection in LLM Fine-Tuning

    May 28, 2026Yuxin Yang, Aoxiong Zeng, Xiangquan YangContinual Learning for LLMsLLM Fine-Tuning

  14. Efficient Test-Time Finetuning of LLMs via Convex Reconstruction and Gradient Caching

    May 28, 2026Alaa Khamis, Alaa MaaloufLLM Inference EfficiencyFine-Tuning

  15. How LoRA Remembers? A Parametric Memory Law for LLM Finetuning

    May 28, 2026Ziwen Xu, Haiwen Hong, Linsong Yu +4Memorization in Language ModelsLLM Fine-Tuning

  16. Harnessing non-adversarial robustness in large language models

    May 28, 2026Qinghua Zhou, Ellina Aleshina, Andrey Lovyagin +6LLM Fine-TuningNeural Network Robustness

  17. Mask the Target: A Plug-and-Play Regularizer Against LoRA Forgetting

    May 28, 2026Runze Xu, Arpit Garg, Hemanth Saratchandran +1Continual Learning for LLMsLLM Fine-Tuning

  18. FoRA: Fisher-orthogonal Rank Adaptation for Parameter-Efficient Fine-Tuning

    May 28, 2026Juneyoung Park, Seongbae Lee, Han-Sang Lee +6LLM Fine-TuningAdapter Tuning

  19. Entropy-KL Divergence-based Token Masking: A Novel Approach for Selective Fine-tuning of Large Language Models

    May 28, 2026Qi Liu, Mingdi Sun, Yongyi He +5Supervised Fine-TuningFine-Tuning

  20. Diagnosing Harmful Continuation in Answer-Correct Long-CoT Training Traces

    May 28, 2026Chen He, Yuhao Wu, Lei Wang +2Fine-TuningLLM Fine-Tuning

  21. Towards Reliable Multilingual LLMs-as-a-Judge: An Empirical Study

    May 27, 2026Irune Zubiaga, Aitor Soroa, Rodrigo AgerriMultilingual Language Model EvaluationLLM-as-a-Judge

  22. RA-MoE: Routing-Aligned Fine-Tuning for Multilingual Adaptation of Mixture-of-Experts Models

    May 27, 2026Guanzhi Deng, Kuan Wu, Haibo Wang +6Mixture-of-Experts Language ModelsLLM Fine-Tuning

  23. SPARD: Defending Harmful Fine-Tuning Attack via Safety Projection with Relevance-Diversity Data Selection

    May 27, 2026Shuhao Chen, Weisen Jiang, Yeqi Gong +5LLM Fine-TuningLLM Safety Alignment

  24. Fine-Tuned LLM as a Complementary Predictor Improving Ads System

    May 27, 2026Hui Yang, Daiwei He, Kevin Jiang +20LLM Fine-TuningOnline Advertising

  25. Unsupervised Identification and Removal of Spurious Correlations During Fine-Tuning

    May 26, 2026Ciarán M. Gilligan-Lee, Joseph Egan, Yuchen Zhu +1LLM Fine-TuningPolitical Bias in Language Models

  26. Learning to Translate from Soft to Hard LLM Prompts

    May 26, 2026Pitipat Kongsomjit, Suryansh Goyal, Jacob WhitehillLLM PromptingLLM Interpretability

  27. Gradient Transformer: Learning to Generate Updates for LLMs

    May 26, 2026Binh-Nguyen Nguyen, Khang Tran, NhatHai Phan +1Privacy-Preserving Language ModelsLLM Fine-Tuning