LLM Fine-Tuning

LLM: Large Language Model

Momentum

42 papers in the last four weeks, up 83% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 509

All topics
CardsList
  1. Rethinking the Multilingual Reasoning Gap with Layer Swap

    May 26, 2026Maxence Lasbordes, Amélie Chatelain, Djamé SeddahMultilingual Language ModelsMultilingual Language Model Evaluation

  2. Open-Weight LLM Fine-Tuning Defenses are Susceptible to Simple Attacks

    May 26, 2026Kevin Kuo, Virginia Smith, Chhavi YadavLLM Fine-TuningAdversarial Attacks on LLMs

  3. Context-Instrumental Data Distillation for Kubernetes Manifest Generation: Method and Experimental Evaluation

    May 25, 2026Andrey Kozachok, Anatoliy Bakaev, Aleksandr Kozachok +2LLM Fine-TuningCode Generation

  4. Phantom transitions in language model fine-tuning

    May 25, 2026Vaibhav Prakash, Jayasri DontabhaktuniLLM Fine-Tuning

  5. RotMoLE: Enhancing Mixture of Low-Rank Experts through Rotational Gating Mechanism

    May 25, 2026Mengyang Sun, Maochuan Dou, Tao Feng +5LLM Fine-TuningLow-Rank Adaptation

  6. Security in the Fine-Tuning Lifecycle of Large Language Models: Threats, Defenses,Evaluation, and Future Directions

    May 24, 2026Wenjuan Li, Yitao Liu, Runze Chen +1LLM Backdoor AttacksLLM Fine-Tuning

  7. DTO: a Differentiable Training Objective for Effective Counterfactual Story Rewriting

    May 24, 2026Amelia Girard, Massimo PiccardiLLM Fine-Tuning

  8. Efficient DP-SGD for LLMs with Randomized Clipping

    May 24, 2026Enayat Ullah, Sai Aparna Aketi, Devansh Gupta +2Privacy-Preserving Language ModelsDifferentially Private Stochastic Gradient Descent

  9. Tiny Brains, Giant Impact: Uncovering the Keystone Neurons of LLM with Just a Few Prompts

    May 24, 2026Xiangtian Ji, Yuxin Chen, Zhengzhou Cai +3Fine-TuningLLM Interpretability

  10. Geo-Expert: Towards Expert-Level Geological Reasoning via Parameter-Efficient Fine-Tuning

    May 24, 2026Chenyou Guo, Zongqi Liu, Yizhou Zhang +2Scientific ReasoningLLM Fine-Tuning

  11. Mix-MoE: Improving Multilingual Machine Translation of Large Language Models through Mixed MoEs

    May 23, 2026Bo Li, Tianyu Dong, Shaolin Zhu +1Multilingual Language ModelsMixture-of-Experts Language Models

  12. ReLoRA: Knowledge-Reusing Adaptation for Fast Rollout of Evolving LLM Services

    May 23, 2026Yang Xu, Zihuai Xu, Hongli Xu +3LLM ServingLLM Fine-Tuning

  13. Jailbreak to Protect: Buffering and Reinforcing via Temporary Jailbreaking for Safe Fine-Tuning in Large Language Models

    May 23, 2026Seokil Ham, Jaehyuk Jang, Wonjun Lee +1LLM Fine-TuningLLM Safety Alignment

  14. PALoRA: Projection-Adaptive LoRA for Preserving Reasoning in Large Language Models

    May 23, 2026Mustafa Hayri Bilgin, Mariam Barry, Albert Bifet +2Knowledge EditingContinual Learning for LLMs

  15. HyperGuide: Hyperbolic Guidance for Efficient Multi-Step Reasoning in Large Language Models

    May 22, 2026Yuyu Liu, Haotian Xu, Yanan He +3LLM Fine-TuningEfficient Language Model Reasoning

  16. Convex Optimization for Alignment and Preference Learning on a Single GPU

    May 22, 2026Miria Feng, Mert PilanciPairwise Preference LearningLLM Alignment

  17. PoisonForge: Task-Level Targeted Poisoning Benchmark for Instruction-Tuned LLMs

    May 22, 2026Luze Sun, Anshuman Suri, Harsh Chaudhari +2LLM Safety BenchmarksLLM Backdoor Attacks

  18. Signs Beat Floats: Low-Rank Double-Binary Adaptation for On-Device Fine-Tuning

    May 22, 2026Yoshihiko Fujisawa, Yuma Ichikawa, Yudai Fujimoto +2LLM QuantizationMemory-Efficient Fine-Tuning

  19. Truthful Online Preference Aggregation for LLM Fine-Tuning in Mobile Crowdsourcing

    May 22, 2026Shugang Hao, Lingjie DuanMechanism DesignLLM Fine-Tuning

  20. Beyond Temperature: Hyperfitting as a Late-Stage Geometric Expansion

    May 21, 2026Meimingwei Li, Yuanhao Ding, Esteban Garces Arias +1LLM InterpretabilityLLM Fine-Tuning

  21. BeLink: Biomedical Entity Linking Meets Generative Re-Ranking

    May 21, 2026Darya Shlyk, Stefano Montanelli, Lawrence HunterLLM Fine-TuningLLM Reranking

  22. Modeling Pathology-Like Behavioral Patterns in Language Models Through Behavioral Fine-Tuning

    May 21, 2026Nicola Milano, Davide MaroccoLLM Fine-TuningPersonality Modeling in Language Models

  23. Models Can Model, But Can't Bind: Structured Grounding in Text-to-Optimization

    May 20, 2026Zhiqi Gao, Albert Ge, Alexander Berenbeim +2LLM GroundingLLM Fine-Tuning

  24. torchtune: PyTorch native post-training library

    May 20, 2026Mark Obozov, Maxime Griot, Joseph Cummings +8LLM Fine-TuningEfficient Language Model Training

  25. PRISM: Preference-Aware Influence Function Based Data Selection Method for Efficient Fine-Tuning

    May 20, 2026Qihao Lin, Guanxu Chen, Dongrui Liu +1Supervised Fine-TuningLLM Fine-Tuning