LLM Fine-Tuning

LLM: Large Language Model

Momentum

42 papers in the last four weeks, up 83% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 509

All topics
CardsList
  1. Fine-tuning with Hierarchical Prompting for Robust Propaganda Classification Across Annotation Schemas

    May 13, 2026Lukas Stähelin, Veronika Solopova, Max Upravitelev +6LLM PromptingLLM Fine-Tuning

  2. LIFT: Last-Mile Fine-Tuning for Table Explicitation

    May 13, 2026Divij Khaitan, Ashish TiwariSupervised Fine-TuningFine-Tuning

  3. PRISM-X: Experiments on Personalised Fine-Tuning with Human and Simulated Users

    May 13, 2026Hannah Rose Kirk, Liu Leqi, Fanzhi Zeng +4LLM EvaluationLLM Sycophancy

  4. STOP: Structured On-Policy Pruning of Long-Form Reasoning in Low-Data Regimes

    May 13, 2026Chenjun Xu, Zhennan Zhou, Zhan Su +3LLM PruningLLM Fine-Tuning

  5. SLAP: Stratified Loss-based Pruning for On-Policy Data-Efficient Instruction Tuning

    May 13, 2026Run Zou, Jianhang Ding, Yifan Ding +3LLM Fine-TuningInstruction-Tuning Data Selection

  6. Persona-Model Collapse in Emergent Misalignment

    May 13, 2026Davi Bastos Costa, Renato VicenteLLM AlignmentLLM Fine-Tuning

  7. Early Data Exposure Improves Robustness to Subsequent Fine-Tuning

    May 12, 2026Lawrence Feng, Gaurav R. Ghosal, Jacob Mitchell Springer +2Language Model PretrainingContinual Learning for LLMs

  8. ORBIT: Preserving Foundational Language Capabilities in GenRetrieval via Origin-Regulated Merging

    May 12, 2026Neha Verma, Nikhil Mehta, Shao-Chuan Wang +7Continual Learning for LLMsLLM Fine-Tuning

  9. Overtrained, Not Misaligned

    May 12, 2026Joel Schreiber, Ariel GoldsteinEarly StoppingLLM Fine-Tuning

  10. Beyond Parameter Aggregation: Semantic Consensus for Federated Fine-Tuning of LLMs

    May 12, 2026Amr Abourayya, Jens Kleesiek, Michael KampLLM Fine-TuningFederated Knowledge Distillation

  11. Probabilistic Calibration Is a Trainable Capability in Language Models

    May 12, 2026Davide Baldelli, Sruthi Kuriakose, Maryam Hashemzadeh +2LLM Fine-TuningControllable Text Generation

  12. When Emotion Becomes Trigger: Emotion-style dynamic Backdoor Attack Parasitising Large Language Models

    May 12, 2026Ziyu Liu, Tao Li, Tianjie Ni +5LLM Backdoor AttacksBackdoor Attacks

  13. StoicLLM: Preference Optimization for Philosophical Alignment in Small Language Models

    May 12, 2026Ishmam Khan, Sindhuja Thogarrati, Shuo ZhangLLM AlignmentLLM Fine-Tuning

  14. AdaPaD: Adaptive Parallel Deflation for PEFT with Self-Correcting Rank Discovery

    May 11, 2026Barbara Su, Fangshuo Liao, Anastasios KyrillidisLLM Fine-TuningAdapter Tuning

  15. FocuSFT: Bilevel Optimization for Dilution-Aware Long-Context Fine-Tuning

    May 11, 2026Zehua Pei, Hui-Ling Zhen, Xianzhi Yu +3Supervised Fine-TuningSelf-Attention

  16. Team-Based Self-Play With Dual Adaptive Weighting for Fine-Tuning LLMs

    May 11, 2026Wu Li, Yigeng Zhou, Zesheng Shi +3LLM AlignmentSelf-Play RL

  17. Concordia: Self-Improving Synthetic Tables for Federated LLMs

    May 11, 2026Jimin Huang, Duanyu Feng, Nuo Chen +8LLM Fine-TuningSynthetic Data Generation

  18. Assessment of RAG and Fine-Tuning for Industrial Question-Answering-Applications

    May 10, 2026Jakob Sturm, Josef Pichlmeier, Christian Bernhard +4LLM Fine-TuningCost-Aware Inference

  19. Few-Shot Truly Benign DPO Attack for Jailbreaking LLMs

    May 9, 2026Sangyeon Yoon, Wonje Jeung, Yoonjun Cho +2Direct Preference OptimizationLLM Fine-Tuning

  20. Hint Tuning: Less Data Makes Better Reasoners

    May 9, 2026Siqi Fan, Minghao Li, Xiaoqian Ma +6Overthinking in Language ModelsLLM Fine-Tuning

  21. EdgeFlowerTune: Evaluating Federated LLM Fine-Tuning Under Realistic Edge System Constraints

    May 9, 2026Jiaxiang Geng, Yiyi Lu, Lunyu Zhao +3LLM EvaluationLLM Fine-Tuning

  22. Rotation-Preserving Supervised Fine-Tuning

    May 8, 2026Hangzhan Jin, Tianwei Ni, Lu Li +3Supervised Fine-TuningFine-Tuning

  23. Self-Play Enhancement via Advantage-Weighted Refinement in Online Federated LLM Fine-Tuning

    May 8, 2026Seohyun Lee, Wenzhi Fang, Dong-Jun Han +2LLM Fine-TuningLanguage Model Self-Improvement

  24. Graph Representation Learning Augmented Model Manipulation on Federated Fine-Tuning of LLMs

    May 8, 2026Hanlin Cai, Kai Li, Houtianfu Wang +4LLM Fine-TuningLLM Security

  25. MatryoshkaLoRA: Learning Accurate Hierarchical Low-Rank Representations for LLM Fine-Tuning

    May 8, 2026Ionut-Vlad Modoranu, Mher Safaryan, Dan AlistarhLLM Fine-TuningHierarchical Representation Learning