LLM Fine-Tuning

LLM: Large Language Model

Momentum

42 papers in the last four weeks, up 83% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 509

All topics
CardsList
  1. AyurParam: A State-of-the-Art Bilingual Language Model for Ayurveda

    Nov 4, 2025Sravan Gorugantu, Mohd Nauman, Vijay Devane +7Medical LLMsHealthcare

  2. LuxIT: A Luxembourgish Instruction Tuning Dataset from Monolingual Seed Data

    Oct 28, 2025Julian Valline, Cedric Lothritz, Siwen Guo +1LLM Fine-TuningSynthetic Data Generation

  3. Data Provenance Auditing of Fine-Tuned Large Language Models with a Text-Preserving Technique

    Oct 7, 2025Yanming Li, Cédric Eichler, Nicolas Anciaux +3Data ProvenanceDataset Watermarking

  4. Uncovering the Computational Ingredients of Human-Like Representations in LLMs

    Oct 1, 2025Zach Studdiford, Timothy T. Rogers, Kushin Mukherjee +1LLM EvaluationLLM Fine-Tuning

  5. Evolution Strategies at Scale: LLM Fine-Tuning Beyond Reinforcement Learning

    Sep 29, 2025Xin Qiu, Yulu Gan, Conor F. Hayes +6Fine-TuningEvolutionary Optimization

  6. Scale or Reason? A Compute-Equivalent Analysis of Reasoning Distillation

    Sep 26, 2025Nicolas Boizard, Hippolyte Gisserot-Boukhlef, Kevin El Haddad +2CoT DistillationLLM Fine-Tuning

  7. EyeMulator: Improving Code Language Models by Mimicking Human Visual Attention

    Aug 22, 2025Yifan Zhang, Chen Huang, Yueke Zhang +5Code TranslationLLM Fine-Tuning

  8. FlexP-SFT: A Flexible Aggregation-Free Framework for On-Device Personalized Split Federated Fine-Tuning of LLMs

    Aug 14, 2025Jiaxiang Geng, Tianjun Yuan, Pengchao Han +3Communication-Efficient Distributed TrainingLLM Fine-Tuning

  9. PLoRA: Efficient Concurrent LoRA Training for Large Language Models

    Aug 4, 2025Minghao Yan, Zhuang Wang, Zhen Jia +2LLM Fine-TuningEfficient Language Model Training

  10. Using Large Language Models for Legal Decision-Making in Austrian Value-Added Tax Law: A Comparative Study

    Jul 11, 2025Marina Luketina, Andrea Benkel, Christoph G. SchuetzAI-Assisted Decision MakingLegal Reasoning

  11. Learning Composable Chains-of-Thought

    May 28, 2025Fangcong Yin, Zeyu Leo Liu, Liu Leqi +2LLM Fine-TuningCoT Reasoning

  12. RECAST: Expanding the Boundaries of LLMs' Complex Instruction Following with Multi-Constraint Data

    May 25, 2025Zhengkang Guo, Wenhao Liu, Mingchen Xie +13LLM Fine-TuningSynthetic Data Generation

  13. Batch Augmentation with Unimodal Fine-tuning for Multimodal Fusion of Large Language Models

    May 10, 2025H M Dipu Kabir, Subrota Kumar Mondal, Mohammad Ali MoniMultimodal FusionMultimodal Classification

  14. Evaluating the Scalability and Adversarial Generalization of GRPO-Trained NLI Models

    Apr 25, 2025Pablo Miralles-González, Javier Huertas-Tato, Alejandro Martín +1LLM Fine-TuningRL for Language Model Reasoning

  15. Towards Harnessing the Collaborative Power of Large and Small Models for Domain Tasks

    Apr 24, 2025Yang Liu, Kejia Zhang, Bingjie Yan +11Privacy-Preserving Language ModelsLLM Fine-Tuning

  16. Boosting Large Language Models with Mask Fine-Tuning

    Mar 27, 2025Mingyuan Zhang, Yue Bai, Huan Wang +4LLM Fine-Tuning

  17. Distributionally Robust Reinforcement Learning with Human Feedback

    Mar 1, 2025Debmalya Mandal, Paulius Sasnauskas, Goran RadanovicDirect Preference OptimizationLLM Fine-Tuning

  18. LIFT: A Novel Framework for Enhancing Long-Context Understanding of LLMs via Long Input Fine-Tuning

    Feb 20, 2025Yansheng Mao, Yufei Xu, Jiaqi Li +5Long-Context QALLM Fine-Tuning

  19. Tuning Language Models by Mixture-of-Depths Ensemble

    Oct 16, 2024Haoyan Luo, Lucia SpeciaLLM Fine-TuningLanguage Model Ensembles

  20. Mitigating Memorization In Language Models

    Oct 3, 2024Mansi Sakarvadia, Aswathy Ajith, Arham Khan +6Memorization in Language ModelsLLM Fine-Tuning

  21. Vikhr: The Family of Open-Source Instruction-Tuned Large Language Models for Russian

    May 22, 2024Aleksandr Nikolich, Konstantin Korolev, Sergei Bratchikov +2Language Model PretrainingMultilingual Language Models

  22. Amortizing intractable inference in large language models

    Oct 6, 2023Edward J. Hu, Moksh Jain, Eric Elmoznino +4Amortized InferenceLLM Fine-Tuning

  23. Aligning Language Models with Observational Data: Opportunities and Risks from a Causal Perspective

    Date pendingErfan LoghmaniLLM AlignmentLLM Fine-Tuning

  24. On The Effectiveness-Fluency Trade-Off In LLM Conditioning: A Systematic Study

    Date pendingIuri Macocco, Pau Rodríguez, Arno Blaas +3LLM Fine-TuningActivation Steering

  25. A Factorial Study of Synthetic Data Generation for Low-Resource Machine Translation using Grammar Books

    Date pendingVarun Ghat Ravikumar, Sina Ahmadi, Lena Jäger +1LLM Fine-TuningSynthetic Data Generation