LLM Fine-Tuning

LLM: Large Language Model

Momentum

42 papers in the last four weeks, up 83% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 509

All topics
CardsList
  1. A Unifying Lens on Supervised Fine-Tuning Through Target Distribution Design

    Jun 9, 2026Tong Xie, Yuanhao Ban, Yunqi Hong +3Supervised Fine-TuningFine-Tuning

  2. Instruction Finetuning DeepSeek-R1-8B Model Using LoRA and NEFTune

    Jun 9, 2026Wu Yuerong, Mingni LuoNamed Entity RecognitionFine-Tuning

  3. OpenRTLSet: A Fully Open-Source Dataset for Large Language Model-based Verilog Module Design

    Jun 9, 2026Jinghua Wang, Lily Jiaxin Wan, Sanjana Pingali +6LLM Fine-TuningElectronic Design Automation

  4. Streaming Interventions: Can Video Large Language Models Correct Mistakes as They Occur?

    Jun 8, 2026Apratim Bhattacharyya, Shweta Mahajan, Sanjay Haresh +5LLM Fine-TuningSynthetic Data Generation

  5. Emergence of Context Characteristics Sensitivity in Large Language Models

    Jun 8, 2026Nadya Yuki Wangsajaya, Haeun Yu, Isabelle AugensteinLLM Fine-TuningInstruction Tuning

  6. PriFT: Prior-Support Guided Supervised Fine-Tuning

    Jun 8, 2026Ke Wang, Shuangqi Li, Mathieu Salzmann +1Supervised Fine-TuningFine-Tuning

  7. Multilingual Fact-Checking at Scale: Fine-Tuned Compact Models vs LLMs

    Jun 7, 2026Pratuat Amatya, Vinay SettyMultilingual Language ModelsLLM Evaluation

  8. AlignFed: Alignment-Aware Asynchronous Federated Fine-Tuning for Large Language Models in Heterogeneous Edge Environments

    Jun 6, 2026Yan Wang, Ziyi Gao, Rui WangLLM Fine-TuningAsynchronous Federated Learning

  9. How Small Can You Go? LoRA Fine-Tuning 270M-8B Models for Merchant Information Extraction in Financial Transactions

    Jun 6, 2026Donghao Huang, Tomas Drietomsky, Benjamin Barrett +1Financial ServicesMemory-Efficient Fine-Tuning

  10. Minibatch Selection for Language Models via Partition Matroid Constrained Gradient Matching

    Jun 6, 2026Prayas Agrawal, Prateek Chanda, Ishita Khatri +3Submodular OptimizationLLM Fine-Tuning

  11. HARP: Efficient Data Selection for Finetuning Large Language Models

    Jun 5, 2026Ning Wang, Zhengxin Zhang, Maosen Tang +3LLM Fine-TuningActive Learning

  12. SpectCount: Spectrotemporal Counting via Synthetic Signals Improves Large Audio Language Models

    Jun 5, 2026Seonuk Kim, Yonghyeon Jun, Ju Yeon Kang +3LLM Fine-TuningAudio Understanding

  13. The Piggyback Hypothesis of Generalization: Explaining and Mitigating Emergent Misalignment

    Jun 4, 2026Jiachen Zhao, Zhengxuan Wu, Aryaman Arora +3LLM AlignmentLLM Fine-Tuning

  14. Improving Answer Extraction in Context-based Question Answering Systems Using LLMs

    Jun 4, 2026Hafez Abdelghaffar, Ahmed Alansary, Ali HamdiLLM Fine-TuningQuestion Answering

  15. RedditPersona: A Modular Framework for Community-Conditioned LLM Adaptation from Reddit

    Jun 4, 2026Amirhossein Ghaffari, Ali Goodarzi, Huong Nguyen +3LLM EvaluationLLM Fine-Tuning

  16. Multilingual Fine-Tuning via Localized Gradient Conflict Resolution

    Jun 4, 2026Long P. Hoang, Yiran Zhao, Wei Lu +1Multilingual Language ModelsLLM Fine-Tuning

  17. Dominant-Layer ZO: A Single Layer Dominates Zeroth-Order Fine-Tuning of LLMs

    Jun 3, 2026Wanhao Yu, Ziyan Wang, Zheng Wang +7Fine-TuningMemory-Efficient Fine-Tuning

  18. SafeGene: Reusable Adapters for Transferable Safety Alignment

    Jun 2, 2026Yanghan Wang, Zhiqiang Kou, Fu Feng +2LLM Fine-TuningLLM Safety Alignment

  19. Safety Measurements for Fine-tuned LLMs Should be Grounded in Capability

    Jun 2, 2026Krishnapriya Vishnubhotla, Hillary Dawkins, Isar Nejadgholi +1Language Model Safety EvaluationLLM Fine-Tuning

  20. Large Language Models Are Overconfident in Their Own Responses

    Jun 2, 2026Mario Sanz-Guerrero, Manuel Mager, Katharina von der WenseConfidence Estimation in Language ModelsLLM Prompting

  21. DECA: Decentralizing Block-Wise Adam for Efficient LLM Full-Parameter Fine-Tuning on Non-IID Data

    Jun 2, 2026Yunsheng Yuan, Shaowei Li, Kai Wang +5Fine-TuningLLM Fine-Tuning

  22. GRZO: Group-Relative Zeroth-Order Optimization for Large Language Model Fine-Tuning

    Jun 1, 2026Liyan Tan, Yequan Zhao, Yifan Yang +3Fine-TuningMemory-Efficient Fine-Tuning

  23. Towards Multidisciplinary Summarization of Hospital Stays: Efficient Sentence-Level Clinical Provenance Categorization

    Jun 1, 2026Baris Karacan, Vaibhav Bhargava, Barbara Di Eugenio +21Data ProvenanceLLM Fine-Tuning

  24. Training Prompt Matters: State-Adaptive Optimization for Robust Fine-Tuning

    Jun 1, 2026Wenhang Shi, Yiren Chen, Shuqing Bian +5Continual Learning for LLMsPrompt Learning