LLM Fine-Tuning

LLM: Large Language Model

Momentum

42 papers in the last four weeks, up 83% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 509

All topics
CardsList
  1. Sub-Billion, Super-Frontier: Small Language Models Rival Zero-Shot Frontier LLMs on General and Literary Relation Extraction

    Jun 21, 2026Despina Christou, Grigorios TsoumakasRelation ExtractionLLM Evaluation

  2. First-Token Broadcasters: Mechanistic Origins of Language Identity and Distributed Robustness in Transformers

    Jun 21, 2026Arjun Pillai, Christian Hoang, Anjelo Jann LarozaMultilingual Language ModelsLLM Interpretability

  3. Fine-Tuning Large Language Models for Quantum Reasoning

    Jun 20, 2026Katherine Ip, Casey R. Myers, Udaya Parampalli +2LLM Fine-TuningRL for Language Model Reasoning

  4. Finetuning with Scientific Data Increases Hallucinations: A Multi-domain Factuality Evaluation of LLMs

    Jun 19, 2026Raia Abu Ahmad, Nikolas Rauscher, Ekaterina Borisova +3LLM EvaluationLLM Fine-Tuning

  5. What Shapes Emergent Misalignment? Insights from Training Dynamics, Model Priors, and Data

    Jun 18, 2026Yuchen Zhang, Anietta Weckauff, Diego Garcia-Olano +1LLM EvaluationLLM Alignment

  6. Tracking Representation Dynamics in Large Language Models with Persistent Homology

    Jun 17, 2026Naman Malhotra, Jay Ambadkar, Abhinav Gupta +4LLM AlignmentLLM Fine-Tuning

  7. Techniques for Peak Memory Reduction for LoRA Fine-tuning of LLMs on Edge Devices

    Jun 17, 2026Hassan Dbouk, Matthias Reisser, Prathamesh Mandke +2Memory-Efficient Fine-TuningLLM Fine-Tuning

  8. Trade-offs in Medical LLM Adaptation: An Empirical Study in French QA

    Jun 17, 2026Ikram Belmadani, Oumaima El Khettari, Carlos Ramisch +3LLM Fine-TuningDomain-Adaptive Pretraining

  9. From Reasoning Traces to Reusable Modules: Understanding Compositional Generalization in Language Model Reasoning

    Jun 16, 2026Lingjing Kong, Xin Liu, Guangyi Chen +9LLM Fine-TuningRL for Language Model Reasoning

  10. From Drift to Coherence: Stabilizing Beliefs in LLMs

    Jun 16, 2026SongEun Kim, Seungyoo Lee, Edwin Fong +2LLM Fine-TuningBayesian Inference

  11. TuneAhead: Predicting Fine-tuning Performance Before Full Training Begins

    Jun 16, 2026Yuxiang Luo, Haonan Long, Chen Wang +6Fine-TuningLLM Fine-Tuning

  12. A Risk Decomposition Framework for Pre-Hoc Fine-Tuning Prediction

    Jun 16, 2026Yuxiang Luo, Chen Wang, Nan TangFine-TuningLLM Fine-Tuning

  13. LiFT: Local Search via Linear Programming for Overfitting-Controlled Transformers

    Jun 15, 2026Abhishek Shukla, Anikeit Khanna, Ankur Sinha +1Neural Network GeneralizationLLM Fine-Tuning

  14. From Tokens to Regions: CUDA-Sensitive Instruction Tuning for GPU Kernel Generation

    Jun 15, 2026Wentao Chen, Jiace Zhu, Xing Zhe Chai +4GPU Kernel OptimizationLLM Fine-Tuning

  15. PreLort: Prefix-Nested LoRA for Federated Fine-Tuning under Rank Heterogeneity

    Jun 14, 2026Muhammad Waseem, Nurbek Tastan, Andrej Jovanovic +4Federated Learning AggregationLLM Fine-Tuning

  16. Conflict-Aware Federated Fine-Tuning of Large Language Models with Mixture-of-Experts

    Jun 14, 2026Yijun Lu, Zihan Fang, Pengpeng Qiao +6Federated Learning AggregationLLM Fine-Tuning

  17. Integrating Reasoning and Generalization in Text-to-SQL via Self-Enhanced Fine-Tuning

    Jun 14, 2026Feng Lyu, Jinfeng Cen, Sijing Duan +4Self-Training for Language ModelsLLM Fine-Tuning

  18. Data-Centric Benchmarking of Exploit Generation in LLMs: Understanding the Impact of Fine-Tuning

    Jun 13, 2026Yiwei Chen, Lichi Li, Kai Cheung +2LLM EvaluationLLM Fine-Tuning

  19. Zero-order Parameter-free Optimization for LMO-based Methods: Novel Approach for Efficient Fine-tuning

    Jun 12, 2026Dmitriy Bystrov, Daniil Medyakov, Dmitry Bylinkin +1Gradient DescentZeroth-Order Optimization

  20. System Report for CCL25-Eval Task 5: New Dataset and LoRA-Fine-Tuned Qwen2.5

    Jun 10, 2026Haotao XieLLM Fine-TuningMachine Translation

  21. Categorical Prior Lock-in: Why In-Context Learning Fails for Structured Data

    Jun 10, 2026Antonio Pelusi, Stefano Braghin, Alberto TrombettaLLM Fine-TuningIn-Context Learning

  22. Fine-tuning Multi-modal LLMs with ART: Art-based Reinforcement Training

    Jun 10, 2026Michal Chudoba, Sergey Alyaev, Petra Galuscakova +1LLM Fine-TuningMultimodal Large Language Models

  23. Lius: Translation Model Based Instructional Lingustic Using Continual Instruction Tuning In Kupang Malay

    Jun 10, 2026Joanito Agili Lopo, Yunita Sari, Guntur Budi HerwantoLLM Fine-TuningLow-Resource MT