LLM Fine-Tuning

LLM: Large Language Model

Momentum

42 papers in the last four weeks, up 83% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 509

All topics
CardsList
  1. Domain Fine-Tuning vs. Retrieval-Augmented Generation for Medical Multiple-Choice Question Answering: A Controlled Comparison at the 4B-Parameter Scale

    Apr 26, 2026Avi-ad Avraam BuskilaRetrieval-Augmented GenerationHealthcare

  2. The Override Gap: A Magnitude Account of Knowledge Conflict Failure in Hypernetwork-Based Instant LLM Adaptation

    Apr 26, 2026Shuaizhi Cheng, Xiang Shi, Zhiwei Zhang +1Knowledge Conflicts in Language ModelsLLM Fine-Tuning

  3. Disentangling Linguistic Relatedness from Task Alignment in Cross-Lingual Transfer

    Apr 26, 2026Ahmed Haj Ahmed, Ruochen Zhang, Alvin GrissomMultilingual Language Model EvaluationLLM Fine-Tuning

  4. S2\mathcal{S}^2IT: Stepwise Syntax Integration Tuning for Large Language Models in Aspect Sentiment Quad Prediction

    Apr 25, 2026Bingfeng Chen, Chenjie Qiu, Yifeng Xie +3LLM Fine-TuningAspect-Based Sentiment Analysis

  5. Fine-tuning vs. In-context Learning in Large Language Models: A Formal Language Learning Perspective

    Apr 25, 2026Bishwamittra Ghosh, Soumi Das, Till Speicher +5LLM EvaluationLLM Fine-Tuning

  6. DeepImagine: Learning Biomedical Reasoning via Successive Counterfactual Imagining

    Apr 24, 2026Youze Zheng, Jianyou Wang, Yuhan Chen +8LLM Fine-TuningCounterfactual Reasoning in Language Models

  7. Self Knowledge Re-expression: A Fully Local Method for Adapting LLMs to Tasks Using Intrinsic Knowledge

    Apr 24, 2026Mengyu Wang, Xiaoying Zhi, Zhiyi Li +4Document UnderstandingLLM Fine-Tuning

  8. mcdok at SemEval-2026 Task 13: Finetuning LLMs for Detection of Machine-Generated Code

    Apr 23, 2026Adam Skurla, Dominik Macko, Jakub SimkoAI-Generated Text DetectionLLM Fine-Tuning

  9. CARE: Counselor-Aligned Response Engine for Online Mental-Health Support

    Apr 23, 2026Hagai Astrin, Ayal Swaid, Avi Segal +1Mental Health CounselingEmotional Support Conversation

  10. Align Generative Artificial Intelligence with Human Preferences: A Novel Large Language Model Fine-Tuning Method for Online Review Management

    Apr 23, 2026Yanan Wang, Yong GeLLM Hallucination MitigationLLM Fine-Tuning

  11. AFRILANGTUTOR: Advancing Language Tutoring and Culture Education in Low-Resource Languages with Large Language Models

    Apr 22, 2026Tadesse Destaw Belay, Shahriar Kabir Nahin, Israel Abebe Azime +6Multilingual Language ModelsIntelligent Tutoring Systems

  12. Compatibility-Aware Dynamic Fine-Tuning for Large Language Models

    Apr 22, 2026Yucheng Zhou, Junwei Sheng, Qianning Wang +1Supervised Fine-TuningFine-Tuning

  13. IRIS: Interpolative Rényi Iterative Self-play for Large Language Model Fine-Tuning

    Apr 22, 2026Wenjie Liao, Like Wu, Liangjie Zhao +2Fine-TuningLLM Fine-Tuning

  14. FedProxy: Federated Fine-Tuning of LLMs via Proxy SLMs and Heterogeneity-Aware Fusion

    Apr 21, 2026Tao Fan, Guoqiang Ma, Yuanfeng Song +3Privacy-Preserving Language ModelsLLM Fine-Tuning

  15. Fine-Tuning Small Reasoning Models for Quantum Field Theory

    Apr 21, 2026Nathaniel S. Woodward, Zhiqi Gao, Yurii Kvasiuk +3Physical ReasoningLLM Fine-Tuning

  16. Universally Empowering Zeroth-Order Optimization via Adaptive Layer-wise Sampling

    Apr 20, 2026Fei Wang, Li Shen, Liang Ding +3Zeroth-Order OptimizationLLM Fine-Tuning

  17. LeGo-Code: Can Modular Curriculum Learning Advance Complex Code Generation? Insights from Text-to-SQL

    Apr 20, 2026Salmane Chafik, Saad Ezzini, Ismail BerradaLLM Fine-TuningCode Generation

  18. TLoRA: Task-aware Low Rank Adaptation of Large Language Models

    Apr 20, 2026Weicheng Lin, Yi Zhang, Jiawei Dang +1LLM Fine-TuningLow-Rank Adaptation

  19. JudgeMeNot: Personalizing Large Language Models to Emulate Judicial Reasoning in Hebrew

    Apr 20, 2026Itay Razumenko, Arnon Sturm, Nir GrinbergLegal NLPLLM Personalization

  20. CodePivot: Bootstrapping Multilingual Transpilation in LLMs via Reinforcement Learning without Parallel Corpora

    Apr 20, 2026Shangyu Li, Juyong Jiang, Meibo Ren +7Code TranslationRL for Language Models

  21. SafeAnchor: Preventing Cumulative Safety Erosion in Continual Domain Adaptation of Large Language Models

    Apr 20, 2026Dongxin Guo, Jikun Wu, Siu Ming YiuContinual Learning for LLMsLLM Fine-Tuning

  22. Evaluating Hallucinations in Domain-Adapted Large Language Models

    Apr 19, 2026Sanchita Porwal, Sai Prasath S, Xingjian Bi +1LLM EvaluationDomain Adaptation

  23. Rethinking Data Curation in LLM Training: Online Reweighting Offers Better Generalization than Offline Methods

    Apr 19, 2026Wanru Zhao, Yihong Chen, Yuzhi Tang +6Language Model PretrainingLLM Fine-Tuning

  24. REALM: Reliable Expertise-Aware Language Model Fine-Tuning from Noisy Annotations

    Apr 19, 2026Sajjad Ghiasvand, Mark Beliaev, Mahnoosh Alizadeh +1Supervised Fine-TuningLLM Fine-Tuning

  25. Continual Safety Alignment via Gradient-Based Sample Selection

    Apr 19, 2026Thong Bach, Dung Nguyen, Thao Minh Le +1Continual Learning for LLMsLLM Fine-Tuning

  26. Beyond the Basics: Leveraging Large Language Model for Fine-Grained Medical Entity Recognition

    Apr 19, 2026Nwe Ni Win, Jim Basilakis, Steven Thomas +6Named Entity RecognitionHealthcare

  27. Guardrails in Logit Space: Safety Token Regularization for LLM Alignment

    Apr 19, 2026Thong Bach, Truyen TranLLM Fine-TuningLLM Safety Alignment