Language Model Merging

Latest papers 69

All topics
CardsList
  1. On the Vulnerability of Parameter-Level Defenses to Model Merging

    Jun 29, 2026Kuangpu Guo, Qingyan Zheng, Jian Liang +4LLM SecurityLanguage Model Merging

  2. Curvature-Guided Mixing for MLLM Adaptation

    Jun 23, 2026Jinglong Yang, Jiaxuan He, Wenjian Huang +2VLM AdaptationMultimodal Large Language Models

  3. Predicting Mergeability of Parameter-Efficient Fine-Tuning Updates

    Jun 17, 2026Lin Tang, Wei Zhang, Jing Li +3Low-Rank AdaptationLanguage Model Merging

  4. Enhancing Multilingual Reasoning via Steerable Model Merging

    Jun 17, 2026Zhuoran Li, Rui Xu, Jian Yang +8Multilingual Language ModelsLanguage Model Merging

  5. Sparsity Curse: Understanding RLVR Model Parameter Space from Model Merging

    Jun 16, 2026Chenrui Wu, Zexi Li, Jiajun Bu +2Reinforcement Learning with Verifiable RewardsLanguage Model Merging

  6. Post-Hoc Merging is Not Enough: Many-Shot Model Merging with Loss-Gap Balancing

    Jun 15, 2026Kyungjin Im, Miru Kim, Chanin Eom +1Multi-Task LearningLanguage Model Merging

  7. PermDoRA -- Understanding Adapter Interference in Language Models: Limits of Parameter-Space Geometry

    Jun 9, 2026Gowtham Sivaramakrishnan, Sarvesha Kumar Kombaiah Seetha, Kishan Gupta Balaji +1Low-Rank AdaptationLLM Security

  8. TaDA: Calibrated Probe Gating for Task-Domain LoRA Merging

    Jun 3, 2026Huy Quoc To, Fuyi Li, Guangyan Huang +1Adapter TuningLow-Rank Adaptation

  9. When Model Merging Breaks Routing: Training-Free Calibration for MoE

    Jun 2, 2026Canbin Huang, Tianyuan Shi, Xiaojun Quan +3Mixture of ExpertsLLM Routing

  10. RogueMerge: Robust and Unified Attacks against LLM Model Merging

    Jun 2, 2026Jinghuai Zhang, Yetian He, Kunlin Cai +3LLM SecurityTask Vector Merging

  11. ResMerge: Residual-based Spectral Merging of Large Language Models

    Jun 1, 2026Yandu Sun, Zhiyan Hou, Haokai Ma +6Task Vector MergingLanguage Model Merging

  12. Access Sets Matter: Budgeting Expert Reads for Scalable Weight-Space Model Merging

    May 28, 2026Yuanyi Wang, Yanggan Gu, Su Lu +5Weight-Space AnalysisLanguage Model Merging

  13. EvoGM: Learning to Merge LLMs via Evolutionary Generative Optimization

    May 28, 2026Tao Jiang, Xinmeng Yu, Chenhao Yi +5Evolutionary OptimizationLanguage Model Merging

  14. Model Merging by Output-Space Projection

    May 27, 2026Bethan Evans, Benjamin Etheridge, Stephen Roberts +1Quadratic ProgrammingLanguage Model Merging

  15. Compositional Generalization in Autoregressive Models via Logit Composition

    May 27, 2026Aakash Kumar, Maria Sofia Bucarelli, Emanuele NataleLanguage Model MergingCompositional Generalization

  16. Extra-Merge: Tracing the Rank-1 Subspace of Model Merging in Language Model Pre-Training

    May 26, 2026Wenjie Zhou, Bohan Wang, Hongtao Zhang +3Language Model PretrainingNeural Network Optimization

  17. On the Limits of Model Merging for Multilinguality in Pre-Training

    May 25, 2026Seth Aycock, Fedor Vitiugin, Aleksandr Umnov +2Language Model PretrainingMultilingual Language Models

  18. Tunable MAGMAX: Preference-Aware Model Merging for Continual Learning

    May 20, 2026Kei Hiroshima, Kento Uchida, Shinichi ShirakawaContinual LearningLanguage Model Merging

  19. A Data-Efficient Path to Multilingual LLMs: Language Expansion via Post-training PARAMΔΔ Integration into Upcycled MoE

    May 18, 2026Hao Zhou, Tianhao Li, Zhijun Wang +6Multilingual Language ModelsMixture-of-Experts Language Models

  20. Merging Methods for Multilingual Knowledge Editing for Large Language Models: An Empirical Odyssey

    May 13, 2026Kunil Lee, Ki-Young Shin, Jong-Hyeok Lee +1Knowledge EditingMultilingual Language Models

  21. DiM\textsuperscript{3}: Bridging Multilingual and Multimodal Models via Direction- and Magnitude-Aware Merging

    May 13, 2026Zijing Wang, Mingyang Wang, Ercong Nie +6Multilingual Language ModelsMultimodal Large Language Models

  22. GIFT: Guided Fine-Tuning and Transfer for Enhancing Instruction-Tuned Language Models

    May 2, 2026Zhiwen Ruan, Yichao Du, Jianjie Zheng +6LLM Fine-TuningLarge Language Model-Guided Optimization

  23. Decouple before Integration: Test-time Synthesis of SFT and RLVR Task Vectors

    May 1, 2026Chaohao Yuan, Chenghao Xiao, Yu Rong +2Task ArithmeticLanguage Model Merging

  24. Evolutionary Negative Module Pruning for Better LoRA Merging

    Apr 20, 2026Anda Cao, Zhuo Gou, Yi Wang +5Low-Rank AdaptationLanguage Model Merging