Instruction Tuning

Latest papers 48

All topics
CardsList
  1. A helps B while B hurts A: directed transfer in instruction-tuning mixture

    Sep 30, 2026Nima H. Siboni, Vahid RostamiInstruction TuningMixtures

  2. The Safety Operator: Modulating the Expression of Safety Instructions via Spectral Optimization

    Sep 29, 2026Benoit Dherin, Michael Munn, Xavier Gonzalvo +14Safety ClaimsInstruction Tuning

  3. Render Before Reading: Visual Rendering as a Prompt Injection Defense

    Sep 28, 2026Jie Zhang, Andrei Baroian, Jan N. van Rijn +2Indirect Prompt InjectionMultimodal Large Language Models

  4. Stabilizing Instruction Supervision for Instruct-TTS via Controllable Diversification and Drift Filtering

    Sep 8, 2026Yizhong Geng, Kecan Mao, Qifei Li +6Instruction TuningInstruction

  5. LLMs Learn Better In-Context from Rules than from Examples

    Sep 2, 2026Xiang Fu, Seungmin Cho, Yukyung Lee +1In-Context LearningIn-Context

  6. How Output Format Confounds Data Quality and Capability in Instruction Tuning

    Sep 2, 2026Chengguang Gan, Hanjun Wei, Yunhao Liang +3Instruction TuningData Quality

  7. Are You Sure You're Sure? On the Impact of Instruction Tuning on Confidence and Lexical Diversity

    Aug 13, 2026Irina Proskurina, Mayank Kumar, Oyindolapo O. KomolafeInstruction TuningInstruction-Tuned Models

  8. Is Convergence Inevitable? Tracing Output Homogeneity Back to Base Models

    Aug 11, 2026Alexandrine Fortier, Hazel Chen, Peter WestInstruction TuningConvergence

  9. DistMoE: Private-data Rehearsal-free Routing in Mixture-of-Experts for Distributed Instruction Tuning

    Aug 10, 2026Mainak Singha, Niccolò Biondi, Elisa Ricci +1Multimodal Continual Instruction TuningMixture-Of-Experts

  10. A Unified Moral-Value Dataset for Instruction Tuning

    Jul 23, 2026Zhaohui Zeng, Florian MaiInstruction TuningMoral Reasoning

  11. Learning from Synthetic Data without Model Collapse in Iterative Instruction Tuning

    Jul 19, 2026Xiaonan Luo, Yue Huang, Kehan Guo +4Instruction TuningSynthetic Training Data

  12. Leveraging Instruction Tuning and Merging for Reasoning Model Adaptation

    Jul 16, 2026Yu-Du Feng, Niels Mündler-Sasahara, Mark Vero +1LLM Reasoning StrategiesInstruction Tuning

  13. Unlocking Speech-Text Compositional Powers: Instruction-Following Speech Language Models without Instruction Tuning

    Jul 2, 2026Congrui Du, Yang Zhang, Kaizhi Qian +1Speech Language ModelsInstruction Tuning

  14. TraMP-LLaMA: Generative Interpretability with Decoupled Instruction Tuning for Facial Expression Quality Assessment

    Jun 25, 2026Shuchao Duan, Alan Whone, Hossein Rahmani +2Facial Expression RecognitionMultimodal Evaluation

  15. LoopCoder-v2: Only Loop Once for Efficient Test-Time Computation Scaling

    Jun 16, 2026Jian Yang, Shawn Guo, Wei Zhang +16Code OptimizationLoop

  16. From Tokens to Regions: CUDA-Sensitive Instruction Tuning for GPU Kernel Generation

    Jun 15, 2026Wentao Chen, Jiace Zhu, Xing Zhe Chai +4CudaGraphics Processing Unit Kernels

  17. Steering Where to Listen: Instruction-Based Activation Steering Redirects Temporal Attention in Large Audio-Language Models

    Jun 9, 2026Tsung-En Lin, Hung-Yi LeeLarge Audio Language ModelsLinear Activation Steering

  18. Decomposing Factual Sycophancy in Language Models: How Size and Instruction Tuning Shape Robustness

    Jun 4, 2026Victor De Marez, Luna De Bruyne, Walter DaelemansSycophancyInstruction-Tuned Models

  19. Visual Instruction Tuning Aligns Modalities through Abstraction

    Jun 2, 2026Luis Palacios, Lorenzo Basile, Diego Doimo +1Multimodal Continual Instruction TuningInstruction Tuning

  20. Large Language Models Are Overconfident in Their Own Responses

    Jun 2, 2026Mario Sanz-Guerrero, Manuel Mager, Katharina von der WenseInstruction-Tuned ModelsOverconfidence

  21. A unified multi-task framework enables interpretable chest radiograph analysis

    Jun 2, 2026Lijian Xu, Ziyu Ni, Xinglong Liu +3Radiology Report GenerationChest X-Ray

  22. ProtoAda: Prototype-Guided Adaptive Adapter Expansion and Geometric Consolidation for Multimodal Continual Instruction Tuning

    Jun 1, 2026Yu-Cheng Shi, Zhen-Hao Xie, Jun-Tao Tang +1Multimodal Continual Instruction TuningVision-Language Model Adaptation

  23. CRAM: Centroid-Routing and Adaptive MoE for Multimodal Continual Instruction Tuning

    Jun 1, 2026Jun-Tao Tang, Zhen-Hao Xie, Yu-Cheng Shi +1Multimodal Continual Instruction TuningInstruction Tuning

  24. Decentralized Instruction Tuning: Conflict-Aware Splitting and Weight Merging

    Jun 1, 2026Minsik Choi, Geewook KimInstruction Tuning

  25. MADS: Model-Aware Diverse Core Set Selection for Instruction Tuning

    May 29, 2026Yi Bai, Wenhao Zhang, Yao Chen +3Instruction TuningModel Fine-Tuning

  26. Beyond Bilingual Transfer: Multilingual Code-Switching in Instruction Tuning

    May 28, 2026Shunta Asano, Jeonghun Baek, Toshihiko YamasakiCross-Lingual TransferMultilingual

  27. Prism: A Plug-in Reproducible Infrastructure for Scalable Multimodal Continual Instruction Tuning

    May 25, 2026Jun-Tao Tang, Yu-Cheng Shi, Zhen-Hao Xie +1Multimodal Continual Instruction TuningInstruction Tuning

  28. BeLink: Biomedical Entity Linking Meets Generative Re-Ranking

    May 21, 2026Darya Shlyk, Stefano Montanelli, Lawrence HunterMedical OntologyCross-Encoder Reranking

  29. DarkLLM: Learning Language-Driven Adversarial Attacks with Large Language Models

    May 15, 2026Ye Sun, Xin Wang, Jiaming Zhang +7Black-Box Adversarial AttacksWhite-Box Spectral-Subspace-Guided Attack

  30. SLAP: Stratified Loss-based Pruning for On-Policy Data-Efficient Instruction Tuning

    May 13, 2026Run Zou, Jianhang Ding, Yifan Ding +3Instruction TuningAlignment-Aware Selection

  31. Dynamic Cross-Modal Prompt Generation for Multimodal Continual Instruction Tuning

    May 11, 2026Tao Hu, Da-Wei ZhouMultimodal Continual Instruction TuningInstruction Tuning

  32. Let the Target Select for Itself: Data Selection via Target-Aligned Paths

    May 10, 2026Huitao Yang, Hengzhi He, Tung Sum Thomas Kwok +1Alignment-Aware SelectionAdaptive Sampling

  33. Decomposing the Basic Abilities of Large Language Models: Mitigating Cross-Task Interference in Multi-Task Instruct-Tuning

    May 7, 2026Bing Wang, Ximing Li, Changchun Li +3Instruction TuningCross-Task Interference

  34. Open-Source Image Editing Models Are Zero-Shot Vision Learners

    May 6, 2026Wei Liu, Jiaxin Lin, Rui ChenInstruction Tuning

  35. Attention Is Where You Attack

    Apr 30, 2026Aviral Srivastava, Sourav PandaAdversarial ExamplesJailbreak Attacks

  36. Multi-Task Instruction Tuning via Data Scheduling for Low-Resource Arabic SpeechLLMs

    Jan 18, 2026Hunzalah Hassan Bhatti, Firoj Alam, Shammur Absar ChowdhuryArabic Natural Language ProcessingArabic

  37. DynamixSFT: Dynamic Mixture Optimization of Instruction Tuning Collections

    Aug 16, 2025Haebin Shin, Lei Ji, Xiao Liu +4Multimodal Continual Instruction TuningInstruction Tuning

  38. In-context Learning vs. Instruction Tuning: The Case of Small and Multilingual Language Models

    Mar 3, 2025David Ponce, Thierry EtchegoyhenInstruction TuningIn-Context Learning

  39. How LLMs Follow Instructions: Skillful Coordination, Not a Universal Mechanism

    Date pendingElisabetta Rocchetti, Alfio FerraraInstruction TuningInstruction-Tuned Models