Mixture-of-Experts Models

Latest papers 297

All topics
CardsList
  1. PRISM: Synergizing Vision Foundation Models via Self-organized Expert Specialization

    Jun 2, 2026Ying Tang, Dong Li, Youjia Zhang +3Vision Foundation ModelsSparse Mixture-of-Experts

  2. When Model Merging Breaks Routing: Training-Free Calibration for MoE

    Jun 2, 2026Canbin Huang, Tianyuan Shi, Xiaojun Quan +3Mixture of ExpertsLLM Routing

  3. Pathway-Structured Privileged Distillation for Deployable Computational Pathology

    Jun 1, 2026Yongxin Guo, Hao Lu, Onur Koyun +2Computational PathologyOncology

  4. CRAM: Centroid-Routing and Adaptive MoE for Multimodal Continual Instruction Tuning

    Jun 1, 2026Jun-Tao Tang, Zhen-Hao Xie, Yu-Cheng Shi +1Mixture-of-Experts ModelsMultimodal Instruction Tuning

  5. GC-MoE: Genomics-Guided Cell-Type-Specific Mixture of Experts for Histology-Based Single-Cell Spatial Transcriptomics

    Jun 1, 2026Kaito Shiku, Ahtisham Fazeel Abbasi, Ryoma Bise +4Computational PathologySpatial Transcriptomics

  6. AdaWeather: Adaptively Mixing Probabilistic Weather Forecasts with Logarithmic Regret

    Jun 1, 2026Saptarishi Dhanuka, Sarvesh Iyer, Manmeet Singh +5Probabilistic ForecastingMixture-of-Experts Models

  7. Hierarchically Decoupled Mixture-of-Experts for Robust Traffic Sign Recognition in Complex Driving Scenarios

    Jun 1, 2026Mingxiao Wang, Xiaozhen Qu, Bolin Gao +2Sparse Mixture-of-ExpertsAutonomous Driving Perception

  8. ProbMoE: Differentiable Probabilistic Routing for Mixture-of-Experts

    Jun 1, 2026Heng Zhao, Zilei Shao, Guy Van den Broeck +1Sparse Mixture-of-ExpertsExpert Routing

  9. Deft Scheduling of Dynamic Cloud Workflows with Varying Deadlines via Mixture-of-Experts

    May 31, 2026Ya Shen, Gang Chen, Hui Ma +1Adaptive Model RoutingMixture-of-Experts Models

  10. DAG-MoE: From Simple Mixture to Structural Aggregation in Mixture-of-Experts

    May 31, 2026Jiarui Feng, Hanqing Zeng, Karish Grover +11Mixture-of-Experts Language ModelsSparse Mixture-of-Experts

  11. Beyond Task-Agnostic: Task-Aware Grouping for Communication-Efficient Multi-Task MoE Inference

    May 31, 2026Zhiyao Xu, Aoxue Liu, Zhanjie Ding +3Mixture-of-Experts InferenceMixture-of-Experts Models

  12. Confidence-Adaptive SwiGLU for Mixture-of-Experts

    May 30, 2026Shaohua Li, Xiuchao Sui, Xiaobing Sun +4Mixture-of-Experts Language ModelsMixture-of-Experts Models

  13. Dialectics of Alignment: Harnessing Unsafe Knowledge for Dynamic Safety Routing

    May 30, 2026Maryam Hashemzadeh, Jerry Huang, Minseon Kim +2LLM Safety AlignmentLLM Safety

  14. PithTrain: A Compact and Agent-Native MoE Training System

    May 29, 2026Ruihang Lai, Hao Kang, Haozhan Tang +6Mixture-of-Experts Language ModelsEfficient Language Model Training

  15. MoG: Mixture of Experts for Graph-based Retrieval-Augmented Generation

    May 29, 2026Zheng Yuan, Chuang Zhou, Linhao Luo +4Retrieval-Augmented GenerationGraph Retrieval-Augmented Generation

  16. Eigenvectors of Experts are Training-free Non-collapsing Routers

    May 29, 2026Giang Do, Hung Le, Truyen TranParameter-Free Mixture-of-Experts RoutingMixture of Experts

  17. Graph-Conditioned Mixture of Graph Neural Network Experts for Traffic Forecasting

    May 28, 2026Amirhossein Ghaffari, Saeid Sheikhi, Ekaterina GilmanAdaptive Model RoutingMixture-of-Experts Models

  18. DAMEL: Dual-Axis Multi-Expert Learning for Class-Imbalanced Learning

    May 28, 2026Hyuck Lee, Taemin Park, Heeyoung KimClass-Imbalanced LearningLong-Tail Learning

  19. RA-MoE: Routing-Aligned Fine-Tuning for Multilingual Adaptation of Mixture-of-Experts Models

    May 27, 2026Guanzhi Deng, Kuan Wu, Haibo Wang +6Mixture-of-Experts Language ModelsLLM Fine-Tuning

  20. VidPrism: Heterogeneous Mixture of Experts for Image-to-Video Transfer

    May 27, 2026Rui Lin, Chuanming Wang, Huadong MaVLM AdaptationVideo Representation Learning

  21. Extracting Small Translation Specialists from LLMs by Aggressively Pruning Experts

    May 27, 2026Liu O. Martin, Lucas Bandarkar, Nanyun PengMixture-of-Experts PruningLLM Pruning

  22. NUCLEUS-MoE: Unified Model of Pool Boiling for Liquid Cooling

    May 26, 2026Arthur Feeney, Xianwei Zou, Sheikh Md Shakeel Hassan +2Neural Surrogate ModelingPDE Surrogate Modeling

  23. Towards Generalization-Oriented Models for Vehicle Routing Problems with Mixture-of-Experts

    May 26, 2026Changhao Miao, Yuntian Zhang, Tongyu Wu +2Reinforcement LearningAdaptive Model Routing

  24. BioFact-MoE: Biologically Factorized Mixture of Experts for Vision-Language Prognostic Modeling in Hepatocellular Carcinoma

    May 25, 2026Junlin Yang, Tian Yu, Nicha C. Dvornek +6Radiology VLMsCancer Survival Prediction

  25. SP-MoMamba: Superpixel-driven Mixture of State Space Experts for Efficient Image Super-Resolution

    May 25, 2026Wenbin Zou, Yawen Cui, Yi Wang +5Visual SSMsMixture-of-Experts Models

  26. Courtroom Analogy: New Perspective on Uncertainty-Aware Classification

    May 25, 2026Taeseong Yoon, Heeyoung KimUncertainty QuantificationInterpretable ML

  27. RotMoLE: Enhancing Mixture of Low-Rank Experts through Rotational Gating Mechanism

    May 25, 2026Mengyang Sun, Maochuan Dou, Tao Feng +5LLM Fine-TuningLow-Rank Adaptation