Mixture-of-Experts Models

Latest papers 297

All topics
CardsList
  1. ConceptM3^3oE: Concept-Guided Multimodal Mixture of Experts for Interpretable Computational Pathology

    May 23, 2026Xuan Wang, Zhongling Xu, Gopi Kannedhara +13Computational PathologyConcept Bottleneck Models

  2. Semantically Structured Mixture-of-Experts for Compositional Robotic Manipulation

    May 22, 2026Chengyu Deng, Guanqi Chen, Yizhou Chen +4Robot Policy LearningRobot Skill Learning

  3. SpikingMoE: SDPrompt-Guided Dynamic Expert Fusion in Spiking Neural Networks

    May 22, 2026Yukai Yang, Chenxi Qin, Jungang Li +3Spiking TransformersDynamic Neural Networks

  4. GMENet: Generative Mixture of Experts Network for Multi-Center Glioma Diagnosis with Incomplete Imaging Sequences

    May 22, 2026Pengfei Song, Fangjin Liu, Wenwen Zeng +5Missing-Modality LearningMedical Diagnosis

  5. FAME: Failure-Aware Mixture-of-Experts for Message-Level Log Anomaly Detection

    May 21, 2026Huanchi Wang, Zihang Huang, Yifang Tian +3Fault DetectionMixture-of-Experts Models

  6. Learning Emergent Modular Representations in Multi-modality Medical Vision Foundation Models

    May 21, 2026Yuting He, Chenyu You, Shuo LiMedical Imaging Foundation ModelsMultimodal Pretraining

  7. FedCoE: Bridging Generalization and Personalization via Federated Coordinated Dual-level MoEs

    May 20, 2026Penglin Dai, Fulian Li, Xincao Xu +3Federated Learning AggregationNon-IID Federated Learning

  8. Task-Routed Mixture-of-Experts with Cognitive Appraisal for Implicit Sentiment Analysis

    May 20, 2026Yaping Chai, Haoran Xie, Joe S. QinSentiment AnalysisMulti-Task Learning

  9. HDMoE: A Hierarchical Decoupling-Fusion Mixture-of-Experts Framework for Multimodal Cancer Survival Prediction

    May 20, 2026Huayi Wang, Haochao Ying, Yuyang Xu +5Cancer Survival PredictionSurvival Analysis

  10. Dynamic TMoE: A Drift-Aware Dynamic Mixture of Experts Framework for Non-Stationary Time Series Forecasting

    May 20, 2026Jiawen Zhu, Shuhan Liu, Di Weng +1Concept DriftMixture of Experts

  11. Beyond Routing: Characterising Expert Tuning and Representation in Vision Mixture-of-Experts

    May 20, 2026Gene Tangtartharakul, Katherine R. StorrsVisual Representation LearningMixture of Experts

  12. GEM: GPU-Variability-Aware Expert to GPU Mapping for MoE Systems

    May 19, 2026Sourish Wawdhane, Avinash Kumar, Poulami DasExpert Load BalancingMixture-of-Experts Inference

  13. Patch-MoE Mamba: A Patch-Ordered Mixture-of-Experts State Space Architecture for Medical Image Segmentation

    May 18, 2026Diego Adame, Fabian Vazquez, Jose A. Nunez +7MambaImage Segmentation

  14. Stable Routing for Mixture-of-Experts in Class-Incremental Learning

    May 17, 2026Zirui Guo, Quan Cheng, Da-Wei Zhou +1Class-Incremental LearningExpert Routing

  15. CHoE: Cross-Domain Heterogeneous Graph Prompt Learning via Structure-Conditioned Experts

    May 15, 2026Peiyuan Li, Yongqi Huang, Jitao Zhao +3Heterogeneous GNNsFew-Shot Learning

  16. When Does Sparse MoE Help in Vision? The Role of Backbone Compute Leverage in Sparse Routing

    May 15, 2026Libo Sun, Po-wei Harn, Peixiong He +1Sparse Mixture-of-ExpertsExpert Routing

  17. φφ-Balancing for Mixture-of-Experts Training

    May 14, 2026Lizhang Chen, Jonathan Li, Qi Wang +5Expert Load BalancingMirror Descent

  18. RQ-MoE: Residual Quantization via Mixture of Experts for Efficient Input-Dependent Vector Compression

    May 14, 2026Zhengjia Zhong, Shuyan Ke, Zaizhou Lin +3Residual VQVector Quantization

  19. MetaMoE: Diversity-Aware Proxy Selection for Privacy-Preserving Mixture-of-Experts Unification

    May 14, 2026Weisen Jiang, Shuhao Chen, Sinno Jialin PanPrivacy-Preserving MLMixture-of-Experts Models

  20. How to Scale Mixture-of-Experts: From muP to the Maximally Scale-Stable Parameterization

    May 13, 2026Leena Chennuru Vankadara, Moritz Haas, Luke Hayward +2Mixture-of-Experts Models

  21. Routers Learn the Geometry of Their Experts: Geometric Coupling in Sparse Mixture-of-Experts

    May 12, 2026Sagi Ahrac, Noya Hochwald, Mor GevaExpert Load BalancingParameter-Free Mixture-of-Experts Routing

  22. Fast Training of Mixture-of-Experts for Time Series Forecasting via Expert Loss Integration

    May 11, 2026Btissame El Mahtout, Florian ZielTime Series ForecastingMixture-of-Experts Models

  23. Mixture of Layers with Hybrid Attention

    May 10, 2026Ivan Ternovtsii, Yurii BilakMixture-of-Experts ModelsHybrid Attention

  24. DisagMoE: Computation-Communication overlapped MoE Training via Disaggregated AF-Pipe Parallelism

    May 10, 2026Zhichen Zeng, Chi-Chih Chang, Jiayi Wang +10Expert ParallelismCommunication-Efficient Distributed Training