Mixture-of-Experts Models

Latest papers 297

All topics
CardsList
  1. Unlocking Cross-Scenario Physical Layer Security: A Mixture-of-Experts Framework with Generative Diffusion Models

    Sep 22, 2026Xiao Tang, Tong Hui, Chao Shen +46G NetworksWireless Communications

  2. PreGS: A Parameter-Transfer-Based Multi-Expert Graph Neural Network for Node Classification

    Sep 22, 2026Zhicong Cai, Yinglong Zhang, Xiaoying Hong +2Graph Neural NetworksMixture-of-Experts Models

  3. MECT: Mixture of Experts with CNN-Transformer Network for Speaker verification

    Sep 21, 2026Yu Zheng, Jinghan Peng, ChangHao Zhang +2Speaker VerificationHybrid CNN-Transformer Architectures

  4. All-in-One Multilingual Scene Text Recognition with Script-aware Mixture-of-Experts

    Sep 21, 2026Xingsong Ye, Yongkun Du, Jiaxin Zhang +6Scene Text RecognitionMixture-of-Experts Models

  5. Generalist-Specialist Mixture-of-Experts for Rare Pathology Detection in Multimodal Imaging

    Sep 16, 2026Johannes Kaiser, Florian Braunmiller, Daniel Rückert +1Multimodal ClassificationMixture-of-Experts Models

  6. Dataset-Dependent Effects of Cross-Depth Aggregation and Soft-Routed Experts in EEG Foundation Model Fine-Tuning

    Sep 15, 2026Mingyang Jiang, Yamin Li, Daniel Moyer +3Attention Residual ConnectionsEEG Decoding

  7. What Breaks Under Pruning in Smart Homes, and When? Evaluating LLM Degradation Across Architectures and Task Complexity

    Sep 15, 2026Congjing Zhang, Vashishtha Patil, Henning Lange +1LLM GroundingLLM Pruning

  8. Dense to MoE Adaptation for Compact Vision Language Action Policies

    Sep 15, 2026Muchun Niu, Shuang Chen, Yuzhou Wu +1Robot Policy AdaptationEfficient VLA Models

  9. STHMoE: Hypergraph-Enhanced Heterogeneous Dependency Coordination for LLM-Based Urban Traffic Data Forecasting

    Sep 14, 2026Jiawen Chen, Qi Shao, Yongjian Chang +3Traffic Flow EstimationLLM-Based Time Series Forecasting

  10. Horizon-specific Expert Fusion for Photovoltaic Power Forecasting

    Sep 14, 2026Xu Yuqing, Zhou Liguo, Sun Ze +2Ensemble LearningSolar Power Forecasting

  11. Evidence-Aligned Local Composition of Discrete Experts for Sequence Restoration

    Sep 14, 2026Mohammad Panahazari, Usman A. Khan, Shuchin AeronMixture-of-Experts InferenceMixture-of-Experts Models

  12. Expert-Space Exploration in MoE Reinforcement Learning

    Sep 14, 2026Hongyi He, Zhenghao Lin, Xiao Liu +3Reinforcement LearningExpert Routing

  13. Hyperparameter Scaling Laws Across MoE Sparsity

    Sep 8, 2026Changxin Tian, Kunlong Chen, Jia Liu +3Language Model Scaling LawsSparse Mixture-of-Experts

  14. MoEMB: Scaling Universal Multimodal Embeddings with Efficient Mixture-of-Experts Models

    Sep 8, 2026Xuanming Cui, Shlok Kumar Mishra, Wentao Bao +6Efficient Multimodal InferenceMultimodal Embedding

  15. Router Prior Bias: Preserving Base Routing Structure in MoE Post-Training

    Sep 8, 2026Jaedeok Lee, Keonwoo Kim, Dongyoon Han +3LLM RoutingMixture-of-Experts Models

  16. Latent-MoE: Domain-Aware Mixture-of-Experts for PDEs with Multi-Regime Physics

    Sep 7, 2026Hanwen Wang, Paris PerdikarisNeural PDE SolversPhysics-Informed ML

  17. MEOX: Compact Multimodal Mixture-of-Experts for Earth Observation

    Sep 4, 2026Mohanad AlbughdadiMasked AutoencodersGeospatial Representation Learning

  18. Towards a Statistical Understanding of Mixture-of-Experts

    Sep 3, 2026Siyuan He, Bokai Yang, Jie Hu +2Mixture of ExpertsSparse Mixture-of-Experts

  19. Routing Is Not Enough: Diagnosing Intra-Adapter Subspace Contention in MoE+LoRA Fine-Tuning

    Sep 2, 2026Mehreen Hossain Chowdhury, Nowshin Mahjabin, Ahmed Shafin Ruhan +3Fine-TuningLow-Rank Adaptation

  20. SEAL: Reinforcing Global Safety in Mixture-of-Experts through Shared Expert ALignment

    Sep 2, 2026Qingyu Meng, Yiwei Zha, Jiahuan Pei +3LLM Safety AlignmentJailbreak Defense

  21. PCoMoE: Shifting MoE Inference from Monolithic Expert Selection to Fine-Grained Path Composition

    Sep 1, 2026Ziyan Gan, Fangxin Liu, Chenyang Guan +10Mixture-of-Experts PruningMixture-of-Experts Inference

  22. PRIME: Mitigating Subgroup Optimization Competition in Shared CTR Top Networks with Plug-in Residual Input-Conditioned Mixture of Expert

    Aug 31, 2026Heng Yao, Siyun Hou, Tianying Liu +8Residual LearningGradient Interference

  23. Regime-Gated Residual Mixture-of-Experts for Cross-Sectional Volatility Forecasting

    Aug 12, 2026Junyi Ye, Gargi Vijay BordeQuantitative FinanceNon-Stationary Time Series Forecasting