Expert Routing

Latest papers 77

All topics
CardsList
  1. DivMoE: Fine-Grained MoE Upcycling via Cross-Domain Expert Composition

    Oct 8, 2026Yuxuan Lou, Kai Yang, Geng Zhang +2Mixture-of-Experts ModelsSparse Mixture-of-Experts

  2. MASKerade: Token-Routed Mask Experts for Dense-to-MoE Upcycling

    Oct 6, 2026Mingyuan Zhang, Yue Bai, Zhongruo Wang +5Expert RoutingSparse Neural Networks

  3. Structuring MoE Expert Selection for Agentic Reinforcement Learning

    Oct 5, 2026Bolian Li, Ting-Yao Hu, Cheng-Yu Hsieh +3Agentic RLExpert Routing

  4. How Sparse Probability Maps Shape Mixture-of-Experts Routing

    Oct 5, 2026Tomás Brogueira, Marcos Treviso, Miguel CouceiroMixture-of-Experts Language ModelsMixture-of-Experts Inference

  5. CIPHER-MoE: Balancing Efficiency and Routing Fidelity in Trillion-Scale MoE Training

    Oct 5, 2026Jing Li, Jian Meng, Yingmeng Gao +8Expert Load BalancingExpert Routing

  6. Conditional Capacity and Routing in Mixture-of-Experts Particle Transformers

    Oct 2, 2026Kaushik Pendiyala, Haris Zia, Trevin Lee +8Mixture-of-Experts ModelsSparse Mixture-of-Experts

  7. Auditing Routing Entropy as an Uncertainty Signal in Attention-Residual Transformers

    Oct 1, 2026Wenhao Liang, Lin Yue, Wei Emma Zhang +3Uncertainty QuantificationModel Calibration

  8. SpikeMoE: Brain-Inspired Competitive Routing for Flexible Spiking Mixture-of-Experts

    Oct 1, 2026Xiaoli Liu, Yujie Liang, Jialin Li +1Spiking Neural NetworksExpert Routing

  9. Looping Beyond Twice: A Scalable Recipe for Looped Mixture-of-Experts

    Oct 1, 2026Di He, Pengxiang Li, Da Chang +3Mixture-of-Experts Language ModelsRecurrent Transformers

  10. MoRA: MoE Pruning via Router Bias Learning and Expert Approximation

    Sep 30, 2026Yushuai Sun, Zikun Zhou, Lin Gao +2Mixture-of-Experts PruningLLM Compression

  11. RouteRec: Behavior-Guided Sparse Routing for Sequential Recommendation

    Sep 30, 2026Junyeong Song, Jaemin YooSequential RecommendationSparse Mixture-of-Experts

  12. Breaking the Uniformity Trap: Scaling Video Diffusion Model via SplitMoE

    Sep 29, 2026Yu Xu, Yuxin Zhang, Xiao Yang +7Video Diffusion ModelsVideo Generation

  13. Cross-Entropy Guided Routing in Mixture-of-Experts Large Language Models

    Sep 29, 2026Yury Nahshan, Nati Daniel, Jacob Goldberger +1Mixture-of-Experts Language ModelsParameter-Free Mixture-of-Experts Routing

  14. Beyond the Previous Layer: Residual Predictive Structure in Sparse MoE Routing

    Sep 15, 2026Hao Li, Yasuyuki Tahara, Yuichi SeiSparse Mixture-of-ExpertsExpert Routing

  15. Expert-Space Exploration in MoE Reinforcement Learning

    Sep 14, 2026Hongyi He, Zhenghao Lin, Xiao Liu +3Reinforcement LearningExpert Routing

  16. Evidence for Shared Routing Geometry and Dynamics in Sparse Mixture-of-Experts

    Sep 2, 2026Kirill Labzin, Stepan Kulibaba, Artem Dzhalilov +1Sparse Mixture-of-ExpertsExpert Routing

  17. Beyond Magnitude: Contrastive Routing for Modular Mixture-of-Experts

    Sep 1, 2026Nikolaos Xiros, Dimitrios Damianos, Maria-Eleni Zoumpoulidi +3Mixture-of-Experts Language ModelsExpert Routing

  18. TradingMoE: Routing the Right Experts in Evolving Markets

    Aug 12, 2026Chang Zhou, Xingtong Yu, Minbin Huang +4Mixture-of-Experts Language ModelsSparse Mixture-of-Experts

  19. Share First, Route What Remains: A Unified Framework for Token-Adaptive MoE Computation

    Aug 11, 2026Gongli Zhang, Zhulin Liu, C. L. Philip ChenMixture of ExpertsMixture-of-Experts Inference

  20. Elbow-Based MoE Routing: A Training-Free Inference Time Plugin for Expert Selection

    Aug 5, 2026Robin Pan, Raymond Liu, Daniel Fang +2Mixture-of-Experts InferenceLLM Inference Acceleration

  21. Uncertainty Is Not Enough: Value-of-Information Routing for Mixtures of LoRA Experts

    Aug 3, 2026Tom Saliencro, Rohan Desai, Priya Nair +2Adaptive Model RoutingSelective Prediction

  22. HetRoute Heterogeneous and Cost-aware Collaborative Routing Framework for Distributed Edge MoE Inference

    Aug 1, 2026Xin Yuan, Ning Li, Wenchao Xu +2Edge InferenceCost-Aware Inference

  23. Relax Within, Balance Across: Geometry-Guided Load Balancing for Vision-Language Mixture-of-Experts

    Aug 1, 2026Ziang Wu, Peng Jin, Qishen Yin +4Expert Load BalancingVision-Language Models

  24. EntropyMoE: Entropy-Aware Sparse Expert Routing for Tokenizer-Free LLMs

    Jul 31, 2026Bo Liu, Muxuab Yu, Yu Zhang +2Sparse Mixture-of-ExpertsByte-Level Language Model

  25. Beyond Geometric Complementarity: Coherent Overlap in Sparse Mixture-of-Experts Routing

    Jul 30, 2026Huiyuan Tian, Bonan Xu, Shijian LiSparse Mixture-of-ExpertsExpert Routing