Mixture-of-Experts Models

Latest papers 297

All topics
CardsList
  1. Spend Experts Where You Are Unsure: Confidence-Adaptive Routing for Mixture-of-Experts LoRA

    Jul 28, 2026Tom Saliencro, Rohan Desai, Priya Nair +2Parameter-Free Mixture-of-Experts RoutingLLM Inference Acceleration

  2. Balanced Soft mixture-of-expert model for Glaucoma Detection

    Jul 28, 2026Sai Venkatesh Chilukoti, Krishna Rauniyar, Min Shi +1Multimodal ClassificationMixture-of-Experts Models

  3. MMOE: Modernizing Diffusion Transformers with Efficient Expert Design

    Jul 27, 2026Yanhao Jia, Jiepeng Wang, Haibin Huang +3Diffusion TransformerDiffusion Model Acceleration

  4. Emergent Compositional Skills in Mixture-of-Experts VLAs

    Jul 22, 2026Shlok Shah, Rhiaan Jhaveri, Tharun Kumar Tiruppali Kalidoss +3Robot Policy LearningRobot Skill Learning

  5. MoAKE: Toward Unified All-in-One Action Quality Assessment via Mixture of Action Knowledge Experts

    Jul 22, 2026Huangbiao Xu, Huanqi Wu, Xiao Ke +3Mixture-of-Experts ModelsAction Quality Assessment

  6. Continual Video-MLLM Adaptation over Evolving Domains

    Jul 21, 2026Rui Cheng, Meixing Shi, Yuxiang Cai +3Video QADomain-Incremental Learning

  7. Adaptive Multi-Expert Graph Transformer for Interpretable EEG-Based Diagnostics

    Jul 20, 2026Maryam Rahimimovassagh, Md Elias Hossain, Ivan Garibay +1ElectroencephalographyDynamic Graph Learning

  8. Can Experts Adapt Without Training? On Test-Time Modality Generalization in MVLMs

    Jul 18, 2026Raza Imam, Darakshan Rashid, Yutong Xie +3VLM RobustnessVLM Adaptation

  9. Multi-Expert Routing for Multi-Domain Low-Resource OCR: A Manchu Case Study

    Jul 15, 2026Zhan Chen, Jiqiao Ma, Chih-wen KuoMixture-of-Experts ModelsOptical Character Recognition

  10. Less Experts, Faster Decoding: Cost-Aware Speculative Decoding for Mixture-of-Experts

    Jul 14, 2026Jincheng Xie, Runheng Liu, Heyan Huang +4Mixture-of-Experts InferenceSpeculative Decoding

  11. Understanding Structured Health Data through Interaction-Aware Mixture-of-Experts

    Jul 14, 2026Ji Hwan Park, Ying Ding, Tianjin GuoMulti-View LearningClinical Outcome Prediction

  12. From Global to Factor-Wise Expert Composition in Discrete Diffusion Models

    Jul 13, 2026Haozhe Huang, Yudong Xu, Abhijoy Mandal +1Expert RoutingMixture-of-Experts Models

  13. HCRMap: Pressure-Aware Hot-Expert Residency Mapping for 3.5D MoE Chiplet Inference

    Jul 13, 2026Yongqin ZhangAI Accelerator InferenceMixture-of-Experts Inference

  14. Mach-Mind-4-Flash Technical Report

    Jul 10, 2026Foundation Model TeamAgentic RLToken Efficiency

  15. It Takes a MAESTRO To Prune Bad Experts

    Jul 9, 2026Palaash Goel, Ayush Maheshwari, Tanmoy ChakrabortyMixture-of-Experts PruningLLM Pruning

  16. SHAP-Weighted Cross-Modal Expert Fusion for Emotion and Sentiment Recognition: Evidence and Limits

    Jul 9, 2026Adis Alihodzic, Selma Skopljakovic HubljarSHAP Feature AttributionMultimodal Emotion Recognition

  17. On the Design of Mixture-of-Experts for Dynamic Gaussian Splatting

    Jul 9, 2026In-Hwan Jin, Hyeongju Mun, Joonsoo Kim +23D Gaussian SplattingDynamic Scene Reconstruction

  18. Mixture of Enhanced-View Experts for Multi-Query Vehicle ReID and A Large-Scale Benchmark

    Jul 9, 2026Aihua Zheng, Jie Zhen, Chenglong Li +2Multi-View ConsistencyMulti-View Learning

  19. Image classification via a quantum-inspired strategy involving a mixture of experts

    Jul 8, 2026Kumari Jyoti, Rohith Babu, Apoorva D. PatelHybrid Quantum-Classical MLQuantum-Inspired ML

  20. ProMoE-FL: Prototype-conditioned Mixture of Experts for Multimodal Federated Learning with Missing Modalities

    Jul 7, 2026Aavash Chhetri, Bibek Niroula, Eduard Vazquez +4Multimodal Federated LearningMissing-Modality Learning

  21. UBEP: Re-architecting Expert Parallelism Communication Library for Production Superpods

    Jul 7, 2026Yipeng Liu, Chang Liu, Si Shen +16Expert ParallelismHigh-Performance Computing

  22. RoME: Robust Mixture of Low-Rank Experts against Multiple Adversarial Perturbations

    Jul 7, 2026Woo Jae Kim, Kyle Min, Suhyeon Ha +2Adversarial TrainingNeural Network Robustness

  23. MoP-JEPA: Hard-Assigned Predictor Mixtures for Stochastic JEPA World Models

    Jul 6, 2026Zhi Song, Ximing Xing, Zhenchao Tang +8World Model LearningLatent Dynamics Modeling

  24. Localized LoRA-MoE: Block-wise Low-Rank Experts With Adaptive Routing

    Jul 6, 2026Babak Barazandeh, Subhabrata Majumdar, Vinay Prithyani +1Adaptive Model RoutingLow-Rank Adaptation

  25. Nemotron-Labs-3-Puzzle-75B-A9B: Compressing Hybrid MoE LLMs

    Jul 5, 2026Akhiad Bercovich, Talor Abramovich, Daniel Afrimi +67Mixture-of-Experts PruningLLM Pruning