LLM Routing

LLM: Large Language Model

Momentum

30 papers in the last four weeks, up 88% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 224

All topics
CardsList
  1. Route, Don't Fix: Regime-Dependent Decoding Correction and a Trajectory-Gated Router for Reliable Clinical LLM Answer Selection

    Sep 13, 2026Zeyu Dong, Benjamin Wang, Joyee W. JinAdaptive InferenceLanguage Model Decoding

  2. SWRouter: Similarity-Contractive Window Routing for Multi-Turn Large Language Model Conversations

    Sep 12, 2026Yu Wang, Yuchen Li, Rui Kong +11Multi-Turn Dialogue EvaluationLLM Routing

  3. Router Prior Bias: Preserving Base Routing Structure in MoE Post-Training

    Sep 8, 2026Jaedeok Lee, Keonwoo Kim, Dongyoon Han +3LLM RoutingMixture-of-Experts Models

  4. Signed Rescue Routing: Harm-Aware Cascades for Efficient LLM Inference

    Sep 7, 2026Zheyuan Wang, Siyu Li, Peiqiao Song +3LLM Inference EfficiencyLLM Routing

  5. SCX Router: Streaming Zero-Shot Model Selection with a Decoder-KV Classifier and a Real-World Task Ontology

    Sep 2, 2026Ihor Stepanov, Aleksandr Smechov, Mykhailo Shtopko +2LLM RoutingZero-Shot Text Classification

  6. CRISP: Cliff-awaRe Input-adaptive Sparse Prefilling with Structural-Mass-Motivated Routing

    Sep 1, 2026Huu Huy Nguyen, Chien Van Nguyen, Franck Dernoncourt +4Long-Context Language Model InferenceLLM Inference Acceleration

  7. CPR for LLMs: Critical-Point Routing against Catastrophic Forgetting in Domain Adaptation

    Aug 31, 2026Kwangmin Ki, Yunhun Nam, Jongheon Jeong +1LLM Fine-TuningDomain Adaptation for LLMs

  8. ProgRouter: Online Progress-Guided Orchestration for Multi-Agent LLM Workflows under Quality-Cost Tradeoffs

    Aug 26, 2026Songyuan Li, Ahmed M. Abdelmoniem, Shiqiang WangLLM Inference EfficiencyMulti-Agent Orchestration

  9. Error-Aware Reverse Auction Mechanism for Large Language Model Routing

    Aug 13, 2026Haolong Chen, Zhengyuan Xin, Liang Zhang +2Cost-Aware InferenceLLM Routing

  10. Who Thinks Best Depends on How Long You Let Them: Budget-Dependent Rankings in LLM Evaluation

    Aug 12, 2026Rodrigo Guedes de Souza, Alison R. PanissonLLM EvaluationLanguage Model Generation Evaluation

  11. TradingMoE: Routing the Right Experts in Evolving Markets

    Aug 12, 2026Chang Zhou, Xingtong Yu, Minbin Huang +4Mixture-of-Experts Language ModelsSparse Mixture-of-Experts

  12. Scheduling Mixed RL Rollouts Beyond Prefix Locality

    Aug 11, 2026Zetao Hong, Song Yuan, Yuanhao Ding +4LLM Inference SchedulingKV-Cache Management

  13. RAISE: Diagnosing Acquisition Collapse in Costly LLM Signals

    Aug 11, 2026Ying Yuan, Yu Wang, Yize Cheng +1Cost-Aware InferenceLLM Routing

  14. MERA: Model Evolution and Routing with Skill Adaptation for Agentic Systems at Scale

    Aug 11, 2026Yuhang Yao, Zeyu Wang, Wanyi Chen +8Continual Learning for LLM AgentsLLM Fine-Tuning

  15. Opportunity Is Not Realizability: Selection-Valid Diagnostics for Multi-LLM Routing

    Aug 8, 2026Ibne Farabi Shihab, Abu Sa-Adat Mohamed Moon-Im Al Ahsan, Md Najmus SwaqeebModel SelectionLLM Evaluation

  16. LLMRouter: Unified Infrastructure for Developing, Evaluating, and Deploying LLM Routers

    Aug 7, 2026Tao Feng, Fangxu Yu, Haozhen Zhang +9LLM EvaluationLLM Routing

  17. MACRO: Markov Chain Routing of Transformer Layers

    Aug 6, 2026Paweł Batorski, Abtin Pourhadi, Akylgali Aitaza +2Markov ModelsLLM Inference Acceleration

  18. RouteGuard: Certifying Routing Gain in LLM Multi-Agent Systems When Complementarity Is Not Enough

    Aug 5, 2026Anchen Sun, Kaiqi YangMulti-Agent LLM SystemsAI Agent Benchmarks

  19. COMPAS: Difficulty-Aware Joint Search for Optimizing Code Generation

    Aug 5, 2026Jingzhi Gong, Jie M. Zhang, Gunel Jahangirova +3Large Language Model-Guided OptimizationCode Generation

  20. EntropyMoE: Entropy-Aware Sparse Expert Routing for Tokenizer-Free LLMs

    Jul 31, 2026Bo Liu, Muxuab Yu, Yu Zhang +2Sparse Mixture-of-ExpertsByte-Level Language Model