LLM Routing

LLM: Large Language Model

Momentum

30 papers in the last four weeks, up 88% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 224

All topics
CardsList
  1. SWE-Router: Routing in Multi-turn Agentic Software Engineering Tasks

    Jun 30, 2026Seongho Son, Sangwoong Yoon, Jiahua Tang +3Software Engineering AgentsLLM Agent Workflow Optimization

  2. SemJoin: Semantic Join Optimization

    Jun 28, 2026Christopher Gou, Aditya Banerjee, Jiaxuan Wang +1Large Language Model-Guided OptimizationCost-Aware Inference

  3. EntroRouter: Learning Efficient Model Routing via Entropy Regulation

    Jun 28, 2026Kaiyi Zhang, Xueliang Zhao, Zhuocheng Gong +2Adaptive Model RoutingCost-Aware Inference

  4. TriageRA-CCF: Source-Side Clinical Confidence and Coverage Signals for Adaptive Rank Budgeting in Medical LLMs

    Jun 28, 2026Shucan Ji, Yining Huang, Hongliang GuoLow-Rank AdaptationMedical QA

  5. When LLMs Develop Languages: Symbolic Communication for Efficient Multi-Agent Reasoning

    Jun 28, 2026Zhengqi Pei, Qingming Huang, Shuhui WangMulti-Agent LLM SystemsEfficient Language Model Reasoning

  6. Cluster, Route, Escalate: Cascaded Framework for Cost-Aware LLM Serving

    Jun 25, 2026Yasmin Moslem, Magdalena Kacmajor, Vasudevan Nedumpozhimana +11LLM ServingCost-Aware Inference

  7. The Capability Frontier: Benchmarks Miss 82% of Model Performance

    Jun 25, 2026Bradley Fowler, Ryan Smith, Daniel Thi Graviet +8LLM EvaluationLanguage Model Generation Evaluation

  8. Efficient and Trainable Language Model Test-Time Scaling via Local Branch Routing

    Jun 24, 2026Yutong Yin, Mingyu Jin, Jin Pan +12RL for Language Model ReasoningTest-Time Scaling

  9. DART: Draft-Agreement Routing for Training-Free Adaptive Thinking Budgets in Hybrid Reasoning Models

    Jun 22, 2026Jungseob Lee, Seongtae Hong, Seungjun Lee +7LLM RoutingEfficient Language Model Inference

  10. Agent-as-a-Router: Agentic Model Routing for Coding Tasks

    Jun 22, 2026Pengfei Zhou, Zhiwei Tang, Yixing Ma +8AI Coding AgentsAI Agent Benchmarks

  11. Does the Same Token Mean the Same State? MoE Routing as Signal for Reasoning Control

    Jun 22, 2026Kang Chen, Minshen Yu, Junjie Nian +3Mixture-of-Experts Language ModelsLLM Routing

  12. Is Our Benchmark Enough? An Analysis of Continual Learning for MLLMs

    Jun 18, 2026Van-Tuan Tran, Shruthi Gowda, Merim Dzaferagic +1Continual LearningLLM Routing

  13. ARIADNE: Agnostic Routing for Inference-time Adapter DyNamic sElection

    Jun 17, 2026Enrico Cassano, Michał Brzozowski, Zuzanna Dubanowska +2LLM Routing

  14. RouteJudge: An Open Platform for Reproducible and Preference-Aware LLM Routing

    Jun 17, 2026Guannan Lai, Haoran Hu, Han-Jia YeLLM EvaluationPairwise Preference Evaluation

  15. SoftMoE: Soft Differentiable Routing for Mixture-of-Experts in LLMs

    Jun 16, 2026Mikołaj Zasada, Łukasz Struski, Jacek Tabor +1Mixture-of-Experts Language ModelsSparse Mixture-of-Experts

  16. DecoSearch: Complexity-Aware Routing and Plan-Level Repair for Text-to-SQL

    Jun 16, 2026Esteban Schafir, Xu Zheng, Hojat Allah Salehi +4Schema LinkingQuestion Decomposition

  17. Online LLM Selection via Constrained Bandits with Time-Varying Demand

    Jun 16, 2026Yin Huang, Qingsong Liu, Jie XuMulti-Armed BanditsCost-Aware Inference

  18. Conversational Query Engine for Mixed-Modality Heterogeneous Enterprise Data Sources

    Jun 15, 2026Darshita Rathore, Vineet Kumar, Vaibhav Singal +2LLM Routing

  19. ChatPlanner: A Large Language Model Framework for Personalized Public Transit Routing

    Jun 13, 2026Tingting Yang, Chenhao Xue, Jun ChenIntelligent Transportation SystemsLLM Routing

  20. Forced Deferral: Manipulating Routing Decisions in Multimodal LLM Cascades

    Jun 13, 2026Zhongye Liu, Yaopei Zeng, Yurui Chang +1Adversarial Attacks on VLMsMultimodal Robustness

  21. A theoretical model for task routing in mixture-of-expert transformers

    Jun 12, 2026Vinoth Nandakumar, Yongli Xiang, Yunzhi Yao +2Transformer ExpressivityMixture of Experts

  22. Cost-Optimal LLM Routing with Limited User Feedback under User Satisfaction Guarantees

    Jun 12, 2026Herbert Woisetschläger, Arastun Mammadli, Ryan Zhang +1Cost-Aware InferenceLLM Routing

  23. STREAM: Multi-Tier LLM Inference Middleware with Dual-Channel HPC Token Streaming

    Jun 11, 2026Anas Nassar, Steve Mohr, Leonard Apanasevich +1LLM ServingLLM Inference

  24. ARMOR-MAD: Adaptive Routing for Heterogeneous Multi-Agent Debate in Large Language Model Reasoning

    Jun 11, 2026Fuqiang Niu, Bowen ZhangMulti-Agent DebateMulti-Agent Consensus