Language Model Ensembles

Momentum

15 papers in the last four weeks, up 400% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 93

All topics
CardsList
  1. Beyond Consensus: Trace-Level Synthesis in Mixture of Agents

    May 27, 2026Shreyas Fadnavis, Praitayini Kanakaraj, Felix WyssLanguage Model EnsemblesMulti-Agent Reasoning

  2. Soft Specialists: αα-Rényi Ensembles for Uncertainty-Aware LLM Post-Training

    May 26, 2026Paula Cordero-Encinar, Georgy Tyukin, Andrew B. DuncanLLM Uncertainty EstimationLanguage Model Ensembles

  3. Mixture of Complementary Agents for Robust LLM Ensemble

    May 21, 2026Yichi Zhang, Kevin Lu, Yuang Zhang +3Language Model EnsemblesMulti-LLM Collaboration

  4. Maestro: Reinforcement Learning to Orchestrate Hierarchical Model-Skill Ensembles

    May 21, 2026Jinyang Wu, Guocheng Zhai, Ruihan Jin +7LLM Agent OrchestrationLanguage Model Ensembles

  5. Residual Skill Optimization for Text-to-SQL Ensembles

    May 20, 2026Jiongli Zhu, Haoquan Guan, Parjanya Prajakta Prashant +8Text-to-SQLAgent Skill Learning

  6. Ensemble Monitoring for AI Control: Diverse Signals Outweigh More Compute

    May 14, 2026Eugene Koran, Yejun Yun, Samantha Tetef +2AI Agent MonitoringAI Control

  7. Calibrate, Don't Curate: Label-Efficient Estimation from Noisy LLM Judges

    May 10, 2026Yanran LiLLM EvaluationLLM-as-a-Judge

  8. POETS: Uncertainty-Aware LLM Optimization via Compute-Efficient Policy Ensembles

    May 8, 2026Nicolas Menet, Andreas Krause, Abbas RahimiThompson SamplingBlack-Box Optimization

  9. Nürnberg NLP at PsyDefDetect: Multi-Axis Voter Ensembles for Psychological Defence Mechanism Classification

    May 8, 2026Philipp Steigerwald, Eric Rudolph, Jens AlbrechtLanguage Model EnsemblesClinical NLP

  10. CLaC at SemEval-2026 Task 6: Response Clarity Detection in Political Discourse

    May 4, 2026Nawar Turk, Lucas Miquet-Westphal, Leila KosseimLLM EvaluationLanguage Model Ensembles

  11. Rethinking LLM Ensembling from the Perspective of Mixture Models

    May 1, 2026Jiale Fu, Yuchu Jiang, Peijun Wu +3LLM Inference AccelerationLLM Routing

  12. Ensembles of Large Language Models for Identifying EQ-5D Studies in PubMed Based on Their Abstracts

    Apr 24, 2026Zhyar Rzgar K. Rostam, Márta Péntek, János Tibor Czere +3Evidence SelectionLanguage Model Ensembles

  13. FUSE: Ensembling Verifiers with Zero Labeled Data

    Apr 20, 2026Joonhyuk Lee, Virginia Ma, Sarah Zhao +4Neural Network VerificationLLM Evaluation

  14. Efficient Low-Resource Language Adaptation via Multi-Source Dynamic Logit Fusion

    Apr 20, 2026Chen Zhang, Jiuheng Lin, Zhiyuan Liao +1Language Model EnsemblesLow-Resource Language Processing

  15. Self-Consistency from Only Two Samples: CoT-PoT Ensembling for Efficient LLM Reasoning

    Apr 19, 2026Raman Saparkhan, Majd Hawasly, Md Rizwan Parvez +1LLM Inference EfficiencySelf-Consistency Decoding

  16. StackingNet: Collective Inference Across Independent AI Foundation Models

    Feb 14, 2026Siyang Li, Chenhao Liu, Dongrui Wu +2Ensemble LearningLanguage Model Ensembles

  17. CARE: Confounder-Aware Aggregation for Reliable LLM Evaluation

    Feb 9, 2026Jitian Zhao, Changho Shin, Tzu-Heng Huang +2LLM EvaluationLLM-as-a-Judge

  18. Human Values in a Single Sentence: Moral Presence, Hierarchies, and Transformer Ensembles on the Schwartz Continuum

    Jan 20, 2026Víctor Yeste, Paolo RossoMulti-Label ClassificationLanguage Model Ensembles

  19. AdaFuse: Adaptive Ensemble Decoding with Test-Time Scaling for LLMs

    Jan 9, 2026Chengming Cui, Tianxin Wei, Ziyi Chen +6Language Model DecodingTest-Time Scaling

  20. FusionFactory: Fusing LLM Capabilities with Multi-LLM Log Data

    Jul 14, 2025Tao Feng, Haozhen Zhang, Zijie Lei +5LLM EvaluationLLM Routing

  21. Ensemble Learning for Large Language Models in Text and Code Generation: A Survey

    Mar 13, 2025Mari Ashiga, Wei Jie, Fan Wu +5Mixture-of-Experts Language ModelsLanguage Model Ensembles