Offline MARL

MARL: Multi-Agent Reinforcement Learning

Momentum

2 papers in the last four weeks, against 1 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 15

All topics
CardsList
  1. Multi-Agent Coordination via Support-Preserving Distillation

    Oct 7, 2026Sangmin Lee, Youngju Na, Chanmi Lee +1Multi-Agent CoordinationOffline MARL

  2. Pessimistic Minimax Learning for Public-Private Information Games under Unilateral Coverage

    Oct 4, 2026Shuze Daniel Liu, Claire Chen, Jiuqi Wang +1Imperfect-Information GamesZero-Sum Games

  3. Rank Without an Oracle: Deviation-Aware Interaction-Rank Selection from Offline Multi-Agent Logs

    Sep 8, 2026Xiangwu Wang, Chengwei Cao, Hongyuan TangOff-Policy EvaluationGame Theory

  4. Out-of-Distribution Generalisation with Sequence Models in Offline Multi-Agent Reinforcement Learning

    Sep 3, 2026Oussama Hidaoui, Omer Ebead, Ulrich Armel Mbou Sob +14Zero-Shot LearningReinforcement Learning

  5. Learning Implicit Causal World Models from Multi-Agent Demonstrations

    Jul 28, 2026Jasorsi GhoshCausal Representation LearningCausal World Models

  6. Scalable Policy Optimization for Networked Multi-Agent Reinforcement Learning with Continuous State-Action Spaces

    Jul 20, 2026Dongming Wang, Pengcheng Dai, Wenwu Yu +1Multi-Agent ControlTemporal-Difference Learning

  7. Offline Multi-agent Continual Cooperation via Skill Partition and Reuse

    Jun 24, 2026Yuchen Xiao, Lei Yuan, Ruiqi Xue +2Offline RLAgent Skill Learning

  8. Sim2O: Efficient Offline-to-Online MARL via Joint Action Composition

    Jun 19, 2026Bingchang Song, Yiqin YangMulti-Agent CoordinationCooperative MARL

  9. Individual Control Barrier Functions-Guided Diffusion Model for Safe Offline Multi-Agent Reinforcement Learning

    Jun 10, 2026Qingyun Guo, Junyi Shi, Jianuo Huang +1Control Barrier FunctionsOffline RL

  10. Mean-Field Diffuser: Scaling Offline MARL to Thousands of Agents

    May 28, 2026Wenhao Li, Xiangfeng Wang, Bo JinMulti-Agent System OptimizationMean Field Games

  11. Distributed Zeroth-Order Policy Gradient for Networked Multi-agent Reinforcement Learning from Human Feedback

    May 15, 2026Pengcheng Dai, He Wang, Dongming Wang +2Policy GradientDecentralized MARL

  12. CoFlow: Coordinated Few-Step Flow for Offline Multi-Agent Decision Making

    May 2, 2026Guowei Zou, Haitao Wang, Beiwen Zhang +2Flow MatchingMulti-Agent Coordination

  13. Pessimism-Free Offline Learning in General-Sum Games via KL Regularization

    Apr 30, 2026Claire Chen, Yuheng ZhangNash EquilibriumReinforcement Learning

  14. DLM: Unified Decision Language Models for Offline Multi-Agent Sequential Decision Making

    Apr 26, 2026Zhuohui Zhang, Bin Cheng, Bin HeSequential MARLOffline RL

  15. CODA: Coordination via On-Policy Diffusion for Multi-Agent Offline Reinforcement Learning

    Apr 25, 2026Marcel Hedman, Kale-ab Abebe Tessera, Juan Claude Formanek +5Multi-Agent CoordinationOffline RL