Cooperative MARL

MARL: Multi-Agent Reinforcement Learning

Latest papers 146

All topics
CardsList
  1. Fog of Love: Engineering Virtuous Agent Behavior with Affinity-based Reinforcement Learning in a Game Environment

    Jun 3, 2026Ajay Vishwanath, Christian OmlinReinforcement LearningCooperative MARL

  2. Episodic Memory Temporal Consistency for Cooperative Multi-Agent Reinforcement Learning

    Jun 3, 2026Zicheng Zhao, Yu Lan, Chengzhengxu Li +2Reinforcement LearningGame-Playing Agents

  3. Coordination Graphs for Constrained Multi-Agent Reinforcement Learning

    Jun 1, 2026Santiago Amaya-Corredor, Miguel Calvo-Fullana, Anders JonssonMulti-Objective Reinforcement LearningMulti-Agent System Optimization

  4. Privacy-Aware Agent Collaboration for Dynamic VR Slice Management in 6G SD-RAN

    May 28, 2026Khaled M. Naguib, Soumaya Cherkaoui, Mahmoud M. Elmesalawy +26G NetworksWireless Communications

  5. LLM-ALSO: LLM-Driven Adaptive Learning-Signal Optimization for Multi-Agent Reinforcement Learning

    May 28, 2026Xiaoguang Wu, Zhi Zheng, Hui XiongReward ShapingLLM-Guided RL

  6. TRACER: Turn-level Regret Matching with Inner Reinforcement Credit for Cooperative Multi-LLM Reasoning

    May 27, 2026Chusen Li, Zhou Liu, Shuigeng Zhou +1Regret MinimizationMulti-Agent Reasoning

  7. Evolutionary Enhanced Multi-Agent Reinforcement Learning for Cooperative Air Combat

    May 24, 2026Chengwei Li, Junlin Liu, Yang GaoMulti-Agent CoordinationReinforcement Learning

  8. Scaling up Energy-Aware Multi-Agent Reinforcement Learning for Mission-Oriented Drone Networks with Individual Reward

    May 24, 2026Changling Li, Ying LiReinforcement LearningCredit Assignment in RL

  9. Adaptive Human-AI Coordination via Hierarchical Action Disentanglement

    May 23, 2026Adnan Ahmad, Bahareh Nakisa, Mohammad Naim RastgooDisentangled Representation LearningHierarchical RL

  10. FedCritic: Serverless Federated Critic Learning-based Resource Allocation for Multi-Cell OFDMA in 6G

    May 20, 2026Amin Farajzadeh, Melike Erol-KantarciFederated RL6G Networks

  11. COAgents: Multi-Agent Framework to Learn and Navigate Routing Problems Search Space

    May 20, 2026Oleksandr Yakovenko, Mahdi Mostajabdaveh, Cheikh Ahmed +4Multi-Agent System OptimizationVehicle Routing

  12. LLM-Guided Communication for Cooperative Multi-Agent Reinforcement Learning

    May 18, 2026Sangjun Bae, Yisak Park, Sanghyeon Lee +1LLM-Guided RLMulti-Agent Systems

  13. Interaction-Breaking Adversarial Learning Framework for Robust Multi-Agent Reinforcement Learning

    May 18, 2026Sunwoo Lee, Mingu Kang, Yonghyeon Jo +1Adversarial TrainingMulti-Agent Coordination

  14. Heterogeneous Information-Bottleneck Coordination Graphs for Multi-Agent Reinforcement Learning

    May 17, 2026Wei Duan, Junyu Xuan, En Yu +2Graph Structure LearningInformation Bottleneck

  15. ERPPO: Entropy Regularization-based Proximal Policy Optimization

    May 13, 2026Changha Lee, Gyusang ChoMulti-Agent SystemsProximal Policy Optimization

  16. Robust Instruction Compliance in Cooperative Multi-Agent Reinforcement Learning

    May 12, 2026Wo Wei Lin, Ethan Rathbun, Enrico Marchesini +1Reinforcement LearningRobust RL

  17. Events as Triggers for Behavioral Diversity in Multi-Agent Reinforcement Learning

    May 12, 2026Hannes Büchi, Manon Flageat, Eduardo Sebastián +1Cooperative MARLMulti-Agent Reinforcement Learning

  18. Adaptive TD-Lambda for Cooperative Multi-agent Reinforcement Learning

    May 12, 2026Yue Deng, Zirui Wang, Yin ZhangTemporal-Difference LearningDensity Ratio Estimation

  19. Shaping Zero-Shot Coordination via State Blocking

    May 12, 2026Mingu Kang, Sunwoo Lee, Yonghyeon Jo +1Multi-Agent CoordinationCooperative MARL

  20. PC3D: Zero-Shot Cooperation Across Variable Rosters via Personalized Context Distillation

    May 11, 2026Ahmet Onur Akman, Rafał KucharskiZero-Shot LearningDecentralized MARL

  21. A Cross-Layered Multi-Drone Coordination for Medical Supply Delivery during Disaster Response Management

    May 10, 2026Aneesh Calyam, Subrahmanya Chandra Bhamidipati, Zack Murry +1Aerial RoboticsUAV Navigation

  22. Rethinking Ratio-Based Trust Regions for Policy Optimization in Multi-Agent Reinforcement Learning

    May 9, 2026Chulabhaya Wijesundara, Andrea Baisero, Zhongheng Li +3Multi-Agent System OptimizationPolicy Optimization

  23. SACHI: Structured Agent Coordination via Holistic Information Integration in Multi-Agent Reinforcement Learning

    May 8, 2026Nikunj Gupta, James Zachary Hare, Jesse Milzman +2Multi-Agent CoordinationPartially Observable RL

  24. The Reciprocity Gradient

    May 8, 2026Yue Lin, Pascal Poupart, Shuhui Zhu +5Credit Assignment in RLPolicy Gradient Methods

  25. Randomness is sometimes necessary for coordination

    May 7, 2026Rohan Patil, Jai Malegaonkar, Henrik I. ChristensenMulti-Agent CoordinationMulti-Agent Systems