Cooperative MARL

MARL: Multi-Agent Reinforcement Learning

Latest papers 146

All topics
CardsList
  1. Continual Graph Multi-Agent Reinforcement Learning

    Oct 7, 2026Tommaso Marzi, Ahmed Hendawy, Jan Peters +3Multi-Agent Reinforcement LearningContinual RL

  2. Learning to Report Unsafe Tasks in a Multi-Agent Game

    Oct 6, 2026Avyay M. Casheekar, Hariganesh TangiralaAI Agent SafetyMulti-Agent Systems

  3. Partially Observable Zero-shot coordination by Predicting Intention of Partner

    Oct 6, 2026Jinnyeong Yang, Yuhwan Jeong, Hoyong Kwon +3Multi-Agent CoordinationPartially Observable RL

  4. Self-Referenced Social Preferences: Cooperation without Observing Others Rewards

    Oct 6, 2026Mohamed Ayman Mohamed, Harshil Kotamreddy, Marcos Menon JoseCooperative MARLMulti-Agent Reinforcement Learning

  5. Who Bears the Burden? Learning Responsibility for Shared Constraints in Multi-Agent Reinforcement Learning

    Oct 5, 2026Xiaoyang Cao, Jingqi Li, Zhe Fu +1Game TheoryConstrained RL

  6. Grounded Joint-Attention Other-Play for Zero-Shot Coordination

    Oct 5, 2026Giulia Benintendi, Constantin Ruhdorfer, Fabian Kögel +1Multi-Agent CoordinationVisual Attention

  7. Synergizing Drone Delivery Order Pooling and Road Network Monitoring through Monitoring-Task Orderization

    Oct 4, 2026Yulong Hu, Meng Xu, Sen Li +1Aerial RoboticsIntelligent Transportation Systems

  8. Flowing Faster to Coordinate: One-Step Online Multi-Agent Flow Policies

    Oct 1, 2026Zhuoran Li, Yunzhan Li, Xun Wang +2Flow MatchingMulti-Agent Coordination

  9. Cooperative Multi-Agent Vision-Language-Action Models via Reinforced Fine Tuning

    Sep 29, 2026Ruixiao Xu, Wong Lik Hang Kenny, Zhiqian Liu +12Vision-Language-Action ModelsVLMs for Robotics

  10. Attention-based Hierarchical Variational Information Bottleneck for Robust Multi-Agent Communication under Variable Bandwidth

    Sep 28, 2026Lukas Koch Vindbjerg, Qi Zhang, Yury Brodskiy +1Information BottleneckMulti-Agent Communication

  11. Escaping Local Views: Discovering Latent Concepts for Interpretable Multi-Agent Reinforcement Learning

    Sep 28, 2026Yijie Sun, Sanquan Sun, Yanda Zhu +3Reinforcement LearningPartially Observable RL

  12. Federated Multi-Modal Human Activity Recognition using Multi-Agent Reinforcement Learning

    Sep 27, 2026Debasmita Dey, Tanmay Sen, Himel MallickMultimodal Federated LearningHuman Activity Recognition

  13. A Decentralized Partially Observable Team Decision Methodology with Delayed Information Sharing

    Sep 22, 2026Xiaoxing Ren, Thomas Parisini, Andreas A. MalikopoulosMarkov Decision ProcessesLinear Markov Decision Processes

  14. MATES: Learning Multi-Agent Interactions by Transforming Observations for Frozen Single-Agent Policies

    Sep 22, 2026Elie Abboud, Oren GalCooperative MARLMulti-Agent Reinforcement Learning

  15. Fully Byzantine-Resilient Multi-Agent Reinforcement Learning

    Sep 22, 2026Haejoon Lee, Dimitra PanagouDecentralized MARLActor-Critic Methods

  16. VISTA: An Attention-Based Multi-Agent Reinforcement Learning Architecture for Space Situational Awareness Sensor Tasking

    Sep 20, 2026Miguel Leiva-Vélez, Adalberto Claudio Quiros, Nicolas Gaston Rozado +2Active SensingCooperative MARL

  17. CoRe-MARL: Cooperative Redistribution Under Unknown Dynamics Using Recurrent Multi-Agent Reinforcement Learning

    Sep 16, 2026Naimur Rahman Chowdhury, Shatabdi Sen Prapti, Md. Salehin Seyam +1Partially Observable RLMulti-Agent Systems

  18. Calibrate Once, Fly Any Team: Residual-Grounded Low-Fidelity Training for Cooperative Drone Swarms

    Sep 15, 2026Maxim Mednikov, Oren GalAerial RoboticsSwarm Robotics

  19. Symmetric solution of the Bellman optimality equation for repeated harmony game

    Sep 14, 2026Hisato KomatsuGame-Playing AgentsGame Theory

  20. Robust and Efficient Communication for Multi-Agent Learning

    Sep 14, 2026Rafael Pina, Varuna De Silva, Corentin ArtaudSequential MARLMulti-Agent Communication

  21. DRG-MAPPO: Hierarchical Dynamic Role-Graph Multi-Agent Reinforcement Learning for Cooperative Air Combat

    Sep 12, 2026Junlin Liu, Chengwei Li, Yang Gao +4Multi-Agent CoordinationHierarchical RL

  22. Graph-Based Safe Reinforcement Learning for Multi-Agent Systems with Time-Varying Topology

    Sep 8, 2026Xiao Sizhe, Dong Lijing, Bai Rui +1Multi-Robot CoordinationSafe RL

  23. SMaRT-Tug: Structured Multi-Agent Reinforcement Learning for Physics-Based Tugboat-Barge Collaborative Manipulation

    Sep 7, 2026Junkai Lu, Jiadong Zhao, Jiacheng Zhang +8Multi-Agent CoordinationMulti-Agent Control

  24. Update for Decisions, Not Freshness: Goal-Oriented Status Updating and Selective Offloading at the Network Edge

    Sep 1, 2026Jianpeng Qi, Qiyang Zhang, Chao Liu +5Partially Observable RLCooperative MARL

  25. OGR-MARL: Option-Guided Residual Multi-Agent Reinforcement Learning for Heterogeneous USV Cooperative Pursuit in Constrained Port Waterways

    Aug 13, 2026Mao Jiayang, Wang Lanfeng, Peng Zhao-HanReinforcement LearningMobile Robotics