Cooperative MARL

MARL: Multi-Agent Reinforcement Learning

Latest papers 146

All topics
CardsList
  1. Multi-AUV Ad-hoc network-based Target Tracking: A Value Gradient Guidance Multi-Agent Diffusion Reinforcement Learning Approach

    Aug 12, 2026Jiaao Ma, Chuan Lin, Guangjie Han +4Multi-Agent ControlDiffusion Policy

  2. Is Per-Agent Policy Composition Safe? Rethinking Successor-Feature Transfer in Cooperative Multi-Agent Reinforcement Learning

    Aug 12, 2026Zijian Zhao, Sen LiSequential Decision MakingSafe RL

  3. Multi-Agent Reinforcement Learning via Agent-Specific Preference

    Aug 9, 2026Ni Mu, Yao Luan, Yiqin Yang +1Decentralized MARLCooperative MARL

  4. A MARL Centered Reference Architecture for Large Language Model Augmentation in Smart Manufacturing

    Aug 7, 2026Fouad Bahrpeyma, Dirk ReicheltManufacturingDecentralized MARL

  5. Online Security Learning in Cooperative Multi-Agent Systems under Hidden Byzantine Attacks

    Aug 6, 2026Ximing Sun, Yue WangMulti-Agent System SecurityRobust RL

  6. Search-Aided Joint Agent-Environment Reinforcement Learning for Robust Lifelong Multi-Agent Path Finding with Rotations

    Aug 6, 2026He Jiang, Jingtian Yan, Yulun Zhang +5Constrained Motion PlanningRobust MAPF

  7. Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning

    Aug 5, 2026Aaditya Mehta, Arya ShahReinforcement LearningReward Shaping

  8. History Matters: Meta-policy Delegation with Heterogeneous Multi-agent Reinforcement Learning

    Aug 4, 2026Ziqing Lu, Avinash Reddy Mudireddy, Sarra Alqahtani +1Multi-Agent SystemsCooperative MARL

  9. Training Small LLMs as Spatial Multi-Agent Policies

    Aug 2, 2026Yi Mao, Andrew PerraultHierarchical RLMulti-Agent Collaboration

  10. Staged Multi-Agent Training (SMAT) for Hip Exoskeletons: Metabolic and Biomechanical Validation of a Simulation-Trained Co-Adaptive Controller

    Aug 1, 2026Yifei Yuan, Jakob Wolf, Ghaith Androwis +1Robotic ControlAssistive Robotics

  11. HetGPS: Scalable Graph Multi-Agent Reinforcement Learning with Physics-Anchored Adaptive Safety for EV Charging

    Aug 1, 2026Xiangwei Wang, Nanduni Nimalsiri, Yu Xia +2Electric Vehicle ChargingSafe RL

  12. MDGAM-Based Cooperative Task Scheduling for Communication-Constrained Distributed Multi-Agent Systems

    Aug 1, 2026Licheng Wang, Mingtao Huang, Yuan ShenGraph Attention NetworksMulti-Agent Systems

  13. MARS-RA: Rank Aggregation for Credit Assignment via Multimodal Comparisons in Embodied Multi-Agent Cooperation

    Jul 30, 2026Dawei Wang, Di Zhao, Xinyuan Liu +5Credit Assignment in RLCooperative MARL

  14. Cooperative Multi-UAV Navigation in Complex Environments via Systematic Multi-Agent Deep Reinforcement Learning

    Jul 28, 2026Yu Su, Nabil AoufLearning from DemonstrationCurriculum Learning

  15. Shared Voxel-Map-Based Cooperative Indoor UAV Guidance with a Multi-Agent Soft Actor-Critic Controller

    Jul 28, 2026Thomas Hickling, Dylan Wynne, Yu Su +1Multi-Agent CoordinationUAV Navigation

  16. Predictive Lightweight MARL for Resilient Coverage in Sparse-Signaling Aerial Networks

    Jul 24, 2026Chuan-Chi Lai, Ang-Hsun TsaiSequential MARLMulti-Agent Control

  17. Compact Latent Coordination for Autonomous Vehicles at Unsignalized Intersections

    Jul 23, 2026Gil Lifshits, Igal Bilik, Gilad KatzMulti-Agent CoordinationHierarchical RL

  18. Safe and Scalable Multi-Drone Payload Transport via CBF-based Reinforcement Learning with Zero-Shot Sim-to-Real Transfer

    Jul 22, 2026Jaeyoun Choi, Oswin So, Songyuan Zhang +2Multi-Robot SystemsControl Barrier Functions

  19. Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents

    Jul 21, 2026Yamato Takahagi, Gentoku Nakasone, Yoshinari Motokawa +1Multi-Agent CoordinationMulti-Agent Control

  20. A Self-Evolving Default Action for Cooperative Tasks with Continuous Action Space

    Jul 21, 2026Shuangyao HuangPolicy GradientCredit Assignment

  21. Aggregate in the Advantage, Not the Ratio: A Canonical-Form Analysis of Cooperative Multi-Agent Policy Optimization

    Jul 20, 2026Zijian Zhao, Sen LiProximal Policy OptimizationCooperative MARL

  22. PRIME: Plasticity Recovery in Multi-Agent Environments for UAV-Assisted Emergency Communication Networks

    Jul 20, 2026Wen Qiu, Zhiqiang He, Wei Zhao +1Non-Stationary RLReinforcement Learning

  23. Value-Aware Prediction for Robust Multi-Agent Coordination Under Communication Loss

    Jul 20, 2026Kemal Devrim Kafadar, Eren Özaltun, Mahmud Efnan Şanlı +4Multi-Agent CoordinationMulti-Agent Communication

  24. Task-Oriented Sensing and Covert Transmissions for Collaborative Multi-AUV Systems

    Jul 15, 2026Xueyao Zhang, Chenyang Yan, Bo Yang +6Cooperative LocalizationUnderwater Robotics

  25. Equilibrium stability as a driver of cooperation among Q-learners

    Jul 15, 2026Janusz M. Meylahn, Maximilian SchäferGame-Playing AgentsRepeated Games

  26. COLMAR: Cooperative View Policy Learning for Multi-Agent Active 3D Reconstruction

    Jul 15, 2026Phu Pham, Damon Conover, Aniket BeraNext-Best-View Planning3D Reconstruction

  27. Unveiling Complex Collective Behaviors from Simple Rewards

    Jul 14, 2026Yize Mi, Jianan Li, Liang Li +1Swarm RoboticsMulti-Robot Coordination

  28. Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning

    Jul 10, 2026Edwin De Nicolo, Rahul Marchand, Cornelius Carlsson +2Cooperative MARL

  29. Provably Optimal Learning Algorithms for Assistance Games

    Jul 9, 2026Nivasini Ananthakrishnan, Mark Bedaywi, Michael I. Jordan +2Imperfect-Information GamesCooperative MARL