Decentralized MARL

MARL: Multi-Agent Reinforcement Learning

Momentum

13 papers in the last four weeks, up 333% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 68

All topics
CardsList
  1. Multi-Agent Coordination via Support-Preserving Distillation

    Oct 7, 2026Sangmin Lee, Youngju Na, Chanmi Lee +1Multi-Agent CoordinationOffline MARL

  2. Independent Multi-Agent Reinforcement Learning with Counterfactual Semantic-Social World Models

    Oct 6, 2026Fernando Martinez, Tao Li, Yingdong Lu +1Sequential MARLAction-Conditioned World Models

  3. Foundation Model-Aided Multi-Agent Reinforcement Learning for Wireless Random Access Network Optimization

    Oct 6, 2026Myeung Suk Oh, Zhiyao Zhang, Alvaro Velasquez +2Wireless Resource AllocationDecentralized MARL

  4. Visual Swarm Navigation via Deep Reinforcement Learning and Evolutionary Hybrid Design

    Oct 5, 2026Álvaro Díez, Fidel AznarSwarm RoboticsMulti-Robot Exploration

  5. Taylor Representations for Model-Free RL in Networked MDPs

    Oct 4, 2026Salah Chikhi, Abdelhaq Chaoui, Asuman Ozdaglar +1Markov Decision ProcessesRepresentation Learning for RL

  6. Fully Online Decentralized Learning in Stochastic Games with Unknown Independent Chains

    Oct 1, 2026S. Rasoul EtesamiGame TheoryOnline Mirror Descent

  7. MASkillBlender: Decentralized Whole-Body Coordination for Multi-Humanoid Loco-Manipulation via Skill Blending

    Oct 1, 2026Yifan Hu, Luhang Hong, Mingkang Long +5Humanoid Loco-ManipulationReinforcement Learning

  8. VERA: Verifiable Feasibility Representations with Counterfactual Credit for Constrained Multi-Agent Control

    Sep 30, 2026Bo Yin, Dongbo Li, Hongkai Chen +2Multi-Agent ControlConstrained RL

  9. Physics-Informed Multi-Agent Coordination for Hospital Patient Flow Optimization

    Sep 29, 2026Guoqing Zhang, Rafik Hadfi, Takayuki ItoMulti-Agent CoordinationHealthcare

  10. Fully Decentralized and Safety-Aware Multi-Agent Reinforcement Learning for Control on Networks

    Sep 28, 2026Theodore Rogalski, Shirantha WelikalaMulti-Agent ControlDecentralized MARL

  11. ICMAPE: In-Context Multiagent Pure Exploration

    Sep 27, 2026Xinyi Hu, Alessio Russo, Aldo PacchianoRL ExplorationDecentralized MARL

  12. A Decentralized Partially Observable Team Decision Methodology with Delayed Information Sharing

    Sep 22, 2026Xiaoxing Ren, Thomas Parisini, Andreas A. MalikopoulosMarkov Decision ProcessesLinear Markov Decision Processes

  13. Fully Byzantine-Resilient Multi-Agent Reinforcement Learning

    Sep 22, 2026Haejoon Lee, Dimitra PanagouDecentralized MARLActor-Critic Methods

  14. CoRe-MARL: Cooperative Redistribution Under Unknown Dynamics Using Recurrent Multi-Agent Reinforcement Learning

    Sep 16, 2026Naimur Rahman Chowdhury, Shatabdi Sen Prapti, Md. Salehin Seyam +1Partially Observable RLMulti-Agent Systems

  15. High-Probability Nash Regret for Decentralized Learning in Markov αα-Potential Games: Episodic and Fully Online Asynchronous Algorithms with Applications to Markov Congestion Games

    Sep 14, 2026S. Rasoul EtesamiPolicy GradientAsynchronous RL

  16. Decentralized Safe Multi-Agent Reinforcement Learning via Predictive Shielding

    Sep 7, 2026Yacine El Yamani, Hanna Krasowski, Elena VanneauxMulti-Robot CoordinationRobot Safety

  17. SMaRT-Tug: Structured Multi-Agent Reinforcement Learning for Physics-Based Tugboat-Barge Collaborative Manipulation

    Sep 7, 2026Junkai Lu, Jiadong Zhao, Jiacheng Zhang +8Multi-Agent CoordinationMulti-Agent Control

  18. Independent Reinforcement Learning in Discounted Markov Games

    Sep 1, 2026Asrin Efe Yorulmaz, Ugur Aydin, Tamer BasarReinforcement LearningGame Theory

  19. Decentralized Multi-Player Q-Learning in Episodic Markov Decision Processes with Information Asymmetry

    Aug 13, 2026Larissa Xu, King Bi, William ChangRegret Minimization in RLReinforcement Learning

  20. Coordinating the Unknown Lipschitz Constant in Multiplayer Bandits

    Aug 11, 2026Ricardo Parada, Chenzhang Zhao, William ChangMulti-Armed BanditsMulti-Agent Coordination

  21. Multi-Agent Reinforcement Learning via Agent-Specific Preference

    Aug 9, 2026Ni Mu, Yao Luan, Yiqin Yang +1Decentralized MARLCooperative MARL

  22. A MARL Centered Reference Architecture for Large Language Model Augmentation in Smart Manufacturing

    Aug 7, 2026Fouad Bahrpeyma, Dirk ReicheltManufacturingDecentralized MARL

  23. Joint UAV Flight and Opportunistic Routing under Reinforcement Learning for Delay-Tolerant Networks

    Aug 5, 2026Xiao Wang, Shun-Ren YangUAV Trajectory OptimizationDecentralized MARL

  24. FedCritic-MIMO: Communication-Efficient Serverless Federated Critic Learning for Massive-MIMO Resource Control in Open and Disaggregated 6G RANs

    Aug 4, 2026Amin Farajzadeh, Melike Erol-KantarciFederated RL6G Networks

  25. GNN-based Multi-Agent Control of Traffic Shockwaves in Sparse Vehicular Ad-hoc Networks

    Jul 26, 2026Prachi Nandi, Madhuri Malakar, Sonakshi Satpathy +1Multi-Agent ControlDecentralized MARL

  26. TRUAV: Distributed Multi-Agent Reinforcement Learning for Trajectory Planning and Routing Enhancement in UAV-Aided IoT-Enabled VANETs

    Jul 26, 2026Muhammad Umar Farooq Qaisar, Lin Zhang, Zhen Chen +3UAV NavigationDecentralized MARL

  27. Variance-Reduced Q-Learning over Static and Time-Varying Networks

    Jul 24, 2026Sreejeet Maity, Feng Zhu, Aritra Mitra +1Reinforcement LearningQ-Learning

  28. Compact Latent Coordination for Autonomous Vehicles at Unsignalized Intersections

    Jul 23, 2026Gil Lifshits, Igal Bilik, Gilad KatzMulti-Agent CoordinationHierarchical RL

  29. Dreamer-CPC: Message Learning with World Models for Decentralized Multi-agent Reinforcement Learning

    Jul 22, 2026Taisuke Takayama, Naoto Yoshida, Tadahiro TaniguchiPredictive CodingPartially Observable RL

  30. Scalable Policy Optimization for Networked Multi-Agent Reinforcement Learning with Continuous State-Action Spaces

    Jul 20, 2026Dongming Wang, Pengcheng Dai, Wenwu Yu +1Multi-Agent ControlTemporal-Difference Learning

  31. Decentralized Multi-agent Reinforcement Learning for Resilient Critical Infrastructures

    Jul 20, 2026Minghui Ding, Evangelos PournarasMulti-Agent CoordinationCredit Assignment in RL

  32. CoDiMAD: Diffusion-Based Privileged Distillation for Communication-Free Multi-Robot Coordination

    Jul 10, 2026Jiyue Tao, Shunheng Xin, Tongsheng Shen +2Multi-Agent CoordinationMulti-Robot Coordination

  33. Dec-MARVEL: Decentralized Multi-Agent Exploration without Communication under Budget Constraints

    Jul 10, 2026Janghyun Cho, Jimmy Chiun, Guillaume Sartoretti +1Aerial RoboticsMulti-Robot Exploration

  34. HyPOLE: Hyperproperty-Guided Multi-Agent Reinforcement Learning under Partial Observation

    Jun 29, 2026Arshia Rafieioskouei, Tzu-Han Hsu, Matthew Lucas +1Reinforcement LearningPartially Observable RL

  35. Sampling-Based Coordination-Informed Multi-Objective Multi-Robot Reinforcement Learning

    Jun 29, 2026Antonio Marino, Esteban Restrepo, Soon-jo Chung +2Multi-Objective Reinforcement LearningMulti-Robot Coordination

  36. ACPO: Agent-Chained Policy Optimization for Multi-Agent Reinforcement Learning

    Jun 29, 2026Daiki E. Matsunaga, Junho Na, Tri Wahyu Guntara +4Multi-Agent System OptimizationMulti-Agent Coordination

  37. Decentralized Autonomous Traffic Management through Corridor Networks

    Jun 22, 2026Jasmine Jerry Aloor, Aadarsh Govada, Hamsa BalakrishnanAir Traffic ManagementIntelligent Transportation Systems

  38. Asymmetric physics enables efficient learning in quadrupedal robot swarms

    Jun 22, 2026Yuang Zhang, Yunlong Song, Zhihao He +7Multi-Robot SystemsSwarm Robotics

  39. Contract-Based Compositional Shielding for Safe Multi-Agent Reinforcement Learning

    Jun 12, 2026Omar Adalat, Edwin Hamel-De le Court, Francesco BelardinelliMulti-Agent CoordinationFormal Verification

  40. CCKS: Consensus-based Communication and Knowledge Sharing

    Jun 10, 2026Jinyuan Zu, Xiaowei Lv, Yongcai Wang +5Multi-Agent ConsensusDecentralized MARL

  41. Network Distributed Multi-Agent Reinforcement Learning for Consensus Control of Quadcopters

    Jun 1, 2026Youssef Mahran, Zeyad Gamal, Aamir Ahmad +1Multi-Agent ControlQuadrotor Control

  42. KISS: Keeping it Simple and Slotted when Learning to Communicate over Wireless

    May 29, 2026Kamil Szczech, Maksymilian Wojnar, Krzysztof Rusek +2Wireless CommunicationsWireless Resource Allocation

  43. Scalable Constrained Multi-Agent Reinforcement Learning via State Augmentation and Consensus for Separable Dynamics

    May 28, 2026Santiago Amaya-Corredor, Miguel Calvo-Fullana, Anders JonssonMulti-Agent System OptimizationMulti-Agent Coordination

  44. SCALE-COMM: Shared, Contrastively-Aligned Latent Embeddings for MARL Communication

    May 26, 2026Mahmoud Abouelyazid, Eman HammadMulti-Robot CoordinationDecentralized MARL

  45. Micro-Swarm Locomotion Optimization in Dynamic Flow using Multi-Objective Multi-Agent Reinforcement Learning

    May 24, 2026Josef Berman, Oren GalMulti-Objective Reinforcement LearningMulti-Agent System Optimization

  46. Decoupling Communication from Policy: Robust MARL under Bandwidth Constraints

    May 20, 2026Alexi Canesse, Benoît Goupil, Jesse Read +1Decentralized MARLMulti-Agent Communication

  47. Learning to Hand Off: Provably Convergent Workflow Learning under Interface Constraints

    May 18, 2026Jiayu Li, Enpei Zhang, Dawei Zhou +2Sequential MARLSequential Decision Making

  48. Distributed Zeroth-Order Policy Gradient for Networked Multi-agent Reinforcement Learning from Human Feedback

    May 15, 2026Pengcheng Dai, He Wang, Dongming Wang +2Policy GradientDecentralized MARL

  49. Task-Semantic Graph-Driven Distributed Agent Networking for Underwater Target Tracking

    May 15, 2026Shengchao Zhu, Guangjie Han, Chuan Lin +1Underwater RoboticsDecentralized MARL

  50. Quantum Advantage in Multi Agent Reinforcement Learning

    May 14, 2026Simranjeet Singh Dahia, Claudia SzaboDecentralized MARLQuantum RL

  51. Priority-Driven Control and Communication in Decentralized Multi-Agent Systems via Reinforcement Learning

    May 11, 2026Qingyun Guo, Junyi Shi, Tomasz Piotr Kucner +1Agent Communication ProtocolsFeedback Control

  52. PC3D: Zero-Shot Cooperation Across Variable Rosters via Personalized Context Distillation

    May 11, 2026Ahmet Onur Akman, Rafał KucharskiZero-Shot LearningDecentralized MARL

  53. MEMOA: Massive Mixtures of Online Agents via Mean-Field Decentralized Nash Equilibria

    May 6, 2026Xuwei Yang, David B. Emerson, Fatemeh Tavakoli +1Nash EquilibriumFederated RL

  54. Modular Reinforcement Learning For Cooperative Swarms

    May 6, 2026Erel Shtossel, Gal A. KaminkaMulti-Robot SystemsReinforcement Learning

  55. Federated Reinforcement Learning for Efficient Mobile Crowdsensing under Incomplete Information

    May 4, 2026Sumedh J. Dongare, Patrick Weber, Andrea Ortiz +3Federated RLDecentralized MARL

  56. GradMAP: Gradient-Based Multi-Agent Proximal Learning for Grid-Edge Flexibility

    Apr 27, 2026Yihong Zhou, Hongtai Zeng, Thomas MorstynMulti-Agent ControlConstrained RL

  57. Cooperative Informative Sensing for Monitoring Dynamic Indoor Environments via Multi-Agent Reinforcement Learning

    Apr 25, 2026Kanghoon Lee, Matthew M. Sato, Jinnyeong Yang +7Decentralized MARLCooperative Perception