Multi-Agent Reinforcement Learning

Latest papers 272

All topics
CardsList
  1. Pay to Learn, Share to Earn: Incentivized Federated Multi-Player Bandits

    Oct 5, 2026Pavamana K J, Chandramani SinghStochastic Multi-Armed BanditsFederated Learning

  2. Flowing Faster to Coordinate: One-Step Online Multi-Agent Flow Policies

    Oct 1, 2026Zhuoran Li, Yunzhan Li, Xun Wang +2Multi-Agent Reinforcement LearningFlow Policies

  3. MASkillBlender: Decentralized Whole-Body Coordination for Multi-Humanoid Loco-Manipulation via Skill Blending

    Oct 1, 2026Yifan Hu, Luhang Hong, Mingkang Long +5Full-Body Humanoid ControlHumanoid Loco-Manipulation

  4. Meta-Multi-Agent Reinforcement Learning for Fast Adaptation of Interactive Policies with Applications to Autonomous Driving

    Sep 30, 2026Huiwen Yan, Kyriakos G. Vamvoudakis, Mushuang LiuMulti-Agent Reinforcement LearningMean Field Games

  5. PowerMarketJax: A JAX Benchmark Suite for Multi-Agent Reinforcement Learning in Power Markets

    Sep 29, 2026Zhanhua Pan, Xin Qin, Xiao Liu +3Multi-Agent Reinforcement LearningDistributed Energy Resources

  6. Fully Decentralized and Safety-Aware Multi-Agent Reinforcement Learning for Control on Networks

    Sep 28, 2026Theodore Rogalski, Shirantha WelikalaMulti-Agent Reinforcement LearningOffline Reinforcement Learning

  7. Coordinated Lane-Level Variable Speed Limits and Ramp Metering for Successive Weaving Segments Considering Merging/Diverging Risks: A Hybrid Model Predictive Control and Multi-Agent Reinforcement Learning Approach

    Sep 28, 2026Guodong Ma, Baofeng Sun, Wenyu Yang +1Standard Traffic Speed BenchmarksTraffic

  8. Escaping Local Views: Discovering Latent Concepts for Interpretable Multi-Agent Reinforcement Learning

    Sep 28, 2026Yijie Sun, Sanquan Sun, Yanda Zhu +3Multi-Agent Reinforcement LearningUnsupervised

  9. Hierarchical Multi-agent Reinforcement Learning for Warehouse Robot Coordination under Communication Loss

    Sep 27, 2026Weihao Sun, Gehui Xu, Andreas A. MalikopoulosMulti-Robot SystemsMulti-Agent Reinforcement Learning

  10. MA-JEPA: Joint-Embedding World Models for Multi-Agent Reinforcement Learning

    Sep 27, 2026Brandon Gary Kaplowitz, Osaze James Obahor, Christian Schroeder de WittMulti-Agent Reinforcement LearningWorld Models

  11. Federated Multi-Modal Human Activity Recognition using Multi-Agent Reinforcement Learning

    Sep 27, 2026Debasmita Dey, Tanmay Sen, Himel MallickMultimodal FusionHuman Activity Recognition

  12. Graph-Based Inference and Topology-Aware Multi-Agent Reinforcement Learning for Large-Scale Railway Network Management

    Sep 24, 2026Giacomo Arcieri, Gregory Duthé, Christophe Muller +3Multi-Agent Reinforcement LearningGraph Representation Learning

  13. REAT: A Reflective Experience-Augmented Tutoring Framework for Multi-turn Mathematical Instruction

    Sep 24, 2026Jianheng Zhou, Chaoli Zhang, Xingjun Wei +6TutorsPedagogical Frameworks

  14. FairTest: Search-Based Fairness Testing for Multi-Agent Reinforcement Learning Systems

    Sep 23, 2026Xiaotong Wang, Xuan XieMulti-Agent Reinforcement LearningAlgorithmic Fairness

  15. Resource-Efficient Distributed Recursive Gaussian Processes

    Sep 22, 2026Josephine King, Ali Emre Balci, Raj Thilak RajanGaussian ProcessMulti-Agent Reinforcement Learning

  16. MATES: Learning Multi-Agent Interactions by Transforming Observations for Frozen Single-Agent Policies

    Sep 22, 2026Elie Abboud, Oren GalMulti-Agent Reinforcement LearningMulti-Agent Communication

  17. Fully Byzantine-Resilient Multi-Agent Reinforcement Learning

    Sep 22, 2026Haejoon Lee, Dimitra PanagouMulti-Agent Reinforcement LearningByzantine Attacks

  18. HOTICE: Whole-Body Humanoid Object Transportation in Cluttered Environments

    Sep 21, 2026Toan Nguyen, Weiduo Yuan, Siheng Zhao +2Full-Body Humanoid ControlAction Space

  19. VISTA: An Attention-Based Multi-Agent Reinforcement Learning Architecture for Space Situational Awareness Sensor Tasking

    Sep 20, 2026Miguel Leiva-Vélez, Adalberto Claudio Quiros, Nicolas Gaston Rozado +2Situational AwarenessSpacecraft

  20. Agentic AI Networking for Heterogeneous Unmanned Aerial Systems in Low-Altitude Wireless Networks

    Sep 17, 2026Nguyen Duc Minh Quang, Chang Liu, Shuangyang Li +1Multi-Agent Reinforcement LearningWireless Communications

  21. CoRe-MARL: Cooperative Redistribution Under Unknown Dynamics Using Recurrent Multi-Agent Reinforcement Learning

    Sep 16, 2026Naimur Rahman Chowdhury, Shatabdi Sen Prapti, Md. Salehin Seyam +1Multi-Agent Reinforcement LearningDecentralized Learning

  22. DualSQL: Text-to-SQL with Multi-Agent Reinforcement Learning

    Sep 16, 2026Shijie Chen, Yu Gan, Yeounoh Chung +6Text-To-SqlSql

  23. Composite-Gradient Learning for Shared Control Authority Between Deep Reinforcement Learning and Model Predictive Control

    Sep 15, 2026Giray Önür, Azita Dabiri, Bart De SchutterModel Predictive ControlMulti-Agent Reinforcement Learning

  24. Assembling the CREW: A Collaborative Multi-agent Reinforcement Learning Framework for Automated Related Work Generation

    Sep 14, 2026Hai-Dang Dang, Bao-Yen Pham, Bao Nguyen +2Data Generation PipelinesMulti-Agent Large Language Model Systems

  25. Robust and Efficient Communication for Multi-Agent Learning

    Sep 14, 2026Rafael Pina, Varuna De Silva, Corentin ArtaudMulti-Agent Reinforcement LearningArtificial Intelligence Agents

  26. Curriculum-Based Adversarial Heterogeneous Agent Reinforcement Learning for Autonomous Quad-Copter Landing in Maritime Settings

    Sep 14, 2026Allan Minh-Tam Nguyen, Sree Showrya Kotala, Stefan Banioi-Crijman +2Reinforcement Learning ControlUnmanned Aerial Vehicles

  27. Forty Shades of Blue: Quality-Diversity Alignment via Mode-Conditioned Reinforcement Learning

    Sep 14, 2026Jiayi Yuan, Hangoo Kang, James Jihao Liu +4Large Language Model AlignmentMulti-Agent Reinforcement Learning

  28. DRG-MAPPO: Hierarchical Dynamic Role-Graph Multi-Agent Reinforcement Learning for Cooperative Air Combat

    Sep 12, 2026Junlin Liu, Chengwei Li, Yang Gao +4Multi-Agent Reinforcement LearningCooperative Air Combat

  29. Graph-Based Safe Reinforcement Learning for Multi-Agent Systems with Time-Varying Topology

    Sep 8, 2026Xiao Sizhe, Dong Lijing, Bai Rui +1Multi-Agent Reinforcement LearningSafety Constraints

  30. Decentralized Safe Multi-Agent Reinforcement Learning via Predictive Shielding

    Sep 7, 2026Yacine El Yamani, Hanna Krasowski, Elena VanneauxMulti-Agent Reinforcement LearningMulti-Robot Systems

  31. SMaRT-Tug: Structured Multi-Agent Reinforcement Learning for Physics-Based Tugboat-Barge Collaborative Manipulation

    Sep 7, 2026Junkai Lu, Jiadong Zhao, Jiacheng Zhang +8Multi-Agent Reinforcement LearningCollaboration

  32. Out-of-Distribution Generalisation with Sequence Models in Offline Multi-Agent Reinforcement Learning

    Sep 3, 2026Oussama Hidaoui, Omer Ebead, Ulrich Armel Mbou Sob +14Multi-Agent Reinforcement LearningOut-Of-Distribution

  33. From Prior-Guided Heuristics to Deployable Agents: Accelerating Demonstration-Driven Reinforcement Learning for Deadline-Constrained Network Control

    Sep 3, 2026Vincenzo Norman Vitale, Mohammad Solki, Antonia Maria Tulino +2Bringing Network CodingLearning-Based Control

  34. Independent Reinforcement Learning in Discounted Markov Games

    Sep 1, 2026Asrin Efe Yorulmaz, Ugur Aydin, Tamer BasarMean Field GamesMulti-Agent Reinforcement Learning

  35. OGR-MARL: Option-Guided Residual Multi-Agent Reinforcement Learning for Heterogeneous USV Cooperative Pursuit in Constrained Port Waterways

    Aug 13, 2026Mao Jiayang, Wang Lanfeng, Peng Zhao-HanAutonomous Underwater VehiclesMulti-Agent Reinforcement Learning

  36. Decentralized Multi-Player Q-Learning in Episodic Markov Decision Processes with Information Asymmetry

    Aug 13, 2026Larissa Xu, King Bi, William ChangQ-LearningMulti-Agent Reinforcement Learning

  37. One Frozen Simulator Is Not Enough: Simulator Collapse in Multi-Agent RL

    Aug 12, 2026Simon Yu, Nicholas Tomlin, Marwa Abdulhai +7Multi-Agent SimulationsSimulation-Based Reinforcement Learning

  38. Multi-AUV Ad-hoc network-based Target Tracking: A Value Gradient Guidance Multi-Agent Diffusion Reinforcement Learning Approach

    Aug 12, 2026Jiaao Ma, Chuan Lin, Guangjie Han +4Multi-Agent Reinforcement LearningMulti-Uav

  39. Is Per-Agent Policy Composition Safe? Rethinking Successor-Feature Transfer in Cooperative Multi-Agent Reinforcement Learning

    Aug 12, 2026Zijian Zhao, Sen LiMulti-Agent Reinforcement LearningSuccessor Representations

  40. Robust Multi-Agent Bandits with Heavy-Tailed Rewards and Information Asymmetry

    Aug 11, 2026Daphne Feng, Ricardo Parada, Lily Jiang +2Stochastic Multi-Armed BanditsMulti-Agent Reinforcement Learning

  41. Competitive mediator games and urban CAV routing markets

    Aug 10, 2026Grzegorz JamrózGame TheoryNash Equilibrium

  42. Task-Oriented Formation Decision via Reinforcement Learning: Herding an Attacking Swarm

    Aug 10, 2026Zhaozong Wang, Guibin Sun, Jinyong Chen +1Multi-Robot SystemsMulti-Agent Reinforcement Learning

  43. Multi-Agent Reinforcement Learning via Agent-Specific Preference

    Aug 9, 2026Ni Mu, Yao Luan, Yiqin Yang +1Multi-Agent Reinforcement LearningPreference Alignment Learning

  44. Per-Shipment Multi-Agent Reinforcement Learning for Intermodal Freight Routing Under Hurricane Disruption

    Aug 7, 2026Aliza Sharmin, Xudong Wang, Mustafa Can Camur +1LogisticsMulti-Agent Reinforcement Learning

  45. Why Study Emergent Behavior When You Can Regulate It? Aligning Multi-Agent Systems with Reward Prediction

    Aug 7, 2026Assaf Caftory, Almog Zemach, Moshe Butman +1Multi-Agent Reinforcement LearningEmergence

  46. Multi-Agent Reinforcement Learning for Online Traffic Scheduling in Time-Sensitive Application

    Aug 5, 2026Marcos Carvalho, Fatih Temiz, Shavbo Salehi +2SchedulersMulti-Agent Reinforcement Learning

  47. Multi-Agent Transformer for Queue-Level XR Traffic Scheduling in TSN Networks

    Aug 5, 2026Marcos Carvalho, Fatih Temiz, Shavbo Salehi +2Multi-Agent Reinforcement LearningEdge Devices

  48. Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning

    Aug 5, 2026Aaditya Mehta, Arya ShahPotential-Based Reward ShapingMulti-Agent Reinforcement Learning

  49. Structured LLM Reasoning for Zero-Shot Human--Robot Coordination Under Hidden Goals

    Aug 5, 2026Dong Hae Mangalindan, Anand Gokhale, Francesco Bullo +1Human-Robot CollaborationTheory-Of-Mind Reasoning

  50. FedCritic-MIMO: Communication-Efficient Serverless Federated Critic Learning for Massive-MIMO Resource Control in Open and Disaggregated 6G RANs

    Aug 4, 2026Amin Farajzadeh, Melike Erol-KantarciOrthogonal Frequency-Division MultiplexingMulti-Agent Reinforcement Learning

  51. History Matters: Meta-policy Delegation with Heterogeneous Multi-agent Reinforcement Learning

    Aug 4, 2026Ziqing Lu, Avinash Reddy Mudireddy, Sarra Alqahtani +1Multi-Agent Reinforcement LearningMulti-Agent Communication

  52. Is Inter-Seed Cross-Play Enough? Evaluating the Robustness of Zero-Shot Coordination Algorithms to Implementation Details

    Aug 4, 2026Maksymilian Wolski, Nicholas Hoernle, Johannes Forkel +1Multi-Agent CoordinationMulti-Agent Reinforcement Learning

  53. Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints

    Aug 3, 2026Yeonseo Jeong, Wonhyeok Ko, Sungweon Hong +1Power AllocationOpen Radio Access Networks

  54. Training Small LLMs as Spatial Multi-Agent Policies

    Aug 2, 2026Yi Mao, Andrew PerraultMulti-Agent Reinforcement LearningLarge Language Model Training