• Home
  • Search
  • Multi-Agent Learning with Policy Prediction
  • Cite Icon114
  • https://doi.org/10.1609/aaai.v24i1.7639Copy DOI Icon

Multi-Agent Learning with Policy Prediction

Show More
  • Abstract
  • Literature Map
  • References
  • Citations
  • Similar Papers
Abstract

Due to the non-stationary environment, learning in multi-agent systems is a challenging problem. This paper first introduces a new gradient-based learning algorithm, augmenting the basic gradient ascent approach with policy prediction. We prove that this augmentation results in a stronger notion of convergence than the basic gradient ascent, that is, strategies converge to a Nash equilibrium within a restricted class of iterated games. Motivated by this augmentation, we then propose a new practical multi-agent reinforcement learning (MARL) algorithm exploiting approximate policy prediction. Empirical results show that it converges faster and in a wider variety of situations than state-of-the-art MARL algorithms.

Similar Papers
  • Conference Article
  • Citations18

Improved Cooperative Multi-agent Reinforcement Learning Algorithm Augmented by Mixing Demonstrations from Centralized Policy

  • May 08, 2019
  • Hyun-Rok Lee +1
  • Conference Article
  • Citations90

Best-Response Multiagent Learning in Non-Stationary Environments

  • Jul 19, 2004
  • Michael C Weinberg +1
  • Research Article
  • Citations1

Solving Action Semantic Conflict in Physically Heterogeneous Multi-Agent Reinforcement Learning with Generalized Action-Prediction Optimization

  • Feb 27, 2025
  • Applied Sciences
  • Xiaoyang Yu +3
  • PDF
  • Research Article
  • Citations6

Robust Multiagent Reinforcement Learning for UAV Systems: Countering Byzantine Attacks

  • Nov 19, 2023
  • Information
  • Jishu K Medhi +3
  • Research Article
  • Citations3

An Effective Training Method for Counterfactual Multi-Agent Policy Network Based on Differential Evolution Algorithm

  • Sep 18, 2024
  • Applied Sciences
  • Shaochun Qu +5
  • Research Article

Multi‐Agent Reinforcement Learning Algorithm Based on Local Observation Imitation Learning

  • Jan 01, 2025
  • IET Control Theory & Applications
  • Hui Zhang +3
  • Research Article
  • Citations53

Reinforcement Learning for Joint Control of Traffic Signals in a Transportation Network

  • Jan 10, 2020
  • IEEE Transactions on Vehicular Technology
  • Jincheol Lee +2
  • Conference Article
  • Citations4

Gas Source Localization using Improved Multi-Agent Reinforcement Learning

  • Nov 06, 2020
  • Zhi-Pu Wang +1
  • PDF
  • Research Article
  • Citations3

UAV Confrontation and Evolutionary Upgrade Based on Multi-Agent Reinforcement Learning

  • Aug 01, 2024
  • Drones
  • Xin Deng +2
  • Conference Article
  • Citations5

A Tensor Factorization Approach to Generalization in Multi-agent Reinforcement Learning

  • Dec 01, 2012
  • Stefano Bromuri
  • Conference Article
  • Citations10

A common gradient in multi-agent reinforcement learning

  • Jun 04, 2012
  • Michael Kaisers +2
  • PDF
  • Research Article
  • Citations6

GHQ: grouped hybrid Q-learning for cooperative heterogeneous multi-agent reinforcement learning

  • Apr 23, 2024
  • Complex & Intelligent Systems
  • Xiaoyang Yu +4
  • Research Article

Using AI for Real-Time Big Data Processing and Analysis with Integration of Multi-Agent Systems

  • Dec 30, 2025
  • Artificial Intelligence
  • Pisarenko J +1
  • Research Article
  • Citations13

Learning Communication for Cooperation in Dynamic Agent-Number Environment

  • Aug 01, 2021
  • IEEE/ASME Transactions on Mechatronics
  • Weiwei Liu +5
  • Research Article
  • Citations6

Distributed entropy-regularized multi-agent reinforcement learning with policy consensus

  • Apr 04, 2024
  • Automatica
  • Yifan Hu +4
Cactus Communications logo

Copyright 2026 Cactus Communications. All rights reserved.