QR Kod

A distributed adaptive policy gradient method based on momentum for multi-agent reinforcement learning

Abstract Policy Gradient (PG) method is one of the most popular algorithms in Reinforcement Learning (RL). However, distributed adaptive variants of PG are rarely studied in multi-agent. For this reason, this paper proposes a distributed adaptive policy gradient algorithm (IS-DAPGM) incorporated wit...

Ful tanımlama

Kaydedildi:
Detaylı Bibliyografya
Asıl Yazarlar: Junru Shi, Xin Wang, Mingchuan Zhang, Muhua Liu, Junlong Zhu, Qingtao Wu
Materyal Türü: Artigo
Dil:Inglês
Baskı/Yayın Bilgisi: Springer 2024-07-01
Seri Bilgileri:Complex & Intelligent Systems
Konular:
Online Erişim:https://doi.org/10.1007/s40747-024-01529-6
Etiketler: Etiketle
Etiket eklenmemiş, İlk siz ekleyin!