A distributed adaptive policy gradient method based on momentum for multi-agent reinforcement learning
Abstract Policy Gradient (PG) method is one of the most popular algorithms in Reinforcement Learning (RL). However, distributed adaptive variants of PG are rarely studied in multi-agent. For this reason, this paper proposes a distributed adaptive policy gradient algorithm (IS-DAPGM) incorporated wit...
Kaydedildi:
| Asıl Yazarlar: | , , , , , |
|---|---|
| Materyal Türü: | Artigo |
| Dil: | Inglês |
| Baskı/Yayın Bilgisi: |
Springer
2024-07-01
|
| Seri Bilgileri: | Complex & Intelligent Systems |
| Konular: | |
| Online Erişim: | https://doi.org/10.1007/s40747-024-01529-6 |
| Etiketler: |
Etiket eklenmemiş, İlk siz ekleyin!
|
