Codi QR

Efficient Searching With MCTS and Imitation Learning: A Case Study in Pommerman

Pommerman is a popular reinforcement learning environment because it imposes several challenges such as sparse and deceptive rewards and delayed action effects. In this paper, we propose an efficient reinforcement learning approach that uses a more efficient Monte Carlo tree search combined with act...

Descripció completa

Guardat en:
Dades bibliogràfiques
Autors principals: Hailan Yang, Shengze Li, Xinhai Xu, Xunyun Liu, Zhuxuan Meng, Yongjun Zhang
Format: Artigo
Idioma:Inglês
Publicat: IEEE 2021-01-01
Col·lecció:IEEE Access
Matèries:
Accés en línia:https://ieeexplore.ieee.org/document/9360826/
Etiquetes: Afegir etiqueta
Sense etiquetes, Sigues el primer a etiquetar aquest registre!