Codi QR

TD algorithm based on double-layer fuzzy partitioning

When dealing with the continuous space problems,the traditional Q-iteration algorithms based on lookup-table or function approximation converge slowly and are diff lt to get a continuous policy.To overcome the above weak-nesses,an on-policy TD algorithm named DFP-OPTD was proposed based on double-la...

Descripció completa

Guardat en:
Dades bibliogràfiques
Autors principals: Xiang MU, Quan LIU, Qi-ming FU, Hong-kun SUN, Xin ZHOU
Format: Artigo
Idioma:Chinês
Publicat: Editorial Department of Journal on Communications 2013-10-01
Col·lecció:Tongxin xuebao
Matèries:
Accés en línia:http://www.joconline.com.cn/thesisDetails#10.3969/j.issn.1000-436x.2013.10.011
Etiquetes: Afegir etiqueta
Sense etiquetes, Sigues el primer a etiquetar aquest registre!