Código QR (código de barras bidimensional)

Safety Verification of Non-Deterministic Policies in Reinforcement Learning

Reinforcement Learning represents a powerful paradigm in artificial intelligence, enabling agents to learn optimal behaviors through interactions with their environment. However, ensuring the safety of policies learned in non-deterministic environments, where outcomes are inherently uncertain and va...

ver descrição completa

Na minha lista:
Detalhes bibliográficos
Principais autores: Ryeonggu Kwon, Gihwon Kwon
Formato: Artigo
Idioma:Inglês
Publicado em: IEEE 2024-01-01
coleção:IEEE Access
Assuntos:
Acesso em linha:https://ieeexplore.ieee.org/document/10786219/
Tags: Adicionar Tag
Sem tags, seja o primeiro a adicionar uma tag!