Apr, 2022

非马尔科夫决策过程中PAC强化学习的马尔科夫抽象

TL;DR本文提出了一种结合自动机学习和经典强化学习的算法,用于学习非马尔可夫决策流程中的马尔科夫抽象,并且证明该算法具有PAC保证。