BriefGPT.xyz
大模型
Ask
alpha
关键词
non-markov decision processes
搜索结果 - 1
IJCAI
非马尔科夫决策过程中 PAC 强化学习的马尔科夫抽象
本文提出了一种结合自动机学习和经典强化学习的算法,用于学习非马尔可夫决策流程中的马尔科夫抽象,并且证明该算法具有 PAC 保证。
PDF
2 years ago
Prev
Next