CVPRMar, 2021

带有目标关系图的层次化和部分可观察的目标驱动策略学习

TL;DR本研究提出一种新型的基于两层分层强化学习的目标驱动任务解决方法,使用 Goals Relational Graph 优化部分可观察的目标导向任务,例如目标驱动视觉导航,实验结果显示该方法在新环境和新目标上表现出卓越的泛化性能。