Dec, 2022

基于 GPU 仿真和高质量演示的交互式人类样学习加速

TL;DR利用 GPU 模拟技术和模仿学习指导策略搜索以使强化学习培训可在高维机器人手表现复杂控制问题的领域中成为可能,最终演示了并行强化学习和模仿学习的互补优势和优秀的验证结果。