Dec, 2023

自适应线性二次控制的非渐进遗憾分析及模型误差

TL;DR对于自适应控制中的预先训练策略,我们研究了一个自适应线性二次控制问题,在这个设置中学习者具有动力学的一组基矩阵的先验知识。我们提出了一种使用这个先验知识的算法,并对通过与系统进行 T 次交互后的预期遗憾给出了上界。