通过强化学习信息策略先验的Q引导斯坦变分模型预测控制
HuggingFace Daily Papers · · 发布于 2026-09-11 · 1 分钟阅读
arXiv:2507.06625v4 公告类型:替换交叉 摘要:模型预测控制(MPC)在动态约束下能够实现可靠的轨迹优化,但通常依赖于准确的动力学模型和精心设计的成本函数。近期的基于学习的MPC方法
要点 1
arXiv:2507.06625v4 公告类型:替换交叉 摘要:模型预测控制(MPC)在动态约束下能够实现可靠的轨迹优化,但通常依赖于准确的动力学模型和精心设计的成本函数。
SOURCES
共 1 个来源