基于多维奖励Q学习的模型预测加权因子动态调整方法
首页 企业 产品 技术 资讯 图库 视频 需求 会议 活动 产业
基于多维奖励Q学习的模型预测加权因子动态调整方法
来源:北方有色网
访问:953
简介: 本发明涉及一种基于多维奖励Q学习的模型预测加权因子动态调整方法,属于自动驾驶车辆轨迹跟踪控制领域。解决了采用模型预测控制原理设计轨迹跟踪控制器时对加权因子的选取不当会降低自动驾驶车辆轨迹跟踪稳定性和精确性以及行驶安全性的问题。本发明通过强化学习中Q学习方法,训练了加权因子最优调整策略,可实时动态调整模型预测轨迹跟踪控制器的加权因子,从而实时优化自动驾驶车辆的轨迹跟踪性能,以减少在每个采样时刻下车辆实际位置与预期轨迹之间的误差,提高自动驾驶车辆的轨迹跟踪精度和行驶稳定性、舒适性。
本发明涉及一种基于多维奖励Q学习的模型预测加权因子动态调整方法,属于自动驾驶车辆轨迹跟踪控制领域。解决了采用模型预测控制原理设计轨迹跟踪控制器时对加权因子的选取不当会降低自动驾驶车辆轨迹跟踪稳定性和精确性以及行驶安全性的问题。本发明通过强化学习中Q学习方法,训练了加权因子最优调整策略,可实时动态调整模型预测轨迹跟踪控制器的加权因子,从而实时优化自动驾驶车辆的轨迹跟踪性能,以减少在每个采样时刻下车辆实际位置与预期轨迹之间的误差,提高自动驾驶车辆的轨迹跟踪精度和行驶稳定性、舒适性。
0
0
0
0
0
         
标签:化学分析
广州铭谦选矿设备有限公司宣传
广州铭谦选矿设备有限公司宣传
相关技术
评论(0条)
200/200
牛津仪器科技(上海)有限公司宣传
发布
技术

顶部
北方有色网-互联网服务平台-关于我们
Copyright 2025 China-mcc.com All Rights Reserved
备案号:京ICP备11044340号-3
电信业务经营许可证编号:京B2-20242293
京公网安备 11010702002294号