期刊文献+
共找到1篇文章
< 1 >
每页显示 20 50 100
基于深度强化学习的车辆自主避撞决策控制模型 被引量:7
1
作者 李文礼 张友松 +2 位作者 韩迪 钱洪 石晓辉 《汽车安全与节能学报》 CAS CSCD 北大核心 2021年第2期201-209,共9页
为提高车辆对行驶环境的自我学习和决策能力,提出了一种基于深度确定性策略梯度(DDPG)的车辆自主避撞决策控制模型。基于Markov决策过程的强化学习理论和车辆纵向运动学特性,设计了决策所需目标对象及自车信息的状态空间和自车减速度的... 为提高车辆对行驶环境的自我学习和决策能力,提出了一种基于深度确定性策略梯度(DDPG)的车辆自主避撞决策控制模型。基于Markov决策过程的强化学习理论和车辆纵向运动学特性,设计了决策所需目标对象及自车信息的状态空间和自车减速度的动作空间,以安全性、舒适性和效率因素为多目标奖励函数的端到端的车辆自主避撞决策模型。利用Matlab/Simulink构建的DDPG算法与交通环境的交互模型,通过了前车静止(CCRs)和前车制动(CCRb)场景测试。结果表明:本决策算法具有很好的收敛性,引入加速度和冲击度的极限值,在实现车辆有效避撞的同时,兼顾乘坐舒适性,且性能优于模糊控制。 展开更多
关键词 车辆安全 自主避撞 深度确定性策略梯度(DDPG) 控制模型 多目标奖励函数
下载PDF
上一页 1 下一页 到第
使用帮助 返回顶部