国内刊号:31-1255/TK
国际刊号:1000-0925
发布日期:
作者:张松,王坤羽,杨蓉,黄伟
单位:1.广西玉柴机器股份有限公司,玉林 537005,2.广西大学 机械工程学院,南宁 530004
关键词:双行星排,混合动力,能量管理,深度强化学习,
基金:国家重点研发计划项目(2017YFE0102800);广西科技基地和人才专项项目(AD19110019);广西创新驱动发展专项项目(AA182420453)
以某款双行星排混合动力公交车为样车,针对控制变量柴油机转速的离散控制和连续控制分别提出基于双深度Q-网络(double deep Q-learning, DDQN)和基于双延迟深度确定性策略梯度(twin delayed deep deterministic policy gradients, TD3)的能量管理策略,并使用优先级经验回放对策略进行优化。仿真研究了样车在C-WTVC工况下的能量管理特性。通过与动态规划策略(dynamic programming, DP)进行对比发现:DDQN和TD3策略收敛速度快,具有较强的自适应能力;与DP策略相似,DDQN和TD3策略在控制逻辑上均表现为低速和较低转矩时纯电驱动,高速和较高转矩时混合驱动;3种策略下柴油机均主要工作于中低转速区间,且TD3策略可以对柴油机转速进行连续控制;DDQN和TD3策略的百公里油耗分别为19.51L和19.48L,燃油经济性均达到DP策略的93%,研究证明了DDQN和TD3策略的有效性。
来源:2021年第6期
《内燃机工程》期刊编辑部