声明
严正声明:本站非期刊官网,非中介代理。
本站仅提供学术规范服务:快速预审、润色编辑服务、中英文查重、降重、去重服务、推荐合适的期刊投稿等学术规范服务。 如需提供学术规范服务请联系在线编辑。
国内刊号:43-1258/TP
国际刊号:1007-130X
发布日期:
作者:邸剑, 万雪, 姜丽梅,
单位:(1.华北电力大学计算机系,河北 保定 071003;2.河北省能源电力知识计算重点实验室,河北 保定 071003;3.复杂能源系统智能计算教育部工程研究中心,河北 保定 071003)
关键词:深度强化学习,进化算法,进化强化学习,随机对称搜索,
基金:华北电力大学中央高校基本科研业务费专项资金(2022MS102)
进化算法的引入极大地提高了强化学习算法的性能。然而,现有的基于进化强化学习ERL的算法还存在易陷入欺骗性奖励、易收敛到局部最优和稳定性差的问题。为了解决这些问题,提出了一种随机对称搜索策略,直接作用于策略网络参数,在策略网络参数中心的基础上由最优策略网络参数指导全局策略网络参数优化更新,同时辅以梯度优化,引导智能体进行多元探索。在MuJoCo的5个机器人运动连续控制任务中的实验结果表明,提出的算法性能优于以前的进化强化学习算法,且具有更快的收敛速度。
来源:2025年第5期
《计算机工程与科学》期刊编辑部
严正声明:本站非期刊官网,非中介代理。
本站仅提供学术规范服务:快速预审、润色编辑服务、中英文查重、降重、去重服务、推荐合适的期刊投稿等学术规范服务。 如需提供学术规范服务请联系在线编辑。