声明
严正声明:本站非期刊官网,非中介代理。
本站仅提供学术规范服务:快速预审、润色编辑服务、中英文查重、降重、去重服务、推荐合适的期刊投稿等学术规范服务。 如需提供学术规范服务请联系在线编辑。
国内刊号:11-2223/N
国际刊号:1000-0054
发布日期:
作者:张思远, 朱晓庆, 陈江涛, 刘鑫源, 王涛
单位:1. 北京工业大学 信息学部, 北京 100124;<br>2. 北京工业大学 北京人工智能研究院, 北京计算智能与智能系统重点实验室, 北京 100124
关键词:生物进化,强化学习,四足机器人,进化策略
基金:国家自然科学基金青年科学基金项目(62103009);北京市自然科学基金面上项目(4202005)
动物对自然界的适应能力是由环境选择与适者生存决定的, 四足哺乳动物可以通过种群的进化逐步适应环境的变化, 提高其对环境的适应度和种群的生存率。基于上述启发, 该文在软演员-评论家(SAC)算法基础上提出一种基于优化并行强化学习的算法OP-SAC, 该算法使用进化策略与强化学习交替训练, 通过知识共享和知识继承优化四足机器人学习效果, 提高训练效率。算法验证结果显示, OP-SAC算法能够完成四足机器人的仿生步态学习; 对比实验验证出OP-SAC算法比其他结合了进化策略的SAC算法具有更加优越的鲁棒性; 设计消融实验证明了知识共享和知识继承策略使算法的训练效果获得较大提升。
来源:2024年第10期
《清华大学学报(自然科学版)》期刊编辑部
严正声明:本站非期刊官网,非中介代理。
本站仅提供学术规范服务:快速预审、润色编辑服务、中英文查重、降重、去重服务、推荐合适的期刊投稿等学术规范服务。 如需提供学术规范服务请联系在线编辑。