国内刊号:44-1240/TP
国际刊号:1000-8152
发布日期:
作者:王东署,高旭霖
单位:郑州大学,郑州大学
关键词:移动机器人; 行为决策; 蓝斑; 好奇度; 探索–利用平衡
基金:国家自然科学基金项目(62173309, 61873245), 河南省自然科学基金项目(202300410483), 河南省科技攻关项目(192102210256)
未知环境中移动机器人柔性的行为决策是完成各种任务的前提. 目前的机器人行为决策方法在面对动态变化的环境时柔性较差, 机器人难以获得持续稳定的学习能力. 本文作者曾尝试通过集成小脑监督学习和基底神经节的强化学习来实现移动机器人动态环境下的柔性行为决策, 但所提算法适应动态环境的能力有限. 在前期工作基础上, 本文设计了更有生物学意义的好奇度指标代替原来的警觉度指标, 通过模拟蓝斑活动在基音模式和阶段模式之间的动态切换, 实现移动机器人环境探索–利用的动态自适应调节. 同时, 设计随外部环境变化的自适应调节因子, 实现移动机器人动态环境中基于小脑监督学习和基底神经节强化学习的柔性行为决策, 使机器人可以获得持续稳定的学习能力. 动态环境和实际环境中的实验结果验证了本文所提算法的有效性.
来源:2023年第4期
《控制理论与应用》期刊编辑部