信息与控制

北大核心,JST,CSCD,WJCI,

国内刊号:21-1138/TP

国际刊号:1002-0411

信息与控制杂志2022年第1期:人群环境中基于深度强化学习的移动机器人避障算法

发布日期:

作者:孙立香, 孙晓娴, 刘成菊, 靖文

关键词:深度强化学习, 人机共融, 行人空间行为, 移动机器人避障

为了控制移动机器人在人群密集的复杂环境中高效友好地完成避障任务,本文提出了一种人群环境中基于深度强化学习的移动机器人避障算法。首先,针对深度强化学习算法中值函数网络学习能力不足的情况,基于行人交互(crowd interaction)对值函数网络做了改进,通过行人角度网格(angel pedestrian grid)对行人之间的交互信息进行提取,并通过注意力机制(attention mechanism)提取单个行人的时序特征,学习得到当前状态与历史轨迹状态的相对重要性以及对机器人避障策略的联合影响,为之后多层感知机的学习提供先验知识;其次,依据行人空间行为(human spatial behavior)设计强化学习的奖励函数,并对机器人角度变化过大的状态进行惩罚,实现了舒适避障的要求;最后,通过仿真实验验证了人群环境中基于深度强化学习的移动机器人避障算法在人群密集的复杂环境中的可行性与有效性。

来源:2022年第1期

《信息与控制》期刊编辑部

查看信息与控制杂志2022年第1期

联系我们

  • 地址:辽宁省沈阳市创新路135号
  • 电话:024-23970049
  • E-mail:xk@sia.cn

咨询工作人员