简介:
本发明公开了一种基于强化学习的AUV自主避障方法,首先设定AUV海底航行自主避障逻辑规则;如果前视声呐无法探测到障碍物,则AUV保持现有航行高度通过障碍物;如果前视声呐探测到障碍物且障碍物高度能够确定,则确定障碍物高度,拉高AUV使AUV航行高度超过障碍物通过障碍物;如果前视声呐探测到障碍物且障碍物高度无法确定,则AUV启动自主偏航策略,通过偏航方式绕过障碍物;AUV自主偏航策略采用基于策略梯度的强化学习模型确定最佳偏航角绕过障碍物。本发明综合考量了任务执行时间、偏离主航线角度与障碍物距离等多种因素,实现了在多种约束下自主实现的最优策略避障。
本发明公开了一种基于强化学习的AUV自主避障方法,首先设定AUV海底航行自主避障逻辑规则;如果前视声呐无法探测到障碍物,则AUV保持现有航行高度通过障碍物;如果前视声呐探测到障碍物且障碍物高度能够确定,则确定障碍物高度,拉高AUV使AUV航行高度超过障碍物通过障碍物;如果前视声呐探测到障碍物且障碍物高度无法确定,则AUV启动自主偏航策略,通过偏航方式绕过障碍物;AUV自主偏航策略采用基于策略梯度的强化学习模型确定最佳偏航角绕过障碍物。本发明综合考量了任务执行时间、偏离主航线角度与障碍物距离等多种因素,实现了在多种约束下自主实现的最优策略避障。