简介:
本发明提出一种利用环境预测优化非模型机器人多轴孔装配控制方法,属于机器人装配技术领域。本发明利用通用动作值函数进行环境相关知识预测,并且根据人的装配经验设计模糊逻辑系统将学习的知识预测作为输入,输出用于优化非模型控制算法的参数,当深度强化学习网络迭代次数上限且装配符合要求时,输出训练完毕的深度强化学习网络用于多轴孔装配过程中输出装配动作。本发明可实现对已有非模型机器人控制算法的优化,缩短了机器人多轴孔装配所需的时间。
本发明提出一种利用环境预测优化非模型机器人多轴孔装配控制方法,属于机器人装配技术领域。本发明利用通用动作值函数进行环境相关知识预测,并且根据人的装配经验设计模糊逻辑系统将学习的知识预测作为输入,输出用于优化非模型控制算法的参数,当深度强化学习网络迭代次数上限且装配符合要求时,输出训练完毕的深度强化学习网络用于多轴孔装配过程中输出装配动作。本发明可实现对已有非模型机器人控制算法的优化,缩短了机器人多轴孔装配所需的时间。