简介:
本发明公开了一种基于深度强化学习的电力通信网路由方法。该方法是针对基于SDN架构的电力通信网路由选择策略;分析了基于SDN的电力通信网体系结构;并设计基于深度强化学习DDPG(Deep Deterministic Policy Gradient)的路由方法,以业务带宽、时延和丢包率要求为奖励值,反复训练深度强化学习模块,实现路由策略优化。
本发明公开了一种基于深度强化学习的电力通信网路由方法。该方法是针对基于SDN架构的电力通信网路由选择策略;分析了基于SDN的电力通信网体系结构;并设计基于深度强化学习DDPG(Deep Deterministic Policy Gradient)的路由方法,以业务带宽、时延和丢包率要求为奖励值,反复训练深度强化学习模块,实现路由策略优化。