简介:
本发明提供的一种基于集群影响度的战场博弈策略强化学习训练方法,通过集群影响度的分析结果并结合强化学习技术,可以有效克服开放战场环境具有的作战单位数目大、战争迷雾等挑战,并通过采用强化学习进行交叉训练保证决策模型可以不断提高自身决策水平,有效应对开放战场环境学习困难的问题,有助于军事战场中的人机协同决策等情况,可广泛应用于局域作战、反恐等领域的决策问题。
本发明提供的一种基于集群影响度的战场博弈策略强化学习训练方法,通过集群影响度的分析结果并结合强化学习技术,可以有效克服开放战场环境具有的作战单位数目大、战争迷雾等挑战,并通过采用强化学习进行交叉训练保证决策模型可以不断提高自身决策水平,有效应对开放战场环境学习困难的问题,有助于军事战场中的人机协同决策等情况,可广泛应用于局域作战、反恐等领域的决策问题。