摘要
本发明公开了一种模拟环境中雷达模式与机动决策协同策略生成方法,包括:分析雷达工作模式的功能特性,根据分析结果设计相应工作准则约束;基于角度、距离、高度的考虑构建攻击奖励函数,基于工作准则约束构建雷达奖励函数,根据攻击奖励函数和雷达奖励函数构建总奖励函数;定义由载机状态信息、目标状态信息、相对态势信息、传感器状态信息构成的状态空间,定义由机动动作空间和雷达动作空间构成的混合动作空间;设计基于EDN‑PPOA的深度强化学习算法框架,基于模拟环境调整网络参数,以输出最优网络参数对应的混合动作策略模型;将状态空间输入混合动作策略模型,输出相应的混合动作空间。本发明实现了机动决策和雷达策略上的协同。