摘要
基于元强化学习的高效DNN推理任务划分策略属于物联网、边缘智能领域,用于解决环境突然变动会导致划分策略需要频繁执行重新采样与模型再训练问题,进而提高系统DNN推理任务执行效率。首先确定边端架构,然后根据边端架构建立系统模型、通信模型和计算模型,进一步建立联合优化模型。将制定的联合优化模型建模为马尔可夫决策过程,建立深度强化学习模型,结合元学习算法的优点,采用一阶近似元强化学习算法来求解原模型中的最优划分问题。在动态多变的环境下即使环境不断接收新任务或者新数据,元强化学习仍能够持续学习,不断积累经验从而快速达到收敛,提高整体系统处理任务效率。