摘要
本申请涉及人工智能技术领域,应用于机器人控制、机器视觉、自动驾驶等业务场景中,通过使用基于无监督方式进行潜在动作预训练和真实动作后训练得到的动作预测模型进行动作预测,可以有效提高动作预测的准确性,进而减少根据预测动作进行任务操作时出现操作错误的概率。涉及一种动作预测方法、装置、设备和介质,该方法包括:获取目标对象的视频流数据和视频流数据对应的语言指令;将视频流数据对应的语言指令和视频流数据输入训练后的动作预测模型中进行动作预测,得到动作预测结果,动作预测模型为预先基于无监督方式进行潜在动作预训练和真实动作后训练得到的模型;根据动作预测结果确定动作指令,并基于动作指令控制目标对象进行任务操作。