摘要
本申请实施例提供了一种模型训练方法、装置、计算机设备、计算机可读存储介质、计算机程序产品,属于视频处理领域。该模型训练方法包括:获取第一视频帧、第二视频帧、第三视频帧和光流掩码图;其中,所述第一视频帧、第二视频帧和第三视频帧为依序分布的连续视频帧且均具有目标文本,所述光流掩码图用于指示所述目标文本在帧画面上的位置;将所述第一视频帧、第三视频帧和所述光流掩码图作为模型输入,通过所述插帧模型输出预测视频帧;根据所述预测视频帧和所述第二视频帧,调整所述插帧模型。本申请实施例的技术方案可以在生成预测视频帧时更准确地保持文本前景的静止特性,减少文本因背景运动而产生的形变,可以提高插帧的准确性和视觉效果。