摘要
本发明涉及人工智能、金融科技及数字医疗领域,公开了基于图像的视频生成方法、装置、设备及存储介质。所述方法包括:接收输入的静态图像并进行预处理,生成多尺度特征;基于多尺度特征,通过时空架构生成器的可微分搜索确定最优时空处理路径,生成融合了时序动态信息的输出特征;基于时序循环神经网络及输出特征生成视频帧;将视频帧输入视频帧序列,通过视频帧序列生成目标视频。本发明通过可微分搜索自动确定最优时空处理路径,摆脱人工干预,且通过动态生成融合时序信息的输出特征并生成视频,保证了视频的时序连贯性与细节真实性,提高了视频生成质量及效率,适用于金融、医疗领域的视频合成、内容创作、虚拟现实等高精度视频生成的应用。