摘要
本申请提出的视频时刻检索方法和装置、电子设备、存储介质,涉及人工智能技术领域,适用于金融科技领域及医疗健康领域。该方法包括:对目标视频进行时空编码,得到初始时空特征图;通过第一分层自适应粒度变换器对初始时空特征图进行特征变换,得到第一层级时空特征图;通过第二分层自适应粒度变换器对第一层级时空特征图进行特征变换,得到第二层级时空特征图;将第一层级时空特征图和第二层级时空特征图进行特征融合,得到多尺度时空特征;获取检索需求信息,然后进行文本编码得到检索需求信息特征;对检索需求信息特征和多尺度时空特征进行特征解码,再然后进行时刻预测,得到目标片段起止时刻。本申请能够提高视频时刻检索效率。