摘要
本发明视频素材处理技术领域,公开了一种基于动态语义驱动的视频素材智能处理方法及装置,该方法包括:通过预训练的语义特征提取模型对输入视频进行逐帧解析,提取包含对象属性、场景上下文及多模态情感特征的深层语义向量;基于时序注意力机制对深层语义向量进行动态分析,实时生成反映视频内容演化规律的语义状态变化图谱;基于用户输入的个性化处理需求与语义状态变化图谱的实时匹配结果,通过强化学习策略网络生成自适应处理策略;依据自适应处理策略对所述输入视频进行动态处理操作,生成目标视频素材;本发明有效解决了现有技术语义理解肤浅、处理方式固定的问题,提升了视频处理效果和用户体验,满足多样化、时效性及个性化需求。