摘要
本发明属于公共安全监测技术领域,具体涉及一种基于视觉与语言融合的智能监测系统及方法。该发明通过针对时空序列图像进行多维度空间分析,能够提取出分层特征信息,对文本数据进行上下文关联解析,生成语义编码信息,再通过分层特征信息和语义编码信息的多级交互通道,将图像特征与文本实体描述进行对接,以及执行趋势一致性校准,消除时序上的相位偏差,并预测分层特征和语义编码的未来趋势,并生成联合表征数据,再以此为基础,结合环境反馈参数动态修正评估边界参数,最后根据修正后的评估边界参数对当前联合表征数据进行评估,确定目标场景下的公共安全状态等级,实现对目标场景下公共安全信息的智能监测流程。