摘要
本发明涉及计算机视觉技术领域,具体涉及基于视觉语言预训练模型的换装行人重识别方法。所述方法包括:训练阶段:输入图像获取衣物掩膜图,生成衣物无关/相关提示。固定文本编码器参数并优化提示权重将文本提示输入编码器获特征,构建分类器以交叉熵损失实现图像‑文本对齐;用视觉编码器提取掩膜图特征,约束类中心欧氏距离实现图像-图像对齐;剥离衣物特征:提取衣物区域特征与对应文本特征,经分类器优化后引入正交损失解耦衣物相关性;推理阶段:将查询图像输入训练好的图像编码器提取特征,与图库特征计算余弦相似度排序返回结果。本技术方案能够提高行人重识别方法在行人服饰变化条件下识别准确率。