摘要
本申请涉及计算机视觉技术领域,特别涉及一种基于文本驱动的弱监督小样本部件分割方法及装置,其中,方法包括:提取图像特征并生成部件的文本原型;利用伪掩码生成模块计算像素级相似度,并为每个像素分配对应的部件类别标签,生成伪标签,从图像特征中提取视觉部件原型;基于文本原型和伪标签,将文本原型中的语义信息嵌入到图像的空间特征中,以利用双模态原型一致性学习模块,在视觉和文本模态之间保持部件原型的一致性;通过预设双模态协同分割策略,生成部件分割结果。由此,解决了相关技术的分割方法由于文本和图像信息的对齐程度较低且部件原型学习的局限性,致使文本信息难以被模型有效利用且无法保证图像与文本之间的语义一致性的问题。