摘要
本发明属于图像处理技术领域,公开了一种基于扩散模型的无掩码图像合成方法及系统,包括:将背景图像和包含目标对象的噪声图像输入至预训练的潜在扩散模型中,潜在扩散模型在条件向量的引导下执行反向去噪过程,以将目标对象自适应地合成在中,得到合成图像;其中,条件向量的获取方式包括:将包含目标对象的参考图像编码为对象嵌入向量,并根据生成一组可学习的背景提示词;将和背景提示词拼接;将拼接后的特征表示进行空间映射,得到条件向量。本发明能够克服现有图像合成技术中存在的流程繁琐、效率低下、需要大量手动干预、合成结果缺乏真实感与和谐性、尤其是前景对象无法根据背景环境进行自适应调整等缺陷。