摘要
本申请提供一种用户画像生成方法、装置、电子设备及存储介质,涉及人工智能技术领域。该方法包括:获取已解密的目标通话音频以及与所述目标通话音频对应的目标通话文本;所述目标通话文本为已脱敏的文本数据;所述目标通话音频为待生成或待更新用户画像的目标用户的通话音频;采用预设多模态融合模型对所述目标通话音频和所述目标通话文本进行特征提取处理和特征融合处理,生成对应多模态融合特征;将所述多模态融合特征输入预设用户画像生成模型生成与所述目标通话音频对应的用户画像标签集合;基于所述用户画像标签集合生成或更新与所述目标用户对应的用户画像。本申请的用户画像生成方法提高了用户画像的准确性。