数字人模型的处理方法、虚拟数字人的口型驱动方法和计算机设备
申请号:CN202510892069
申请日期:2025-06-30
公开号:CN120823296A
公开日期:2025-10-21
类型:发明专利
摘要
本申请涉及一种数字人模型的处理方法、虚拟数字人的口型驱动方法、装置、计算机设备、计算机可读存储介质和计算机程序产品。方法包括:获取目标形象的样本视频,从样本视频中提取出样本音频以及真实人脸样本图像;真实人脸样本图像包括有图像质量不满足预设条件的第一区域;将真实人脸样本图像和样本音频输入至预训练的通用数字人模型,输出虚拟人脸样本图像;根据虚拟人脸样本图像与真实人脸样本图像之间的差异,更新通用数字人模型中的部分模型参数,得到目标数字人模型;其中,部分模型参数包括通用数字人模型中与第二区域关联的模型参数,目标数字人模型用于对目标形象对应的虚拟数字人进行口型驱动。采用本方法能够提高数字人的驱动效果。
技术关键词
人脸
样本
区域位置信息
图像
语义分割模型
驱动方法
计算机设备
计算机程序产品
音频
链路
参数
视频
可读存储介质
处理器
掩膜
存储器