摘要
一种中医问答数字人制作方法,包括以下步骤:构建中医知识库;搭建工作流,将中医知识库接入工作流;利用工作流的多轮问答方式确定病人具体病情;构建虚拟数字人;将工作流输入到gpt‑sovits语音克隆模型中,生成与虚拟数字人形象相匹配的个性化语音;将个性化语音输入到虚拟数字人中生成唇形同步的虚拟数字人视频;构建用于用户与虚拟数字人交互的前端界面;通过whisper语音识别技术,将用户语音转化为文本后传到后端,与中医知识库进行问答,并将生成的结果通过webRTC流媒体的形式返回。通过对中医中的自然语言进行深度理解和生成,通过多轮对话和数字人视频生成技术,使用户在虚拟中医师的解答过程中提升沉浸感和信任感,提升问答的效果。