生成语音包的方法、语音播报方法及对应装置

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
生成语音包的方法、语音播报方法及对应装置
申请号:CN202511101232
申请日期:2025-08-07
公开号:CN120612919A
公开日期:2025-09-09
类型:发明专利
摘要
本申请实施例公开了一种生成语音包的方法、语音播报方法及对应装置。主要技术方案包括:获取目标说话人的至少一条语音;基于所述至少一条语音的声学特征,生成多条增广语音;利用所述多条增广语音,在第一语音合成模型的基础上对第二语音合成模型进行蒸馏训练,得到蒸馏训练后的第二语音合成模型,所述第二语音合成模型的参数规模小于所述第一语音合成模型的参数规模;基于所述蒸馏训练后的第二语音合成模型,确定所述目标说话人对应的语音包。通过本申请,仅需要数量很少的目标说话人语音,甚至一条语音,即可生成语音包,大大降低了语音数据的采集门槛;并且在保证模型效果的基础上,提高了语音包的生成效率。
技术关键词
声学特征 语音播报方法 文本 蒸馏 语义特征 生成语音包 语音播报装置 规模 参数 解码器 计算机程序产品 基础 发音 客户端 门槛 数据 模块