一种零配置的自适应说话人识别方法及系统
# 热门搜索 #
大模型
人工智能
openai
融资
chatGPT
验证码登录
×
发送
登录即代表您已同意AITNT
用户协议
和
隐私政策
登录
登录成功后会自动刷新界面
AITNT公众号
AITNT APP
AITNT交流群
搜索
未登录
首页
AI中心
退出
首页
AI资讯
AI技术研报
AI监管政策
AI产品测评
AI商业项目
AI产品热榜
AI 源力市场
寻求报道
一种零配置的自适应说话人识别方法及系统
申请号:
CN202511068328
申请日期:
2025-07-31
公开号:
CN120708626A
公开日期:
2025-09-26
类型:
发明专利
摘要
一种零配置的自适应说话人识别方法及系统,涉及语音信号处理技术领域。本申请通过接收音频流,进行语音活动检测,获取单人语音片段,提取单人语音片段的声纹嵌入向量并进行在线聚类,生成说话人身份池;通过计算剩余单人语音片段与语音模型的多维度融合相似度以更新身份池,并输出单人语音片段对应的临时身份标签。本申请提供的说话人识别方法无需预先注册声纹模板,提高了系统的灵活性和实时性。
技术关键词
说话人身份
单人
说话人识别方法
语音活动检测
标签
样本
深度神经网络模型
语音信号处理技术
音频
无监督聚类
动态增量
在线
生成语音
模块
连续性
有效性