摘要
本发明针对现有角色分离技术的准确性较差的问题,公开一种单通道无监督角色分离方法、系统、设备和介质,属于智能语音交互领域,方法包括:检测语音中的角色变更点,将语音按照角色变更点进行分割,得到多个待分类语音片段;根据长度阈值对待分类语音片段分类,得到长片段语音数据和短片段语音数据;对长片段语音数据进行聚类,再根据短片段语音数据与聚类类别的相似度,将短片段语音数据分配到聚类后的类别中,得到语音角色分离结果。本发明可以实现基于长片段的聚类结果指导短片段的分类,大大减少了碎片化的问题,明显提升用户体验效果。