摘要
本申请实施例提供了一种主题挖掘模型训练方法、设备及存储介质,可应用于自然语言处理技术领域,在该方法中,对获得的多个分词类别中的任一分词类别,通过大语言模型确定分词类别是否满足语义一致性;确定多个样本文档在语义一致性的分词类别下对应的主题与词计数矩阵,并确定多个主题的全局权重;每个分词类别对应一个主题,同一分词在多个样本文档中出现的次数作为分词在对应主题下的词计数;将主题与词计数矩阵作为主题挖掘模型中主题与词分布的初始值;通过多个样本文档和全局权重对主题挖掘模型进行训练,直至获得具有目标值的主题与词分布的主题挖掘模型,这样通过语义一致性判断,提高了主题挖掘的准确性,并降低了模型的训练时间。