摘要
本发明公开了一种基于多模型分级协同的文本安全分类方法和装置,属于人工智能安全领域。方法包括:利用若干个上游子模型对待分类文本并行进行对应维度的判断,以得到各上游子模型对该待分类文本在各维度的判断结果和置信度分数;其中,每一个上游子模型对应一种法规指标维度;基于置信度分数确定是否利用下游终审模型继续进行分类;将待分类文本、至少部分上游子模型输出的判断结果和置信度分数输入至下游终审模型,以利用下游终审模型进行多源注意力融合分类,得到分类结果。因此,本方案可以提高可靠性和准确性,避免对不确定性信息的粗暴处理,且实现了法律法规强对齐的判断维度。