摘要
本发明提供了一种目标语种类型的文本处理方法、装置及设备,属于计算机信息处理技术领域,解决了目标语种命名实体识别标注失真、边界模糊、数据稀缺问题。该方法包括:获取带有标注的目标语种的文本数据;对带有标注数据的目标语种的文本数据进行校正和转换处理,得到预设格式的第一目标文本数据;对预设格式的第一目标文本数据进行转换和修正处理,得到转换后的第二目标文本数据;对转换后的第二目标文本数据进行动态拆分处理,得到拆分后的第三目标文本数据;将拆分后的第三目标文本数据输入文本识别模型进行处理,得到目标语种类型的文本识别结果数据。该方案提升了目标语种文本的实体标注效率与识别精度。