本发明公开了一种基于深度学习的英文文献污染物信息抽取方法,包括:构建适用于本土环境监测文献文本挖掘的术语词典;获取原始文献,并对原始文献进行语料分词,构建文献生语料;构建实体抽取模型和关系抽取模型;对文献生语料进行预处理,得到用于实体抽取模型和关系抽取模型的训练集和测试集;通过训练集对实体抽取模型和关系抽取模型进行训练,得到训练完成的实体抽取模型和关系抽取模型;将测试集输入至训练完成的实体抽取模型进行识别,得到实体识别结果;将实体识别结果和测试集数据输入至训练完成的关系抽取模型,得到关系抽取结果。本发明不仅实现了原始英文文献中化学品的命名实体识别,也对化学品及检测浓度进行了关系抽取。
声明:
“基于深度学习的英文文献污染物信息抽取方法” 该技术专利(论文)所有权利归属于技术(论文)所有人。仅供学习研究,如用于商业用途,请联系该技术所有人。
我是此专利(论文)的发明人(作者)