数字人文视域下典籍动物命名实体识别研究——以SikuBERT预训练模型为例
数字人文视域下典籍动物命名实体识别研究——以SikuBERT预训练模型为例

数字人文视域下典籍动物命名实体识别研究——以SikuBERT预训练模型为例


标题: 数字人文视域下典籍动物命名实体识别研究——以SikuBERT预训练模型为例


作者: 林立涛,王东波,刘江峰,李斌,冯敏萱


第一作者: 林立涛


机构: 南京农业大学信息管理学院,南京师范大学文学院


期刊: 图书馆论坛


发表日期: 2022-04-16


论文摘要: 通用命名实体识别难以满足不同领域研究的需要,特定领域命名实体识别研究对于提升文本挖掘精度具有重要意义。文章基于SikuBERT预训练模型,构建用于典籍动物命名实体识别模型,为典籍动物知识挖掘提供有效方法。利用25部经人工标注动物命名实体的先秦典籍语料,对SikuBERT等由BERT预训练模型发展而来的系列模型以及CRF、Bi-LSTM-CRF进行训练,构建多种用于识别典籍中动物命名实体的模型,并对这些模型进行识别性能测试,比较验证SikuBERT预训练模型的识别性能。结果表明:基于SikuBERT经训练所构建的动物命名实体识别模型效果最优,十折交叉测试的平均调和平均值(F1)为85.46%,最高一次达86.29%,应用于《史记》动物命名实体识别准确率达91.6%。


知网阅读链接: 点击跳转






提示:本站使用最低限度cookies来确保基础功能实现。 View more
同意
拒绝