收藏本站
收藏 | 投稿 | 论文排版

基于BERT的多特征融合农业命名实体识别

赵鹏飞  赵春江  吴华瑞  王维  
【摘要】:命名实体识别是农业文本信息抽取的重要环节,针对实体识别过程中局部上下文特征缺失、字向量表征单一、罕见实体识别率低等问题,提出一种融合BERT(Bidirectional Encoder Representations from Transformers,转换器的双向编码器表征量)字级特征与外部词典特征的命名实体识别方法。通过BERT预训练模型,融合左右两侧语境信息,增强字的语义表示,缓解一词多义的问题;自建农业领域词典,引入双向最大匹配策略,获取分布式词典特征表示,提高模型对罕见或未知实体的识别准确率;利用双向长短时记忆(Bi-directional Long-short Term Memory,BiLSTM)网络获取序列特征矩阵,并通过条件随机场(Conditional Random Field,CRF)模型生成全局最优序列。结合领域专家知识,构建农业语料集,包含5 295条标注语料,5类农业实体。模型在语料集上准确率为94.84%、召回率为95.23%、F_1值为95.03%。研究结果表明,该方法能够有效识别农业领域命名实体,识别精准度优于其他模型,具有明显的优势。

知网文化
【相似文献】
中国期刊全文数据库 前1条
1 韩斌;曾松伟;;基于多特征融合和卷积神经网络的植物叶片识别[J];计算机科学;2021年S1期
中国硕士学位论文全文数据库 前1条
1 曾莉;多特征融合的紫色土图像分类[D];重庆师范大学;2020年
 快捷付款方式  订购知网充值卡  订购热线  帮助中心
  • 400-819-9993
  • 010-62982499
  • 010-62783978